⚡️ Протестировал Kimi K3
Дал ей тот же промпт, что и другим моделям в прошлом YouTube-видео: сделать клон Sea of Thieves. Закинул на баланс $5 и запустил в Claude Code.
Kimi K3 работала 46 минут 51 секунду и полностью съела все $5. Причём денег даже не хватило, чтобы закончить задачу. По ощущениям, модель просто успела написать код, но почти ничего не проверяла и не исправляла.
В итоге получился один HTML-файл.
Что есть в игре:
- острова;
- торговец картами;
- можно плавать на корабле;
- можно стрелять из пушек;
- есть смена дня и ночи;
- есть вражеские корабли.
Что не получилось:
- нет скелетов;
- нельзя копать сокровища;
- управление инвертировано;
- корабль наполовину находится под водой;
- графику сами увидите в видео.
По результату Kimi K3 получилась лучше GPT-5.5, но немного не дотянула до GPT-5.6 Sol. Примерно так же её оценили и в бенчмарках.
При этом по цене выходит примерно как GPT-5.6 Sol, потому что Kimi, похоже, заметно менее эффективно расходует токены.
P.S. Потом я решил попросить модель провести аудит готовой игры и найти баги. Она потратила ещё $10 и даже не закончила аудит. В итоге я просто прервал задачу.
В целом на данный момент это, наверное, лучшая китайская модель. Но стоит она примерно как GPT-5.6 Sol, поэтому лично я пока останусь на GPT.
Post #22
1.18K