Kimi K3: как мощная модель в роли «основной» ухудшила результат и подняла цену в 8 раз
Провёл тест-драйв Kimi K3. Гипотеза простая: раз модель мощнее DeepSeek Pro, значит, справится качественнее. Взял задачу (написать кросс-платформенный синглтон с вежливой остановкой предыдущих экземпляров и автоочисткой мёртвых pid'ов) и сел работать, сессия на 4 часа.
Первая попытка — Kimi как основная. 4 часа кодинга, ответы медленные, дорогие. Я, сам того не замечая, стал экономить на запросах. Модели больше доверял, реже перепроверял — вроде бы умная же. Итог: почти 35 юаней и код, который пришлось потом переписывать с нуля. Не потому что Kimi глупая — а потому что я выпал из роли контролёра и перестал дожимать каждую итерацию.
Второй подход — по схеме, где DeepSeek Pro делает основную работу: быстрые, дёшевые итерации, я постоянно правлю, уточняю, держу контекст. Kimi подключается только в конце как эксперт-ревьюер. Итог: 4.5 юаня и готовый production-код, который не стыдно показать.
Мощная модель — не универсальный солдат, работать с ней как с основной не практично. Её место — финальное ревью, точечная экспертиза, а не роль основной рабочей лошадки. Контроль и дешёвые быстрые правки оказались важнее «интеллекта» модели. Теперь Kimi K3 у меня только на доводке отлаженного кода — и там она действительно хороша.
Post #1895
348

- 🔥 5
- 👍 3