Вышел Kimi K3. 2,8 трлн параметров, контекст 1M — и теперь Kimi уже совсем не дешёвый
Moonshot AI выпустила и открыла веса Kimi K3 — нового флагмана для coding-агентов, больших репозиториев и длинных инженерных задач.
Что заявлено:
→ 2,8 трлн параметров
→ контекст до 1 048 576 токенов
→ нативная работа с изображениями и видео
→ always-on thinking
→ новая архитектура Kimi Delta Attention
→ доступ через Kimi Code и API
K3 позиционируют под long-horizon engineering: большие рефакторинги, разработку игр и 3D, GPU-ядра, компиляторы, проектирование чипов и scientific computing.
То есть идея простая: дать агенту большой проект и как можно дольше не вмешиваться.
Но самое интересное — тарификация.
Через API Kimi K3 стоит:
→ cached input — $0,30 за 1M токенов
→ обычный input — $3 за 1M
→ output вместе с reasoning — $15 за 1M
По сравнению с Kimi K2.7 Code новая модель примерно втрое дороже на входе и почти в четыре раза дороже на выходе.
И здесь получается интересный момент: по расходу лимитов Kimi K3 — это почти Kimi K2.7 Code HighSpeed.
HighSpeed официально расходует квоту с коэффициентом 3×. Для K3 отдельный точный коэффициент Moonshot не публикует, но, судя по API-тарификации, он тоже должен съедать credits примерно в 3–4 раза быстрее обычного K2.7 Code.
То есть K3 — это не модель, которую получится бездумно использовать весь день на базовой подписке.
Тарифы Kimi Code:
→ Moderato — $19/месяц
K3 доступен, но контекст ограничен 256K. Квоты хватит скорее на несколько тяжёлых сессий в неделю.
→ Allegretto — $39/месяц
Открывается полный контекст до 1M и даётся 5× credits. Ориентировочно это 1–3 часа активной работы с K3 в день.
→ Allegro — $99/месяц
15× credits. Уже можно использовать K3 как основную модель несколько часов в день.
→ Vivace — $199/месяц
30× credits. Тариф для постоянной работы или нескольких агентов.
Это примерные оценки: абсолютное число токенов Moonshot не раскрывает. Расход сильно зависит от размера репозитория, длины сессии, количества reasoning и попадания prompt cache.
Сам миллионный контекст тоже может очень быстро сжечь лимит. Когда история разрастается до сотен тысяч токенов, каждый следующий шаг агента становится дорогим, особенно при cache miss.
Отдельно есть K2.7 Code HighSpeed. Это та же K2.7 без заявленного ухудшения качества, но генерация работает примерно в 5–6 раз быстрее и расходует в три раза больше квоты.
В итоге линейка выглядит так:
K2.7 Code — дешёвая рабочая модель на каждый день.
K2.7 Code HighSpeed — быстро, но с расходом 3×.
K3 — примерно такой же тяжёлый по квоте режим, как HighSpeed, но уже с новой frontier-моделью, reasoning и контекстом до миллиона токенов.
Поэтому реальный минимальный тариф для K3 — Allegretto за $39, а для активной ежедневной работы я бы смотрел уже на Allegro за $99.
Moonshot явно закончила этап «почти как Claude, только сильно дешевле». Теперь у неё модель frontier-класса — и расход лимитов тоже frontier.
https://www.youtube.com/watch?v=bn0atstgavo
Post #566
2.72K