🤖 Кажется, гонка за «самый умный ИИ» закончилась. Началась гонка за «самый дешёвый токен».
Эта неделя оказалась показательной. Практически все крупные игроки выпустили новые модели, но самое интересное — они перестали соревноваться только в интеллекте. Теперь главный KPI — стоимость вычислений.
👉 OpenAI представила семейство GPT-5.6 вместо одной универсальной модели:
• Sol — флагман для сложных задач и агентного программирования.
• Terra — баланс между качеством и стоимостью.
• Luna — самая дешёвая и быстрая модель для массовых сценариев.
И буквально через несколько дней OpenAI ещё сильнее снизила цены: Luna подешевела на 80%, Terra — на 20%.
📄 https://openai.com
👉 Moonshot AI представила Kimi K3
Китайцы продолжают играть по-крупному. Новая модель содержит 2,8 трлн параметров, что выводит её в одну лигу с лучшими моделями OpenAI и Anthropic. Для сравнения, индустрия оценивает Claude Opus примерно в 1,5–2 трлн параметров.
Похоже, Китай окончательно отказался от роли догоняющего.
📄 https://moonshot.ai
👉 Google обновила линейку Gemini
Сразу три модели:
• Gemini 3.6 Flash — быстрее, дешевле и потребляет на 17% меньше токенов.
• Gemini 3.5 Flash-Lite — версия для дешёвого массового inference.
• Gemini 3.5 Flash Cyber — специализированная модель для поиска уязвимостей, доступная только государственным структурам и доверенным партнёрам.
Даже Google уже продаёт не «ИИ вообще», а модели под конкретную экономику задач.
📄https://deepmind.google
👉 Anthropic представила Claude Opus 5
Новая модель более чем в два раза превосходит Opus 4.8 на FrontierBench, при этом компания сохранила прежний уровень цен.
Кроме того, появилась возможность выбирать режим работы:
— максимальное качество;
— или более дешёвый и быстрый режим.
То есть даже Anthropic теперь ориентируется не только о качество модели, но и на стоимости её использования.
📄 https://www.anthropic.com
🧠 Ещё год назад компании боролись за то, у кого модель умнее. А сегодня - у кого дешевле inference.
На самом деле, идет нормальная эволюция рынка.
Я уже писал про заявление NVIDIA, где признали, что стоимость вычислений начинает превышать стоимость сотрудников. Теперь это видно и по действиям разработчиков моделей.
Все одновременно:
— снижают цены;
— выпускают дешёвые версии;
— оптимизируют потребление токенов;
— делают специализированные модели вместо универсальных.
Похоже, этап бесконечного масштабирования заканчивается и начинается новый этап экономики ИИ.
Post #1455
232
- ❤ 1
- 👌 1
- 🏆 1
- 🤝 1