Grok 4.5: новая frontier-модель, которая бьёт по цене и скорости
Сегодня SpaceXAI (бывший xAI) вместе с Cursor выпустили Grok 4.5 – самую умную модель в линейке Grok. Её тренировали не только на коде, но и на STEM, research и knowledge work.
Что умеет Grok 4.5
- Сложный engineering: от Rust/C++ до приложений «из одного промпта»
- Agentic workflows: исследует проблему, вызывает tools, откатывается от ошибок, проверяет результат
- Office-задачи: Excel, PowerPoint, Word — и #1 на Harvey Legal Agent Benchmark
- Скорость ~80 TPS и ~2× выше token efficiency, чем у конкурентов на тех же задачах
- Цена: $2 / $6 за 1M input/output токенов (fast-вариант — $4 / $18)
Сравнение с Claude Opus и GPT-5.5
• Claude Opus 4.8 — всё ещё эталон для тяжёлого кодинга и работы с документами. На SWE-Bench Pro и сложных рефакторингах часто впереди. Минус — дороже и медленнее по токенам.
• GPT-5.5 — лучший «универсальный агент»: terminal-автоматизация, tool-calling, экосистема ChatGPT/Codex. Если нужен надёжный multi-step агент в DevOps — часто выбор №1.
• Grok 4.5 заходит с другой стороны: близкий (или выше) уровень на real engineering при в разы меньшей цене и заметно меньшей трате токенов. По заявлениям SpaceXAI — ~4× меньше output-токенов на SWE-Bench Pro vs Opus max. Плюс совместный тренинг с Cursor: модель заточена под реальную работу в IDE, а не только бенчмарки.
Кому что брать
• Код + качество ответа важнее всего → Claude Opus
• Агенты, shell, широкий стек OpenAI → GPT-5.5
• Много задач, бюджет и latency → Grok 4.5
Один победитель «вообще» уже не существует. В 2026 выбор – это маршрутизация: Opus на сложный PR, GPT на terminal-агента, Grok на объём и скорость.
Grok 4.5 интересен тем, что впервые у SpaceXAI модель реально претендует не на «дешёвую альтернативу», а на место в тройке frontier – с ценой, от которой Claude и GPT выглядят премиум-сегментом.
@dnevnik_ton
Post #265
213

- ❤🔥 4
- 👾 4
- 🐳 2