⚡️ SpaceXAI выпустила Grok 4.5 и это уже стоящий конкурент Claude Code с Sonnet/Opus
Модель доступна уже сегодня в Grok Build, во всех тарифах Cursor и в консоли SpaceXAI. Цена: $2/млн входных токенов, $6/млн выходных — заметно дешевле Opus $5/$25
Главный аргумент компании не про качество, а про эффективность: на SWE-Bench Pro Grok 4.5 тратит в среднем 15 954 токена на задачу против 67 020 у Opus 4.8 (max) — это в 4.2 раза меньше. Цена за токен падает, а реальная стоимость задачи определяется не прайсом, а тем, сколько токенов агент нажигает на решение. Попробовать можно уже сегодня в Cursor.
Цифрам доверять пока нельзя так как все тесты внутренние. DeepSWE и Terminal Bench SpaceXAI гоняла каждую модель в её собственном харнессе — Fable, GPT 5.5 и Opus тестировались не в одинаковых условиях с Grok. Пока это маркетинг и лишь заявку, а не независимое сравнение. А Маск любит такое.
Для агентных пайплайнов интереснее проверить не заявленную эффективность, а реальный расход токенов на своих задачах, а не на чужих графиках.
Однозначно покупка Cursor пошла напользу, вполне возможно, что именно их наработки и легли в основу новой модели.
#AI #Grok #Cursor
Post #186
2.12K

- 👍 16
- 👎 7