🚀 Похоже, у Google произошёл хороший comeback с Gemini 4 Argon. На бенчмарки Google я смотреть даже не стал, т.к. сразу стал проверять, нет ли тут накрутки как у Sonnet 5.5 через перерасход токенов, что модель делает бессмысленной. Нет, Gemini 4 Argon по расходу как GLM 5.3 или Kimi K3 на задачу, что весьма неплохо. По реальной цене за задачу в Artificial Analysis модель Google дешевле Opus 5.5 в 3 раза и дешевле Astra в 2 раза.
Однако насчёт «возврата Google» в разработку ПО я бы добавил изрядный скепсис. Хотя LM Arena показывает, что модель неплохая, но от Astra и Opus её отделяет 100 баллов Эло, что внушительная разница для такого рейтинга. При личной дуэли с Opus 5.5 её Gemini 4 Argon во фронтах проигрывает с вероятностью выше 70%.
Проблема Google сейчас в том, что сейчас малый спрос на «парня №2», т.к. профессионалы обычно архитектурную фазу и премиальный дизайн делают в самой мощной LLM на рынке и им не так важна её цена, т.к. это будет 10% расходов токенов примерно. Поэтому берётся «лучшее из лучшего», тут плотно Anthropic и сидит «царем горы» и Gemini ценой его не сдвинет, т.к. дальше профессионал применяет worker-агентов, которые пропустят 90% токенов, а это обычно DeepSeek V4.1, который имеет цену «в подарок от коммунистов» и скорость как у турболета за 200 токенов/сек.
Проще говоря, Gemini 4 Argon не жилец против связки Opus 5.5 + DeepSeek V4.1 ни по какому параметру (IQ, скорость и цена).
https://blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-4-argon/
Post #5264
2.5K

- 👍 19
- ❤ 7
- 🤔 3
- ✍ 2
- 💯 2
- 🏆 1