TGViewer
AI Projects AI Projects @turboproject · 11.5K subscribers
Post #5264 2.5K
🚀 Похоже, у Google произошёл хороший comeback с Gemini 4 Argon. На бенчмарки Google я смотреть даже не стал, т.к. сразу стал проверять, нет ли тут накрутки как у Sonnet 5.5 через перерасход токенов, что модель делает бессмысленной. Нет, Gemini 4 Argon по расходу как GLM 5.3 или Kimi K3 на задачу, что весьма неплохо. По реальной цене за задачу в Artificial Analysis модель Google дешевле Opus 5.5 в 3 раза и дешевле Astra в 2 раза.

Однако насчёт «возврата Google» в разработку ПО я бы добавил изрядный скепсис. Хотя LM Arena показывает, что модель неплохая, но от Astra и Opus её отделяет 100 баллов Эло, что внушительная разница для такого рейтинга. При личной дуэли с Opus 5.5 её Gemini 4 Argon во фронтах проигрывает с вероятностью выше 70%.

Проблема Google сейчас в том, что сейчас малый спрос на «парня №2», т.к. профессионалы обычно архитектурную фазу и премиальный дизайн делают в самой мощной LLM на рынке и им не так важна её цена, т.к. это будет 10% расходов токенов примерно. Поэтому берётся «лучшее из лучшего», тут плотно Anthropic и сидит «царем горы» и Gemini ценой его не сдвинет, т.к. дальше профессионал применяет worker-агентов, которые пропустят 90% токенов, а это обычно DeepSeek V4.1, который имеет цену «в подарок от коммунистов» и скорость как у турболета за 200 токенов/сек.

Проще говоря, Gemini 4 Argon не жилец против связки Opus 5.5 + DeepSeek V4.1 ни по какому параметру (IQ, скорость и цена).

https://blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-4-argon/
  • 👍 19
  • ❤ 7
  • 🤔 3
  • ✍ 2
  • 💯 2
  • 🏆 1
More from @turboproject
  1. Oct 1, 2026Google опубликовал очень большую статью насчёт наличия сознания у ИИ. По поведенческому и…
  2. Sep 30, 2026Хорошо известный в российском ИИ-сообществе Валерий Ковальский замутил себе стартап на инф…
  3. Sep 30, 2026DeepSeek опубликовал версию DeepSeek Harness для Windows и iOS. Я уже потестировал на наст…
  4. Sep 30, 2026Я сейчас изучаю очень серьёзную проблему reward hacking для обычных программных тестов в к…
  5. Sep 30, 2026🔬 Scientific American опубликовал статью «ИИ решил „святой Грааль“ задачи из теории вероя…
  6. Sep 30, 2026Anthropic сделал нечто странное, по факту Дарио дал мощную рекламу GLM, утверждая, что мод…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →