TGViewer
AI Product | Igor Akimov AI Product | Igor Akimov @ai_product · 8.27K subscribers
Post #2436 1.83K
Google вернулся в топ-3 – Gemini 4 Argon. Только потрогать пока нельзя :)

Гугл снова в строю. Думал, что сжалятся и хотя бы дадут попробовать, но нет, пока только у всяких бенчмаркеров и "надежных партнеров". Зато вот добавили в AntiGravity Opus 5.5 и Sonnet 5.5, снова халява и возможность выжать из своей подписки максимум. А еще и облачных GPU дают (спасибо за наводку https://t.me/cgevent, отпишу, как протестирую сам)

Что внутри:
– 1M токенов контекста, на вход текст, картинки, видео и речь
– Выход до 1M токенов (!) – было 64K. Модель может думать сотни тысяч токенов за один заход. Короче, книги писать - туда.
– $2/$10 за 1M input/output на старте, потом $4/$20, кэш – со скидкой 95%. Это дешевле Sol/Sonnet, но жрет она токены сильно. Тратит в среднем 62k токенов на задачу против 27k у Astra, и $1.99 за задачу выходит только за счёт скидки – потом будет $3.98. А GPT-6.1 Sol при той же цене за токен даёт почти тот же интеллект за $0.72.

Бенчмарки от Google:
– DeepSWE v1.1 – 77.9% против 74.1% у GPT-6 Astra и 74.2% у Opus 5.5
– Harvey Legal Agent – 19.6% против 5.4% у Astra и 3.8% у Opus
– GraphWalks на 256K–1M токенов – 84.2% против 71.8% у Astra

Но! FrontierSWE v2 – 55.0% против 65.5% у Astra, а Terminal-Bench 4.0 – 57.4% против 66.4% у Opus

Независимые:
– Artificial Analysis – 53, наравне с GPT-6 Astra. У Opus 5.5 – 58. В среднем довольно неплохая, в топ-5
– Галлюцинации 15% против 51% у Astra – модель чаще честно говорит «не знаю». Это конечно существенный плюс.
– Arena: #1 в Text Arena, но #8 в Code Arena и Agent Arena. Короче, тексты пишет хорошо (скорее всего и всякие переводы, художественность, понимание языка будет хорошее), а для кодинга пока "такое". Ну и норм, не всем же в мире нужны модели только для кодинга.

Внутри гугла я так понимаю мнения разделились. Но в целом "больше моделей - хороших и разных". Будет супер-моделька для финансов, юристов и длинных документов, где низкие галлюцинации решают больше, чем лишние проценты кодинга.

https://blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-4-argon/
  • 🔥 8
  • ❤ 6
  • 👍 4
  • 🤡 1
  • 😐 1
  • 💘 1
More from @ai_product
  1. Oct 7, 2026OpenAI вывалили на GitHub 722 математические статьи от своей внутренней модели. Одним рели…
  2. Oct 6, 2026Блин, мне проапрувили почти сразу, вау!
  3. Oct 6, 2026О, Anthropic расширили программу Claude Startups – теперь до $7K на Claude и до $45K на па…
  4. Oct 6, 2026Mistral зарелизил версию 4 Типа самая мощная за пределами Китая и США. Даже круче корейско…
  5. Oct 6, 2026Свежие обновления выгодности подписок подъехали Ребята не поленились: гоняли запросы через…
  6. Sep 30, 2026Бенчмарки железа для ИИ-шек Artificial Analysis сделал AA-AgentPerf-Local – открытый бенчм…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →