Нашел время поразбираться с анонсами Google I/O. Ща будет прям несколько постов, берите попкорн.
Если что все статьи и новостные обзоры у них собраны тут:
https://blog.google/innovation-and-ai/technology/developers-tools/google-io-2026-collection/
В целом, кажется Google обгоняет-таки OpenAI по званию "народный AI".
– За год вырос от 480 трлн токенов в месяц до 3,2 квадрильонов – рост в 7 раз
– API обрабатывает ~19 млрд токенов в минуту
– Затраты на этот год $180–190 млрд (в 2022 было $31 млрд)
– Gemini-app: 900 млн MAU против 400 млн год назад, daily-запросы выросли в 7 раз. То есть прям близкое к OpenAI.
– AI Overviews в поиске – 2,5 млрд MAU, AI Mode – уже 1 млрд за год после запуска
Главные две модели:
Gemini Omni Flash – их версия мультимодальной "Nano Banana", но для видео. Принимает любой инпут (текст/фото/видео/аудио) и генерит видео по разговору в чате. Можно сказать "сделай скульптуру из пузырей" или "когда я касаюсь зеркала, оно растекается как ртуть" – и модель держит консистентность персонажей и физику между правками. Доступно сегодня в Gemini-app, Google Flow и YouTube Shorts (на Shorts бесплатно). API – через несколько недель. Дальше в семействе будут изображения и аудио. Честно говоря выглядит прям супер-круто.
https://blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-omni/
Gemini 3.5 Flash – их новый дейли-драйвер для агентских задач. Цифры заявленные:
– 76,2% на Terminal-Bench 2.1
– 83,6% на MCP Atlas
– 1656 Elo на GDPval-AA (реальные экономически значимые задачи)
– 4× быстрее других frontier-моделей по output tokens/sec
– Превосходит Gemini 3.1 Pro почти на всех бенчмарках, при этом стоит меньше.
Но тут как бы надо разбираться, на самом деле они нехило так подняли цены и главное преимущество останется (если и правда будет) - высокое качество при высокой скорости, но цена тоже высокая :)
Вот что получается сейчас (входные/выходные токены)
– Gemini 3 Flash – $0.50 / $3
– Gemini 3.1 Pro – $2 / $12 (до 200K контекста, дальше $4 / $18)
– Gemini 3.5 Flash – $1.50 / $9 (!) То есть почти как про.
Pro кстати не показали, обещают через месяц.
– GPT-5.4 mini – $0.75 / $4.50
– GPT-5.5 – $5 / $30
– Claude Haiku 4.5 – $1 / $5
– Claude Sonnet 4.6 – $3 / $15
– Claude Opus 4.7 – $5 / $25
Под капотом этого всего – два новых TPU. TPU 8t для претрейна (втрое мощнее предыдущего, тренировка распределена через на >1 млн TPU между датацентрами) и TPU 8i для инференса (фокус на latency). У обоих в 2 раза лучше perf-per-watt.
Внутри Google уже гоняют 3 трлн токенов в день через свои dev-инструменты – ровно тот feedback loop, про который говорил Борис из Anthropic, только в гугловой обертке.
В общем, Google теперь позиционируется как "у нас frontier + 4× скорость + "адекватная" цена пополам".
https://blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-3-5/
Post #1801
3.35K
