Что известно о Google Gemini 3.0?
На днях CEO Google Сундар Пичаи официально подтвердил существование Gemini 3.0, пообещав, что модель выйдет до конца 2025-го и покажет более ощутимый прогресс, чем все, что мы видели раньше.
Не надо быть Пичаи, чтобы оценить прогресс уже сейчас. С начала октября тестовые версии новой модели попадаются в Google AI Studio: надо выбрать Gemini 2.5 Pro, дождаться A/B-теста (обычно на 15-20 раз), в котором правый вариант ответа относится к новинке.
И в том же самом программировании она на голову выше, чем 2.5 Pro – можно видеть по роликам, но к ним вернемся позже. 99% вероятность, что речь идет о Gemini 3.0, причем в Pro-версии: 2.5 Flash обновляли совсем недавно, плюс 2.5 Pro также выходила первой.
Если решите экспериментировать сами, то учитывайте, что A/B-тест включен не всегда. Google меняет чекпоинты (версии) модели, пытаясь подобрать наиболее сбалансированный по ответам вариант.
Кроме того, недавно модели от Google под кодовыми именами lithiumflow и orionmist на какое-то время появлялись на сервисе LMArena, где пользователи вслепую сравнивают разные модели, выбирая, чей ответ больше нравится – из этого формируется рейтинг.
Появление на LMArena – важный шаг к запуску, но не указывающий, что он произойдет вот-вот. Весной и в начале лета Google обкатала на этой площадке более десятка чекпоинтов Gemini 2.5 Flash и Pro. Логика та же: компания пытается выбрать оптимальный вариант, причем если мы на этом этапе обычно восхищаемся примерами из кодинга (они самые наглядные), то разработчику важно смотреть на разные ответы – от советов по кулинарии до решения сложных математических задач.
Теперь к подборке видео выше – это не официальные демки от Google, а то, чем делились энтузиасты в сети. Как по мне, то почти все на голову выше того, что показывают текущие ИИ, вплоть до дорогущих GPT-5 Pro и Gemini 2.5 Deep Think. Впечатляет, что демки выполнены буквально с 1-2 промптов – то есть в грамотных руках это не предел возможностей модели, а только начало.
Будущая Gemini 3.0 Pro отлично справляется с визуалом – смотрите примеры интерфейса MacOS в html. Это не полноценные операционные системы, но с одного раза создать оболочку с работающими приложениями – тоже отличный результат.
А еще модель очень творческая даже в коде – смотрим ролики видеоигр и мини-эпизод “Южного парка”, выполненный в SVG.
Глава Google AI Studio Логан Килпатрик уже подтвердил в X, что у Gemini 3.0 Pro будет продвинутая работа с инструментами. Это то, за что я люблю GPT-5 Thinking и Grok 4 – размышляя над ответом, модель может выполнить поиск несколько раз подряд, уточняя информацию. Или запустить python-скрипт для обработки данных. В работе с информацией это крайне важная функция.
Есть намеки, что Gemini 3.0 Pro стала лучше в мультимодальности. Например, она проходит хитрый тест, когда показывают рисунок кисти с шестью пальцами и просят эти пальцы посчитать – обычно ИИ называют число “пять”. Плюс 3.0 Pro хорошо читает время на изображениях часов со стрелками – еще одно слабое место текущих моделей.
Мои тесты показывают, что Gemini 3.0 Pro очень хорошо справляется с текстами на русском. Это то, что мне нравится в предыдущей версии: у текстов хорошая структура, они написаны понятным языком, без лишних терминов и англицизмов. Очень надеюсь, что выбранный в итоге чекпоинт не утратит этот навык.
Под вопросом пока уровень галлюцинаций. Я прощаю GPT-5 Thinkng слишком заумный язык и использую ее как основную модель потому, что она почти перестала выдумывать отсебятину. Надеюсь, Gemini 3.0 Pro окажется минимум не хуже.
Второй – проактивность модели. Проблема, о которой я писал недавно: чтобы стать лучше в роли ассистента, ИИ должны не просто следовать промпту, а вести полноценный диалог – задавать вопросы, временами даже спорить с пользователем. В тестовых версиях этого не видно, но есть шанс, что докрутят настройками.
Когда? Не берусь судить. Однозначно до конца года, но даты, которые называли инсайдеры, пока были ошибочными. Так что ждем.
Post #270
10.1K