Итоги Google I/O - компания показала модели, которые рвут все
Модели Gemini 2.5 - умнее, круче в кодинге, мультимидальнее. №1 по результатом огромной кучи бенчмарков. Отменяйте свои подписки на ChatGPT, он вам больше не нужен 🙂
Gemini Diffusion - гугл пошли в использование другой архитектуры. Традиционные модели работают на базе архитектуры трансформеров, сейчас же пробуют дифузионные модели. Результат - вместо предсказания результата токен за токеном, генерим сразу цельный ответ. Модель сейчас в бете, но говорят, что она крута в кодинге и математике (с которой страдают LLM)
Gemini Robotics - показали специализированную модель, предназначенную для обучения роботов. Фокус модели на работе с физикой. Моделька учит роботов, как правильно взаимодействовать с окружающим миром.
Project Astra - то, чего я ждал очень давно. Риал лайф использование Gemini. Словами не передать. Нужно смотреть видео. Но если коротко - показали юзкейс, как можно отремонтировать велик с помощью AI. Говорим модели, что надо сделать, в процессе она получает полный доступ к телефону, управляет им, может сделать подсказку по видео, ходить в интернет, звонить и делать что угодно. Также показали, как данный продукт может использоваться незрячими для ориентации в окружающем мире
AI Mode - аналог Perplexity от Google, который я долго тестировал в рамках Google Labs. Сегодня делают доступным для всех в США. В него добавили также режим Personal context, учитывающий данные о вас, DeepResearch и поиск по наведению камеры, так называемый Search Live. Летом завезут функции комплексного анализа и визуализации данных.
AI для шопинга - сделали агента, который позволяет сделать виртуальную примерку одежды, а потом отправить его купить то, что вам понравилось.
DeepResearch прокачали. - теперь можно будет пикрепить свои файлы, на которые вы хотите, чтобы модель опиралась при поиске. Также скоро обещают добавить DeepResearch по вашему гугл диску.
Gemini добавили в Chrome - модель будет доступна прямо в браузере. Раскатывают на этой неделе на Штаты. Моделька сможет понимать контекст страницы, которую вы просматриваете прямо сейчасю
Imagen 4 - обновили модельку для генерации картинок. Обещают более высокое качество, работу с текстами и редактирование изображений прямо в приложении Gemini. При этом модель работает в 10 раз быстрее.
VEO 3 - ДОСТУПНА УЖЕ СЕГОДНЯ. И ЭТО ОФИГЕТЬ! Модель генерирует не просто видео, но и звуки, диалоги и кучу всего! В общем, полноценные фильмы!
Flow - отдельная студия, в которой можно работать со всеми медиа, которые вы генерируете. Можно создать фильм, озвучку и музыку к нему.
Gemini Ultra - новая подписка, которая включает в себя VEO 3, Gemini 2.5 Pro DeepThing, 30 тб хранилища, жирные лимиты, YouTube Premium и кучу других плюшек. Стоит $250 в месяц. Теперь сижу и думаю, как задушить жабу, которая говорит не покупать ее 😁
Это была САМАЯ МОЩНАЯ презентация от Google на моей памяти!
👉🏻 Оригинальный пост гугла
Post #309
608