TGViewer
Грустный Киберпанк Грустный Киберпанк @korolevsnotes · 6.39K subscribers
Post #3194 1.39K
Gemini Omni — Google научила ИИ думать о реальности
 
Вечер, эксперты. Помните, как в фантастике появился образ суперкомпьютера, который не просто отвечает на вопросы — он моделирует целые миры? Физику, поведение частиц, логику пространства. Казалось, красивая выдумка сценаристов. На Google I/O 2026 выяснилось, что выдумка заканчивается.

Google представила Gemini Omni — то, что сами разработчики называют world model, «моделью мира». По данным The Verge, система принимает на вход текст, изображения, аудио и видео одновременно и генерирует не просто ответ, а физически согласованную видеосцену, которую можно редактировать. Говоря проще: показываешь стол, стакан и кирпич — система просчитывает, что произойдёт, когда кирпич упадёт. Не приблизительно, а с симуляцией физических взаимодействий в реальном времени. Разработчики называют это grounded generation: выход системы привязан к физической логике мира, а не к языковой статистике.

Под капотом — слияние Gemini с двумя проектами DeepMind: Veo, отвечающим за генерацию видео, и Genie, разработанным как модель интерактивных игровых сред. Bloomberg Technology описывает результат как «мультимодальный движок, обученный понимать причинно-следственные связи в физическом мире». Это принципиально другой класс систем по сравнению с тем, что мы видели раньше — не потому что картинки красивее, а потому что меняется сам принцип работы с реальностью.

Традиционные языковые модели работают со статистическими паттернами: они не понимают, что кирпич тяжелее стакана — они просто видели миллиарды текстов, где написано, что тяжёлые предметы падают быстрее. Gemini Omni претендует на то, чтобы выйти за эти рамки. Если заявленное работает именно так, применимость ИИ в робототехнике, промышленном проектировании, медицинских симуляциях и климатическом моделировании меняется качественно — не на проценты, а на порядки. Это уже не про «умный чат-бот», это про цифровой двойник физического мира.

Конкуренты не спят. OpenAI работает над аналогичными мультимодальными системами через Sora и GPT-5; Meta* (организация признана экстремистской) вложила миллиарды в исследования симуляции физической среды. Китайские компании — Baidu, Zhipu AI, 01.AI — идут чуть сзади, но разрыв сокращается быстрее, чем хотелось бы в Пало-Альто. Вопрос здесь не в том, кто первый покажет красивое демо на конференции. Вопрос в том, у кого хватит вычислительной инфраструктуры, чтобы сделать технологию доступной в масштабе — то есть не для демонстрационного стенда, а для промышленного применения с реальными нагрузками.

Для России картина сложная. GigaChat и YandexGPT развиваются в принципиально других условиях: нет доступа к TPU Google последних поколений, нет той же глубины обучающего корпуса, нет инфраструктуры DeepMind. Вычислительные мощности, закрытые санкциями, не резиновые, и разрыв между мировыми лидерами и отечественными разработками продолжает расти — не потому что российские инженеры хуже думают, а потому что думать в условиях дефицита железа значительно сложнее. Строить world model без доступа к суперкластерам — примерно как писать симфонию на трёх нотах.

World model — это не маркетинговый термин для инвесторов. Если технология работает так, как обещает Google, мы говорим о системе, которая умеет думать о реальности, а не только о словах, описывающих реальность. Разница примерно как между картой и территорией — и разница эта существенная. Между «показали на конференции» и «работает в промышленном масштабе» обычно помещается несколько лет и пара громких разочарований — но направление движения теперь, кажется, понятно всем. Хорошего вечера, эксперты.

Подписывайтесь на «ГК» в Telegram|на Sponsr|в MAX
Telegram Грустный Киберпанк Наблюдаем за ИТ и телекомом в России и мире, делимся историями из прошлого и аналитикой настоящего. Рассказываем о госцифре, софте, железе и импортозамещении. За рекламой (или чтобы поделиться чем-то интересным) пишите боту: @GoslingFromBladeRunnerBot
  • 🔥 5
  • ❤ 2
More from @korolevsnotes
  1. Sep 30, 2026Post #3334
  2. Sep 29, 2026Женский вклад в программирование 14 февраля 1946 года в Школе электротехники имени Мура пр…
  3. Sep 29, 2026Post #3332
  4. Sep 28, 2026Что же, ребятки, с большим интересом наблюдаем за тем, как проектирование «Объединенной Ми…
  5. Sep 25, 2026Post #3330
  6. Sep 23, 2026Ребятки, кто в конце девяностых просиживал ночи в «Героях меча и магии 3», помнит это ощущ…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →