Напомню, это новый мультимодальный флагман, который понимает физику, культурные контексты, историю — и сам достраивает реалистичные детали без километровых промптов. Вы пишете «вид астронавта на Марсе», а модель сама знает, как выглядит марсианский горизонт, как падает свет и как дрожит шлем в невесомости. Модель доступна всем в Gemini. Вот главные тезисы руководства:
• Говорите короче, думайте глубже. Omni не нужны лекции — достаточно упомянуть эпоху, стиль или культурный маркер, и она сама заполнит остальное
• Текст внутри видео — это отдельный инструмент. Можно задавать шрифт, анимацию каждого слова и даже «внутренний монолог» персонажа поверх кадра — как субтитры его мыслей
• Говорите языком оператора. «Непрерывный кадр», «зум-переход», «пленочная зернистость» — Omni реагирует на операторский сленг точнее, чем на бытовые описания
• Правьте точечно, не переписывайте всё. Модель держит структуру сцены: можно поменять только фон или убрать один объект, не трогая остальное
• Действия персонажей — тоже ваша юрисдикция. Темп, эмоция, жест в конкретный момент сцены — всё задаётся прямой командой
В сети, по большей части, очень довольный новинкой гугла. Единственное — модель уступает Seedance 2 в экшен-сценах, но на этом пожалуй все. В остальном топ, даже липсинк под разные языки умеет отрисовывать 😂
@creativethecreator