Ютюберы в кучу
Автомонтаж подъехал.
Здесь такой дисклеймер, что Flash 3.8 - это лучшая модель для понимания видео, аудио и вообще любых модальностей. Дело в том, что в посте про мультимодальность я немножко облажался. Мне потребовалось сделать небольшой ресерч, чтобы выяснить, что все вот эти громкие заявления, что наша модель мультимодальная, - это на самом деле то, что она понимает картинки и текст. И всё.
То есть два — это уже мультимодальность. И никто, ни DeepSeek, ни какой-нибудь Kimi, никто не понимает на вход, например, аудио. И в этом смысле Gemini — это единственная модель, которая реально хавает всё. Ну хорошо, еще новый Qwen Omni.
Я даже специально спросил: а вот эта наша новая Astra, она же мультимодальная, она может понимать аудио на вход? Ответ: нет. Она принимает на вход только текст и картинки. Я честно пытался засовывать в неё MP3 файлы, она галлюцинирует. Поэтому в этом смысле новость, вообще говоря, бомба. Потому что Google строит прямо интересную систему вокруг мультимодальности Flash 3.8, ну и, надеемся, Gemini 4.
YouTube показал, пожалуй, одну из самых интересных фишек - полноценного разговорного монтажёра на Gemini Omni.
Идея простая: загружаешь исходники в Shorts или YouTube Create и вместо ручного ковыряния таймлайна начинаешь разговаривать с Gemini.
Например:
«Собери первый черновик»
-> «Убери паузы»
-> «Сделай начало динамичнее»
-> «Переставь эти куски»
-> «Синхронизируй монтаж с битом»
-> «Добавь текстовый hook»
Gemini сама режет речь, переставляет кадры, синхронизирует музыку и собирает первый монтаж. После этого можно руками полезть в обычный timeline, что-то поправить и снова отдать работу AI. То есть это не чёрный ящик «нажал кнопку - получил видео», а гибридный монтаж человек + модель.
Параллельно YouTube перестраивает вокруг AI вообще весь workflow автора.
YouTube Studio сможет смотреть ранний монтаж и давать персональные советы по темпу, структуре и сторителлингу.
Появится A/B-тестирование уже не только заголовков и превью, но и до трёх разных монтажных версий одного видео. Можно сделать три разных начала и посмотреть, какой hook реально лучше держит зрителя.
Dynamic Thumbnails смогут показывать разные из трёх превью разным сегментам аудитории, вместо попытки найти одно универсально лучшее.
Ask Studio сможет в фоне копаться в старых видео канала, находить кандидатов на повторное продвижение, предлагать новые превью и тестировать их.
Генерация thumbnails тоже становится персонализированной - YouTube пытается подстраивать изображения под стиль конкретного канала.
Плюс экспериментальный AI-модератор комментариев будет постепенно учиться на том, какие комментарии конкретный автор удаляет и оставляет.
На итоге, ютюберы:
-> исходники
-> автоматический первый монтаж
-> разговорные правки
-> ручная доводка
-> AI-анализ ролика
-> превью
-> A/B-тест разных монтажей
-> публикация
-> анализ старого каталога и попытка его оживить.
Пока это именно новая линейка анонсированных инструментов Made on YouTube 2026, а не набор функций, который сегодня одновременно появился у всех. Например, A/B-тест трёх монтажей YouTube прямо помечает как coming soon.
В общем, начинаем кричать, не на монтажера, а в монитор.
https://blog.youtube/news-and-events/made-on-youtube-new-tools-power-creation-journey/
@cgevent
Post #16758
3.23K
- 👍 28
- ❤ 8
- 👎 1
- 😁 1