Kandinsky 6.0 Video — новая линейка моделей генерации видео со звуком
Модели генерируют видео с диалогами, музыкой и звуками окружения. Аудиодорожка синхронизирована с происходящим в кадре, движения губ персонажей совпадают с речью. Это первая российская нейросеть, генерирующая видео с синхронным звуком.
— Флагман новой линейки, Kandinsky 6.0 Video Pro — показывает качество на уровне Veo 3.1 Audio, а среди открытых моделей уступает только MiniMax H3, достигая паритета с LTX 2.5.
— Есть компактная Video Lite (3B) для запуска дома — доступны пресеты для видеокарт с 16–32 ГБ VRAM.
Веса моделей доступны на Hugging Face, код — на GitHub и на Gitverse. Также опубликован подробный технический отчёт с описанием архитектуры, данных, процесса обучения и результатов тестирования. Модель можно попробовать бесплатно в ГигаЧате в разделе генерации видео.
Post #10114
16K


- 👍 112
- 😭 75
- 🗿 37
- 🔥 20
- 😁 20
- ❤ 12
- 🕊 2
- 🤨 2
- ☃ 1
- 🎉 1
- 🤓 1