🎬 Новое поколение kandinsky: генерация видео с синхронным звуком
Сбер представил линейку моделей Kandinsky 6.0 Video. Главная особенность заключается в создании роликов с полностью синхронизированным звуком. Нейросеть генерирует диалоги, музыку и фоновые шумы, при этом движения губ персонажей точно совпадают с произносимой речью.
В сравнении с мировыми аналогами новинка демонстрирует высокие результаты:
🔊 синхронизация аудиодорожки с происходящим в кадре
🔊 наличие мощного флагмана и облегченного варианта lite
🔊 открытый доступ к весам моделей и программному коду
Флагманская версия достигла уровня Veo 3.1 Audio и конкурирует с LTX 2.5. Для практического тестирования инструменты интегрированы в Гигачат, а исходные материалы размещены на платформе GitHub.
©Artificial_Intelligence_Relations
🤖 в IT и выйти
Post #5506
1.01K

