🧐 FLUX 3 VIDEO!?
Немецкая компания правоприемник Stable Diffusion выпускает мультимодальную модель, для генерации видео...
И это самая мультимодальная модель что мы видели: сразу для изображений, видео с нативным аудио и даже предсказания действий для роботов. Уже работает на заводах Audi (подробнее расскажу завтра в ролике)
На старте доступно не все:
— Видео с нативным аудио - уже в early access
— Open-weight версия и генератор картинок— позже
По качеству, увы отстает от Seedance и Gemini Omni, но по моим ощущениям подобралась очень близко (бенчмарков пока нет)
Видео до 20 секунд, поддержка text-to-video, image-to-video, ключевые кадры.
Почитать подробнее тут | Получить ранний доступ тут
@creadvice
Post #929
1.56K


