TGViewer
Complete AI Complete AI @complete_ai · 7.86K subscribers
Post #96 15.7K
⚡️⚡️⚡️VideoFusion
Вышла первая open source диффузионная модель для синтеза видео по текстовому описанию на 1.7B параметров (CVPR 2023).

Авторы предлагают рассматривать диффузионный процесс как некоторый декомпозируемый процесс: базовый шум (base), общий для всех кадров, и шум остаточный (residual), который изменяется во времени. Две модели учатся совместно и приводят к результату, по качеству превосходящему существующие GAN-based и диффузионные модели синтеза видео.

Статья
HuggingFace

@complete_ai
  • 🔥 19
  • 👍 6
  • ⚡ 3
  • ❤‍🔥 2
More from @complete_ai
  1. Oct 9, 2026Коллеги из Яндекса, мы с вами. Пусть хватит сил пройти через всё это, справиться с последс…
  2. Oct 9, 2026Приходите послушать Бориса Заикина — он расскажет про наши исследования в области RL обуче…
  3. Oct 9, 2026Время ИИшницы! Приглашаем на митап, который пройдёт 22 октября в 18:30⤵️ В честь юбилейног…
  4. Oct 7, 2026🚀 Мы с командой представляем Kandinsky 6.0 Video Lite и Pro — новое поколение наших модел…
  5. Sep 17, 2026AI + разработка — Senior-разработчиков ждут в Ozon Tech В компании развивается новое напра…
  6. Sep 7, 2026Мы выложили программу Practical ML Conf 2026 Я уже не первый год состою в программном коми…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →