Tongyi Lab от Alibaba выкатил Wan 2.2 — открытую видеомодель для text‑to‑video и image‑to‑video. Она работает через двух «экспертов»: один строит сцену, второй отвечает за детали. Такой подход даёт качество и при этом сохраняет эффективность.
По тестам Wan 2.2 обошёл Seedance, Hailuo, Kling и даже Sora в рендере текста, управлении камерой, эстетике и детализации. Модель обучили на 66% больше изображений и 83% больше видео, чем Wan 2.1, поэтому она лучше справляется со сложным движением и визуальными эффектами.
Пользователи могут тонко настраивать свет, цвет и углы камеры, добиваясь почти киношного уровня контроля.
И что?
Бизнес: доступ к мощному видео‑ИИ без лицензий и подписок; это сокращает расходы на производство контента.
Инвесторы: Китай усиливает позиции не только в языковых, но и в мультимодальных open‑решениях.
Рынок: возникает параллельная китайская open‑экосистема, которая может стать стандартом для разработчиков.
🚨Нам пи**ец
Google (Veo 3): 5/10 — Wan 2.2 близко по качеству, но пока непонятно, какое железо нужно. Если окажется доступным, Google потеряет эксклюзивность. И звука нет.
Киноиндустрия: 9.5/10 — если раньше был запас 2–3 года, то теперь его может не быть вовсе. Такие релизы, сильно взбодрят американцев, и они сделают ответ как они это любят 10X. С такими темпами фильмы можно будет собирать промптами уже через год, и бюджеты на традиционное производство рухнут.
Post #1772
971
- 👍 9
- ❤ 4