【今晚,AI视频生成工作流已经闭环了】
刚刚,谷歌正式发布了 SOTA 的生图/改图模型 nano banana,定名 Gemini 2.5 Flash Image,通义也同时发布了完全开源的 Wan2.2-S2V。
2.5 Image 擅长精准定位编辑,保持角色一致性,并且拥有 Gemini 的世界知识!而 Wan2.2-S2V 开源地实现了文字+图+音频→数字人的视频生成!
我觉得视频创作者的黄金时代可能已经来了!
今晚之后,AI 视频制作流程将简化为以下几步:
1️⃣用现有的顶尖 AI 图像生成工具,例如即梦、GPT image 或 Midjourney 生成图像,再用即梦或者 nano banana 打字P图,精准修改到满意为止;
2️⃣用 Elevenlabs 生成语音,Suno生成音乐;
3️⃣用通义万象 Wan2.2-SV 或 HeyGen 将语音和图像转换为数字人形象。
整个流程门槛低,成本低,效果上乘,且高度可控!
此前已经出现了一些高质量的 AIGC 视频,例如 AI 生成的雪王大战东方明珠和瑞克与莫蒂穿越多重时空这些。
今晚发布的这些模型想必会让接下来几周的 AI 视频的制作效率和效果变得更好了...
nano banana:https://aistudio.google.com/
Wan2.2-S2V:https://mp.weixin.qq.com/s/K6eA-I11dHMgsdgUGDw9Uw
#AI #AIGC #Google #Gemini #Wan #Alibaba #Video #Photo #Avatar
Post #8146
1.92K
