گوگل همچنین از نسخهی جدید مدل تولید ویدئوش یعنی Veo 3 رونمایی کرده؛ مدلی که حالا میتونه علاوهبر ساخت ویدیو، صداهایی مثل افکت صوتی، صدای محیط و حتی دیالوگ رو هم بسازه و با ویدیو همگام کنه.
دمیس هاسابیس، مدیرعامل دیپمایند گفته Veo 3 ما رو از «دوران ویدیوی بیصدا» بیرون آورده. کاربرا میتونن با یه پرامپت ساده، صحنه و شخصیتها رو توصیف کنن و حتی بگن دیالوگها چه جوری صدا بده.
گوگل میگه یکی از تفاوتهای اصلی Veo 3 با مدلهای دیگه، مثل Runway، Pika یا OpenAI، قابلیت تولید و همزمانسازی خودکار صدا با تصویر براساس پیکسلهای خام ویدیوئه. این توانایی میتونه برگ برندهای برای گوگل باشه تو بازاری که حالا دیگه حسابی شلوغ شده. با اینکه ابزارهای تولید صدا با هوش مصنوعی قبلاً معرفی شده بودن، Veo 3 با درک عمیقتر از تصویر، یه قدم جلوتره.
گفته میشه دیپمایند برای ساخت این مدل از پژوهشهای قبلیش تو زمینه «ویدیو به صدا» استفاده کرده؛ و البته احتمالش زیاده که یوتیوب هم یکی از منابع آموزشی این مدل بوده باشه.
در کنار معرفی Veo 3، گوگل یهسری قابلیت جدید هم برای Veo 2 فعال کرده. حالا کاربرا میتونن عکسهایی از کاراکترها، صحنهها یا سبک بصری بدن تا خروجی ویدیوها یکدستتر بشه. Veo 2 همچنین حرکات دوربین مثل چرخش یا زوم رو هم بهتر درک میکنه و امکان حذف یا اضافهکردن اشیا تو ویدیو یا تغییر قاب از پرتره به منظره رو فراهم کرده. این امکانات قراره بهزودی از طریق پلتفرم Vertex AI گوگل در اختیار توسعهدهندهها هم قرار بگیره.
مدل Veo 3 فعلاً فقط برای مشترکای پلن AI Ultra با قیمت ۲۴۹.۹۹ دلار در ماه از طریق چتبات Gemini در دسترسه.
@aipulse24
Post #463
2.19K
- 🤯 12
- ❤ 5
- 🔥 2