استارتاپ Midjourney که با مدلهای تولید تصویر مبتنی بر هوش مصنوعی شناخته میشه، بهتازگی از مدل تولید ویدئوی خودش به نام V1 رونمایی کرده. این مدل میتونه از یک تصویر ثابت (چه تصویر آپلودی، چه تصویر تولیدشده توسط مدلهای قبلی Midjourney) چهار ویدئوی پنجثانیهای تولید کنه و کاربران میتونن این ویدئوها رو تا چهار بار، هر بار بهمدت چهار ثانیه، طولانیتر کنن. در نتیجه، حداکثر طول ویدئویی که با V1 ساخته میشه میتونه به ۲۱ ثانیه برسه. این ویدئوها در حال حاضر فقط از طریق پلتفرم دیسکورد و در نسخهی وب در دسترس قرار دارن.
V1 بهگونهای طراحی شده که استفاده ازش هم ساده باشه و هم قابلیتهای فنی متنوعی در اختیار کاربران بذاره. از جمله تنظیماتی که در این مدل در نظر گرفته شده میشه به حالت «انیمیشن خودکار» اشاره کرد که تصویر ورودی رو بهصورت تصادفی و بدون دخالت کاربر به حرکت درمیاره. برای کاربران حرفهایتر، حالت «انیمیشن دستی» فراهم شده که در اون میتونن بهصورت متنی توضیح بدن که چه نوع حرکتی مدنظرشونه — مثل چرخش دوربین، حرکت کاراکتر یا تغییرات پسزمینه. همچنین گزینههایی برای میزان تحرک صحنه در نظر گرفته شده: از «low motion» برای حرکات آرام گرفته تا «high motion» برای صحنههای پویاتر.
از نظر هزینه، مدل V1 نسبت به مدلهای تصویری Midjourney پرمصرفتره. طبق اعلام شرکت، تولید یک ویدئو تا ۸ برابر بیشتر از یک تصویر از سهمیهی ماهانهی کاربران مصرف میکنه. اشتراک پایه برای استفاده از V1 از ۱۰ دلار در ماه شروع میشه، درحالیکه مشترکین پلن Pro (با قیمت ۶۰ دلار) و Mega (۱۲۰ دلار) امکان تولید نامحدود ویدئو در حالت Relax (حالت غیرسریع) رو دارن. البته Midjourney اعلام کرده که طی ماه آینده، سیاست قیمتگذاری برای مدلهای ویدئویی خودش رو بازبینی خواهد کرد.
از نظر جلوههای بصری، ویدئوهای تولیدشده توسط V1 در نگاه اول بیشتر «سورئال» و خیالگونه بهنظر میرسن تا واقعگرایانه؛ ویژگیای که پیشتر هم در مدلهای تصویری Midjourney دیده شده بود. با وجود اینکه این سبک ممکنه برای برخی از کاربران مناسب نباشه، اما در میان هنرمندان و خلاقان بازخورد مثبتی دریافت کرده. با این حال، هنوز مشخص نیست که V1 در عمل تا چه حد میتونه با مدلهایی مثل Veo 3 از گوگل یا Gen-4 از Runway رقابت کنه، مخصوصاً در زمینه کیفیت، پایداری تصویر و کنترلپذیری دقیق صحنه.
درنهایت، Midjourney با مدل V1 نشون داده که همچنان میخواد مرزهای خلاقیت بصری در دنیای هوش مصنوعی رو جابهجا کنه — حتی در شرایطی که از سوی نهادهای حقوقی و استودیوهای بزرگ فیلمسازی به چالش کشیده میشه. مسیر بعدی این شرکت، طبق وعدهها، توسعهی مدلهایی برای تولید رندرهای سهبعدی و شبیهسازیهای بلادرنگ خواهد بود؛ هدفی جاهطلبانه که میتونه آیندهی طراحی و داستانسرایی بصری رو متحول کنه.
@aipulse24
Post #526
2.35K
- ❤ 18
- 🔥 6
- 👍 4