TGViewer
هوش مصنوعی و علم داده به فارسی هوش مصنوعی و علم داده به فارسی @dataplusscience · 6.06K subscribers
Post #3633 215
‏🤖 افزودن آواتار ویدئویی سخنگو به مدل Gemini 3.8 Live

‏گوگل در به‌روزرسانی جدید مدل Gemini 3.8 Live، قابلیت تولید ویدئوی لحظه‌ای از یک شخصیت سخنگو را اضافه کرد. این آواتار با تشخیص صوت و تصویر کاربر، به صورت خودکار حرکت لب‌ها و میمیک چهره را با محتوای کلام هماهنگ می‌کند. برای توضیح فنی کامل‌تر این موضوع، توضیح کامل‌تر در سایت را ببینید.

‏مهم‌ترین ویژگی‌های این قابلیت:

‏* هماهنگی زبانی: حرکات چهره و لب‌ها برای ۹۷ زبان مختلف بهینه شده و هنگام تغییر زبان در حین گفتگو، کیفیت تصویر حفظ می‌شود.
‏* شخصی‌سازی: امکان انتخاب از کتابخانه پیش‌فرض یا ساخت آواتار اختصاصی با استفاده از یک تصویر واحد (در حال حاضر برای مشتریان سازمانی).
‏* امنیت: تمام خروجی‌های ویدئویی و صوتی با واترمارک غیرقابل مشاهده SynthID نشانه‌گذاری می‌شوند.
‏* عملکرد چندگانه: مدل می‌تواند همزمان داده‌های ویدئویی و صوتی را دریافت کرده و ابزارهای خارجی را بدون وقفه در مکالمه فراخوانی کند.

‏این سرویس هم‌اکنون از طریق Gemini Enterprise و Gemini Live API در دسترس است.
More from @dataplusscience
  1. Sep 29, 2026‏🤖 عرضه مدل جدید Claude 3.5 Sonnet ‏شرکت Anthropic نسخه جدید مدل Claude 3.5 Sonne…
  2. Sep 29, 2026🧠 خلاصه تحولات 24 ساعت گذشته هوش مصنوعی و علوم داده 🗂 گزارش #128 | 📌 8 آیتم گزارش | 🧾…
  3. Sep 29, 2026‏💰 زیان ۴۲ میلیارد دلاری و برنامه هزینه‌کرد ۵۱۸ میلیارد دلاری Anthropic ‏خبرگزاری…
  4. Sep 29, 2026‏📊 اهمیت اجرای سازمانی در پروژه‌های هوش مصنوعی ‏مک‌کینزی در تحلیل جدید خود تأکید…
  5. Sep 29, 2026‏🤖 تعویق نامحدود انتشار مدل GPT-6.1 Astra ‏گزارش‌های منتشر شده حاکی از آن است که…
  6. Sep 29, 2026‏🇨🇳 چراغ سبز چین به واردات تراشه‌های انویدیا ‏دولت چین که طی سال‌های اخیر برای ک…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →