🧠 گوگل مدلهای جدید هوش مصنوعی برای ساخت صدا معرفی کرد
گوگل از دو مدل جدید Gemini 3.8 Flash TTS و Gemini 3.8 Flash-Lite TTS رونمایی کرده است؛ مدلهایی که برای تبدیل متن به گفتار طبیعیتر و ساخت صداهای قابل تنظیم طراحی شدهاند.
🎙️ مدل Flash TTS به کاربران اجازه میدهد با استفاده از دستورهای متنی، صدای جدیدی از ابتدا طراحی کنند و حتی نحوه بیان هر جمله را مشخص کنند. سرعت صحبت، احساسات، لهجه، مکثها و نحوه اجرای دیالوگها نیز قابل کنترل است.
🎮 این فناوری میتواند در ساخت بازیهای ویدیویی، دوبله فیلم و سریال، پادکست، کتاب صوتی و دستیارهای صوتی کاربرد داشته باشد. گوگل همچنین اعلام کرده مدلهای جدید از بیش از 100 زبان پشتیبانی میکنند.
🔐 گوگل برای جلوگیری از سوءاستفاده از صداهای تولیدشده، قابلیتهای امنیتی از جمله واترمارک را نیز در نظر گرفته است.
📅 این مدلها از 23 سپتامبر 2026 در Google AI Studio و Gemini API در دسترس قرار گرفتهاند.
اخبار و تحلیل ها را در #زیرسان دنبال کنید
@ziresan
Post #296
8

- 👍 3
- ❤ 1