Google выпустила Gemini 3.8 Flash TTS — модель, которая создаёт голоса с нуля по текстовому описанию
Google выпустила две новые модели голосового синтеза: Gemini 3.8 Flash TTS и Gemini 3.8 Flash-Lite TTS. Главное отличие от предыдущих версий — голос теперь можно не выбирать из готового набора, а создавать с нуля, описав нужный акцент, тембр и характер персонажа обычным текстом.
Раньше пользователям были доступны 30 предустановленных голосов. Теперь к ним добавилась генерация новых голосов по текстовому описанию, библиотека из 2000+ образцов с региональными особенностями произношения, а также репликация голоса по 30-секундной записи. Flash TTS поддерживает 130 языков, Flash-Lite TTS — 101, оба работают с японским, русским и другими крупными языками.
Источник: ITmedia AI+ (🇯🇵)
Подробнее — в следующем посте
#Google #GeminiFlashTTS #синтезречи #ИИ
Post #2747
10

- 🔥 1