TGViewer
AiXenix - нейробезумие AiXenix - нейробезумие @aixenix · 534 subscribers
Post #3941 252
Gemini 3.8 TTS генерирует голоса на основе описания и клонирует речь пользователя.

Google выпустила две модели для синтеза речи. Flash TTS работает со 130 языками, а Flash-Lite TTS — со 101. Обе версии поддерживают русский язык и уже доступны через API.

При озвучивании видео или аудиокниг можно настраивать эмоции, скорость и паузы для каждой фразы. Нейросеть способна воспроизводить смех, вздохи и вести диалог от лица двух персонажей.

Процесс копирования голоса включает запись аудиообразца, предоставление отдельного устного согласия и сохранение профиля для синтеза.

Протестировать функцию можно в Google AI Studio: необходимо выбрать модель, создать голос и ввести текст. Предусмотрены бесплатные лимиты. В итоговый аудиофайл внедряется скрытый водяной знак SynthID для идентификации сгенерированного контента.

@AiXenix
More from @aixenix
  1. Oct 5, 2026Нейросетевой агент получил способность создавать клоны стороннего программного обеспечения…
  2. Oct 5, 2026Команда OpenAI встала на путь исправления. Теперь ежедневно внедряется либо полезная функц…
  3. Oct 4, 2026Поклонники собрали 3D-модели деталей и наборов LEGO Bionicle для самостоятельного изготовл…
  4. Oct 4, 2026Функционал бесплатного Gemini сократят: пользователям без подписки оставят лишь Flash-Lite…
  5. Oct 3, 2026Я, когда 25 агентов просят подтверждения. @AiXenix
  6. Oct 3, 2026Ноутбуки MacBook стали полноценными игровыми устройствами: независимый разработчик при под…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →