TGViewer
Data Secrets Data Secrets @data_secrets · 94.7K subscribers
Post #9059 28.4K
Google выпустили SOTA модель для генерации речи

Вышла Gemini 3.1 Flash TTS – новое поколение голосового движка в экосистеме Gemini.

Киллер-фича: суперточный контроль интонации. Возможно задавать стиль, темп, ударения и «атмосферу» речи через теги в тексте, почти как в режиссерских заметках для голоса.

Плюс модель может работать с многоголосием с сохранением стиля голоса каждого персонажа, так что ее можно использовать для озвучки целых фильмов.

Плюс скорость. По сравнению с более ранними TTS ускорение первого токена и общей задержки произошло на десятки процентов. Это уже близко к полноценным онлайн прод-сценариям.

Озвучка, переводы, ИИ-подкасты и голосовые агенты скоро выйдут на совсем новый уровень

blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-3-1-flash-tts/
  • 👍 126
  • 🔥 57
  • ❤ 24
  • 🤔 5
  • 🤯 5
  • 😁 4
More from @data_secrets
  1. Oct 9, 2026В ночь с 7 на 8 октября в результате атаки БПЛА был серьезно поврежден дата-центр Яндекса…
  2. Oct 9, 2026Anthropic обновила Usage Policy, и теперь Claude нельзя обижать 🤡 В документе они пишут,…
  3. Oct 8, 2026OpenAI раскатили на всех пользователей GPT-6 и новую фичу под названием Intelligent UI Теп…
  4. Oct 7, 2026Новый Haiku 5.5, сводка: — В среднем запуск обходится на 75% дешевле Haiku 4.5. — Большой…
  5. Oct 7, 2026Вышел Haiku 5.5
  6. Oct 7, 2026Когда только собрался делать стартап, который продашь за 500M$+, но лимиты закончились чер…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →