Большой шаг вперёд для синтеза речи
Компания Qwen выложила в open source новую TTS-модель, которая умеет:
🔘 клонировать голоса
🔘 создавать новые
🔘 и даже управлять подачей речи через обычный текст
Можно просто написать:
«Говори бодро, но с лёгкой ноткой волнения» — и модель реально так и сделает
И всё это без сложной настройки аудио и танцев с инженерией звука.
Post #5544
3.39K
- ❤ 11
- 🔥 4