Появилась новая open-source модель для генерации речи — Supertonic 3.
Поддерживает 31 язык, включая русский, умеет передавать эмоции, интонации и даже мелкие детали вроде пауз, вздохов или кашля, из-за чего озвучка звучит заметно живее обычного AI-TTS.
Модель работает локально без интернета и запускается даже на слабых ПК и смартфонах. Забираем здесь.
Post #4541
489

- ❤ 3
- 🔥 2