Есть прикольная модель для синтеза речи с названием NeuTTS Air. Открытая и бесплатная, всего 0.5B параметров, запускается локально. Работает на телефоне, ноуте и даже на Raspberry Pi.
Голос один из лучших, что я слышал – получается естественно, почти идеально. Для клонирования голоса хватит 3 секунды аудио, и даже на таком коротком куске точно копируется тембр.
Думаю, может сварганить из подобных инструментов себе ферму рилсов? 🤔
> Главный нюанс: понимает только английский.
> GitHub: https://github.com/neuphonic/neutts.
📱 Youtube | 💬Чат | 📱 Канал
Post #1572
979
- ❤ 4