Нашёл локальный генератор речи, который работает на 1 ГБ оперативы — Soprano.
Что умеет:
• Озвучивает текст до 20× быстрее реального времени на CPU и до 2000× на GPU
• Под капотом 80 миллионов параметров без потери качества
• Начинает воспроизводить речь практически сразу после получения текста
• Озвучивает длинные тексты без ограничений по длине
• Поддерживает Windows, Linux и macOS
• Работает через WebUI, командную строку, Python API и OpenAI-совместимый API
• Модель можно дообучить на записях речи для клонирования или под новый язык
Сохраняем.
Пет-проект
Post #4270
2.73K
- 🔥 11
- ❤ 7
- 👍 4