Главные фишки:
🔘Voice cloning — можно скормить аудиофайл с голосом (свой или чей-то) и модель будет читать этим голосом
🔘1110+ языков — включая русский, поддержка через Fairseq
🔘Автоматическое разбиение на главы — лучше всего работает с epub/mobi
🔘Веб-интерфейс на Gradio — не нужно возиться с CLI
🔘Минимальные требования — 4GB RAM, работает на CPU (медленно) или GPU (почти realtime на NVIDIA)
Как запустить:
git clone https://github.com/DrewThomasson/ebook2audiobook.git
cd ebook2audiobook
./ebook2audiobook.sh # Linux/Mac
# или ebook2audiobook.cmd на Windows
Откроется веб-интерфейс на localhost:7860. Есть готовый Docker-образ с поддержкой GPU.
Выходные форматы: m4b (с главами), mp3, flac, wav, ogg. Проект активно развивается — 13.9k звёзд, 22 контрибьютора.
Репо на гитхабе, на видео демо.
@prog_tools