alexandria-audiobook
Слушать аудиокниги удобно, но если нужно конвертировать имеющийся роман или электронную книгу в аудиоформат, большинство инструментов выдают «механический» голос с одним тембром — без разделения персонажей и эмоциональной выразительности.
Недавно наткнулся на open-source проект Alexandria Audiobook Generator, который с помощью AI автоматически размечает текст и генерирует аудиокнигу с озвучкой нескольких персонажей. Сначала большая модель парсит весь текст книги, точно разделяя нарратив (описание) и реплики разных персонажей, а также проставляет эмоциональные теги.
В проект встроен локальный TTS-движок: поддерживаются разные языки, а такие вещи, как вздохи, смех и прочие паралингвистические элементы, воспроизводятся естественно с учётом контекста.
Есть удобный UI, где можно назначать разные голоса для каждого персонажа; также поддерживается клонирование голоса по короткому аудио-сэмплу (буквально несколько секунд).
Поддерживается one-click локальный деплой — без необходимости использовать внешние голосовые сервисы, всё работает полностью на локальной машине.
На выходе можно экспортировать аудиокнигу в формате M4B с главами или в виде многодорожечного аудио. Отличный вариант для тех, кто любит аудиокниги или занимается созданием аудиоконтента.
📁 Language: #Python 58.3%
⭐️ Stars: 422
➡️ Cсылка на GitHub
📱 @git_developer
Post #1500
2.71K

- 👍 7
- ❤ 3
- 😁 1