TGViewer
[PYTHON:TODAY] [PYTHON:TODAY] @python2day · 63.8K subscribers
Post #8086 10.4K
😱 Клонируем практически любой голос локально — нашли настоящий комбайн для работы с AI-аудио.

Voice Clone Studio — объединяет сразу несколько мощных нейросетей в одном интерфейсе: Qwen3-TTS, VibeVoice, Fish Speech, Chatterbox, LuxTTS и другие.

Что умеет:
🎙 клонировать голос по короткому образцу речи;
🗣 озвучивать этим голосом совершенно новый текст;
😂 управлять эмоциями — шёпот, смех, возбуждение и десятки других вариантов;
🎧 создавать новые голоса просто по текстовому описанию;
👥 генерировать разговоры нескольких персонажей;
🎧 превращать один записанный голос в другой;
📚 создавать длинную озвучку — VibeVoice поддерживает до 90 минут непрерывной речи;
🧠 дообучать собственные голосовые модели;
🗑 автоматически чистить, нарезать и транскрибировать записи;
💥 генерировать звуковые эффекты и атмосферу для видео.

Установка:
git clone https://github.com/FranckyB/Voice-Clone-Studio.git
cd Voice-Clone-Studio

chmod +x setup-linux.sh
./setup-linux.sh


▶️ Запуск:

С помощью Python
python voice_clone_studio.py


Windows

launch.bat

Linux
./launch.sh


После запуска открываем:
http://127.0.0.1:7860


▶️ Как клонировать голос:

1. Открываем вкладку Prep Audio.
2. Загружаем или записываем примерно 3–10 секунд чистой речи.
3. При необходимости обрезаем запись, нормализуем громкость и удаляем шум.
4. Нажимаем Transcribe или самостоятельно вводим точный текст, который произносится на записи.
5. Сохраняем результат через Save as Sample.
6. Переходим в Voice Clone и выбираем сохранённый голос.
7. Выбираем движок — например Qwen3-TTS, VibeVoice или Fish Speech.
8. Пишем совершенно новый текст и нажимаем Generate.

Готово — нейросеть генерирует новую речь на основе выбранного голосового образца.

А если собственного образца вообще нет, можно открыть Voice Design и просто описать нужный голос, например:

Мужчина, 35 лет, глубокий спокойный голос, слегка хриплый, уверенная манера речи.


ИИ попробует создать подходящий голос с нуля.

♎️ GitHub/Инструкция

🔥 По сути, это целая локальная AI-студия озвучки в одном интерфейсе:
🟢для роликов,
🟢подкастов,
🟢игр,
🟢персонажей,
🟢аудиоконтента и экспериментов с синтезом речи.

🙂 Лайф | 📲 Зеркало Max

#python #soft #github #нейросеть
  • 🔥 41
  • 👍 18
  • ❤ 12
More from @python2day
  1. Sep 24, 2026😎 Когда узнал, что зарабатываешь больше айтишников
  2. Sep 23, 2026🎬 ИИ научили снимать рекламные ролики одной командой /brag — open-source инструмент, скил…
  3. Sep 23, 2026🚀 Новый релиз: Provision OCR 0.9.3 Большое обновление системы распознавания документов, к…
  4. Sep 23, 2026😯 Наступил звездный час для инфоцыган Чувак наглядно показал разницу нейросетей против ре…
  5. Sep 21, 2026🤖 Будущее наступило старик В Сан-Франциско стартап REK устроил первый публичный поединок…
  6. Sep 21, 2026⚡️ Linecast — настоящая погодная станция, карта мира и планетарий прямо в терминале. Open-…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →