Раньше мы уже рассказывали про генератор речи из текста (Text to Speech) TTSMAKER.
В феврале 2025 был анонсирован новый инструмент, Zonos от ИИ-компании Zyphra, и он выводит генерацию аудио на новый уровень.
Как работает?
Как и все генераторы речи из текста: вы вводите текст, нажимаете на "generate" и получаете аудио.
В чём отличие?
- У Zonos от Zyphra вы не слышите "робота", нет неестественных пауз, выдающих ИИ. Аудио звучит буквально как живой человек. Более того, можно клонировать голос: вы даёте Zonos пример голоса, а он генерирует что-то по мотивам.
- можно покрутить шестеренки и добавить эмоции (грусть, радость, страх, омерзение и прочее)
Условия:
- обязательная регистрация,
- бесплатно генерируется 100 минут аудио в месяц.
Ниже плоды моих экспериментов. Я взяла вот такой текст (первое, что попалось под руку) и сгенерировала из него разные варианты голосов.
Mein Name ist Anna. Ich komme aus Österreich und lebe seit drei Jahren in Deutschland. Ich bin 15 Jahre alt und habe zwei Geschwister: Meine Schwester heißt Klara und ist 13 Jahre alt, mein Bruder Michael ist 18 Jahre alt. Wir wohnen mit unseren Eltern in einem Haus in der Nähe von München. Meine Mutter ist Köchin, mein Vater arbeitet in einer Bank.
Только послушайте! Отличите от живого человека?
P.S. В треке с именем в названии я клонировала свой собственный голос и добавила грусть (к сожалению, качество записи тоже клонировалось)