Большой момент для Soniox: сегодня запускаем Soniox Text-to-Speech.
Это серьёзный шаг вперёд. Soniox начинали с распознавания речи. Теперь, имея и распознавание, и синтез, мы становимся голосовой платформой для любого языка.
Soniox TTS заточен под самые сложные части генерации речи:
- Речь уровня носителя на более чем 60 языках
- Генерация без галлюцинаций
- Корректное озвучивание буквенно-цифровых последовательностей: числа, идентификаторы, адреса
- Правильное произношение имён и иностранных слов
- Стриминг с ультранизкой задержкой для приложений в реальном времени
Ценообразование простое: $0.70 за час сгенерированной речи.
Ключевое здесь — общий вектор: разработчики и компании могут работать с одним провайдером для базового голосового стека — распознавание речи, синтез речи, мультиязычный голос, инфраструктура реального времени, региональные деплои и соответствие требованиям.
Это важный шаг в переходе от провайдера распознавания речи к полноценной голосовой платформе для всех языков.
Голос становится базовым интерфейсом для софта. Для глобального использования он должен быть быстрым, точным, устойчивым и доступным на любом языке. Этим мы и занимаемся в Soniox.
Подробнее в блоге
👉 @PythonPortal
Post #5750
5.25K

- 😁 2
- ❤ 1