Это мультиязычная управляемая TTS-модель, которая умеет:
- стабильно клонировать голос
- генерировать длинные аудио
- точно управлять паузами
- работать с несколькими языками
Теперь MOSS-TTS-v1.5 официально поддерживается в
vLLM-Omni и SGLang-Omni, что делает её интересной не только для экспериментов, но и для более серьёзной инфраструктуры голосовых приложений.Модель разработала команда OpenMOSS-Team.
GitHub: https://github.com/OpenMOSS/MOSS-TTS
Hugging Face: https://huggingface.co/OpenMOSS-Team/MOSS-TTS-v1.5
ModelScope: https://modelscope.ai/organization/openmoss
