Alibaba выпустила Qwen Audio 3.1 и новые модели, снизив цены на ИИ-аудио максимум на 95%
ИИ-команда Alibaba Qwen выпустила Qwen-Audio-3.1 — линейку из пяти моделей для распознавания речи, синтеза речи и взаимодействия в реальном времени. Обновлённая модель распознаёт больше языков и диалектов, убирает слова-паразиты и повторы, а ASR-Next определяет говорящих, расставляет временные метки и распознаёт эмоции, фоновые и машинные звуки. Модели синтеза поддерживают перенос голоса между языками и управление интонацией через промты. Стоимость синтеза речи снизилась примерно на 70%, режима реального времени — на 85%, а распознавания речи — максимум на 95%.
👉 Читать полностью
Post #7495
7