🚀 Step-Audio-R1.1 от StepFun AI только что поставил новый SOTA на лидерборде Artificial Analysis по Speech Reasoning! 🏆
И это не просто «чуть лучше» - модель обошла Grok, Gemini и GPT-Realtime, показав 96.4% точности.
Почему это реально мощно:
✅ Native Audio Reasoning (End-to-End) - рассуждает прямо в аудио, без костылей
✅ Audio-native CoT (Chain of Thought) - цепочка рассуждений «родная» для аудио
✅ Real-time streaming inference - работает в режиме стриминга, почти как живой диалог
✅ FULLY OPEN SOURCE - полностью открыта 🔥
Короче: это один из тех релизов, после которых становится понятно - аудио-ИИ выходит на новый уровень.
🌟 Demo: https://modelscope.cn/studios/stepfun-ai/Step-Audio-R1
🤖 Model: https://modelscope.cn/models/stepfun-ai/Step-Audio-R1.1
Post #1731
2.18K

- 👍 5
- ❤ 2
- 🔥 2