🎧 Модель аудиоразмышлений Step-Audio-R1
Step-Audio-R1 — первая аудиомодель, которая преодолевает проблему "обратного масштабирования", улучшая производительность при увеличении вычислительных ресурсов. Используя метод MGRD, модель фокусируется на акустическом анализе, что позволяет ей эффективно обрабатывать аудиоданные.
🚀 Основные моменты:
- Успешно решает проблему "обратного масштабирования"
- Сравнима с Gemini 3 по аудиобенчмаркам
- Инновационный подход к обучению через акустические особенности
- Доступна для использования на Hugging Face и ModelScope
📌 GitHub: https://github.com/stepfun-ai/Step-Audio-R1
@pythonl
Post #5284
6.71K

- ❤ 13
- 👍 2
- 🔥 2