InterSpeech 2025 — презентуем GigaAM
Сегодня мы представили нашу работу GigaAM: Efficient Self-Supervised Learner for Speech Recognition на сцене InterSpeech 2025 🔥
📌 Напомним, в статье мы предложили новый подход к self-supervised предобучению для распознавания речи (HuBERT-CTC) и показали:
• Лучший WER среди open-source моделей на русском языке (−50% к Whisper-large-v3)
• Подробные ablation studies: layers probing, data & model scaling
• Возможность дообучать модели под streaming/full-context режимы без повторного предобучения
📖 arXiv: https://arxiv.org/abs/2506.01192
👩💻 GitHub: https://github.com/salute-developers/gigaam
🐶 GitVerse: https://gitverse.ru/GigaTeam/GigaAM
✨ Для нас это очень важный шаг — GigaAM стал частью дискуссии на крупнейшей конференции по обработке речи в мире!
Post #37
5.25K

- 🔥 47
- 👏 16
- 👍 12
- ❤ 8
- 🗿 2