🟦 Хорошие новости: SberDevices выложила в свободный доступ датасет Dusha.
Самый большой открытый датасет для распознавания эмоций в устной речи на русском языке можно скачать на GitHub.
✅ Общепризнанный бенчмарк для Speech Emotion Recognition (SER) — IEMOCAP — насчитывает всего лишь 5к семплов/12 часов аудио.
✅ Датасет Dusha — это 320к семплов/350 часов аудио. В дополнение к нему также опубликованы сырые данные разметки до агрегации и код для обучения бейзлайнов.
Распознавание эмоций уже используют в новом продукте Сбера — SaluteSpeech Insights.
SaluteSpeech Insights:
🔹оценивает эмоции клиента и оператора колл-центра по каждой фразе;
🔹 классифицирует диалоги как позитивные, нейтральные и негативные;
🔹 определяет более 300 различных речевых характеристик;
🔹 прогнозирует удовлетворённость клиентов (CSI) по каждому диалогу.
Подробности про датасет эмоций читайте в нашем блоге на Хабре.
Post #1142
2.68K

- 🔥 10
- ❤ 3
- 👍 2