📞 Cekura Bench ⭐ 169 · 💬 17
«Бенчмарки голосовых AI-моделей на реальных звонках в режиме реального времени»
📌 Проблема:
Голосовые AI-модели быстро развиваются, но нет прозрачных и проверяемых данных для оценки их эффективности на реальных звонках. Это затрудняет выбор оптимального решения для бизнеса.
💡 Решение:
Cekura Bench предоставляет открытые и воспроизводимые бенчмарки для голосовых AI-агентов, тестируя их на 82 сценариях живых звонков с измерением надежности, точности данных, скорости ответа и стоимости.
✨ Почему этот продукт крут:
• Тестирование 9 голосовых моделей в одинаковых условиях на реальных звонках.
• Публичные транскрипты и метрики для полной прозрачности.
• Оценка по ключевым параметрам: надежность, точность, скорость, стоимость.
• Поддержка различных типов бенчмарков: голосовые агенты, STT, скоро TTS.
⚙️ Как это работает:
• Запускает голосовые модели в едином open-source агенте Pipecat.
• Проводит по 3 прогона на 82 сценариях звонков (например, запись в клинику).
• Анализирует успешность звонков по правильности результата и сохранению данных.
• Публикует детальные отчёты с транскриптами, вызовами инструментов и оценками.
💡 Для кого продукт:
Для разработчиков и компаний, которые хотят объективно сравнить и выбрать лучшие голосовые AI-модели для своих продуктов и сервисов.
🔗 Подробнее на Product Hunt
#SaaS #DeveloperTools #ArtificialIntelligence
Post #3238
2