Обнаружил интересную штуку, может и вам будет полезно
Используем API от Open AI и появилась задачка транскрибировать диалоги 2х человек и оценивать их по определенным критериям.
Делаю в n8n, стандартными ИИшными нодами, но у whisper(модели для распознания аудио) нет возможности разделять диалог на спикеров. Но оказалось, что даже 4о-mini хорошо обрабатывают полотно диалога и корректно разделяет его на спикеров.
Получается дешево и сердито)
Post #412
1.32K

- 👍 15
- ❤ 2
- 🔥 1