ГигаЧат научился понимать эмоции по голосу и находить нужные моменты в длинных записях
Сбер представил обновлённую нейросеть GigaChat Audio, которая теперь доступна в ИИ-помощнике ГигаЧат и в открытом коде для разработчиков. Новая модель обрабатывает аудиофайлы и голосовые сообщения без предварительного преобразования речи в текст, а также научилась распознавать интонацию и эмоции пользователя.
ГигаЧат теперь понимает, с какой эмоцией к нему обращаются — позитивной или негативной, и реагирует уместнее: мягче отвечает раздражённому пользователю или поддерживает настроение, если человек делится хорошей новостью. Модель способна обрабатывать записи длиной до трёх часов, находить нужные моменты в разговоре, пересказывать отдельные отрезки и делать саммари всей записи с таймкодами. Она также различает спикеров, что полезно для разбора совещаний и звонков.
👉 Подробности
❗️Мы в Max
Post #22355
286
