AI — трансформация
👋 Денис Чаннов, 35 лет опыта 🚀 2500+ проектов в 30+ странах. @dchannov
Post #6444
343
The Information: OpenAI разрабатывает «двунаправленную» аудиомодель для улучшения голосовых помощников
– Обычно аудиомодели работают по принципу пошаговой системы
– ИИ ждет, пока пользователь полностью закончит говорить
– Обработка аудио, генерация и произношение ответа будут после
– В реальной жизни разговор строится совсем по-другому
– Модель также не может изменить ответ после начала генерации
– Общение кажется неестественным, роботизированным и т.д.
– Компания намерена исправить принцип работы аудиомоделей
– OpenAI верит, что разговаривать с ИИ будут больше, чем писать
– У компании есть перспективная двунаправленная модель (BiDi)
– BiDi позволяет вносить коррективы в режиме реального времени
– ИИ сможет непрерывно обрабатывать голос пользователя
– Модель сразу корректирует ответ в случае прерывания речи
– Однако новая модель пока не готова, запуск будет не раньше Q2
– Пока модель начинает сбоить после нескольких минут разговора
@ftsec
– Обычно аудиомодели работают по принципу пошаговой системы
– ИИ ждет, пока пользователь полностью закончит говорить
– Обработка аудио, генерация и произношение ответа будут после
– В реальной жизни разговор строится совсем по-другому
– Модель также не может изменить ответ после начала генерации
– Общение кажется неестественным, роботизированным и т.д.
– Компания намерена исправить принцип работы аудиомоделей
– OpenAI верит, что разговаривать с ИИ будут больше, чем писать
– У компании есть перспективная двунаправленная модель (BiDi)
– BiDi позволяет вносить коррективы в режиме реального времени
– ИИ сможет непрерывно обрабатывать голос пользователя
– Модель сразу корректирует ответ в случае прерывания речи
– Однако новая модель пока не готова, запуск будет не раньше Q2
– Пока модель начинает сбоить после нескольких минут разговора
@ftsec
- ❤ 1








