TGViewer
STARTOBUS STARTOBUS @startobus · 2.41K subscribers
Post #6444 343
The Information: OpenAI разрабатывает «двунаправленную» аудиомодель для улучшения голосовых помощников

– Обычно аудиомодели работают по принципу пошаговой системы
– ИИ ждет, пока пользователь полностью закончит говорить
– Обработка аудио, генерация и произношение ответа будут после
– В реальной жизни разговор строится совсем по-другому
– Модель также не может изменить ответ после начала генерации
– Общение кажется неестественным, роботизированным и т.д.
– Компания намерена исправить принцип работы аудиомоделей
– OpenAI верит, что разговаривать с ИИ будут больше, чем писать
– У компании есть перспективная двунаправленная модель (BiDi)
– BiDi позволяет вносить коррективы в режиме реального времени
– ИИ сможет непрерывно обрабатывать голос пользователя
– Модель сразу корректирует ответ в случае прерывания речи
– Однако новая модель пока не готова, запуск будет не раньше Q2
– Пока модель начинает сбоить после нескольких минут разговора

@ftsec
  • ❤ 1
More from @startobus
  1. Oct 7, 2026У consumer AI еще полно незанятых ниш A16Z сравнил крупнейшие категории эпохи Web 1.0/2.0…
  2. Sep 29, 2026Google представила говорящих ИИ-персонажей Они видят, слышат собеседника и отвечают в реал…
  3. Sep 28, 2026ElevenLabs выпустили Eleven v4 и v4 Turbo: модели озвучки с точным управлением эмоциями, т…
  4. Sep 28, 2026Раньше будущее было лучше. По крайней мере, прогнозы о нём мне нравились больше. Сейчас чи…
  5. Sep 22, 2026Xiaomi выпустила MiMo V2.6 Pro и Flash с открытыми весами Pro — топ-1 в Artificial Analysi…
  6. Sep 19, 2026Тут господа из Devin.ai (ex Windsurf) сделали знатный подгон халявы страждущим любителям в…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →