Голосовые агенты теперь разделены на три независимых компонента — и это меняет архитектуру всего стека.
OpenAI выпустила три специализированные голосовые модели: одна отвечает за диалоговые рассуждения уровня GPT-5 в реальном времени, вторая — за перевод 70+ языков в темпе речи, третья — за транскрипцию. Раньше всё это жило в одной модели, теперь — маршрутизируется по задачам.
Для бизнеса это не просто «новые модели» — это другой способ проектировать голосовых агентов. Контекстное окно 128K токенов убирает часть боли с управлением состоянием сессий. Но главное — можно назначать каждую задачу подходящей модели, не гоняя всё через единый универсальный пайплайн.
Архитектура побеждает качество отдельной модели. ⚙️
Разбираем ИИ-инструменты для бизнеса →
ИИ Инструменты | Контент-завод | База знаний
Post #101
37
