OpenAI выкатили gpt-realtime — голосовую модель формата «речь-в-речь». Она обрабатывает аудио напрямую, без промежуточной транскрибации в текст, поэтому отвечает быстрее и звучит естественнее; понимает десятки языков (включая русский) и умеет варьировать интонацию.
Где полезно: личный тренер произношения, живой голосовой ассистент, задачки с «инструментами» по команде — модель уверенно держит сложные инструкции.
Пробуем тут, нужен вход в аккаунт.
#Service | Подписаться
Post #4086
781

- ❤ 5
- 👍 2