OpenAI випустила GPT-Live-1 в API — голосових AI-агентів тепер можна перебивати
OpenAI відкрила розробникам GPT-Live-1 — голосову модель, яка вже працює в ChatGPT Voice.
Головна відмінність від попередніх голосових систем — модель одночасно слухає і говорить.
Тобто не потрібно чекати схеми:
ви сказали → замовкли → AI зрозумів, що репліка закінчилася → почав відповідати.
GPT-Live-1 працює в режимі full-duplex. Її можна перебити, зробити паузу, змінити думку посеред речення — модель продовжує стежити за розмовою в реальному часі. (OpenAI)
Ще одна важлива зміна — голос і міркування тепер можна розділити.
GPT-Live-1 веде сам діалог, а якщо потрібно щось складніше — пошук, робота з інструментами або глибше міркування — може передати завдання іншій моделі.
Наприклад, GPT-6 Astra.
Поки Astra думає або працює з інструментами, GPT-Live-1 може продовжувати розмовляти з користувачем. (OpenAI)
OpenAI також покращила:
— роботу з фоновим шумом
— розпізнавання пауз і тиші
— довгі голосові сесії
— телефонні дзвінки
— керування темпом, тоном і стилем голосу.
У Full Duplex Bench GPT-Live-1 отримала результат на 30 процентних пунктів вище за GPT-Realtime-2.1. А в тестах Speak нова модель майже на 80% рідше перебивала учнів порівняно з попередніми turn-based системами. (OpenAI)
Модель уже доступна через API.
Ціна — $0,05 за хвилину голосової сесії, тарифікація посекундна. Backend-модель та інструменти оплачуються окремо. (OpenAI Developers)
Для бізнесу це насамперед новий рівень голосових агентів: підтримка клієнтів, бронювання, call-центри, продажі та інші сценарії, де AI має не просто озвучувати текст, а нормально вести живу розмову.
OpenAI — GPT-Live-1 в API
#openai #gptlive #ai #voiceai #aiagents #api #automation #технології
Post #502
50