Google выпустила Gemini 3.8 Live и 3.8 Live Extended Thinking, голосовые модели, которые думают и говорят одновременно. Extended Thinking заняла первое место в Speech to Speech Quality Index у Artificial Analysis с 82,6 балла и лучше всех доводит агентные задачи до конца: 68,6% на τ-Voice и 35,1% на банковском τ-Voice-banking от Sierra.
Главное отличие от прошлых Live-моделей в фоновой работе. Вызовы инструментов и API идут параллельно разговору, модель говорит «сейчас проверю» и продолжает беседу, а по ходу длинной задачи проговаривает прогресс. И это прям меняет опыт по сравнению с тем же GPT, попробуйте. Обычная 3.8 Live обрабатывает видеопоток почти в реальном времени и сама переключается между 97 языками посреди разговора.
Обе модели уже доступны в Gemini API и AI Studio, Extended Thinking ещё и в Gemini Live и в Workspace для подписчиков AI Pro и Ultra. На видео Extended Thinking превращает наброски и голосовые правки в React-компоненты.
@neuro_channel
Post #2890
1.68K
- ❤ 7
- 👍 2