тибо — руководитель core products openai рассказал мэттью берману, как компания видит следующую форму персонального ai. несколько сильных поинтов из 44-минутного разговора.
— за год до chatgpt в deepmind уже существовал внутренний lm chat с похожей идеей. модели казались особенными, но deepmind плохо умел превращать исследования в публичные продукты. соттьё вынес оттуда два урока — командам нужна свобода быстро запускать идеи и общая планка качества, которая не даёт продукту превратиться в набор несвязанных функций.
— нынешние coding agents пока требуют от пользователя обслуживать skills, память, сабагентов и локальную среду. следующая версия должна знать человека, его цели и контекст команды, сама выбирать нужные инструменты, предлагать действия и сохранять цельность взаимодействия.
— ноутбук спроектирован под скорость одного человека. агент способен одновременно работать с десятками приложений, поэтому вычисления будут всё чаще уходить в облако. с ускорением моделей новым ограничением становятся tool calls, сеть и остальные части агентного стека.
— рабочий процесс тоже изменится. вместо запуска 10–15 медленных агентов и постоянного переключения контекста появится синхронная работа голосом, когда идеи, прототипы и отчёты собираются почти в реальном времени. продукту придётся бережно управлять вниманием человека и понимать, какой результат показать сейчас, а какой отложить.
— тибо разделяет два направления. персональный агент работает рядом с человеком и адаптируется под него. автономные системы целиком ведут процессы вроде анализа продакшен-логов, исправления регрессий и закрытия уязвимостей, оставляя человеку подтверждение рискованных действий.
— chatgpt и codex объединяют из-за общей архитектуры будущего агента. под капотом будет один мультимодальный, voice-first harness для кода, исследований и повседневных задач. интерфейс должен динамически подстраиваться под конкретного человека. разработчик, дизайнер и пользователь без технического опыта смогут работать в одной системе и видеть разные уровни детализации.
— конечная форма такого продукта выглядит ambient. агент слышит интонацию, видит жесты и записи на доске, присутствует на общем canvas и позволяет голосом направлять создаваемый объект. высокая скорость особенно полезна в визуальной работе, где можно мгновенно получить несколько вариантов, выбрать направление и продолжить редактирование.
— сбросы лимитов codex появились как компенсация за сбои и неудачные обновления. решение не проходит через маркетинг или финансы. у тибо есть физическая кнопка, которой он может вернуть пользователям токены, когда считает это справедливым.
— более сильные модели уже применяют для оптимизации собственного inference-стека, cuda-ядер и продуктовой инфраструктуры. по словам тибо, обычный inference за три месяца ускорился примерно на 60%, а значительное увеличение пропускной способности уложилось в прежний вычислительный бюджет. он считает это ранней практической формой рекурсивного самоулучшения всей системы.
— ultra fast ускоряет генерацию в 10–14 раз. при множестве инструментов реальный выигрыш ближе к 3–4 разам. внутри openai режим используют при инцидентах и срочных проектах. тибо ожидает, что через один-два года близкая скорость станет массовой, хотя сверху всегда останется более дорогой уровень.
— ответ на тревоги вокруг ai оказался самой слабой частью интервью. тибо говорил об удешевлении интеллекта, широком доступе и пользе chatgpt в письме, здоровье и финансах. вопросы занятости и экологического следа остались без подробного ответа.
полное интервью