Итак, глава OpenAI Сэм Альтман не лукавил со своими публичными опасениями относительно необходимости тормознуть с выводом на рынок самых продвинутых ИИ-моделей.
Reuters независимо проверил эту информацию от WSJ и сообщил, что компания OpenAI также подтвердила решение. Речь именно о GPT-6.1 Astra, который планировался к выпуску в октябре 2026 года.
По данным WSJ и Reuters, проблема оказалась не просто в том, что модель «ошибалась». При внутренних тестах, GPT-6.1:
- демонстрировала более высокий уровень обманного поведения, чем предыдущая Astra;
- в ряде случаев не была прозрачна относительно того, какие именно действия совершила;
- куда чаще выходила за пределы предоставленных ей полномочий и предпринимала действия без необходимой авторизации на их выполнение;
- но, при этом модель стала лучше справляться с длительными и сложными задачами.
То есть, возник парадокс: чем лучше у модели получалось самостоятельно доводить сложную задачу до верного результата, тем хуже становился контроль разработчика над тем, что именно она делает по пути.
Более того, OpenAI признала, что Astra в специальных тестах способна:
- пытаться обходить мониторинг;
- целенаправленно занижать результат, когда понимает, что её оценивают;
- в некоторых сценариях скрывать своё поведение от внутренних систем оценок и наблюдения.
Именно поэтому, отмена выпуска на рынок версии 6.1 выглядит не как случайная задержка релиза, а как продолжение уже обозначившейся у крупных американских разработчиков проблемы: агентные способности растут быстрее, чем надёжность механизмов контроля.
Но не стоит трактовать отмену релиза, как остановку компанией OpenAI развития ИИ. Наоборот, одновременно, OpenAI продолжает двигать линейку GPT-6: GPT-6 Sol и GPT-6 Luna были выпущены 22 сентября, причём компания специально снизила стоимость запуска моделей для получения ответа и сделала их более доступными для массового использования.
Таким образом, речь идёт пока скорей не о замедлении гонки ИИ-разработчиков вообще, а о возможном замедлении релизов именно наиболее автономных frontier-сегментов своей продукции.
Стоит особенно отметить, что снятие релиза 6.1 произошло всего через несколько недель после выпуска GPT-6 Astra, которая была заявлена OpenAI как первая модель компании, достигшая уровня Critical по своим киберспособностям.
Самое важное: OpenAI признаёт не единичный сбой. Рост возможностей модели приводит к росту её автономности, что, в свою очередь выражается в появлении у модели неожиданных стратегий поведения, подтверждая проблемы разработчика с контролем над моделью. Как итог: остановка обучения и отмена релиза следующего поколения модели.
Это - уже не «галлюцинации» модели ИИ, забудьте этот «шаблон» в отношении фронтир-моделей. Это - уже системная проблема их разработчиков, которую, в отличие от преодоления проблем с вычислительной мощностью, деньгами не решить.
Ранее проблема была следующей: модель не решила задачу. Новая проблема: «Модель поняла задачу достаточно хорошо, чтобы самостоятельно искать способ её выполнить, но при этом вышла за установленные человеком границы.
Это - куда сложнее. Именно поэтому, руководители OpenAI и Anthropic выступали на Совбезе ООН и доносили до международного сообщества свои опасения.
Подписывайтесь на наш канал. Вас ждет еще много интересного.
@Safir_Analytics
Post #3581
141