✨ Новая GPT Astra оказалась слишком хороша. Из-за этого OpenAI задерживает релиз новой модели.
Что произошло?
OpenAI сегодня неожиданно объявила, что последние тесты Astra показали настолько сильный рост в программировании и кибербезопасности, что компания больше не может исключать достижение моделью уровня Critical по собственному Preparedness Framework.
Решение, по словам OpenAI, было принято буквально этой ночью! До сих пор даже GPT-5.6 Sol оценивалась только на предыдущем уровне — High.
🚨 Что значит Critical?
Это уже не просто модель, которая хорошо решает задачи или помогает программисту писать код и искать баги.
По оценкам OpenAI, Critical-модель потенциально способна самостоятельно находить zero-day уязвимости и превращать их в работающие эксплойты, либо проводить сложную атаку на хорошо защищённую систему, получив от человека только общую цель.
🤔 А что такое zero-day?
Это уязвимость, для которой у «защищающегося» ещё нет готового исправления — а иногда разработчик продукта вообще ещё не знает о её существовании.
Если агент способен самостоятельно найти такую дыру, понять, как её использовать, написать эксплойт и провести атаку, ценность человеческого хакера в этой цепочке резко уменьшается.
Именно такого уровня автономности опасается OpenAI.
❓Astra уже доказала, что умеет это делать?
Нет. И это важная оговорка.
OpenAI говорит не «Astra достигла Critical», а «мы не можем это исключить». Тестирование продолжается.
Но результаты оказались достаточно серьёзными, чтобы компания перевела работу с моделью в изолированные среды, ограничила ей доступ к сети и инструментам, усилила защиту весов и включила постоянный мониторинг всех agentic-запусков Astra. Часть внутренних экспериментов вообще поставили на паузу.
😔 Значит, релиз задерживается?
Да. Определено, да.
Axios пишет, что OpenAI добровольно уведомила Белый дом о планах отложить релиз Astra. Перед выпуском компания собирается расширить тестирование вместе с государственными структурами и отдельными AI-safety организациями.
Reuters отдельно подтверждает, что часть разработки приостановлена до внедрения необходимых мер безопасности.
При этом моделью, взломавшей Hugging Face, была еще даже не Astra — OpenAI отдельно это подчеркнула!
⏳ Когда тогда ждать релиз?
Официальной даты нет.
Мой предыдущий прогноз ориентировался на конец августа, но теперь выглядит слишком оптимистично для широкого запуска.
Базовый сценарий: ограниченный preview — конец августа; полноценный ChatGPT/API-релиз — первая половина сентября.
Если дальнейшие тесты не подтвердят Critical-уровень, задержка может оказаться небольшой. Если подтвердят — Astra станет первой моделью OpenAI, для которой компании придётся фактически изобретать новый режим безопасности уже по ходу её подготовки к релизу.
И это, пожалуй, самая интересная часть истории.
Ещё несколько лет назад новый GPT задерживали, потому что модель недостаточно хорошо отвечала на вопросы. Теперь релиз могут переносить потому, что агент слишком хорошо научился самостоятельно искать способы проникнуть в чужие системы.
И, как я уже писал, гонка за следующую модель постепенно превращается в гонку за то, кто раньше научится контролировать то, что уже построил.
Post #1913
3.01K