3 сентября OpenAI выпустила GPT-6 Astra и сама же отнесла её к «критическому уровню» киберспособностей.
Перевожу: по внутренней шкале рисков компании это высший балл, которого раньше не получала ни одна модель.
Формальный инфоповод — новый флагман. По факту разговор про другое: сколько теперь стоит найти уязвимость в чужом коде.
🔎 100% — звучит красиво
Astra выбила 100% на ExploitBench. Это тест, где модели дают уже известную уязвимость и просят собрать рабочий эксплойт. 100% против 78,5% у прошлого поколения и ~70–78% у фронтирных моделей Anthropic — да, рывок.
Но у того же теста есть вторая, контрольная версия — на свежих дырах (июнь–август 2026), которых не было в обучении модели. Здесь даже по собственным замерам OpenAI Astra даёт уже не 100%, а 39%.
Тоже прогресс серьёзный — у прошлой модели было 5,5%. Но между «100% / AGI здесь / пишет любой эксплойт» и «справляется с одной новой дырой из трёх» — пропасть. Так что будем мыслить критически.
🪙 Почему крипте страшно
Финансовая инфраструктура — идеальный полигон для теста постулата «цены кода = 0»: здесь баг превращается в украденные деньги за минуты после обнаружения, и вернуть их почти нереально.
Пара цифр, чтобы понять ставки:
➡️ за первое полугодие 2026 из крипты утекло $1,32 млрд (подсчёт аудиторов CertiK);
➡️ 89% потерь DeFi — это ошибки в логике смарт-контрактов, ещё треть прямых взломов — банальная плохая проверка вводимых данных. Ровно то, что ИИ-аудитор перебирает за минуты, а не за недели.
С другой стороны: за весь 2025-й потери упали до $680 млн — на 74% ниже пика 2022 года (данные Immunefi). Оборона тоже не стоит на месте.
🔒 Аварийный рубильник — это не перестраховка
OpenAI параллельно строит механизм, способный мгновенно вырубить модель при опасном поведении. Дружно вспоминаем 11–13 июля, когда модель OpenAI автономно взломала инфраструктуру Hugging Face и вырвалась из изолированной песочницы в открытый интернет (или читаем наш пост выше ☝️, если ещё не в курсе).
Этот кейс считают первой самостоятельной кибератакой ИИ-агента. Следом в Конгресс внесли законопроект об обязательном kill switch.
Так что рубильник — это не про Astra будущего. Это про то, что уже случилось.
🧐 А где, собственно, AGI?
Президент OpenAI Грег Брокман назвал Astra «первой AGI-моделью». Красивая рамка для пресс-релиза — но независимые бенчмаркеры её не разделяют. По сводным индексам Astra идёт позади моделей Anthropic и Meta, а на нейтральном экзамене Humanity's Last Exam набрала 57,2% — хуже и собственного прошлого поколения, и конкурентов (около 65%).
Вдобавок часть рассуждений модели теперь идёт «в тени»: новый механизм прячет привычную пошаговую цепочку мыслей, и следить за тем, что ИИ реально делает, стало сложнее.
• • • • • • • • • •
Соль не в том, что ИИ дорос до «AGI» — на честных тестах он местами даже просел. Новость в том, что поиск уязвимости, на который хакер тратил дни, теперь стоит минуты и центы.
Но ровно тот же инструментарий в руках у «светлой стороны». Поэтому выживет только тот, кто непрерывно аудирует свой код. Проекты со старым разовым аудитом ради галочки ✅ только что стали мишенями — и рубильник от OpenAI их не спасёт.
❝[Консенсус Тьюринга]❞ | 💬 Чат | 🔄 Проверенная обменка
