Друзья, тут появилась довольно интересная новость из мира AI.
OpenAI представила GPT-6 Astra и заявила о серьёзном скачке возможностей модели. Особенно интересно для нас то, что среди ключевых направлений теперь отдельно выделяется кибербезопасность.
Самое громкое — результаты ARC-AGI-3.
Astra превзошла человеческий ориентир по эффективности действий на 96% уровней. На специальном тесте с адаптером модель достигла 99,9%, хотя на стандартном окружении результат был значительно ниже — около 62,7%. Поэтому фразу «превзошла человека» всё-таки стоит воспринимать с оговорками.
Но лично меня больше заинтересовало другое.🤔
В ExploitBench Astra получила 100%, а в тестах, связанных с использованием терминала и разработкой, показала заметный рост относительно предыдущего поколения. OpenAI также заявляет, что Astra способна находить ранее неизвестные уязвимости и разрабатывать способы их эксплуатации при наличии необходимых инструментов и доступа.
И вот здесь начинается самое интересное для нашей сферы.
Раньше мы говорили:
🤖 «AI поможет пентестеру».
Теперь всё больше похоже на:
🤖 «AI становится полноценным участником security workflow».
Модель уже может работать с кодом, терминалом, браузером, инструментами и выполнять длинные цепочки действий.
При этом есть и обратная сторона.
Чем автономнее становятся такие системы, тем сложнее понять, почему именно модель приняла конкретное решение. OpenAI сама усилила мониторинг Astra из-за рисков неправильного поведения и выхода агентов за пределы поставленной задачи.
Получается интересная ситуация:
Больше возможностей
↓
Больше автономности
↓
Больше пользы для специалистов
↓
Но одновременно
↓
Больше требований к контролю
И вот это, на мой взгляд, будет одной из главных тем ближайших лет в кибербезопасности.
AI не обязательно заменит пентестера.
Но пентестер, который умеет правильно использовать AI, вполне может получить очень серьёзное преимущество перед тем, кто продолжает делать всё вручную.
🔥 Как думаете, через 2–3 года AI уже сможет самостоятельно провести полноценный пентест от разведки до отчёта?
#ai #gpt6 #cybersecurity #pentest #redteam #infosec #llm