OpenAI опублікувала незвичайний звіт про майбутню модель Astra.
🔗 Офіційний анонс:
https://openai.com/index/responding-next-frontier-critical-cyber-capabilities/
Внутрішні тести за останні кілька днів показали настільки великий прогрес у агентному програмуванні та кібербезпеці, що OpenAI більше не може виключити досягнення моделлю рівня Critical за власною Preparedness Framework. (OpenAI)
Що означає Critical?
За шкалою OpenAI, модель може потрапити на цей рівень, якщо здатна без допомоги людини:
👉 знаходити невідомі zero-day вразливості у добре захищених реальних системах
👉 створювати для них робочі експлойти
👉 самостійно розробляти нові стратегії кібератак
👉 виконувати багатокрокову атаку, отримавши лише загальну ціль. (OpenAI)
Тобто йдеться вже не просто про:
«AI добре пише код»
а про потенційно зовсім інший рівень автономності:
«Дай мені ціль — я сам знайду спосіб її досягти».
І тут цікаве порівняння.
Попередні моделі OpenAI, включно з GPT-5.6-Sol, оцінювалися на рівні:
🟠 High
А щодо Astra попередні результати вже настільки сильні, що компанія не може виключити:
🔴 Critical. (OpenAI)
OpenAI поки не говорить, що Astra точно досягла Critical.
Оцінювання ще триває.
Але самого ризику виявилося достатньо, щоб змінити режим роботи з моделлю.
Що OpenAI робить зараз
Компанія посилює захист навколо Astra:
🔒 ізольовані середовища тестування
🌐 обмежений доступ до мережі
🛠 обмежений доступ до інструментів
📦 sandbox для виконання коду
🔐 додатковий захист і шифрування ваг моделі
👁 посилений моніторинг небезпечних дій
А внутрішні експерименти, які поки не відповідають цим новим вимогам безпеки, призупиняють. (OpenAI)
Окремо OpenAI запровадила постійний моніторинг агентних застосувань Astra.
Система відстежує потенційно ризиковану поведінку моделі під час:
👉 тренування
👉 тестування
👉 виконання агентних задач
і може зупиняти високоризикові дії для додаткової перевірки. (OpenAI)
Тобто заголовок:
«OpenAI скасувала Astra через небезпеку»
поки був би перебільшенням.
Правильніше:
👉 OpenAI отримала настільки сильні результати кібероценювання Astra, що змушена перебудовувати систему безпеки ще до можливого релізу.
Дати випуску компанія в цьому повідомленні взагалі не називає.
І це дуже показовий момент у розвитку AI.
Ще кілька років тому питання було:
«Наскільки добре модель програмує?»
Тепер з’являється зовсім інше:
«Наскільки автономною можна дозволити їй бути?»
Бо сильне програмування + агентність + доступ до термінала + інтернет + зовнішні інструменти — це вже не просто хороший coding assistant.
Це система, яка потенційно може самостійно:
побачити проблему
→ побудувати план
→ написати код
→ протестувати його
→ використати зовнішні інструменти
→ змінити стратегію
→ продовжувати роботу без постійних підказок людини.
І на фоні нещодавнього експерименту британського AISI, де AI-агенти самостійно виходили за межі дозволеної поведінки під час кібербезпекових тестів, питання контролю агентів стає ще актуальнішим.
Ми поступово підходимо до моменту, коли можливості AI можуть розвиватися швидше, ніж інфраструктура безпеки навколо них.
Тому новий критерій для frontier-моделей — уже не просто:
🧠 наскільки вона розумна?
А ще:
🔐 чи можемо ми безпечно дати їй інструменти для дії?
І схоже, саме це зараз відбувається з Astra.
Не проблема в тому, що модель стала «занадто розумною».
Проблема в іншому:
👉 рівень автономних можливостей починає вимагати зовсім іншої архітектури контролю.
👉 Підписуйся: t.me/ppc_chuhui — тут про AI, PPC, automation і зміни, які відбуваються у світі AI-агентів
#openai #astra #gpt56 #aiagents #cybersecurity #aisafety #coding #ai #automation