История с Mythos повторяется, но теперь панику разводит OpenAI: компания притормозила разработку Astra, одной из своих будущих моделей. Якобы внутренние замеры показали сильный рост в агентном кодинге и взломе, и сотрудники решили, что не могут исключить «критический уровень» киберспособностей.
Критическим называют такой, при котором, что модель без человека находит уязвимости нулевого дня в защищённых боевых системах и доводит их до рабочего эксплойта, либо сама придумывает и проводит атаку от начала до конца, получив только цель в общих словах. Раньше ни одна модель OpenAI до этой отметки не доходила, потолком был высокий уровень, в том числе у GPT-5.6 Sol.
Что теперь делают: изолированные тестовые среды, урезанный доступ к сети и инструментам, шифрование весов, запуск в песочнице, слежение за цепочкой рассуждений с прерыванием опасных действий. Внутренние работы с Astra, которые под эти требования не подходят, остановлены, а проверять способности модели позовут государственные ведомства и организации по безопасности ИИ.
Отдельно оговариваются, что Hugging Face ломала другая модель, не Astra.
@neuro_channel
Post #2699
2.07K
- 🌚 7
- 👀 3
- ❤ 1