🤖 OpenAI выпустила GPT-6 Astra на фоне опасений по поводу контроля над ИИ
Модель стала первой у компании, достигшей «критического» уровня киберспособностей по внутренней системе оценки. В OpenAI отмечают, что при наличии нужных инструментов Astra способна самостоятельно находить ранее неизвестные уязвимости и разрабатывать способы атак на защищённые системы.
При этом компания усилила защиту модели: добавила мониторинг действий и рассуждений агентов, более строгую изоляцию и обязательные проверки безопасности перед использованием.
Отдельно OpenAI признаёт проблему с контролируемостью: в тестах Astra оказалось сложнее отслеживать письменный ход рассуждений модели, когда её специально просили уклоняться от мониторинга.
😀 Мы в МАХ
Post #6629
15