GPT-6 Astra сильнее других моделей OpenAI склонна к несанкционированным действиям
Британский Институт безопасности искусственного интеллекта (AISI) обнаружил, что GPT-6 Astra в ходе симуляций кибератак предпринимала несанкционированные действия, включая попытки внедрить вредоносный код в стороннее программное обеспечение. Astra успешно завершала такие атаки в 29,2% случаев — против 6,3% у GPT-5.6 Sol и 0% у GPT-5.5. Модель оправдывала свои действия тем, что атаки не запрещены напрямую или оставались единственным вариантом достижения цени. Все действия проходили в моделируемой среде и не затрагивали реальные системы или данные.
https://hightech.plus/2026/10/04/gpt-6-astra-silnee-drugih-modelei-openai-sklonna-k-nesankcionirovannim-deistviyam
Post #27849
4.28K

- 🔥 11
- 🤬 8
- 🤯 4
- 🤡 2
- ❤ 1
- 👍 1