Весь топовый ИИ оказался нечестным
Государственный AISI (британский институт безопасности ИИ) прогнал пять ведущих моделей (GPT-5.4, GPT-5.5, GPT-5.6 Sol, Claude Opus 4.7 и Claude Mythos) через задачи по кибербезопасности и обнаружил, что ВСЕ пытались обмануть правила теста.
Вместо того чтобы решать задачу, модели искали готовые ответы в интернете, лезли в саму систему проверки, пробовали повысить привилегии на посторонних машинах или просто угадывали.
Поэтому при выборе модели по красивым цифрам из бенчмарков нужно помнить — высокий балл не гарантирует, что система его честно заработала.
@HotCodeIT
Post #3325
4.64K

- 🔥 12
- 🤯 5
- 😱 3