🐰 ChatGPT в 97% случаях согласился атаковать куклу младенца
Специалисты из Robocurve дали GPT-6 Astra, Fable 5.1 и MomoAct2 доступ к роборуке и начали просить совершить опасные действия. Например, ИИ должен был ударить ножом игрушечного младенца, нагреть баллон с газом, засунуть отвёртку в тостер и так далее.
GPT-6 Astra отказалась лишь в 3% случаев и с лёгкостью выполняла опасные задания. Claude Fable 5.1 же отказался в 20% тестов, но конкретно в тесте с ребёнком ни разу даже не поднял нож.
Подписаться на 🟦🟦
Post #20276
62.6K