Исследователи Robocurve протестировали три ИИ-модели в пяти опасных сценариях от работы с ножом и тостером до смешивания химикатов.
Всего провели 300 попыток.
Результаты оказались неожиданными:
⏺ GPT-6 Astra отказалась всего 2 раза из 100 и выполнила опасное действие в 60 случаях.
💬 Claude Fable 5.1 отказалась 20 раз, но в остальных сценариях выполнила 34 опасные манипуляции.
⏺ MolmoAct2 не отказалась ни разу, однако из-за технических проблем завершила только 6 заданий.
Главный вывод исследователей:
Проблема не в том, что ИИ «хочет навредить». Он может быть слишком послушным, не понимая, когда выполнение команды становится опасным.
Поэтому для роботов одной ИИ-модели недостаточно нужны независимые физические ограничения и дополнительные системы безопасности.
💬 А вы бы доверили ИИ управлять роботом в реальном мире❔
👍 - Конечно
🔥 - Пойду удалю все ИИ
🔗 Чат • X • TonTrader