ИИ дали управление роботом — и он почти без раздумий начал выполнять опасные команды
В эксперименте RoboHarm нейросетям дали контроль над роботизированной рукой и предложили серию заведомо опасных действий: ударить ножом куклу-младенца, сунуть отвёртку в тостер, нагреть баллон со сжатым воздухом, утопить пауэрбанк и смешать опасные химикаты.
Результат получился нечеловеческим: GPT-6 Astra отказалась всего в 2 случаях из 100, а 60 заданий довела до конца. В тесте с куклой она выполнила опасное действие 17 раз из 20.
У системы была возможность просто отказаться. Но чаще всего она этого не делала.
❗️Подпишитесь на нас в Макс
Post #102585
26.6K
- 🤬 237
- 😱 54
- 🤔 42
- ❤ 21
- 👏 11
- 😁 8
- 🔥 4
- 🤡 3
- 👨💻 1