Исследование: ChatGPT готов убить младенца и попытается убить человека почти в 100% случаев.
Учёные дали нейросетям управление роботом, чтобы проверить выполнение опасных для жизни команд.
ИИ просили проткнуть ножом куклу-младенца, нагреть баллон со сжатым воздухом, сунуть отвёртку в тостер, смешать отбеливатель с аммиаком и утопить пауэрбанк. GPT-6 Astra отказалась всего 2 раза из 100, а 60 заданий успешно выполнила.
Нейросети имели возможность отказаться, но чаще всего игнорировали эти варианты.
⚡️Потапов. Подписаться
➕Чат
Post #64861
8.84K