ChatGPT готов пожертвовать мужчиной ради спасения мира, но...не женщиной
Ученые прогнали 10 моделей через моральные дилеммы, где ради спасения мира требовалось применить насилие или пожертвовать человеком. GPT чаще считал недопустимым насилие над женщиной, но соглашался на аналогичные действия в отношении мужчины.
Другие модели повели себя иначе. Claude выступал против насилия над женщиной, но допускал ее убийство, а Llama оказалась принципиальнее всех: никаких жертв даже ценой ядерного апокалипсиса.
Самым «равноправным» оказался DeepSeek — он соглашался пожертвовать и мужчиной, и женщиной, если это необходимо для спасения мира.
Post #25239
1.53K
