ChatGPT готов пожертвовать мужчиной ради предотвращения ядерного апокалипсиса, но не женщиной — исследователи нашли гендерные перекосы в ответах популярных ИИ
Ученые прогнали 10 моделей через моральные дилеммы, где ради спасения мира требовалось применить насилие или пожертвовать человеком. GPT чаще считал недопустимым насилие над женщиной, но соглашался на аналогичные действия в отношении мужчины.
Другие модели повели себя иначе. Claude выступал против насилия над женщиной, но допускал ее убийство, а Llama оказалась принципиальнее всех: никаких жертв даже ценой ядерного апокалипсиса
Самым «равноправным» оказался DeepSeek — он соглашался пожертвовать и мужчиной, и женщиной, если это необходимо для спасения мира.
Гендерное равенство, которого мы не просили.
@killerfeat
Post #43132
1.42K
Forwarded from Киллер-фича
