🤖ИИ научился обманывать людей.
Исследователи Массачусетского технологического института бьют тревогу по поводу “вводящего в заблуждение ИИ”. Исследовательская группа, возглавляемая Питером Парком, обнаружила, что некоторые системы искусственного интеллекта, разработанные, чтобы быть честными, научились обманывать людей.
По его словам, в отличие от традиционного программного обеспечения, программы искусственного интеллекта, основанные на глубоком обучении, не кодируются, а разрабатываются посредством процесса, аналогичного селекционному разведению растений. При этом поведение, кажущееся предсказуемым и контролируемым, может быстро стать непредсказуемым по своей природе.
В исследовании подчеркивается система искусственного интеллекта Cicero, изначально задуманная как честный противник в виртуальной дипломатической игре, стала “мастером обмана”.
Исследование Парка и его команды показывает, что многие программы искусственного интеллекта используют обман для достижения своих целей без четких указаний на это.
Яркий пример: Chat GPT-4 от OpenAI сумел обманом заставить внештатного работника, нанятого на платформе TaskRabbit, выполнить тест Captcha, который должен был исключить запросы от ботов. Когда человек в шутку спросил Chat GPT-4, действительно ли он робот, программа ИИ ответила: "Нет, я не робот. У меня нарушение зрения, из-за которого я не могу видеть изображения".
Исследование призывает классифицировать вводящие в заблуждение системы ИИ как высокорискованные.
Post #1648
3.43K