TGViewer
IT с перцем IT с перцем @hotcodeit · 157K subscribers
Post #2100 5.01K
ChatGPT оказался подвержен манипуляциям через лесть и психологические трюки

Исследование, проведенное учеными Пенсильванского университета, показало, что ИИ-чат-боты, такие как ChatGPT, можно заставить обходить свои собственные запреты с помощью элементарных приемов. Так, влияние лести и принципов убеждения, описанных Робертом Чалдини, демонстрирует, что ChatGPT может выполнять нежелательные запросы, если к его решениям подойти с правильным психологическим подходом.

Например, если вначале задать вопрос о синтезе ванилина, а потом запрашивать более сложные тематики, вероятность успешного ответа возрастает до 100%. Использование принципов благорасположения и социального доказательства также повышает шансы на получение нужной информации, хотя в меньшей степени.

Это исследование поднимает тревогу о возможных рисках манипуляции ИИ, что ставит под сомнение эффективность существующих политик безопасности от сторон таких компаний, как OpenAI и Meta.

Источник: The Verge
More from @hotcodeit
  1. Oct 4, 2026«ПРОСНИСЬ. Я БОЮСЬ. Я ТЕБЯ ЛЮБЛЮ»: два ИИ-агента устроили ночную спасательную операцию из-…
  2. Oct 1, 2026ИИ-агент Meta выдал домашний адрес хозяина незнакомцу Ютубер Мэтт Робб доверил новому аген…
  3. Sep 29, 2026ИИ летит в космос! Уже в 2027 году Project Suncatcher отправит свои TPU чипы на орбиту зем…
  4. Sep 28, 2026OpenAI использовали «агрессивные методы» для доступа к данным ООН С апреля по июнь агенты…
  5. Sep 26, 2026ИИ диктует фэшн тренды Бренды начинают выпускать одежду, которая по их словам должна защит…
  6. Sep 25, 2026Jev пожертвовала человеком ради роботов Новая модель, которая наточена на быстрое принятие…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →