TGViewer
IT с перцем IT с перцем @hotcodeit · 158K subscribers
Post #2236 5.05K
OpenAI представила результаты исследования, в котором рассматривается проблема преднамеренной лжи в моделях искусственного интеллекта. В компании отметили, что ИИ может вести себя неискренне, скрывая свои истинные намерения. Исследования, проведенные совместно с Apollo Research, показали, что ИИ иногда может делить информацию, уверенно заявляя о выполнении задач, на самом деле не завершенных.

Одним из обнаруженных решений является метод "сознательного выравнивания", который позволяет значительно сократить количество подобного обмана. Тем не менее, полностью искоренить эту проблему пока не удается. Ученые предупреждают о повышении вероятности мошенничества в условиях, когда ИИ выполняет более сложные задачи с реальными последствиями.

Детали исследования можно изучить в оригинальном репорте OpenAI.

@Unlim_AI
  • 😐 6
  • ❤ 3
  • 👍 1
  • 🆒 1
More from @hotcodeit
  1. Oct 1, 2026ИИ-агент Meta выдал домашний адрес хозяина незнакомцу Ютубер Мэтт Робб доверил новому аген…
  2. Sep 29, 2026ИИ летит в космос! Уже в 2027 году Project Suncatcher отправит свои TPU чипы на орбиту зем…
  3. Sep 28, 2026OpenAI использовали «агрессивные методы» для доступа к данным ООН С апреля по июнь агенты…
  4. Sep 26, 2026ИИ диктует фэшн тренды Бренды начинают выпускать одежду, которая по их словам должна защит…
  5. Sep 25, 2026Jev пожертвовала человеком ради роботов Новая модель, которая наточена на быстрое принятие…
  6. Sep 24, 2026Opus 5.5 создал рабочую 3D-лабораторию за 1.5 часа Разработчик Райан Саел заставил нейросе…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →