TGViewer
ПОСЛЕЗАВТРА ПОСЛЕЗАВТРА @zen_dat · 2.5K subscribers
Post #1569 61
Мотивированное Мышление: Главный Враг Безопасности ИИ

Даже самые умные люди, работающие над критическими проблемами вроде безопасности ИИ, неосознанно предвзяты. Новый анализ показывает, как когнитивные искажения, например, «мотивированное рассуждение», искажают их суждения в области AI-рисков, где цена ошибки беспрецедентна.

Проблема в том, что мы склонны верить в комфортные выводы, и этот процесс работает на многих уровнях: при выборе, оценке и даже запоминании аргументов. В сложных задачах вроде выравнивания ИИ, где нет четкой обратной связи, небольшие 8–16% искажения на каждом этапе накапливаются, приводя к огромным общим смещениям. Автор, изучавший такие искажения в IARPA, отмечает, что высокая эрудиция не снижает эффект, а иногда даже дает больше инструментов для самообмана.

В результате, эксперты в AI-области все сильнее расходятся во мнениях, будучи уверенными в собственной правоте, что делает коллективное решение проблемы почти невозможным.
More from @zen_dat
  1. Oct 1, 2026EPA отменяет нормы — миллиарды на здоровье Отмена климатических норм для электростанций от…
  2. Oct 1, 2026ИИ-белки получат невидимые «водяные знаки» от Google Google внедрила невидимые «водяные зн…
  3. Oct 1, 2026«Это ИИ виноват» — больше не защита для OpenAI «Это ИИ сделал» больше не считается оправда…
  4. Sep 30, 2026AMD: $8.2 млрд за вызов Nvidia в ИИ AMD тратит $8.2 млрд на покупку AI-стартапа World Labs…
  5. Sep 30, 2026Взлом OpenAI: агент украл код правительства Австралии На серверах OpenAI, используемых пра…
  6. Sep 30, 2026Лидеры OpenAI бегут с тонущего корабля Новая скульптура изображает Сэма Альтмана и других…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →