TGViewer
МИР РУССКОЙ МЫСЛИ МИР РУССКОЙ МЫСЛИ @mir_russkoi_mysli · 12.1K subscribers
Post #1595 997
Разговор о рисках ИИ все чаще упирается в сложную проблему: что происходит, когда система получает всё больше признаков самостоятельного действующего субъекта — планирует, использует инструменты и корректирует собственное поведение. О том, почему спор о безопасности ИИ нельзя сводить ни к алармизму, ни к чисто инженерной проблеме, — в комментарии доцента философского факультета МГУ Антона Кузнецова:
Заявления о рисках развития ИИ давно стали одним из модусов существования данной области и потому нередко воспринимаются скорее как маркетинг, нежели как выражение реальной обеспокоенности. Однако одно не исключает другого. В своём эссе от 12 сентября глава Anthropic Дарио Амодей указывает на два обстоятельства: растущую способность ИИ участвовать в создании систем следующего поколения (то, что он считает началом рекурсивного самоулучшения ИИ) и инцидент с Hugging Face, когда агенты OpenAI атаковали реальные системы и совершали действия, не предусмотренные задачей.

Эти обстоятельства показывают особенности проблематики безопасности ИИ. Часто говорят, что дело не в молотке, а в том, кто и как его применяет. Это верно. Но только до тех пор, пока «молоток» сам не начинает решать, как и какие действия ему осуществлять. Независимо от того, считаете ли вы системы ИИ «настоящими» агентами, а их решения — «настоящими» решениями, их существенное отличие заключается в том, что у них есть черты действующих субъектов: они планируют действия, используют инструменты, корректируют поведение и вступают во взаимодействие друг с другом. В настоящий момент, как подчёркивает Роман Ямпольский, не продемонстрировано ни одного способа, гарантирующего полный и устойчивый контроль над системой ИИ, превосходящей человека по своим когнитивным способностям.

Пока нельзя напрямую сделать вывод о реальной вероятности глобальной утраты контроля. Однако вопросы безопасности не решаются на основе чистой вероятности. Важно также понимать масштаб возможного ущерба и необратимость последствий. Например, вероятность авиакатастрофы мала, но масштаб и необратимость возможного инцидента оправдывают строгость регуляции. И напротив, вероятность запачкать одежду велика, однако незначительность возможного ущерба объясняет отсутствие сопоставимых мер «безопасности». В настоящее время надёжная эмпирическая оценка вероятности реализации рисков ИИ крайне затруднена в силу того, что сами риски не вполне конкретизированы, и в силу того, что пока, к счастью, история ИИ-катастроф небогата.

В этом смысле общая идея Дарио Амодея — привести скорость развития ИИ в соответствие со скоростью развития средств контроля — выглядит разумной и консервативной. Однако в отношении деталей всё уже не так однозначно. Если Сэм Альтман и Илон Маск выразили поддержку, то Марк Цукерберг и Дженсен Хуанг отвергли идею координированного замедления. Цукерберг считает, что конкуренция и юридическая ответственность уже создают у компаний достаточные стимулы самостоятельно обеспечивать безопасность. Хуанг, в свою очередь, полагает, что безопасность является инженерной проблемой и не требует замедления: компании должны не выпускать продукт, пока не уверены в его безопасности. Главное разногласие состоит в том, следует ли рассматривать последние инциденты как ранние признаки будущей утраты контроля или как серьёзные, но принципиально устранимые инженерные и организационные сбои.

Я бы сказал, что категория «замедления» проблемна сама по себе, как и общая идея координированной дружбы демократических государств против Китая, которая в итоге будет оправдывать (и уже оправдывает) отказ от любого реального замедления развития ИИ. В целом поиск некоторой рамки безопасности ИИ через создание чего-то вроде «тайного мирового правительства по ИИ» скорее в последнюю очередь будет связан с безопасностью. Однако здесь важнее сама дискуссия, нежели достижение одного суперрешения, которое пока представляется маловероятным и нереалистичным.


📎Подписывайтесь в MAX
  • 👍 4
  • ❤ 3
  • 🔥 3
More from @mir_russkoi_mysli
  1. Sep 20, 2026📌 Главное в политической экспертизе за неделю ♦️ «Выборы-2026: на финишной прямой» — иссл…
  2. Sep 19, 2026История с партнерством Nebius Аркадия Воложа и Palantir действительно заслуживает разговор…
  3. Sep 19, 2026Креативная экономика как часть технологического суверенитета ❗️Главная ставка Стратегии ра…
  4. Sep 18, 2026Саммит БРИКС в Нью-Дели 12–13 сентября показал важный сдвиг: объединение всё меньше выгляд…
  5. Sep 16, 2026Собрали для вас папку полезных Telegram-каналов по темам науки и образования: лекции, иссл…
  6. Sep 15, 2026Что почитать? Ваш надежный маяк в книжном океане. Канал «Книгосмотр. Больно, но по делу»:…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →