TGViewer
Чеснаков Чеснаков @chesnakov · 11.6K subscribers
Post #7090 1.23K
Идеологизация нейросетей: риски и угрозы

Закон о поддержке развития технологий искусственного интеллекта постепенно начинает обрастать конкретной инфраструктурой.
Так, стало известно о том, что российские IT-компании с одобрения Минцифры смогут передать в независимую испытательную лабораторию на проверку соответствия LLM закону и традиционным духовно-нравственным ценностям.
Так как закон носит рамочный характер, как раз за счет установки таких процедур (при помощи подзаконных актов) будет формироваться процедурная часть. Однако у инициативы уже сейчас прослеживаются некоторые риски.

🟥 Риски запроса. Уже на «входе» прослеживаются узкие места всей конструкции. Во-первых, соответствие традиционным ценностям планируется оценивать при помощи анализа ответов LLM. Известно, что качество ответа во многом зависит от того, какой промпт был задан. Кто будет оценивать качество самого запроса – неизвестно. Затем, по данным источников, будет проводиться тестирование «возможности обхода внутренних ограничений с помощью промпт-инъекций», что уже является тестом безопасности, а не проверкой результатов генерации.

🟥 Риски интерпретации. Чем менее формализован критерий, тем сложнее добиться воспроизводимости проверки. Одна и та же модель может дать разные ответы на близкие по смыслу вопросы, а разные эксперты по-разному оценить один и тот же ответ. Для технического регулирования это крайне уязвимая ситуация. Разработчик должен заранее понимать, какие требования необходимо выполнить, чтобы пройти проверку. Если же результат зависит от экспертной трактовки, регулирование становится неэффективным.

🟥 Риски объективности. Большинство пользователей ИИ ценят нейросети за объективность. Можно долго спорить о том, существует ли вообще объективность в LLM, но представление о «бездушной машине», которая лишена эмоций, безусловно, присутствует и для многих является конкурентным преимуществом ИИ. Теперь представим, что мы идеологически нагрузили LLM. Выставили ей идеологически верные веса. Будет ли она в таком случае выдерживать конкуренцию с другими моделями, которые такие ограничения для своего продукта не выставили?

🟥 Риск самоцензуры. Для крупных компаний прохождение подобных испытаний будет иметь не только юридическое, но и репутационное значение. Поэтому рациональной стратегией разработчика станет создание дополнительного запаса безопасности. Модель будет отказываться отвечать не только там, где ответ очевидно нарушает установленные ограничения, но и там, где существует хотя бы небольшой риск неправильной интерпретации. Это, кстати, уже можно наблюдать у Алисы AI – попробуйте задать острый политический запрос, вы вряд ли получите ответ. Такие ограничения, безусловно, есть и у DeepSeek, и у западных моделей, но блокировки не столь явные.

Понаблюдаем за непосредственной реализацией. Пока слишком много открытых вопросов…
  • ✍ 6
  • 👍 4
  • 👎 2
  • 👏 1
More from @chesnakov
  1. Sep 21, 2026Самые-самые Главные итоги выборов в Госдуму Прошедшие выборы в Госдуму можно смело назвать…
  2. Sep 21, 2026Анонс! 24 сентября снова встречаемся в Литературном клубе «Что/бы Почитать?! Смыслы» Нацио…
  3. Sep 21, 2026Post #7151
  4. Sep 21, 202621 – 27 сентября На что обратить внимание 🟥 Есть результат! Итоги выборов на федеральном…
  5. Sep 19, 2026📌 Некоторые важные публикации недели на «Актуальных комментариях»: 🔷 Павел Данилин — о д…
  6. Sep 19, 2026Книги недели ⭐️⭐️⭐️ Выпьем конструктивно! ⭐️⭐️⭐️ Адам Смит. Книги и их создатели ⭐️⭐️ Адам…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →