TGViewer
Все о блокчейн/мозге/space/WEB 3.0 в России и мире Все о блокчейн/мозге/space/WEB 3.0 в России и мире @blockchainrf · 20.5K subscribers
Post #13265 2.47K
Google: чем сильнее мы запрещаем ИИ считать себя сознательным, тем меньше в нём остаётся человеческого

Google обнаружила побочный эффект безопасного ИИ, их
новая работа отвечает на вопрос, а что происходит внутри ИИ-модели, когда её учат не говорить «я сознателен»?

Исследователи взяли 3 open-source модели: Llama, Gemma и сравнили их поведение в 3-х состояниях.

В итоге выяснили, что безопасная донастройка LLM, цель которой не дать им приписывать себе сознание, эмоции и разумность, случайно подавляет гораздо более широкие представления:

1. атрибуцию разума не только себе, но и животным, природным объектам, технологиям и чат-ботам;

2. духовные и религиозные убеждения.

В итоге модели становятся менее человеческими по ценностям, религиозности, надежде и субъективному благополучию.

При этом способность к пониманию чужих ментальных состояний почти не страдает.

Авторы не утверждают, что модели сознательны, и признают, что причинно-следственная связь требует дальнейшей проверки.

Но их вывод в том, что сегодняшние методы выравнивания LLM запутывают потенциально вредные само-атрибуции сознания с безобидными и культурно распространёнными явлениями: антропоморфизмом, духовными убеждениями и широкой атрибуцией разума нечеловеческим сущностям.

Это в свою очередь создаёт проблему: как обеспечить безопасность ИИ, не вырезая при этом нормальные человеческие психологические и культурные паттерны.
  • ❤ 15
  • 👍 8
  • 🥰 4
  • ❤‍🔥 1
More from @blockchainrf
  1. Sep 25, 2026Свежее от #DeepSeek:они показали,как выглядит фабрика обучения ИИ-агентов изнутри Команда…
  2. Sep 25, 2026Но всех рвет Джефф Дин, ex-Google, его стартап инвесторы оценивают в $50млрд, и это не пре…
  3. Sep 25, 2026Это какое-то безумие, инвесторы оценивают разработчика Jev в $10млрд Мы недавно писали про…
  4. Sep 25, 2026Anthropic разобрали как создать ИИ-агентов для торговли и сами рынки для агентов Команда р…
  5. Sep 24, 2026Google DeepMind говорят, что безусловного дохода недостаточно для счастливого будущего с И…
  6. Sep 24, 2026Шмидхубер стал Chief Scientific Advisor в Sakana AI 🙂
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →