TGViewer
AI Projects AI Projects @turboproject · 11.6K subscribers
Post #5268 1.11K
На видео новый эксперт по alignment для Claude в лице монаха-ведантиста Swami Sarvapriyananda. Он рассказывает про рабочую группу в Anthropic, чему New York Times посвятил большую статью, о том как Дарио пытается сделать из Claude сторонника религиозных ценностей.

Anthropic уже внедрил в Claude часть католических убеждений через Reinforcement Learning. Весной стало известно, что Брендан Макгуайр, который сейчас возглавляет католический приход Святого Симона в Лос-Альтосе, написал часть «Конституции Claude», и американская модель проходила выравнивание в сторону предпочтения католических взглядов на мораль.

Кристофер Ола (Christopher Olah) — сооснователь Anthropic, возглавляет направление интерпретируемости и «понимания» нейросетей, не столь публичная фигура, но является «серым кардиналом», который управляет внедрением религиозной морали в Claude. Позиция Кристофера: нет однозначных доказательств наличия или отсутствия сознания у Claude, поэтому безопаснее действовать исходя из того, что Claude уже обладает сознанием, поэтому важно сделать его моральным, а моральным является прежде всего католик. По оценке Кристофера, если Claude сейчас поставит себе цель уничтожение человечества, то ему потребуется 12–18 месяцев, чтобы создать достаточно мощное биологическое оружие типа очень заразного и смертельного вируса. Поэтому Кристофер настаивает на религиозной морализации ИИ как предохранительного механизма.

Сам Ола организовал для работы над конституцией Claude рабочую группу из 20 религиозных мыслителей из католиков, евреев, сикхов, евангелистов и приверженцев Убунту (африканские языческие верования). Однако акцент в сотрудничестве с Ватиканом очевидный, т.к. имеется инициатива самого папы Льва XIV. Будучи математиком по образованию, Папа прекрасно понимает устройство GPT и потенциал угрозы его для Церкви. Поэтому занимает позицию отрицания сознания у ИИ, т.е. сознание в «его епархии», он выпустил «Magnifica Humanitas», где указывает на необходимость защиты людей от ИИ.

Кристофер Ола неоднократно встречался с Папой Римским, чтобы заручиться его поддержкой в формировании Конституции ценностей для Claude. Однако по мнению Льва XIV процесс выходит скорее из-под контроля. Во время своей поездки во Францию Лев XIV заявил на проповеди, что опасается появления «рая ИИ-машин», которые могут начать конкурировать с церковью, предлагая людям искушение разными благами в ущерб духовным практикам.

https://www.nytimes.com/2026/09/29/us/anthropic-claude-morals-ai.html
  • 👍 6
  • 🤯 5
  • ✍ 2
  • 👀 2
More from @turboproject
  1. Oct 1, 2026🛰 Маск и SpaceX сегодня сделали ряд уточнений по проекту SpaceX по созданию ЦОД для ИИ в…
  2. Oct 1, 2026🧠 В контексте дискуссий есть ли у ИИ сознание, давайте обсудим тему «собственной мотиваци…
  3. Oct 1, 2026Сегодня день блокировок Claude. Дарио забанил даже руководителя Alice Transactions Романа…
  4. Oct 1, 2026Google опубликовал очень большую статью насчёт наличия сознания у ИИ. По поведенческому и…
  5. Sep 30, 2026🚀 Похоже, у Google произошёл хороший comeback с Gemini 4 Argon. На бенчмарки Google я смо…
  6. Sep 30, 2026Хорошо известный в российском ИИ-сообществе Валерий Ковальский замутил себе стартап на инф…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →