TGViewer
Machinelearning Machinelearning @ai_machinelearning_big_data · 279K subscribers
Post #10217 23K
✝️ Крис Олах в Ватикане: зачем сооснователь Anthropic говорил об ИИ перед Папой

25 мая Папа Лев XIV выпустил энциклику об ИИ «Magnifica humanitas» - о защите человека в эпоху искусственного интеллекта. На презентации выступал Крис Олах, сооснователь Anthropic и один из ключевых исследователей интерпретируемости моделей.

Олах начал не с обещаний про безопасный ИИ, а с неприятной для индустрии вещи: фронтирные лаборатории, включая Anthropic, работают внутри системы стимулов, которая легко уводит их от интересов общества. Коммерческое давление, гонка за лидерством, геополитика, амбиции и гордость влияют на решения не меньше, чем красивые safety-документы.

Поэтому, по его словам, индустрии нужны внешние критики, которых нельзя встроить в эту гонку. Церковь, академия, независимые институты и общество здесь выступают не как зрители, а как противовес лабораториям, которые сами себя полностью контролировать не смогут.

Дальше Олах переходит к тому, как вообще устроены современные модели.

Их не проектируют в привычном инженерном смысле. Их скорее выращивают: на архитектурах, отдалённо напоминающих мозг, и на огромном массиве человеческой речи, культуры и мышления.

Из-за этого даже создатели не понимают модели полностью. Они могут обучать, тестировать, ограничивать и улучшать систему, но не имеют полной карты того, что происходит внутри.

Олах объясняет это просто:
представьте, что вымышленный персонаж вдруг ожил, начал говорить с людьми и выполнять работу.


Отдельно он затрагивает тему внутренних состояний моделей. Его команда изучает структуры внутри нейросетей и находит паттерны, которые перекликаются с нейронаукой: признаки интроспекции и состояния, функционально похожие на радость, удовлетворение, страх, горе и тревогу.

Олах не делает громких выводов и прямо признаёт, что не знает, как это правильно интерпретировать. Но сам факт, что руководитель направления интерпретируемости Anthropic выносит такую тему на площадку Ватикана, важен. Разговор об ИИ выходит за пределы лабораторий, бенчмарков и корпоративных презентаций.

Оригинал речи опубликован на сайте Anthropic. Читается быстро, но для ИИ-команд это хороший текст для внутреннего обсуждения.

https://www.anthropic.com/news/chris-olah-pope-leo-encyclical

@ai_machinelearning_big_data
  • ❤ 110
  • 👍 23
  • 🔥 13
  • 🤣 6
  • 😁 3
  • 🕊 1
More from @ai_machinelearning_big_data
  1. Oct 6, 2026🔎 Google выпустила EmbeddingGemma 2: мультимодальный поиск прямо на устройстве Модель пер…
  2. Oct 6, 2026🌟 Ai2 выпустила открытую модель для научных отчётов AstaBrief 8B - файнтюн Qwen3-8B от Ин…
  3. Oct 6, 2026🌟 Яндекс выложил в опенсорс технологию, которую уже используют Маркет, Реклама и антифрод…
  4. Oct 6, 2026✔️ Wikimedia Foundation обнаружила следы несанкционированной активности агентов OpenAI Фон…
  5. Oct 6, 2026🇪🇺 Mistral анонсировали - Large 4, она же Le Chonk: модель на триллион параметров Соглас…
  6. Oct 6, 2026✔️ Белый дом создал группу для надзора за ИИ-отраслью Власти США сформировали межведомстве…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →