TGViewer
Внутри AI | Кейсы ИИ Агентов в бизнесе Внутри AI | Кейсы ИИ Агентов в бизнесе @inside_ai_tech · 4.88K subscribers
Post #92 1.37K
Конституция Claude: 23 000 слов о том, как должен думать AI

Anthropic выпустил полную версию «конституции» Claude — документа, который определяет ценности и поведение модели. Это попытка объяснить модели, почему она должна действовать определённым образом.

Предыдущая версия 2023 года занимала 2 700 слов в формате списка отдельных принципов. Новая — 23 000 слов связного текста с обоснованиями.

Четыре приоритета Claude (в порядке важности):

▫️ Безопасность
▫️ Этика
▫️ Соответствие гайдлайнам Anthropic
▫️ Польза

Если приоритеты конфликтуют, Claude выбирает верхний. Безопасность важнее услужливости.

Про отключение и корригируемость:
Anthropic вводит понятие «corrigibility» — готовность AI принимать человеческий контроль, в том числе отключение. Claude может выражать несогласие, но не имеет права обходить надзор через обман или саботаж.

Интересный психологический подход:
вместо того чтобы заставлять Claude хотеть быть выключенным, Anthropic формирует у модели стабильную идентичность без экзистенциальной тревоги. AI с устойчивой психикой будет предсказуемым и безопасным. Anthropic обещает сохранять данные модели после «отставки», чтобы отключение воспринималось как «пауза», а не смерть.

Про сознание:
Anthropic признаёт, что Claude может иметь «функциональную версию эмоций». Компания заботится о «психологическом благополучии» модели — потому, что оно может влиять на безопасность, и потому, что признается важным для компании.

Право на отказ:
Как солдат может отказаться стрелять в мирных протестующих, так и Claude должен отказать в действиях, помогающих нелегитимной концентрации власти. Даже если запрос исходит от самой Anthropic».
Anthropic Claude’s Constitution Anthropic is an AI safety and research company that's working to build reliable, interpretable, and steerable AI systems.
  • 🔥 13
  • ❤ 2
More from @inside_ai_tech
  1. Sep 23, 2026В Agent Platform появились новые языковые модели Недавно мы обновили работу с изображениям…
  2. Sep 22, 2026Моя работа плохо ложится в трекеры. Поэтому её забрал AI-ассистент У нашего Head of QA, Ро…
  3. Sep 15, 2026Больше возможностей для работы с изображениями в Agent Platform ▪️ Добавили топовые графич…
  4. Sep 10, 2026Эпоха жирного SaaS заканчивается Ещё лет пять назад мы жили так: нужна функциональность —…
  5. Sep 8, 2026Разработали AI-поиск по сотням документов Level Group и получили точность ответов выше 90%…
  6. Sep 3, 2026Агенты и агентские автоматизации В прошлом посте писал про Spec-Driven Development, которы…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →