TGViewer
Data Secrets Data Secrets @data_secrets · 94.3K subscribers
Post #9502 25.8K
Data Secrets Anthropic нашли внутри Claude внутреннее пространство, где хранятся его мысли Стартап выпустил одну из самых интересных работ по интерпретируемости за последнее время. Они обнаружили, что в LLM есть отдельный небольшой внутренний набор нейронных активаций…
Смешной пример из исследования: Claude говорят не думать о мосте в Сан-Франциско во время ответа на вопрос, и в ответ на это во внутреннем пространстве мыслей модели сначала появляется слово «мост», а затем «damn» («черт»).

Ближе к человеку, чем кажется
  • 😁 544
  • ❤ 24
  • 🔥 7
  • 👍 4
  • 🍓 4
  • 🤯 3
  • ☃ 2
  • 😍 1
  • 🍾 1
More from @data_secrets
  1. Sep 30, 2026Каждую осень у бизнеса просыпается спрос на подрядчиков – бухгалтеров, юристов, маркетолог…
  2. Sep 30, 2026DeepSeek вместе с Huawei разрабатывают альтернативу CUDA Компании выложили в опенсорс набо…
  3. Sep 30, 2026Т-Технологии показали на ACM RecSys 2026 три инструмента для рекомендаций, и все они в опе…
  4. Sep 30, 2026После презентации нового агента Dots от OpenAI домен dot.com начал перенаправлять пользова…
  5. Sep 30, 2026Кстати, по итогу этой встречи ИИ-лидеры подписали добровольное соглашение о контроле В нем…
  6. Sep 30, 2026Герой дня – Дарио Амодеи на свежем репортаже из Белого Дома, где техлидеры обсуждали контр…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →