TGViewer
Love. Death. Transformers. Love. Death. Transformers. @lovedeathtransformers · 25.7K subscribers
Post #11100 4.29K

Forwarded from AbstractDL

Evidence of Linear Superposition in LLMs

Языковые модели ЕЩЁ ЛИНЕЙНЕЕ, чем мы думали. Это, конечно, какой-то смех, но если тупо усреднить инпут-эмбеддинги у входных текстов, то LLM будет в аутпуте продолжать оба текста сразу. То есть она может параллельно о двух разных вещах думать и разбираться в усреднённых активациях, распутывая их. Похоже, это следствие линейности внутренних репрезентаций, которую я описывал в старой работе.

У меня тоже получилось немного помочь с этой статьёй и залететь в соавторы, но я там скорее рядом постоял просто. Все лавры Паше Тихонову за крутую находку.

Статья
huggingface.co Paper page - Your Transformer Can Hold Two Thoughts at Once: Evidence of Linear Superposition in LLMs Join the discussion on this paper page
  • 👍 48
  • 🔥 25
  • 😨 8
  • 😁 6
  • 🍓 4
  • 🤔 3
  • 🎉 2
  • 👏 1
  • 💩 1
  • 🤗 1
More from @lovedeathtransformers
  1. Sep 26, 2026Self-Play Pretraining with Zero Data https://arxiv.org/abs/2609.30063
  2. Sep 25, 2026вы ща охуеете, это были ДОМЕННЫЕ ТРОЛИ которые угнали имя на хф
  3. Sep 25, 2026код 200 мы вместе
  4. Sep 25, 2026после пары месяцев жизни в лондонске прям хочется написать роман антиутопию. Особенно остр…
  5. Sep 25, 2026забавный факт, карты nvidia дороже чем популярные наркотики, а к 2030 будут дороже чем кок…
  6. Sep 24, 2026а есть хорошие работы про антислоп детекторы?
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →