TGViewer
AbstractDL AbstractDL @abstractdl · 18.7K subscribers
Post #284 17.7K
Confidence Neurons: у каждой LLM есть нейрон, который регулирует «температуру» генерации

Авторы этой работы нашли несколько конкретных нейронов, которые вообще ничего не делают, кроме как меняют энтропию распределения логитов. При этом на предсказание следующего токена они не оказывают никакого влияния, т.к. работают исключительно в null space финальной LM головы.

Грубо говоря, активируя эти нейроны, языковая модель «регулирует» температуру своих предсказаний через LayerNorm. А если эти нейроны специально отключить, то LLM будет всегда на 100% уверена в своих ответах.

Статья
  • 👍 151
More from @abstractdl
  1. Sep 30, 2026Все же слышали, что OpenAI пересмотрели условия подписок Codex? Теперь такое по квотам: 10…
  2. Sep 28, 2026Sonnet-5.5 фанфакт из техрепорта: это первая модель антропик, которой пофиг насколько вежл…
  3. Sep 27, 2026Опять много взломов и новостей алаймента от агентов OpenAI накопилось, держите дайджест: >…
  4. Sep 25, 2026Evidence of Linear Superposition in LLMs Языковые модели ЕЩЁ ЛИНЕЙНЕЕ, чем мы думали. Это,…
  5. Sep 22, 2026GPT-6-sol и luna. Куда ещё дешевле то? Демпингуют) UPD: раздали всем reset-ы лимитов
  6. Sep 22, 2026Антропик дропнули сброс лимитов, доступен до 22 октября
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →