TGViewer
False Positive False Positive @falseposi · 1.13K subscribers
Post #74 784
В последнее время все более отчетливо проявляется тренд на эффективность инференса LLM.

Сначала мы жили в парадигме: "хочешь более умную модель - просто добавь параметров, данных и GPU-часов". Даже для вопроса вроде "Какая столица России?" задействовались все миллиарды параметров модели.

Затем стали популярны MoE-архитектуры (Mixture of Experts): вместо использования "всего мозга" модель активирует лишь несколько специализированных его частей.

Однако даже такой подход упускает ключевую вещь, которая есть у человека, но отсутствует у моделей — настоящая память. Люди мгновенно узнают знакомые факты, а не каждый раз приходят к ним через цепочку вычислений.

Современные LLM все еще страдают от скрытой неэффективности — computational memory: мы прогоняем запрос через несколько слоев модели, чтобы восстановить то, что в идеале можно было бы просто "посмотреть в словаре".

В эту пятницу в15:00 на PT ML Reading Group мы обсудим новую статью Engram от DeepSeek, которая предлагает подход к устранению этой неэффективности и переосмысляет роль памяти в LLM.

Ссылка для подключения: Ктолк

#reading_group #llm
  • 🔥 9
  • 👀 5
  • 👍 3
  • ❤ 1
More from @falseposi
  1. Sep 30, 2026К нам в сореву залетела дрозофила🪰 И она уже расследует инциденты лучше чем мы А чего доб…
  2. Sep 25, 2026False Positive pinned a photo
  3. Sep 25, 2026Никто: Абсолютно никто: ИИ-агент, увидев PowerShell на сервере: 🚨🚨🚨 ВЗЛОМ 🚨 ВСЁ ПРОПАЛ…
  4. Sep 24, 2026Попробовать атакующих агентов кстати сейчас самим можно и в лабах и на CTF. А как повторит…
  5. Sep 24, 2026Выкладываем запись RG Глеба Кумичева про то как агенты хакнули HF #reading_group #openai #…
  6. Sep 18, 2026Мы начинаем🤗
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →