TGViewer
very vibe coding very vibe coding @veryvibecoding · 120 subscribers
Post #1206 34

Forwarded from Dealer.AI

Мозг,мыши и путь к сыру AGI✌️👋

Вышла интересная статья в Nature Communications, которая описывает, как в процессе развития мозг мышей меняет архитектуру нейронных связей: от локальной, плотной и случайной к распределённой, разреженной и структурированной.
По сути, мозг переходит от жёсткой и энергозатратной сети к более гибкой и эффективной.

Проведем параллели между этим биологическим процессом и обучением LLM.
Можно выделить несколько основных направлений:

🧠 Этапы развития в жизни, как путь от переобучения к обобщению в LLM.

В статьей рассказано, что в раннем возрасте у мышей связи между нейронами гиппокампа были локальными, плотными и случайными. При этом сила отдельных синапсов была настолько высокой, что одного события было достаточно для активации нейрона. Это напоминает состояние переобучения у нейросетей: модель буквально запоминает каждый факт и не умеет видеть общие закономерности. Даже к 18–25 дням связи всё ещё были случайными и сильными, но сеть уже начинала реорганизовываться, подготовливая почву для следующего этапа.

У взрослых особей архитектура кардинально меняется: плотность связей снижается, они становятся разреженными и структурированными, обеспечивая надёжное и точное хранение информации. Синапсы слабеют, и для активации нейрона требуется суммация сигналов от нескольких входов.

Тут возникает аналогия с LLM. В процессе обобщения модель учится выявлять закономерности и абстрагироваться от конкретных примеров, что позволяет ей гибко реагировать на новые данные, а не просто вспоминать заученное. Снижение силы отдельных связей можно сравнить с регуляризацией, которая предотвращает запоминание шума и улучшает способность модели к обобщению.

🎯 Память, точность и контроль галлюцинаций в LLM

Разреженная, структурированная сеть взрослого гиппокампа идеально подходит для хранения множества различных воспоминаний без взаимных помех (низкая интерференция). Случайная, плотная сеть ребёнка, напротив, была бы плохим хранилищем, так как новые данные быстро перезаписывали бы старые.

Это может стать аналогией с проблемой катастрофического забывания, которая стоит перед LLM при дообучении на новых данных. Кроме того, разреженная архитектура снижает риск создания ложных ассоциаций - аналог галлюцинаций LLM, когда модель генерирует правдоподобную, но неверную информацию. Для LLM это означает, что более структурированное и разреженное внутреннее представление знаний потенциально может сделать её более надёжной и точной.

⚡️ Экономия ресурсов мышления и вычислений

Переход к разреженной сети значительно энергоэффективнее, тк активируется лишь малая часть нейронов, необходимая для обработки конкретного сигнала. Это критически важно для биологического мозга, работающего в условиях ограниченных ресурсов.

Для LLM мы наблюдаем то же самое. Вспомним разреженные вычисления, такие как MoE, sparse attention и тп. В таких моделях для каждого запроса активируется только небольшая часть экспертов, что позволяет достигать высокой производительности с меньшими вычислительными затратами, чем у плотных моделей аналогичного размера. Однако, мы храним все веса модели в памяти gpu. Но давайте будем честны, мы и весь вес мозга носим на себе, хотя активируем отдельные области 🧠

Ну а что делать-то? 🙄
Как мы видим по статье, что для мышей, что для LLM - путь к эффективности общая стратегия.

Природа за миллионы лет эволюции пришла к разреженности не потому, что лень, а потому что плотная сеть не масштабируется 😱

LLM на 100B параметров в плотном виде — это мышь на P8: шумная, жадная до энергии и неспособная к сложной ассоциативной памяти.

Разреженность - не фича, а база. Получается, что LLM должна эволюционировать от плотной детской фазы к структурированной взрослой.

Правда, эволюция сделала это без градиентного спуска и H100 👍 А сможете ли Вы? 🤔
Nature Developmental emergence of sparse and structured synaptic connectivity in the hippocampal CA3 memory circuit Nature Communications - Using multicellular patch-clamp recording, the authors show that the hippocampal CA3 autoassociative network undergoes pruning of CA3–CA3 synapses and downregulation...
More from @veryvibecoding
  1. Sep 29, 2026Новости OpenAI - прямо печаль какая-то, а не новости.
  2. Sep 29, 2026Интересно, что тарифы на ИИ все больше начинают напоминать тарифы на электроэнергию. У z.a…
  3. Sep 29, 2026Unsloth выпустил квантизацию Laya, которая работает на 4гб памяти. Буду тестировать. Laya…
  4. Sep 29, 2026Начинается OpenAI Dev Dey. Главный релиз - Astra 6.1, видимо, отложен. Жди доработок Codex…
  5. Sep 28, 2026Вернул подписку на GLM от Z.ai. Приятный бонус - у них агент AutoClaw - на основе pi и Ope…
  6. Sep 28, 2026Последние впечатления от chatGPT и воспоминания о том, как Claude вместо внешних моделей г…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →