"A Brain-like Synergistic Core in LLMs Drives Behaviour and Learning"
https://arxiv.org/abs/2601.06851
Оказывается, в средних слоях больших языковых моделей при обучении спонтанно возникает мозгоподобное "синергетическое ядро" – небольшая группа компонентов, взаимодействие которых порождает интегративную информацию, не сводимую к сумме их отдельных частей. Это ядро формируется в ходе обучения, его выключение сильно ухудшает поведение модели (что доказывает его критическую роль) и оно особенно эффективно для улучшений при обучении с подкреплением. В отличие от входных и выходных слоев, которые полагаются на избыточность данных, средние слои развивают механизмы сложной интеграции, структурно напоминающие работу высших интегративных сетей человеческого мозга, и поэтому это возникающее в средних слоях мозгоподобное "синергетическое ядро" можно рассматривать как важную мишень для более эффективной донастройки и оптимизации моделей.
Это новое важное открытие сближает психофизиологию и нейросетевой искусственный интеллект, предлагая теоретически обоснованный путь к более эффективной архитектуре искусственного интеллекта через направленное воздействие на его мозгоподобное "когнитивное ядро". Обратите внимание, что в числе соавторов есть выдающийся специалист по проблеме возможности возникновения искусственного сознания Мюррей Шанахан, о котором я часто пишу в этом канале, а также на заключительную фразу статьи "bridging neuroscience and deep learning not only enriches our understanding of large-scale models but also offers a rigorous lens through which to explore the broader "space of possible minds" and the universal principles of intelligence".
Post #1538
2.6K
arXiv.org A Brain-like Synergistic Core in LLMs Drives Behaviour and Learning The independent evolution of intelligence in biological and artificial systems offers a unique opportunity to identify its fundamental computational principles. Here we show that large language...
- 🔥 14
- ❤ 8
- ❤🔥 3
- ✍ 1
- ⚡ 1
- 👏 1
- 🤣 1
- 💔 1
- 👀 1
- 💘 1