TGViewer
Data Secrets Data Secrets @data_secrets · 94.4K subscribers
Post #10073 13.2K
Исследователи из Meta* предложили дать моделям полный контроль над собственным контекстом

Обычно контекст агента устроен довольно просто: старый контекст + новый ответ -> новый контекст. История постепенно растет, а когда становится слишком большой, ее приходится отдельно сжимать или чистить.

В Context Language Models (CLM) авторы предлагают вообще убрать заранее заданную логику управления контекстом и дать модели возможность самой переписывать собственную историю.

Технически весь текущий контекст хранится в обычном файле, к которому у модели есть доступ через Bash. Она может в любой момент удалить ненужные сообщения, заменить большой кусок истории короткой заметкой, сохранить важный результат дословно или полностью перестроить содержимое. После каждого изменения файл становится новым контекстом модели.

При этом никаких правил о том, как именно управлять историей, модели не дают. В экспериментах агенты сами начинали заводить внутри контекста пометки, писать функции для удаления старых результатов поиска и собирать компактные таблицы с состоянием других агентов. Например, в одном из тестов модель за 163 редактирования удерживала рабочий контекст в пределах 6–8K токенов.

Авторы пошли дальше и попробовали отдельно обучить модель этому навыку через RL. После обучения Qwen3.5-9B на BrowseComp-Plus выросла с 28.8% до 42.5%, при этом на вычисления ушло на 38.8% меньше, чем у обученного тем же способом бейзлайна с обычной суммаризацией.

Произвольное редактирование контекста, правда, ломает обычное кеширование. Если изменить что-то в середине истории, все состояния после этого места формально приходится считать заново. Для этого авторы сделали Suffix Cache Reuse: для неизменившихся частей контекста продолжают использовать старый KV-cache, даже если текст перед ними поменялся. В экспериментах это сократило серверные вычисления еще примерно на 35% без заметной потери качества.

На длинных задачах разница становится уже довольно большой. На 12-часовом EdgeBench CLM получил на 5% больше баллов при сокращении объема вычислений на 59%. В 24-часовом тесте на оптимизацию кода CLM при том же вычислительном бюджете показал на 65% лучший результат, чем бейзлайн.

И все это работает поверх обычных LLM, без изменения архитектуры самой модели.

Код | Статья
  • ❤ 111
  • 🔥 58
  • 👍 25
  • 😁 4
  • 🤔 4
  • 👏 3
  • 🫡 2
  • ⚡ 1
  • 🏆 1
More from @data_secrets
  1. Oct 1, 2026GPT-6 Astra за 6 часов взломала шифр генерала Наполеона, который числился нераскрытым 217…
  2. Oct 1, 2026😎 GoCloud Tech 2026: регистрация открыта Этой осенью Cloud․ru снова собирает ИТ-специалис…
  3. Oct 1, 2026OpenAI пытаются задобрить пользователей после понижения лимитов Напоминаем, что стартап на…
  4. Oct 1, 2026OpenAI обнаружила массовую кампанию по дистилляции своих моделей Не так давно Anthropic ут…
  5. Oct 1, 2026ИИ все чаще пишет код сам. Тогда чем теперь занимается разработчик? На конфе Яндекса по об…
  6. Oct 1, 2026FigureAI заставляют своих роботов предыдущего поколения бросаться в лаву, чтобы избавиться…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →