TGViewer
Михаил Омельченко | AI&IT Михаил Омельченко | AI&IT @django_school · 5.19K subscribers
Post #2007 1.08K
Окно на миллион токенов не отменило работу с контекстом

Окна моделей выросли до миллиона токенов и появилось ощущение, что можно складывать в контекст всё подряд, места хватит.

Давайте разберёмся, почему это не сработало.

В июле 2025 года Chroma прогнала 18 моделей на входах разной длины: Claude, GPT, Gemini, Qwen. Chroma делает базу для векторного поиска, то есть интерес в этой теме у неё большой и читать замер стоит с поправкой на это.
Вывод, модели не держат одинаковое качество на разной длине входа. Причём деградация начинается задолго до физического предела окна и идёт она неровно, провалами.

У этого есть название, context rot, гниение контекста.

Anthropic в статье про контекст инжиниринг (context engineering) называет контекст конечным ресурсом с убывающей отдачей. Объясняет через бюджет внимания: он у модели ограничен, каждый новый токен его тратит и поэтому чем длиннее контекст, тем строже приходится отбирать, что в него класть.

Поэтому большое окно не заменило работу с контекстом. Оно отодвинуло точку, где отсутствие этой работы становится заметным и подняло цену ошибки, за лишнее в окне вы платите на каждом шаге, и платите не один раз.

Источники:
1) Замер Chroma "Context Rot: How Increasing Input Tokens Impacts LLM Performance"

2) Anthropic, "Effective context engineering for AI agents"
  • ❤‍🔥 3
  • 👍 3
  • 🎉 1
  • 💯 1
More from @django_school
  1. Sep 23, 2026У автономного цикла есть цена. 1) Расход токенов. Цикл, который гоняет сам себя, жжёт токе…
  2. Sep 22, 2026Сразу ставить агентов на автомат, чтобы они сами писали и сами мёржили, это ошибка. В итог…
  3. Sep 21, 2026Чаще всего агент делает не то потому, что задачу ему поставили словами "сделай хорошо". Бе…
  4. Sep 20, 2026Git Worktrees, чтобы агенты не мешали друг другу Несколько агентов, которые работают над о…
  5. Sep 20, 2026Второй сезон в клубе по разработке ИИ агентов скоро стартует. Анкеты принимаю до 21 сентяб…
  6. Sep 19, 2026Почему агент не должен проверять сам себя Отдельный проверяющий агент выглядит лишней трат…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →