TGViewer
DeepSchool / underthehood DeepSchool / underthehood @deepschool_underthehood · 1.13K subscribers
Post #542 565
Пока писал пост про перегрузку LLM-промпта, понял, что упустил важное ограничение: ответ агента сразу стримился пользователю. Нельзя, чтобы промежуточные размышления модели не должны были быть видны пользователю, поэтому reasoning вслух я фактически запретил.

Получился странный сетап: модель должна следовать сложной логике промпта, но не может размышлять.

Ей нужно сразу понять задачу, выбрать нужные инструменты, удержать ограничения, не нарушить формат и начать писать user-facing ответ. То есть сложную логику надо было “проризонить” внутри, без размышлений.

В таком режиме complex instruction following деградирует сильнее. И тогда разбиение на planner + executor выглядит уже не просто как способ разгрузить промпт.

Это попытка жестко задать архитектуру рассуждения модели на уровне графа выполнения.

Planner думает, определяет состояние по бизнес логике и даёт план. Он размышляет вслух. Executor вызывает инструменты и пишет ответ пользователю. Это происхожит все ещё молча, но уже работает лучше, потому что задача упрощена.

По сути, это schema-guided reasoning, но вынесенный из промпта в алгоритм.

Не “модель, пожалуйста, рассуждай вот так”, а сам порядок промптов и их цель добавляет рассуждение каждый раз.

Возможно, если бы я мог позволить модели свободно рассуждать перед ответом, проблема была бы не такой критичной. Но если reasoning нельзя показывать пользователю, то им все равно нужно как-то управлять.

Вывод для меня такой: complex instruction following ломается не только из-за длинных промптов.

Иногда проблема в том, что модели не дали безопасного места, где она может подумать. А если такого места нет, его приходится создавать архитектурно.

P.S. интересно услышать ваши подходы к тому, как добиться от LLM следования сложной логике!
  • ❤ 13
  • 👍 6
  • 🤩 3
  • 👏 1
More from @deepschool_underthehood
  1. May 13, 2026На этом моя неделя заканчивается Пытался показать агентскую разработку не со стороны хайпа…
  2. May 12, 2026Tool call — это просто текст. Его можно модифицировать Когда LLM вызывает инструмент, это…
  3. May 9, 2026ReAct-промпт стал монолитом Это был узел в агенте, который искал круизы и вел пользователя…
  4. May 7, 2026Агенту нельзя просто дать backend API и ждать магии Делали простой сценарий: — есть LLM-аг…
  5. May 6, 2026Всем привет! Меня зовут Егор, на этой неделе канал веду я Я эдакий фулстак мл - начинал с…
  6. May 6, 2026Неделя авторства тут пересеклась с организацией хакатона, поэтому не успел написать поболь…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →