TGViewer
Вася Сизов | grok ML Вася Сизов | grok ML @grok_ml · 62 subscribers
Post #75 82
Что вообще такое «агент»

Агентом сейчас называют что угодно: чат-бота, скрипт с одним промптом, обёртку над API. Спорить о терминах бессмысленно, но есть вопрос, который сразу расставляет всё по местам: сколько решений вы отдали модели, а сколько оставили за кодом.

Harrison Chase из LangChain называет это когнитивной архитектурой — как ваша система думает. То есть поток кода, промптов и вызовов LLM, который превращает запрос пользователя в ответ или действие.

Внутри любой такой системы кто-то принимает три решения:

• что выдать на конкретном шаге
• какой шаг делать следующим
• какие шаги вообще доступны

Дальше всё просто. Считаем, сколько из трёх решений принимает LLM, — и получаем шесть уровней автономии:

1. Код. LLM нет вообще, все решения зашиты.
2. Один вызов LLM. Модель решает только, что выдать. Один шаг.
3. Цепочка. Вызовов несколько, но их порядок задан кодом.
4. Роутер. Модель сама выбирает, какой шаг делать следующим. Циклов нет: каждый шаг проходится максимум один раз.
5. Стейт-машина. То же плюс циклы. Число вызовов заранее неизвестно, но набор доступных шагов всё ещё ограничен кодом.
6. Автономный агент. Модель сама определяет, какие шаги ей доступны: меняет промпты, инструменты, иногда код.

Граница проходит между 4 и 5. До неё поток ведёт человек, после — система сама, потому что появляются циклы, и вы больше не знаете, сколько шагов она сделает.

Отсюда главное: агентность — не флажок, а ползунок. Чем выше уровень, тем меньше предсказуемости, тем дороже отладка и эксплуатация. Ни один уровень не лучше другого — они под разные задачи. И архитектуру стоит перебирать так же спокойно, как вы перебираете промпты.

#agent
  • 🔥 8
  • ❤ 3
More from @grok_ml
  1. Sep 14, 2026В предыдущем посте были пять паттернов workflow. Общее у них одно: путь по шагам задан код…
  2. Sep 14, 2026В прошлом посте была шкала из шести уровней автономии. У неё есть слабое место: граница ме…
  3. Aug 2, 2026Сегодня на урбан ml рассказывал о продолжении нашего проекта с агентским рагом. Мы провери…
  4. Jul 11, 2026Масштаб претрейна LLM В эру развития больших языковых моделей я часто слышу, как люди гово…
  5. Jul 3, 2026Оценка железа под LLM (часть 4 серии про оценку ML-задач в банке) В предыдущем посте мы ра…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →