TGViewer
Книжный куб Книжный куб @book_cube · 15.8K subscribers
Post #5047 676
Материалы Research Insights #34: долгоживущие агенты и передача работы (Рубрика #AI4SDLC)

Доступны материалы сольного выпуска Research Insights Made Simple от 7 октября 2026 года — «Долгоживущие агенты: передача работы». Разобрал инженерный пост Anthropic "Effective harnesses for long-running agents" от 26 ноября 2025 года о работе агента на протяжении нескольких сессий.

Код остался на диске, а контекст закончился. Следующей сессии достаются файлы и обнадёживающее «почти готово», но ещё нужно выяснить, что действительно работает, какие проверки прошли и с чего продолжать. На примере клона claude.ai авторы показывают, как устроить такую передачу работы.

В выпуске разобрал:
🔸 Что подготовить в первой сессии
Список функций, журнал прогресса, скрипт запуска init.sh и начальный коммит. Требования, объяснение сделанного, запуск среды и история кода отвечают на разные вопросы. Одним пересказом беседы их трудно заменить.
🔸 Как определить готовность
«Сделать чат» превращается в пользовательский сценарий: создать разговор, увидеть приветствие и новый пункт в боковой панели. Статус меняется после проверки. При этом запрет переписывать требования в исходном решении задан промптом — отдельная внешняя проверка их неизменности не показана.
🔸 Как начинать и заканчивать рабочий шаг
Прочитать состояние, запустить приложение, проверить основу, выбрать одну функцию, реализовать и проверить её, сохранить коммит и запись в журнале. Это одна функция за шаг; за сессию таких шагов может быть несколько.
🔸 Что агент не видит в браузере
В описанном опыте Puppeteer MCP не давал видеть нативные диалоги alert, и связанные с ними функции оставались более ошибочными. Зелёные тесты и подключённый браузер ещё не гарантируют, что пользовательский путь пройден.
🔸 Как проверить саму обвязку
Предложил сравнивать варианты на одинаковых задачах, модели и бюджете, принудительно сбрасывая контекст и меняя по одному механизму. Это предложение для эксперимента; у Anthropic в исходном посте — качественные наблюдения без измеренного вклада каждого компонента.

В финале посмотрел и на продолжение истории: с более сильными моделями состав обвязки меняется. Вчерашние ограничения тоже нужно перепроверять.

Материалы выпуска:
📌 Страница выпуска с таймкодами
📊 Слайды
📖 Лонгрид об эволюции агентных оболочек
🎬 YouTube, VK Видео
🎧 Podster, Яндекс Музыка, Apple Podcasts
📝 Текстовый конспект

Что чаще теряется у вашего агента после смены сессии: понимание задачи, результаты проверок или следующий шаг? Расскажите, чем помогли продолжить работу.

#AI4SDLC #Agents #DevTools #Evals #ResearchInsights #Engineering
polomodov.tech Долгоживущие агенты: передача работы - Research Insights Made Simple Как агент продолжает работу после смены контекста: подготовка среды, список функций, журнал прогресса, Git и проверка в браузере.
  • 🔥 4
  • ❤ 2
  • 👍 2
More from @book_cube
  1. Oct 9, 2026Заходите на прямой эфир Research Insights - сегодня серия с обсуждением мартовской статьи…
  2. Oct 9, 2026По традиции я раз в год участвую в благотворительной акции с механикой аукциона, где можно…
  3. Oct 8, 2026Материалы Code of Leadership №84: разработчик становится менеджером в эпоху AI? (Рубрика #…
  4. Oct 8, 2026Проектирование обвязки для длительной (автономной) разработки приложений (Рубрика #AI4SDLC…
  5. Oct 8, 2026Материалы выпуска Research Insights #33: SWE-agent (Рубрика #AI4SDLC) Собрал материалы сол…
  6. Oct 8, 2026Justin Reock: код менять легче, деплоить страшнее (Рубрика #AI4SDLC) Новый доклад Justin R…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →