Доступны материалы сольного выпуска Research Insights Made Simple от 7 октября 2026 года — «Долгоживущие агенты: передача работы». Разобрал инженерный пост Anthropic "Effective harnesses for long-running agents" от 26 ноября 2025 года о работе агента на протяжении нескольких сессий.
Код остался на диске, а контекст закончился. Следующей сессии достаются файлы и обнадёживающее «почти готово», но ещё нужно выяснить, что действительно работает, какие проверки прошли и с чего продолжать. На примере клона claude.ai авторы показывают, как устроить такую передачу работы.
В выпуске разобрал:
🔸 Что подготовить в первой сессии
Список функций, журнал прогресса, скрипт запуска
init.sh и начальный коммит. Требования, объяснение сделанного, запуск среды и история кода отвечают на разные вопросы. Одним пересказом беседы их трудно заменить.🔸 Как определить готовность
«Сделать чат» превращается в пользовательский сценарий: создать разговор, увидеть приветствие и новый пункт в боковой панели. Статус меняется после проверки. При этом запрет переписывать требования в исходном решении задан промптом — отдельная внешняя проверка их неизменности не показана.
🔸 Как начинать и заканчивать рабочий шаг
Прочитать состояние, запустить приложение, проверить основу, выбрать одну функцию, реализовать и проверить её, сохранить коммит и запись в журнале. Это одна функция за шаг; за сессию таких шагов может быть несколько.
🔸 Что агент не видит в браузере
В описанном опыте Puppeteer MCP не давал видеть нативные диалоги
alert, и связанные с ними функции оставались более ошибочными. Зелёные тесты и подключённый браузер ещё не гарантируют, что пользовательский путь пройден.🔸 Как проверить саму обвязку
Предложил сравнивать варианты на одинаковых задачах, модели и бюджете, принудительно сбрасывая контекст и меняя по одному механизму. Это предложение для эксперимента; у Anthropic в исходном посте — качественные наблюдения без измеренного вклада каждого компонента.
В финале посмотрел и на продолжение истории: с более сильными моделями состав обвязки меняется. Вчерашние ограничения тоже нужно перепроверять.
Материалы выпуска:
📌 Страница выпуска с таймкодами
📊 Слайды
📖 Лонгрид об эволюции агентных оболочек
🎬 YouTube, VK Видео
🎧 Podster, Яндекс Музыка, Apple Podcasts
📝 Текстовый конспект
Что чаще теряется у вашего агента после смены сессии: понимание задачи, результаты проверок или следующий шаг? Расскажите, чем помогли продолжить работу.
#AI4SDLC #Agents #DevTools #Evals #ResearchInsights #Engineering