https://www.anthropic.com/engineering/effective-harnesses-for-long-running-agentsShu artiklni o'qib, o'zim tushunganlarimni konspekt qilib yozib qo'yabman
Anthropic uzoq vaqt ishlaydigan agentlarni samaraliroq qilish bo'yicha izlanishibdi va ekspriment qilishibdi.
Uzoq ishlaydigan agentni muammolari:
• Hamma ishni bitta contextga sig'dira olmaydi
• Vazifalarni bir-nechta context oynalarga bo'lib bajaradi
• Bir context boshqa contextni natijasidan xabardor bo'lmaydi
• Claude ilovani erta tugatilgan deb o'ylashi
• Bir urinishda to'liq app yozmoqchi bo'lib, featurelarni ishlashini end-to-end test qilmasligi.
Muammoga quyidagi yechimlardan birini qoʻllab koʻrishibdi:
• Ikki xil agent: Initializer va Coding agent
• Initializer agent
init.sh fayl yaratib dev serverni yurgazish buyruqlarini bajaradi
• Initializer agent jamiyki qilinishi kerak bo'lgan feature'larni feature-list.json faylga yozib boradi
• Coding agent bir vaqtda faqat bitta feature ustida ishlaydi
• Coding agent natijasi
claude-progress.txt faylga yozilib boriladi
• Feature tugaganda Puppeteer MCP orqali E2E test qilinadi
• Feature tugaganda agent reponi "toza" holatda qoldiradi. Ya'ni testlar/linter fail bo'lmagan, muammosiz holatda
• Coding agent yangi feature boshlashdan oldin
claude-progress.txt va git loglarni o'qib, dev serverni run qilib, basic E2E testing qilib ko'radi