Ви написали ідеальний `CLAUDE.md`. «Перед змінами прочитай архітектуру. Після змін запусти тести. Перевір, що код відповідає вимогам». Агент відкрив файл. Прочитав. І що далі?
🙂 Автори свіжого дослідження розібрали 557 сесій із Claude Code, Codex, Cursor, Gemini CLI та іншими агентами І ось що цікавого знайшли:
• після 1 328 читань документації лише тричі(!) саме наступною дією була правка коду;
• жодного (!!) явного випадку, коли агент перейшов за посиланням з одного документа в інший;
• жодного явного випадку, коли він порівняв два документи;
• нуль випадків, коли агент узяв документацію за еталон і звірив із нею результат.
Це не означає, що агенти не читають документацію. Читають. Причому найбільше працюють саме
CLAUDE.md, AGENTS.md, SKILL.md та власні нотатки (плани, тимчасові файли і тд)❌ Проблема в тому, що ми ставимося до CLAUDE.md занадто несерйозно.
Так, документація лише передає контекст. Рядок «обов’язково запусти тести» ще не створює verification loop. Це гарантовано спрацює тоді, коли перевірка вбудована в процес: через тест, linter, hook або CI.
✅ Зняв про це відос, де розбираю:
— що агенти насправді читають у репозиторії;
— чому критичні правила не варто ховати за ланцюжком посилань;
— як правильно розкладати
CLAUDE.md, AGENTS.md і скіли;— навіщо перетворювати документацію на виконувані артефакти;
— чому агенти самі змінюють файли, які керуватимуть їхніми наступними сесіями;
— як виміряти, чи виконується правило, а не просто сподіватися на це.
Дивитися тут: https://www.youtube.com/watch?v=GWGFNRM0o40
Цікаво, чи знайшли для себе щось новеньке від цієї інфи 🙂 діліться
Youtube | Instagram