Два классных проекта от Microsoft про skills для LLM-агентов:
SkillOpt project page: https://microsoft.github.io/SkillOpt/
SkillLens project page: https://microsoft.github.io/SkillLens/
SkillOpt — это метод Microsoft для “обучения” текстовых skill-файлов для LLM-агентов. Модель не fine-tune’ят, веса не меняют. Система гоняет агента на задачах, смотрит на ошибки и успешные траектории, редактирует markdown-инструкцию, проверяет новую версию на validation set и оставляет только те правки, которые улучшают результат. Правки, которые ухудшают результат, тоже сохраняются в память как rejected edits, чтобы не повторять те же ошибки. Получается training loop для prompt/skill-документа.
SkillLens — это исследование того, как такие model-generated skills работают: как они извлекаются из прошлых траекторий агента, когда помогают, когда вредят, почему один skill может улучшать GPT, но ломать Qwen, и почему “красиво написанный skill” не обязательно полезен. Строим lifecycle : experience → extraction → consumption.
P.S. Так как это Microsoft, продукты они всё равно построят ужасные. Талант не пропьёшь.
Post #953
25.9K
- 😁 113
- 👍 53
- ❤ 17
- 🔥 5
- 👎 1
- 🤡 1
- 💯 1