🤖 ИИ-агентам убрали «начальника», и сложные задачи стали решаться быстрее.
Исследователи Стэнфорда представили DeLM, систему поверх Codex и Claude Code. Вместо центрального координатора агенты используют общий контекст и очередь задач: сами забирают работу, сразу делятся находками и видят, какие подходы уже провалились. Это сокращает ожидание и повторную работу.
В экспериментах авторов:
• До 2,49× быстрее стандартного Claude Code.
• До +19,2 процентного пункта к доле решённых задач относительно стандартного Claude Code.
• До +19,9 пункта к доле пройденных тестов ProgramBench за те же 120 минут.
Масштаб проверки пока небольшой: по 10 выбранных длительных задач из Terminal-Bench и DeepSWE, плюс две задачи ProgramBench. Ускорение также не всегда означает меньшие расходы на вычисления.
Авторы открыли код, 720 траекторий работы агентов и плагин для Codex и Claude Code.
🌐 Project & code: https://yuzhenmao.github.io/DeLM/
📄 Paper: https://arxiv.org/abs/2606.10662
Post #5921
3.16K


- 🔥 28
- ❤ 18
- 👍 9
- 👏 5
- 😁 4
- 🎉 4
- 💯 4
- 🤔 3