Mini-SWE-Agent — минималистичный coding-агент от команды SWE-bench (авторы SWE-agent, Принстон)
Философия: «весь агент в ~100 строках Python» 🤯
Что в нём есть:
- Один-единственный инструмент — запуск bash-команд (модель через shell читает файлы, правит, тестирует);
- Простейший цикл: промпт → действие модели → результат команды → снова модель. Без планировщиков, без под-агентов, без сложного контекст-менеджмента;
- Зато дешёвый, воспроизводимый и честный бенчмарк: почти ничего не маскирует способности самой модели.
Зачем он в этом исследовании: 62% в Mini-SWE-Agent против 33% в Claude Code — модель решает вдвое больше, когда харнесс максимально простой, и проваливается в сложном обвесе. То есть «умность» харнесса не добавляет — для маленькой модели сложный API-формат и цикл инструментов Claude Code только мешают.
🤯🤯🤯
https://github.com/swe-agent/mini-swe-agent - 8.2к звезд
Post #2179
293