SWE-agent или как интерфейс меняет результат / Research Insights Made Simple #33 (Рубрика #AI4SDLC)
Через полчаса проведу прямой эфир Research Insights, где поговорю про статью из 2024 года «SWE-agent: Agent-Computer Interfaces Enable Automated Software Engineering» с NeurIPS 2024. В ней рассказывается про то, а что меняется, если дать той же языковой модели более удобный интерфейс для работы с репозиторием? Вместо разговора только о моделях и промптах посмотрим на действия агента и обратную связь, которую он получает.
В программе будет
- Поиск по коду и чтение файлов: как агент находит нужное и сохраняет ориентиры.
- Многострочные правки и проверка синтаксиса: как предотвращать ошибки и восстанавливаться после них.
- Управление контекстом: что показывать модели, что сокращать и что сохранять.
- Результаты SWE-bench и SWE-bench Lite: с чем сравнивают SWE-agent и что показывают абляции.
- Выводы для современных агентов: какие принципы стоит перенести в свою систему, а какие настройки остались частью эксперимента 2024 года.
#Engineering #AI4SDLC #AI #SystemDesign #Research
Post #5031
1.32K