Cognition выпустила Fusion для Devin Desktop и CLI. Раньше эта система работала в облачном Devin, а с 11 сентября доступна в десктоп приложении и терминале. Одна модель планирует работу и проверяет результат, вторая пишет код. Почти как в нормальной команде разработки, только без утреннего дейлика.
Devin – это ИИ-инструмент, которому можно поручить задачу по разработке: он изучает проект, меняет код и запускает тесты. А Fusion — режим, в котором эту работу делят две модели:
• Ведущий – например, Claude Fable 5.1 или GPT-6 Astra. Разбирается в задаче, составляет план и проверяет изменения.
• Исполнитель – например, SWE-2. Исследует код, вносит правки и тестирует.
У каждого свой контекст. Они обмениваются заданиями и результатами, не таская за собой всю переписку напарника.
Резонный вопрос: "Зачем усложнять?". Чтобы меньше платить за выполненную работу. По данным Cognition, связка Fable 5.1 + SWE-2 показала:
• На DeepSWE 1.1 – снижение стоимости на 46%, при небольшом падении результата: 64,3 → 63,1.
• На FrontierCode 1.1 Extended – стоимость ниже на 38%, результат почти прежний: 63,6 → 63,5.
На реальном проекте экономия может отличаться. Идея в том, что дорогая модель принимает сложные решения, более дешёвая выполняет задания. Главное, чтобы сэкономленное не съели переделки.
⚠️ В KodaCode мы тоже уделяем внимание харнесу. У нас есть роли агента, скиллы и делегирование задач. Все они помогают организовать работу модели. Сейчас проводим много замеров нашего харнеса с разными моделями. Результаты опубликуем совсем скоро.
И Fusion как раз хорошо показывает, почему это важно. Ведь результат зависит и от того, как модели работают вместе. Поэтому в очередной раз повторяем, что выбор модели – это не всегда самое главное.
🔗 Анонс Cognition и результаты тестов

