Результаты:
- Учитель (Qwen3-Coder-Next): корректный синтаксис — 87,6%
- Студент (4B): 100%
- У учителя — 11 вызовов инструментов с пустыми аргументами
- У LocoOperator-4B — 0 ошибок
Как обучали:
- Full-parameter SFT
- 170K многошаговых диалогов
- ~25 часов обучения на 4× H200
- Использовался фреймворк MS-SWIFT
Специализация модели — навигация по кодовой базе:
Инструменты:
- Read
- Grep
- Glob
- Bash
- Task
Вывод — строго структурированный JSON в формате
<tool_call>.Практическое применение:
Модель может работать как локальный sub-agent для Claude Code:
- Sonnet принимает решения
- Haiku маршрутизирует задачи
- выполнение идёт через локальную llama.cpp
- стоимость API — $0
Модель: https://modelscope.cn/models/LocoreMind/LocoOperator-4B
GitHub: https://github.com/LocoreMind/LocoOperator
