Связка Kimi K3 и Tinker позволяет почти полностью автоматизировать исследовательский цикл.
Поскольку большая часть инфраструктуры для обучения уже скрыта под капотом, изменения, которые вносит Kimi, остаются сосредоточены именно на эксперименте. Благодаря этому проще отслеживать, что изменилось, и направлять следующие запуски.
При попытке воспроизвести работу Self-Distilled RLVR модель с первого раза собрала базовую реализацию, затем провела 19 экспериментов с шестью конфигурациями и оформила итоговый отчёт. Заодно она сама подготовила его версию на китайском языке.
Попробовать авторесёрч с Kimi можно самостоятельно на openresearch.sh. Для воспроизведения эксперимента используйте пример из репозитория.
Post #3565
17.2K
