TGViewer
EDU EDU @productsandstartups · 15.4K subscribers
Post #1722 4.61K
Применяем Autoresearch за пределами ML

В марте я разбирал autoresearch Карпатого и обещал адаптировать под "приземлённые задачи" —> на днях устроили с ai нейтивами билд сессию, делюсь результатами.

Напомню: autoresearch - это цикл, где дружбан крутит-вертит один файл, решающий заданную задачу, оценивает результат: если удачно - сохраняет и идет на следующую итерацию улучшение; если нет - откатывается к предыдущему. Для machine learning задач работает очень хорошо.


Главный вывод сразу: Карпатовский loop - это шаг 5 из 5. 80% работы - ДО его запуска, а не внутри.

На каких задачах крутили:
1) Скилл для дежурного сотрудника (Илья) - one-shotнул хороший скилл сразу, не особо и луп пришлось делать
2) квалификация входящих лидов (Дмитрий) - докрутил промпты для оценки лидов, улучшил точность
3) ML задачка на kaggle (Гаяр) - 60е место из 1400, авторесерч; вообще такой подход превращает ML в коммодити, конечно
4) negotiation challenge с хакатона paradigm (я) - за 25 экспериментов +14% к базовому результату, дальше можно и нужно крутить

В целом, можно и нужно применять, НО не для каждой задачи. Поэтому по мотивам запилил скилл - он делает 3 ключевые вещи:

1) Triage - подходит ли вообще эта задача для autoresearch?

2) Fitness/оптимизационная функция - помогает математически сформулировать, что такое хорошо и что такое плохо —> чтобы цикл улучшения понимал, когда эксперимент помог, а когда - нет

3) Стратегия экспериментирования - несколько дополнительных режимов для придумывания экспериментов: explore vs exploit, идеи от человека, barbell стратегия Талеба и тп

Интересный вывод сделал Илья в конце сессии:
"мы подтвердили твою гипотезу - когда у всех будет autoresearch, узким местом станут идеи"


Я бы еще добавил:

и сформулировать fitness функцию


Как бы отсылаю к недавнему посту 😉
  • ❤ 17
  • 🔥 7
  • 👌 1
More from @productsandstartups
  1. Sep 26, 2026Как вернуть джунам последствия Пару месяцев назад я спрашивал: как не лишить молодое покол…
  2. Sep 24, 2026Наш плагин на днях апрувнули в chatgpt - некоторые очень ранние заметки с полей: 1) 4-5 ин…
  3. Sep 22, 2026Некоторые наблюдения с полей о внедрении AI в компаниях с 50+ сотрудниками: 1) у каждой ко…
  4. Sep 21, 2026Поиграем про то, как AI агенты "ломают" продуктовые команды В пятницу с 17 по 19мск - реги…
  5. Sep 19, 2026Попробовал модель, что не умеет писать текст TypeSafe выкатили Jev - «System One» модель (…
  6. Sep 17, 2026Думаю, что следующим прорывом в тренинге моделей будет тренировка их на координацию агенто…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →