Идея, что "расстояние в тысячу ли покрывается крошечными шагами, если ты их делаешь и не слишком плутаешь" -- она контринтуитивна. Я своим постом на 22Кзнака хочу показать, когда и как я осознал, что шедевры делаются как сумма микропоправок, каждая из которых кажется незначительной, а вовсе не "чётких нескольких крупных действий", с "драматически заметными" результатами каждого действия. Затем я покажу, что AI-агенты идут ровно по этому маршруту: каждое их действие тупое, маленькое, сомнительное -- но если этих действий много, то в результате тоже будет шедевр, что тоже контринтуитивно, как и в случае людей. Это можно считать "внутренним циклом бесконечных улучшений", это "база", а не SoTA. Затем я покажу, что "просто много пилить в цикле" недостаточно -- и появятся новые слова про open-endedness, Парето-фронт и характеризацию как внешний цикл пересборки целей и отслеживания результатов "непрерывного пиления по чуть-чуть", а также изменения способов этого непрерывного улучшения. Это всё приложимо и к людям: если взять инженерию личности, то такой подход и будет "развитием для развитых".
https://ailev.livejournal.com/1788081.html
Post #66
464
Forwarded from Лабораторный журнал
- 👍 5