Продолжение к вчерашнему посту про skill
technical-premortemЯ решил его строго проверить. Взял реальные планы (включая те, что уже были ранее без проблем реализованы), прогнал через разные версии скиллов (от 600 до 50 строк) на моделях Sol и Opus.
⚠️ В том числе сравнивал с моделями, которые делали проверки вообще без skill.
Привлёк независимых судей-верификаторов Sol и Fable. Сравнил количество подтверждённых находок, мусор, вердикты и затраты токенов.
Главный вывод: скилл не делает модели умнее – они и так всё умеют.
Никакой когнитивной активации с помощью premortem техники не происходит, никаких дополнительных возможностей модель не получает.
Но skill всё равно работет, он убирает панические блокировки, режет мусор и дисциплинирует формулировки.
Краткий разбор в 4-х постах + сам skill + сравнение и различие в поведении Sol vs Opus/Fable
https://t.me/cinicai/116
https://t.me/cinicai/117
https://t.me/cinicai/118
https://t.me/cinicai/119
#opensource