Вот и подходят к концу обе мои квоты на Fable (личная и корпоративная).
Отличная ли это модель? Да 👍
Как когда-то GPT-4 значительно повысил надёжность языковых моделей, Fable значительно повысила надёжность агентов.
В случае Опуса я предполагал по умолчанию, что я не доверяю выхлопу модели. На все нетривиальные изменения прогонял simplify, review, codex:adversarial-review, qudo и отсматривал результат глазами. Потому что много раз меня Опус подводил, как в макро, так и в микро-решениях.
В случае Fable я по привычке это тоже сначала делал, но пользы от этого было уже не так много. Предположение по умолчанию поменялось.
Более того, Fable регулярно делала что-то сверх того, о чём я её просил. Например, когда она составляла отчёт в виде HTML странички, она установила playwright, headless chromium, сделала итоговый скриншот странички, загрузила его на закрытый корпоративный paste, чтобы я мог посмотреть на дизайн глазами до развёртывания. Мог ли такое сделать Опус? Мог конечно, но только если бы я описал весь путь. А я даже не знал, что я такое хочу!😜
Означает ли это, что Fable не ошибалась? Лол, конечно ошибалась, и тоже и в макро, и в микро. Но вот количество ошибок было гораздо меньше, и исправлять их было проще.
Post #591
7.04K

- 👍 53
- ❤ 13
- 🤔 5
- 👌 1