Post #93
374
Forwarded from ForgePlan

v0️⃣.3️⃣4️⃣.0️⃣
ForgePlan v0.34 - что нового. Главное: инструмент перестал врать.
Версия про честность цифр. Раньше forgeplan показывал оценку доверия к решению, и в трёх местах эта оценка была неправдой. Разобрал все три.
🔷 Оценка больше не «двойка навсегда».
Было так. Проверка нашла в коде дефект, записала «опровергнуто», оценка ноль. Дефект починили, две новые проверки на свежем коде это подтвердили. А оценка всё равно ноль. Навсегда. Как аттестат, куда вписали худшую контрольную за всю жизнь, и пересдать нельзя.
Чем это плохо на практике: агент упирается в недостижимую планку и начинает чинить не код, а запись о прошлом: подделывать старый вердикт. У человека, который прислал мне этот баг, так случилось три раза подряд на одной записи.
Теперь оценка означает «насколько можно сейчас доверять». Старая проверка остаётся в истории и видна в отчёте с пометкой, но текущее число больше не тянет. Починил, оценка поднялась.
🔷 «Я всё сделал» больше не принимается на слово.
Если доказательство утверждает, что код изменился, forgeplan теперь сам сверяет это с git: были ли на самом деле те коммиты и те файлы. Зелёные тесты поверх пустого изменения, когда по факту ничего не менялось, больше не считаются успехом. Это пустой результат, а не проверка.
Забавная деталь: сам релиз это на себе и проверил. Доказательство релиза несёт такую сверку, гейт её прогнал и пропустил.
🔷 Предупреждения перестали быть шумом.
В отчёте было 140 «проблем». Из них 106 - выдумка самого инструмента: он ругался на нормальные вещи, а в одном сообщении вообще писал неправду про то, как считается штраф. Когда три из четырёх предупреждений ложные, человек перестаёт вообще их читать.
Осталось 34, все настоящие.
🔺 Заодно закрыл багу, которую сам же и создал. После первой правки оценку стало можно накрутить одной командой: помечаешь неудобную проверку устаревшей - и ноль превращается в единицу, ни строчки кода не тронув. Поймал это на разборе собственного фикса, до того как выложил. Теперь так нельзя, а если проверку всё-таки закрыли без замены, forgeplan это подсвечивает отдельным предупреждением.
А теперь честная история.
Проверка безопасности падала 11 дней, и я об этом не знал.
У GitHub есть привычный список уведомлений про уязвимости, я в него иногда смотрю. Оказалось, что база уязвимостей для Rust туда просто не попадает. Отдельная проверка в сборке маячила красным одиннадцать дней подряд, пять запусков, включая мои же вчерашние, а в списке уведомлений было все по феншую.
Нашлось только потому, что перед релизом есть обязательный пункт «ветка должна быть зелёной», и я пошёл проверять руками, вместо того чтобы поверить списку.
Починил три уязвимости, одна серьёзная. И записал себе правило: для Rust-проекта список уведомлений GitHub - не полная картина, надо смотреть обе проверки аналогово.
Что заметите при обновлении: у части решений оценка может упасть. Это нормально. У меня из 89 упало одно: то, чьё единственное доказательство закрыли ещё в апреле. Старая формула это молча скрывала, новая показывает как есть. Прогоните forgeplan score --all и посмотрите, где ваши доказательства уже протухли и пора их пересматривать.
Обновление:
brew upgrade forgeplan
Готовые плагины для работы в Claude Code:
🔹 https://github.com/ForgePlan/marketplace
Полный список изменений:
🔹 https://github.com/ForgePlan/forgeplan/blob/main/CHANGELOG.md
ForgePlan v0.34 - что нового. Главное: инструмент перестал врать.
Версия про честность цифр. Раньше forgeplan показывал оценку доверия к решению, и в трёх местах эта оценка была неправдой. Разобрал все три.
🔷 Оценка больше не «двойка навсегда».
Было так. Проверка нашла в коде дефект, записала «опровергнуто», оценка ноль. Дефект починили, две новые проверки на свежем коде это подтвердили. А оценка всё равно ноль. Навсегда. Как аттестат, куда вписали худшую контрольную за всю жизнь, и пересдать нельзя.
Чем это плохо на практике: агент упирается в недостижимую планку и начинает чинить не код, а запись о прошлом: подделывать старый вердикт. У человека, который прислал мне этот баг, так случилось три раза подряд на одной записи.
Теперь оценка означает «насколько можно сейчас доверять». Старая проверка остаётся в истории и видна в отчёте с пометкой, но текущее число больше не тянет. Починил, оценка поднялась.
🔷 «Я всё сделал» больше не принимается на слово.
Если доказательство утверждает, что код изменился, forgeplan теперь сам сверяет это с git: были ли на самом деле те коммиты и те файлы. Зелёные тесты поверх пустого изменения, когда по факту ничего не менялось, больше не считаются успехом. Это пустой результат, а не проверка.
Забавная деталь: сам релиз это на себе и проверил. Доказательство релиза несёт такую сверку, гейт её прогнал и пропустил.
🔷 Предупреждения перестали быть шумом.
В отчёте было 140 «проблем». Из них 106 - выдумка самого инструмента: он ругался на нормальные вещи, а в одном сообщении вообще писал неправду про то, как считается штраф. Когда три из четырёх предупреждений ложные, человек перестаёт вообще их читать.
Осталось 34, все настоящие.
🔺 Заодно закрыл багу, которую сам же и создал. После первой правки оценку стало можно накрутить одной командой: помечаешь неудобную проверку устаревшей - и ноль превращается в единицу, ни строчки кода не тронув. Поймал это на разборе собственного фикса, до того как выложил. Теперь так нельзя, а если проверку всё-таки закрыли без замены, forgeplan это подсвечивает отдельным предупреждением.
А теперь честная история.
Проверка безопасности падала 11 дней, и я об этом не знал.
У GitHub есть привычный список уведомлений про уязвимости, я в него иногда смотрю. Оказалось, что база уязвимостей для Rust туда просто не попадает. Отдельная проверка в сборке маячила красным одиннадцать дней подряд, пять запусков, включая мои же вчерашние, а в списке уведомлений было все по феншую.
Нашлось только потому, что перед релизом есть обязательный пункт «ветка должна быть зелёной», и я пошёл проверять руками, вместо того чтобы поверить списку.
Починил три уязвимости, одна серьёзная. И записал себе правило: для Rust-проекта список уведомлений GitHub - не полная картина, надо смотреть обе проверки аналогово.
Что заметите при обновлении: у части решений оценка может упасть. Это нормально. У меня из 89 упало одно: то, чьё единственное доказательство закрыли ещё в апреле. Старая формула это молча скрывала, новая показывает как есть. Прогоните forgeplan score --all и посмотрите, где ваши доказательства уже протухли и пора их пересматривать.
Обновление:
brew upgrade forgeplan
Готовые плагины для работы в Claude Code:
🔹 https://github.com/ForgePlan/marketplace
Полный список изменений:
🔹 https://github.com/ForgePlan/forgeplan/blob/main/CHANGELOG.md
- 👍 5
















