TGViewer
ForgePlan ForgePlan @forgeplan · 38 subscribers
Post #10 50
Самое слабое звено

R_eff = 0.10. И ни слова почему.

🔸 В обвязке ForgePlan есть оценка R_eff — насколько решению можно верить. Считается она по подтверждениям, которые к решению привязаны (тесты, замеры, чужой разбор). Главная идея: минимум, не среднее. Если три подтверждения по 0.9 и одно по 0.1 — R_eff равен 0.1, не 0.7.

🔸 Звучит сурово. И это осознанно. Доверие к решению не выше, чем самое слабое его подтверждение. Одно слепое пятно — и всё проседает. Среднее бы это спрятало; минимум — нет.

🔸 А теперь история, которую я стеснялся рассказать. Сам R_eff молча врал о своей честности. Если таблица с подтверждением была оформлена не по форме — без явных полей «вердикт», «уровень соответствия», «тип подтверждения» — разбирающая её часть тихо ставила «противоречит» и роняла оценку почти к нулю.

🔸 Агент смотрел на R_eff = 0.10 и не понимал почему. Просто низкий балл, без объяснения. Кладбище решений внутри инструмента, который должен был кладбища решений предотвращать.

«Студенты не могут проверять свои собственные экзамены».

> — walkinglabs, лекция 9

🔸 Anthropic в 2025 опубликовали находку: агент, который сам себя оценивает, систематически завышает оценку. Это особенность того, как обучали модели — «полезный» в их мире равно «да, готово». Решение — отдельный проверяющий с другим контекстом.

🔸 Чинил двумя раундами разбора. В выводе теперь явно: «EVID-091 не содержит структурных полей → штраф». В правилах проекта появилась красная линия про обязательную форму таблицы доказательств. Урок: если механизм самопроверки молчит про свои промахи, он сам становится молчаливым кладбищем.

🔹 https://walkinglabs.github.io/learn-harness-engineering/ru/

#harness #ai
  • 🔥 1
More from @forgeplan
  1. Aug 17, 2026v0️⃣.3️⃣4️⃣.0️⃣ ForgePlan v0.34 - что нового. Главное: инструмент перестал врать. Версия п…
  2. Jun 17, 2026v0️⃣.3️⃣3️⃣.0️⃣ ForgePlan v0.33 — что нового. Главное про AI. 🔷 AI без второго ключа. Ран…
  3. Jun 1, 2026v0️⃣.3️⃣2️⃣.1️⃣ ForgePlan v0.32 - что нового. И одна честная история в придачу. Сначала пр…
  4. May 19, 2026Главное правило инструмента вроде ForgePlan - знать, когда им не пользоваться. 🔸 У инстру…
  5. May 18, 2026Документация всегда отстаёт от кода. Кроме одного случая. 🔸 У документации в команде вечн…
  6. May 13, 2026Почему первая идея почти всегда хуже второй? 🔸Каждый, кому случалось принимать сколько-ни…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →