TGViewer
IT Test IT Test @ittestru · 320 subscribers
Post #1254 164
Разработчики были уверены, что ИИ ускорил их на 20%. Замеры METR на реальных задачах показали обратное - минус 19% к скорости.

Испытуемые с доступом к ИИ-ассистентам (Cursor и аналоги) на реальных репозиториях работали медленнее, чем без них, но субъективно были убеждены в обратном. Разрыв между ощущением и фактом играет большую роль, если на этом ощущении строится решение сдавать код без дополнительной проверки.

Похожая картина и по качеству: по данным Opsera (2026), в ИИ-сгенерированных PR багов в 1,7 раза больше, а доля PR, принятых без правок, - 32,7% против 84,4% у код-ревью на человеческом коде.

Если автор кода ошибается в оценке собственной скорости на 19 п.п., то доверять его же самооценке качества кода не стоит.

Именно здесь и нужна независимая оценка: тестирование, которое проверяет результат, а не веру в результат 🔍
  • 👍 3
  • 💯 2
More from @ittestru
  1. Oct 2, 2026На техническом собеседовании инженера 72% вопросов — теория. На собеседовании руководителя…
  2. Sep 29, 2026🤖Современные модели пишут синтаксически корректный код почти в 100% случаев. Безопасным э…
  3. Sep 24, 202667% российских IT-компаний назвали автоматизацию тестирования приоритетом номер один. Это…
  4. Sep 22, 202618 августа отказ питания на подстанции, обслуживающей ММТС-9, на полтора часа уронил Steam…
  5. Sep 18, 2026Один из самых дорогих багов в истории обошёлся в 440 миллионов долларов за 45 минут. В 201…
  6. Sep 15, 2026В классическом ПО не было категории дефекта "система уверенно врёт". В продуктах с LLM это…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →