Лаборатория METR опубликовала обновление своего эксперимента по продуктивности
Ранние данные 2025 года показывали, что AI‑ассистенты иногда даже замедляли задачи, но в начале 2026 года наблюдается очевидный рост выигрыша по скорости.
Но свежая статистика начала 2026 года отрезвляет:
→ Техдолг летит в космос: По данным бенчмарков 2026 года, после внедрения AI технический долг вырастает на 30-41%, а PR содержат в 1.7 раза больше проблем, чем написанные человеком.
→ Иллюзия скорости: Весь профит у новых проектов сгорает к шестому месяцу. Причина — резкий рост когнитивной сложности кодовой базы (почти на 40%).
→ Кризис доверия: В отчете Sonar 96% инженеров признались, что не доверяют AI-коду. 61% жалуются на самую опасную иллюзию: сгенерированный код выглядит идеально, но содержит скрытые архитектурные баги.
→ Даже ученые в тупике: В февральском отчете METR исследователи признали, что замерять продуктивность стало невозможно. Качество итоговой работы (особенно покрытие тестами и документация) при делегировании агентам сильно деградирует.
В итоге мы не стали писать код быстрее. Мы просто тратим сэкономленное время на дебаг и ревью чужих галлюцинаций.
#AIcoding #AIAgents #LLM
METR: We are Changing our Developer Productivity Experiment Design
Post #315
79

- ❤ 6
- 👍 1
- 👎 1