Всем привет. Сегодня до двух ночи мы с Родионом Мостовым (в подвале поста будет ссылка на его канал) обсуждали, как оценивать и оплачивать работу сотрудников, которые пользуются ИИ.
Рынок сильно поменялся. Старые подходы к оценке труда уже плохо описывают реальность. После разговора у меня родилась серия постов. Начну с первой.
Какое-то время назад Anthropic выпустили исследование о том, как люди на самом деле работают с Claude Code.
В исследовании было около 400 тысяч сессий и 235 тысяч пользователей. Период - с октября 2025 по апрель 2026.
Изучали простой вопрос: что сильнее всего влияет на успешную работу с ИИ агентом.
По их данным, главное — понимание предметной области. Умение писать софт влияет заметно слабее. Потому что сами ИИ агенты уже неплохо пишут и проверяют код.
Вот некоторые факты:
🔹 в обычном рабочем заходе человек принимает около 70% решений о том, что делать, а Claude берёт на себя около 80% решений о том, как делать;
🔹 чем лучше человек знает предмет, тем больше ИИ делает за один запрос. У новичков примерно 5 действий и 600 слов на выходе, у профиков - около 12 действий и 3200 слов;
🔹 проверенный успешный результат у новичков получается в 15% рабочих циклов, у людей среднего уровня и выше - в 28–33%. Основной рост происходит на переходе от новичка к среднему уровню. Дальше кривая почти не растёт;
🔹 когда работа упирается в ошибки, новички бросают задачу в 19% случаев, остальные - в 5–7%;
🔹 профессия почти не решает. В рабочих циклах с кодом все 10 ведущих профессий находятся в пределах 7 процентных пунктов от прогеров. А руководители по доле проверенного успешного результата даже чуть выше инженеров 😂 пум пум пум =)
🔹 за 7 месяцев доля поиска и исправления ошибок упала с 33% до 19% рабочих циклов. Зато выросли деплой в в контур, анализ данных и тексты. Оценочная стоимость средней задачи выросла примерно на четверть. Четверть Карл!
На практике ИИ забирает на себя исполнение, а вот оценивать результат всё ещё должен человек. И порог для такой оценки не слищком высокий. Хватает нормальной компетенции в своей теме. Очень глубокая экспертиза сверху добавляет уже не так много.
Я это вижу на себе.
В своих проектах, где я профи внутри своего домена (предметной области), Claude Code спокойно гоняет длинные цепочки без моего вмешательства.
В незнакомой теме я дёргаю агента каждые два-три шага. И качество на выходе проседает в разы.
Цифры Anthropic просто подтвердили мои ощущения.
Сами авторы пишут, что следят за одним сигналом: начнёт ли падать выгода от человеческой экспертизы или нет.
Если начнёт, значит модели уже научились поставлять не только исполнение, но и оценку.
Но пока этого не происходит.
Посмотрим, сколько ещё продержится 🤓
Канал Родиона и его заметка про стоимость работы ИИ
Блогпост источник.
#ии #разработка #claude #anthropic #иипомощники #оценкаработы
Post #79
625

- ❤ 24
- 🔥 17
- 💯 13
- 👍 12