TGViewer
Eli Rum - Tech & Ai Eli Rum - Tech & Ai @somecrazyhands · 589 subscribers
Post #79 625
Всем привет. Сегодня до двух ночи мы с Родионом Мостовым (в подвале поста будет ссылка на его канал) обсуждали, как оценивать и оплачивать работу сотрудников, которые пользуются ИИ.

Рынок сильно поменялся. Старые подходы к оценке труда уже плохо описывают реальность. После разговора у меня родилась серия постов. Начну с первой.

Какое-то время назад Anthropic выпустили исследование о том, как люди на самом деле работают с Claude Code.

В исследовании было около 400 тысяч сессий и 235 тысяч пользователей. Период - с октября 2025 по апрель 2026.

Изучали простой вопрос: что сильнее всего влияет на успешную работу с ИИ агентом.

По их данным, главное — понимание предметной области. Умение писать софт влияет заметно слабее. Потому что сами ИИ агенты уже неплохо пишут и проверяют код.

Вот некоторые факты:

🔹 в обычном рабочем заходе человек принимает около 70% решений о том, что делать, а Claude берёт на себя около 80% решений о том, как делать;

🔹 чем лучше человек знает предмет, тем больше ИИ делает за один запрос. У новичков примерно 5 действий и 600 слов на выходе, у профиков - около 12 действий и 3200 слов;

🔹 проверенный успешный результат у новичков получается в 15% рабочих циклов, у людей среднего уровня и выше - в 28–33%. Основной рост происходит на переходе от новичка к среднему уровню. Дальше кривая почти не растёт;

🔹 когда работа упирается в ошибки, новички бросают задачу в 19% случаев, остальные - в 5–7%;

🔹 профессия почти не решает. В рабочих циклах с кодом все 10 ведущих профессий находятся в пределах 7 процентных пунктов от прогеров. А руководители по доле проверенного успешного результата даже чуть выше инженеров 😂 пум пум пум =)

🔹 за 7 месяцев доля поиска и исправления ошибок упала с 33% до 19% рабочих циклов. Зато выросли деплой в в контур, анализ данных и тексты. Оценочная стоимость средней задачи выросла примерно на четверть. Четверть Карл!

На практике ИИ забирает на себя исполнение, а вот оценивать результат всё ещё должен человек. И порог для такой оценки не слищком высокий. Хватает нормальной компетенции в своей теме. Очень глубокая экспертиза сверху добавляет уже не так много.

Я это вижу на себе.

В своих проектах, где я профи внутри своего домена (предметной области), Claude Code спокойно гоняет длинные цепочки без моего вмешательства.

В незнакомой теме я дёргаю агента каждые два-три шага. И качество на выходе проседает в разы.

Цифры Anthropic просто подтвердили мои ощущения.

Сами авторы пишут, что следят за одним сигналом: начнёт ли падать выгода от человеческой экспертизы или нет.

Если начнёт, значит модели уже научились поставлять не только исполнение, но и оценку.

Но пока этого не происходит.

Посмотрим, сколько ещё продержится 🤓

Канал Родиона и его заметка про стоимость работы ИИ

Блогпост источник.

#ии #разработка #claude #anthropic #иипомощники #оценкаработы
  • ❤ 24
  • 🔥 17
  • 💯 13
  • 👍 12
More from @somecrazyhands
  1. Aug 18, 2026v0️⃣.3️⃣4️⃣.0️⃣ ForgePlan v0.34 - что нового. Главное: инструмент перестал врать. Версия п…
  2. Aug 18, 2026Давненько не было релизов в ForgePlan, вчера задеплоил новую версию.
  3. Aug 14, 2026Всем привет! Ваш покорный весной записывал курс для Hitch (red_mad_robot) https://ai.hitch…
  4. Aug 7, 2026Пока технологии несутся а люди борются за еду наперегонки с тостерами и кофемолками ИИ Я р…
  5. Aug 5, 2026Без ИИ как без рук. Назад больно Поделюсь историей, которая случилась со мной на прошлой н…
  6. Aug 4, 2026Про вайб кодинг на удаленке. 🔹 Многие наверное видели вот эти посты из каждого утюга где…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →