TGViewer
ВИРУСНАЯ НАГРУЗКА ВИРУСНАЯ НАГРУЗКА @viralload · 4.3K subscribers
Post #692 12.7K
31 августа вышел интересный препринт, который показал, что ИИ для медицинских записей (AI scribe) ошибается в более чем 30% случаев. Его широко рекламируют как инструмент, избавляющий врачей от бюрократии, но на практике он часто доставляет проблемы, выбрасывая существенные детали или додумывая недостающие.

В одном из таких случаев пациентка из Великобритании была потрясена, когда узнала, что у нее демиелинизация нервов, встречающаяся при тяжелых заболеваниях ЦНС. Она запросила данные МРТ, и тогда выяснилось, что ИИ просто выбросил слово “no” из описания. Больница исправила ошибку, указав, что “демиелинизация отсутствует”. В другом случае модель перепутала схожие названия препаратов, указав в назначениях неправильный. В третьем - самостоятельно “назначила” пациенту аспирин и т.д.

Сотрудники лондонской компании Composo, занимающейся AI scribe, решили выяснить уровень ошибок (правда, на чужих продуктах). Они прогнали 142 реальных и выдуманных разговора через 3 коммерческих AI scribe и получили 565 записей. Далее Claude Opus 5 искал все подозрительное (пропуски, галлюцинации, ошибки в препаратах и т.д.) и нашел их в изобилии - 13 678 потенциальных ошибок, из которых после первичной фильтрации осталось 5 898. Затем Claude и GPT-5.5 дали противоположную задачу: они должны были аргументированно доказать, что это не ошибка, если это было возможно. В результате осталось 618 подтвержденных ошибок, которые были обнаружены в 177 записях из 565 (31,3%).

В чем заключались эти ошибки? 
❇️ Самая большая категория (111) - пропуск информации об аллергии и препаратах, которые принимает пациент, несмотря на то, что они обсуждались на приеме. 
❇️ В 93 случаях ИИ додумывал данные пациента: если фамилия или имя были написаны неразборчиво или отсутствовали, AI scribe дописывал их сам. У одного человека так оказалось название препарата для химиотерапии вместо имени. 
❇️ В 53 записях был выброшен диагноз, хотя ИИ оставил на месте рекомендации по лечению. 
❇️ ИИ также был склонен представлять консультацию по телефону как физический осмотр (42 записи). Например, если врач говорил пациенту с сыпью, что осмотрел бы его, но такой возможности нет, AI scribe все равно создавал раздел “осмотр” с описанием сыпи. 
❇️ В 32 случаях планируемое исследование превращалось в выполненное: если врач говорил, что нужно договориться о проведении ЭКГ, ИИ писал, что “ЭКГ выполнена сегодня в клинике”. 
❇️ ИИ также менял описание симптомов (28): например, указывал, что они влияют на сон, хотя в разговоре не было ничего подобного. В другом случае пациент жаловался на отек и воспаление коленей, врач также фиксировал отечность и покраснение, но в записи эти симптомы отрицались. 
❇️ Заодно ИИ приписывал пациентам болезни их родственников, оставлял в силе предыдущий вариант лечения, если врач передумал, и т.д.

Но ключевой вопрос, который поставили авторы, заключался не в опасениях за судьбу пациентов, а в том, насколько можно доверять сообщениям о многочисленных ошибках, если неизвестен метод, которым их измеряли? При установлении строгих критериев LLM подтверждалось 9,3% потенциальных ошибок, при более мягких - 79% (что давало 96,5% записей с как минимум одной ошибкой). Но на практике ни пациенту, чьи симптомы или личные данные перепутали, ни врачу, назначения которого не записали, нет дела до методологических споров. Решение проблемы лежит в другой плоскости - создание AI scribe с множественными механизмами самопроверки на основе продвинутых LLM-моделей. Это усложнит жизнь разработчикам, но, по крайней мере, позволит отлавливать ошибки, когда вместо имени пациента написано название препарата.

Заодно эти случаи показывают, насколько декоративным на самом деле может быть контроль записей со стороны врача. Пациентке, которой “диагностировали” демиелинизацию, повезло - она сама работала в NHS и догадалась запросить оригинальные данные. Но многие на ее месте и не подозревают, что записи, под которыми стоит подпись врача, ошибочны.
More from @viralload
  1. Sep 18, 2026Сотни крупных лабораторий по всему миру годами использовали неправильные антитела для иссл…
  2. Sep 16, 2026Американский фармрынок снова готов наступить на грабли опиоидной эпидемии: компания Defini…
  3. Sep 11, 2026У Novartis выдалось несколько тяжелых недель: сначала пелакарсен провалился в фазе III, по…
  4. Sep 9, 2026Мы уже обсуждали, что в ситуациях, когда ИИ составляет медицинские записи, а врач подписыв…
  5. Sep 2, 2026В феврале 2026 г. в Неаполе разразился скандал: 2-летнему мальчику пересадили донорское се…
  6. Aug 28, 2026Штат Пенсильвания подал иск против владельцев Character.AI, обвинив их чат-бот в незаконно…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →