Новое про ИИ в медицине. Ожидаемое неожиданное!
Напомню, что наш Президент давно и четко сказал - никакой ИИ не может заменить врача. И он, как всегда, прав.
❗️🔵🔵🔵 Новое научное исследование про ситуацию, когда люди пытаются вместо диагностики у врача, получить совет у ИИ.
Nature Medicine вылило холодное ведро воды на горячие головы энтузиастов такой самодиагностики. Ученые из Оксфорда проверили: если дать людям доступ к мощным моделям (GPT‑4o, Llama 3, Command R+), станут ли они лучше понимать свои симптомы и правильно выбирать, когда лечиться дома, а когда вызывать скорую?
Оказалось - нет. Когда сценарии решают сами модели ИИ, они почти безошибочно называют хотя бы один релевантный диагноз и достаточно часто выбирают правильный уровень помощи.
Но стоит между моделью и задачей поставить реального человека с его жалобами на здоровье, всё рассыпается: такие пользователи с ИИ реже попадают в диагноз и не лучше контрольной группы выбирают тактику.
Контроль, напомню, - это обычный «гугл, сайты, свой опыт».
Почему так? Потому что медицина - это не только «знание ответа», но и правильные вопросы. Про умение слушать человека. Люди, не медики, иногда сложно формулируют жалобы, могут забыть важные детали, задают модели закрытые вопросы уровня «а это от стресса?».
Модель ИИ, в свою очередь, выдаёт несколько версий, иногда противоречивых, и делегирует выбор неспециалисту. В результате связка «человек+ИИ» часто слабее, чем каждая часть по отдельности.
Авторы исследования показывают ещё одну неприятную вещь: привычные медицинские бенчмарки, где ИИ блестяще решает экзаменационные вопросы, и даже симуляции «виртуальных пациентов» почти ничего не говорят о том, как система поведёт себя в живом диалоге с неспециалистом. На тестах — «суперврач», в реальности — повышенный риск ошибиться вместе с пользователем.
Вывод довольно трезвый: ни одна из протестированных моделей пока не готова к роли «первой линии» для пациентов. Этого не исправить ещё одним рекордом на MedQA или ещё одной красивой демонстрацией. Нужно разворачивать испытания к реальным людям, реальным сценариям и неудобным вопросам - и честно смотреть, что происходит на границе «человек–ИИ», а не только внутри нейросети.
Для практикующих врачей это значит, что пациенты «после чата с ИИ» не обязательно приходят более информированными. Для разработчиков и регуляторов - что пора перестать мерить надёжность медицининских LLM по экзаменам и симуляциям и переходить к систематическим пользовательским испытаниям под контролем клиницистов.
Будем обсуждать с коллегами новые данные на ближайшем заседании Экспертного совета Комитета по охране здоровья по цифровизации в здравоохранении.
#ИИ #Медицина #ГосударственнаяДума #ЕдинаяРоссия #ВашДепутатБашанкаев
Post #11615
41.6K