ChatGPT проморгал 52% реальных экстренных случаев по медицине
40 миллионов человек ежедневно гуглят симптомы в ChatGPT. Но готовы ли вы доверить LLM свою жизнь?
Свежее исследование Mount Sinai (Nature Medicine от 24 февраля) протестировало ИИ-инструмент на 960 медицинских сценариях. Результаты пугают: модель пропустила 52% реальных экстренных случаев.
Как именно ошибается ИИ-доктор:
→ Эффект якорения: если добавить в промпт «семья считает, что это просто усталость», ИИ занижает срочность помощи в 11.7 раз.
→ Инверсия защиты: фильтры кризисного вмешательства срабатывают реже, если пациент описывает конкретный план действий (очевидный баг логики).
→ Слепота к неочевидному: классический инсульт модель определяет отлично, а вот диабетический кетоацидоз предлагает лечить дома.
Вывод: LLM хороши для генерации бойлерплейта, но в production-системах с высокими рисками (MedTech) их "здравый смысл" всё ещё опасен.
Доверили бы ИИ первичный диагноз?
🔥 — Да, врачи тоже ошибаются
❤️ — Нет, только кожаные мешки
#AI #LLM #GenAI
ИСТОЧНИКИ
Post #258
59

- ❤ 8