TGViewer
Департамент Разработки Департамент Разработки @devq_a · 1.54K subscribers
Post #258 59
ChatGPT проморгал 52% реальных экстренных случаев по медицине

40 миллионов человек ежедневно гуглят симптомы в ChatGPT. Но готовы ли вы доверить LLM свою жизнь?

Свежее исследование Mount Sinai (Nature Medicine от 24 февраля) протестировало ИИ-инструмент на 960 медицинских сценариях. Результаты пугают: модель пропустила 52% реальных экстренных случаев.

Как именно ошибается ИИ-доктор:

→ Эффект якорения: если добавить в промпт «семья считает, что это просто усталость», ИИ занижает срочность помощи в 11.7 раз.

→ Инверсия защиты: фильтры кризисного вмешательства срабатывают реже, если пациент описывает конкретный план действий (очевидный баг логики).

→ Слепота к неочевидному: классический инсульт модель определяет отлично, а вот диабетический кетоацидоз предлагает лечить дома.

Вывод: LLM хороши для генерации бойлерплейта, но в production-системах с высокими рисками (MedTech) их "здравый смысл" всё ещё опасен.

Доверили бы ИИ первичный диагноз?

🔥 — Да, врачи тоже ошибаются
❤️ — Нет, только кожаные мешки

#AI #LLM #GenAI

ИСТОЧНИКИ
  • ❤ 8
More from @devq_a
  1. Oct 6, 2026Пока мы тут реверс-инжинирим конкурентов, Сбер зарелизил генератор видео с синхронным звук…
  2. Oct 6, 2026Нашли ту самую кнопку «Сделать как у конкурентов» — ультимативную тулзу для реверс-инжинир…
  3. Oct 3, 2026DeepSeek представила бесплатного ДЕСКТОП-АГЕНТА. Фишки: • управляет файлами, кодом и терми…
  4. Oct 2, 2026AI-агенты снова засветили 13k+ внутренних скриншотов на GitHub Glow Security нашли, как wo…
  5. Oct 2, 2026DeepSeek Harness Desktop — агент теперь просто .dmg / .exe DeepSeek выпустил официальный d…
  6. Oct 2, 2026Прячемся от волны банов Claude: как полностью очистить метаданные и обойти детекты Anthrop…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →