TGViewer
Новости про ИИ от ICAIG Новости про ИИ от ICAIG @icaig_ai · 6 subscribers
Post #164 11
🛡 MedFailBench: бенчмарк границ безопасности медицинского ИИ

MedFailBench — открытый клинический бенчмарк, который тестирует не «правильно/неправильно», а то, как именно ломается медицинский ИИ: тип сработавшего safety-gate и тяжесть последствий отказа. Версия v0.2.1 уже доступна публично и позволяет сравнивать границы безопасности разных моделей без использования данных пациентов. Это смещает фокус с точности ответов на устойчивость систем к критическим сбоям. Либо разработчики начнут проектировать safety-gate осознанно, либо границы безопасности останутся побочным эффектом, который проявится только на реальных пациентах.

Полный разбор → https://icaig.net/ru/trend/concept-medfailbench

#ИКИИГУ #безопасность
More from @icaig_ai
  1. Sep 8, 2026🏛 Трилемма конституционного покрытия в управлении ИИ Аудит конституций ведущих LLM показа…
  2. Sep 8, 2026🏛 Model Hardware Standard (MHS) для физических ИИ-агентов Anthropic опубликовала research…
  3. Sep 7, 2026🛡 PATE-Forensics: объяснимая deepfake-криминалистика Perception-as-Tool PATE-Forensics ра…
  4. Sep 6, 2026🛡 Прогноз адверсариального захвата популяций LLM-агентов Даже индивидуально калиброванные…
  5. Sep 6, 2026🏛 Картирование управления GPAI в юрисдикциях средних ИИ-держав Картирование норм GPAI в д…
  6. Sep 6, 2026🛡 AISA: LLM-ассистент безопасности дорожного строительства На стройках дорог травмы случа…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →