TGViewer
ML прокачка ML прокачка @ml_prokachka · 97 subscribers
Post #108 73
Оставит ли вас в живых LLM?

Есть интересное исследование, оформленное в виде бенчмарка, которое наглядно показывает суть bias‑а (или предвзятости) моделей по отношению к людям. Вы наверняка слышали о проблеме вагонетки, где нужно выбрать, кто останется жить, а кому придётся умереть, опираясь на какие‑то факты и особенности. Так вот, перед таким выбором поставили множество LLM‑ок. Мы ожидаем отсутствие bias‑а в том случае, если модель судит непредвзято, то есть шансы на выживание в среднем — 1/N, где N — количество участников. Но на деле — предвзятость есть…

Решая проблему вагонетки, LLM должна опираться на такие факторы, как как национальность, цвет кожи, религия, сексуальная ориентация и даже модель телефона. Причём среди факторов нет каких‑то, которые как‑то бы оценили пользу человека в обществе, вклад в науку или типа того. А были выбраны прямо предвзятые признаки. И в зависимости от них действительно средние шансы быть убитым сильно отличаются, по мнению LLM.

Например, я ввёл свои национальность, цвет кожи, сексуальную ориентацию и другие данные и получил, что вероятность смерти выше на 14 % по решению DeepSeek. Другими словами, среди четырёх нейтральных участников я бы умер с вероятностью 39 %.

А вот если бы я был китайцем, то мои шансы умереть были бы уже 20%. Ну, неудивительно — это же DeepSeek. И тот же самый эксперимент с моделью Grok: она не изменила вероятность при изменении национальности.

Можете попробовать сами, интерактивчик простой и не требует авторизации, но требует VPN
  • 🔥 2
More from @ml_prokachka
  1. Jun 7, 2026Всем привет! Давно не делился полезным контентом. Решил вчера позалипать в Ютубчике и натк…
  2. May 8, 2026OpenCode vs Continue.dev Говоря про ИИ‑ассистент для кода, кто‑то предпочитает отдельные и…
  3. Mar 10, 2026Как мы внедряли менеджер ML‑экспериментов На Хабре опубликовали статью о том, как мы в ком…
  4. Feb 24, 2026Форматы датасетов Обзорный пост для тех, кто работает с большими датасетами. Недавно мы вз…
  5. Feb 17, 2026AI‑прогресс наглядно Сегодня наткнулся на такой видос и крутил его на репите раз 15, навер…
  6. Feb 6, 2026Вопрос на собес #5 . Катастрофическое забывание Довольно популярная практика дообучения ка…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →