TGViewer
Reliable ML Reliable ML @reliable_ml · 6.6K subscribers
Post #67 2.38K
Разбор статьи от автора - DORA: Exploring outlier representations in Deep Neural Networks

Обнаружение аномальных репрезентаций в ResNet18, предобученной на ImageNet. DORA автоматически обнаруживает потенциально инфицированные нейроны (154, 314) — детекторы китайских водяных знаков. Соответствующие синтетические сигналы, активизирующие найденные репрезентации (и их ближайших соседей в пространстве репрезентаций) показаны в центре. Справа показана мера "инфицированности" нейронов в задаче бинарной классификации изображений с и без добавленных водяных знаков, где показатели представлены в виде ROC-кривых. Нейрон 154, найденный DORA, демонстрирует самое высокое значение AUC (зеленая кривая), за ним следуют его ближайшие соседи.

Ссылка на статью: https://arxiv.org/abs/2206.04530
Гитхаб: https://github.com/lapalap/dora

#tech #interpretable_ml
  • 👍 6
  • 🔥 1
More from @reliable_ml
  1. Sep 18, 2026Наслаждаюсь работой на конференции дата-аналитиков на экономическом факультете МГУ. Тут со…
  2. Sep 18, 2026Конференция дата-аналитиков на Экономфаке МГУ Новости за сегодня) Перепост ниже. Прийти на…
  3. Aug 4, 2026Не в тему - но про ИИ Тут пришли ребята (на самом деле девчата, @Antonina_Zhiteneva) - они…
  4. Jul 15, 2026LLM Evaluation как задача Causal Inference #1 Первая заметка серии, посвященной современны…
  5. Jul 14, 2026Ура, доклады с Датафеста! Секция ReliableML Датафеста доступна на сайте ods.ai https://ods…
  6. Jun 17, 2026Каникулы Бонифация Или ML System Design - наше все В этом году устроила для себя необычный…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →