TGViewer
Дата канальи Дата канальи @datarascals · 6.26K subscribers
Post #26 1.66K
#ML

Продолжая тему данных или почему мучения каналий из прошлого поста были направсны.
Всем подписчикам знакома картинка с пандой из статьи десятилетней давности Яна Goodfellow на ICLR’15 с примером, показывающим, что если добавлять малые, но не случайные, возмущения к картинке с пандой, можно получить картинку-объект, на котором модель будет ошибаться и называть панду гиббоном. Такие объекты называются adversarial examples и чаще всего причиной их существования является underfitting моделей – слишкому уж они линейны в смысле разделяющей поверхности.

Так вот, эти adversarial examples устойчивы к добавлению случайного шума и, более того, они частично сохраняются даже при смене типов модели! 😱😱😱 (см картинку из другой его статьи тех же времен).

Если смена моделей и их тюнинг становятся похожими на перемещение кроватей в борделе – надо таки глянуть в датасет, для этого, правда, нужно обладать фантазией и кругозором.
В эпоху трансформеров, llm, агентов, канальи стали забывать формулу shit in == shit out 💩. И этому есть и организационные причины, и инженерные, о чем и поговорим дальше.
  • 👍 8
More from @datarascals
  1. Sep 26, 2026#ML #корпжиза В комментах к посту про транзакции отметились ребята кто делал очень похожие…
  2. Sep 25, 2026#ML Есть у меня искренняя убежденность что Knowledge Graphs все же не самый плохой подход…
  3. Sep 22, 2026Протестируй своё решение на задаче и данных от ПАО «Интер РАО» На хакатоне ты создашь умно…
  4. Sep 20, 2026#ML #корпшиза Про регэкспы В комментах к посту про IFы в проде вспомнили про регэкспы. Ест…
  5. Sep 17, 2026Из серии «подслушано у кулера» — У нас в проектном офисе уже больше 50 человек! — А почему…
  6. Sep 17, 2026утренний ребус тщеславия оригинал
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →