TGViewer
Максим Максимов // IT, AI Максим Максимов // IT, AI @maks_it_ai · 697 subscribers
Post #131 676

Forwarded from _rnd

⚡️ Открываем NSFW-бенчмарк для систем модерации

В прошлых постах мы много говорили о фильтрации NSFW. А теперь выкатываем в открытый доступ наш двуязычный бенчмарк для систем модерации контента.

Что внутри датасета:
• контрастные пары — о которых мы уже писали,
• сложные пограничные примеры — hard negatives.

Все данные собирались, отсеивались и валидировались полностью вручную.

В карточке датасета рассказали, как устроена таксономия небезопасного контента. А ещё — добавили метрики популярных открытых моделей на этом датасете для удобного сравнения.

Тестируйте свои фильтры на прочность и делитесь мыслями в комментариях. 😍

↗️ Hugging Face

Автор этого поста, как и большинства предыдущих про безопасность, Андрей Иванов — NLP-инженер в R&D red_mad_robot.


#Безопасность
huggingface.co redmadrobot-rnd/nsfw_benchmark · Datasets at Hugging Face We’re on a journey to advance and democratize artificial intelligence through open source and open science.
  • 🤯 2
  • 🔥 1
More from @maks_it_ai
  1. Jul 8, 2026Как я разработал легковесный Guardrails для русского языка Написал статью на Хабр, в котор…
  2. Jun 11, 2026⚡️ Открываем бенчмарк для детекции PII в русском тексте Мы тут много рассказывали про рабо…
  3. Jun 6, 2026Как дообучить LLM. Рассказываю шаг за шагом Написал статью на Хабр, в которой рассказал ша…
  4. May 11, 2026Максим Максимов // IT, AI pinned «🤷 Когда использовать BERT, а когда LLM? Во время решени…
  5. May 11, 2026🤷 Когда использовать BERT, а когда LLM? Во время решения различных NLP задач ловлю себя н…
  6. Apr 24, 2026Максим Максимов // IT, AI pinned «🤑 Как платить меньше за инференс LLM Занимался изучение…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →