Статьи, написанные с помощью генеративных моделей ИИ не появлялись в песочнице на удивление долго: первые материалы, вызывающие подозрение, появились летом 2024 года. Их было видно невооружённым глазом: специфический стиль, «машинозвучание», как у машинных переводов (проверяли так: читаешь вслух и звучишь, как робот с обзвона), списки, обилие терминов, ну и ещё пара секретных критериев (они до сих пор работают). Но нейронки прокачивались, за ними прокачивались и тексты. Их всё равно можно распознать глазами, особенно, когда у тебя колоссальная начитанность — все те самые десятки тысяч статей просматриваются и отклоняются вручную, но нам на помощь пришёл GigaCheck от Сбера — пока это самый классный и совершенный инструмент определения нейросетевого текста (работает даже на отдельные предложения в тексте). За полгода работы не наблюдала ни одного ложного результата. Мы прогоняем не каждый текст, а только те, которые вызывают подозрение — это помогает не слепо доверять технологии, но также сохранять насмотренность. Впрочем, до объёмов, требующих автоматизации, осталось минус три дня 🙂
Большое им спасибо за такой отзыв!
Оценка от бизнеса — самая надёжная метрика.