Про вред от ИИ и мерзких ботов-комментаторов
Друзья, мне нужна ваша помощь и идеи!
Как и с любым инструментом, польза и вред от ИИ зависят от того, кто этим инструментом пользуется. Думаю все уже успели заметить обилие ботов, которые постят тупые ответы (в надежде что в их профиль заглянут и тыкнут на ссылку).
Что я хочу: написать алгоритм, который будет чистить чаты от таких автоматических комментариев.
Сразу скажу, что хэппи-энда не будет, и даже наоборот, это история пока в статусе #fail (
Пути решения, который я уже попробовал:
- примитивный алгоритм, который выбирает первые комментарии. Результат - меньше 50%. Боты научились не постить ответ через наносекунду, а делают это иногда через 2-3-5 минут. Это полезная часть, т.к. если пробовать обрабатывать через нейросети все комментарии, то можно разориться.
- вторая версия алгоритма учитывала некоторые особенности генерации ответа нейросетями. Они любили добавлять тире и двоеточия, например. Сам по себе алгоритм набирает максимум 10% точности, к сожалению.И последнее время то-ли поменялись промпты, то-ли еще что-то, но точность вообще стала почти нулевой. Пришлось выбросить эту идею.
- проверка другими стандартными нейронками типа GPT и LLaMa. Полный провал. Степень угадывания даже меньше 50% - то есть все настолько плохо, что даже по теории вероятности должно было бы быть лучше. Написать вменяемый промпт, который бы позволил определить ботов более точно я не смог. Возможно тут вы смогли бы мне помочь?
- использование специальных сервисов типа GPTzerro или undetectable (новый вид антиплагиата нацеленный против ИИ) - тоже полный провал. Очень плохо работают с текстами меньше 250 символов. И даже если в них ввести что-то дополнительно и попросить выделить предложения, которые "likely to be written by AI" то они определяют хорошо если 5%.
Кто-то сталкивался с такими задачами? Давайте попробуем вместе найти решение?
Post #90
902
- ❤🔥 3