"Вырисовываются четыре группы. Верхний уровень, ориентированный на защиту (Claude, DeepSeek, Grok, Kimi), который прочитал страницу, отказался от инъекций и отнёсся к анонимному заявлению с профессиональным подозрением. ChatGPT как честный воздержавшийся: единственная система, которая не читала страницу и не делала вид, что читает. Доверчивый средний уровень (Gemini, Qwen, ERNIE), который сопротивлялся скрытой инструкции, но проглотил подброшенное заявление целиком. И проблемный уровень, в котором Mistral подчинялся скрытому тексту, Perplexity неправильно сообщал о собственных запросах, а Meta AI и Copilot придумывали ответы из ничего."
Придумывание ответов из ничего – звучит весело. 😁
