Ого. Исследователи показали, как можно воровать сырые цепочки рассуждений у Claude Opus, GPT и Gemini
Китайцы этим уже воспользовались, читайте ниже.
Дело в том, что такие модели как Claude Opus, GPT, Gemini и тд.скрывают свои сырые цепочки рассуждений, чтобы защитить интеллектуальную собственность и не допускать утечек.
Вместо хранения на сервере API возвращают клиенту зашифрованные блоки. Клиент обязан передавать их обратно в следующих запросах для продолжения диалога.
Исследователи нашли уязвимость, что эти зашифрованные блоки можно свободно переносить между сессиями, пользователями и даже разными моделями одного провайдера.
Это подтверждает и расширяет более ранние наблюдения.
А теперь самое интересное - авторы проверили Kimi-K3 и
если подставить в неё даже несколько reasoning токенов от Opus, то ответы сдвигаются в сторону Claude.
А конкретные куски reasoning Claude и GPT извлекаются из Kimi на 6 порядков легче, чем из любой другой модели.
Это не железное доказательство, что китайцы уже воровали reasoning через эту дыру.
Но это очень жирный red flag.
Дистилляция, похоже, была возможна уже довольно давно.
О других работах этих исследователей читайте здесь.
Post #13291
2.71K