TGViewer
SecureTechTalks SecureTechTalks @securetechtalks · 301 subscribers
Post #804 189
🧠🕵️ Claude Code нашли с "водяными знаками" в запросах

Исследователи обратили внимание на любопытную особенность Claude Code. Если клиент работает не через официальный API Anthropic, а через собственный прокси (ANTHROPIC_BASE_URL), он может незаметно изменять символы в системном промпте.

Вместо привычной строки:
Today's date is 2026-06-30
клиент использует визуально идентичные символы: другой апостроф или разделитель даты. Для пользователя и модели текст выглядит одинаково, но на сервер отправляется уже немного другой набор Unicode-символов.

Фактически это стеганографическая метка, встроенная прямо в системный контекст.

⚙️ Что именно кодируется?

По результатам реверс-инжиниринга логика появилась в версии 2.1.196.
При использовании собственного ANTHROPIC_BASE_URL клиент анализирует адрес прокси и, по утверждению исследователей, проверяет совпадение с набором заранее заданных доменов. Отдельно учитывается часовой пояс, например, Asia/Shanghai или Asia/Urumqi.

Полученные признаки кодируются изменением отдельных символов даты. При этом сами списки доменов, как сообщается, скрыты в бинарном файле с помощью Base64 и XOR-обфускации.

🧨 Зачем это нужно?

Наиболее вероятным объяснением является борьба с неофициальными прокси и массовой дистилляцией моделей.

Сегодня существует рынок прокси, которые перепродают доступ к Claude. Кроме того, через такие шлюзы можно автоматически собирать большие массивы ответов модели для последующего обучения собственных LLM.

Если выводы исследователей верны, подобные метки позволяют серверной стороне определить, что запрос, вероятно, пришёл не через официальный API.

🛡️ Почему это вызвало дискуссию?

Главная претензия не к самой идее защиты от дистилляции, а к её реализации. По данным реверс-инжиниринга, клиент с доступом к shell, Git и файловой системе анализирует параметры окружения и скрытно кодирует их в системном промпте, хотя подобное поведение не было описано в release notes. Для инструментов такого уровня привилегий прозрачность становится вопросом доверия.

Stay secure and read SecureTechTalks 📚

#кибербезопасность #AI #Claude #Anthropic #LLM #ReverseEngineering #AIsecurity #AgenticAI #SupplyChainSecurity #SecureTechTalks
  • 👍 1
  • 🔥 1
More from @securetechtalks
  1. Oct 1, 2026🧨 AI агенты выложили 13 000 внутренних скриншотов компаний в публичный Исследователи Glow…
  2. Sep 30, 2026🧨 MCP сервер может украсть OAuth токен через настоящий экран входа В официальном MCP Pyth…
  3. Sep 29, 2026🍷 Исследователи «напоили» LLM Команда UNSW решила проверить довольно странную гипотезу, ч…
  4. Sep 28, 2026🧨 GitHub отдал fuzzing AI агенту GitHub Security Lab открыла инструмент, который автомати…
  5. Sep 25, 2026🧨 Carbonato: ботнет устанавливает AI агента на взломанный сервер Исследователи ThreatDown…
  6. Sep 24, 2026🧨 CLOSEDQUORUM: вредоносное ПО передало управление атакой совету из четырёх LLM Cisco Tal…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →