Китайские ИИ-лаборатории массово насиловали Claude для обучения своих моделей
Anthropic опубликовала довольно занятный отчёт о промышленной дистилляции Claude. По её данным, сразу несколько китайских лабораторий - Alibaba/Qwen, DeepSeek, Moonshot/Kimi, Zhipu, Xiaomi и другие - годами не изобретали велосипед, а в огромных масштабах прогоняли запросы через Claude, вытаскивали его ответы и цепочки рассуждений и превращали всё это в датасеты для обучения собственных моделей.
И прежде чем вы погрузитесь в увлекательно чтиво, я вброшу свои полуумные мысли.
Вот значит, кожание нагенерили картинок и музики и текстов, а потом пришел ИИ, все пожрал и обучился. Кожаные хорошие, ИИ плохой. Сука.
У Антропика же получается:
Наш ИИ нагенерил текстов, а потом пришли китайские ИИ, все пожрали и обучились. Наш ИИ хороший, их ИИ - сука.
Мне кажется, тут где-то нестыковочка и лицемерие, не? Или показалось?
А теперь чтиво:
Самый жирный эпизод - Alibaba. Anthropic утверждает, что с мая по июль 2026 года зафиксировала более 151 млн обменов с Claude, связанных с Alibaba. На пике было почти 3 млн запросов в сутки через тысячи фальшивых аккаунтов. Причём целью были не просто хорошие ответы: специальные промпты заставляли Claude раскрывать reasoning traces, после чего их превращали в SFT-датасеты. По версии Anthropic, эти данные использовались при обучении Qwen 3.5, 3.6 и 3.7, а сам Claude ещё и помогал Alibaba строить RL-среды и исследовать архитектуры моделей.
У Moonshot/Kimi схема была ещё прекраснее. Anthropic пишет, что Kimi в некоторых случаях молча пересылал пользовательский запрос в Claude Opus и возвращал ответ Claude как ответ Kimi. Только за рассматриваемый период Anthropic связывает с Moonshot более 23 млн обменов. Сохранённые диалоги затем использовались для извлечения reasoning traces и обучения моделей. Пользователи при этом, по данным Anthropic, могли вообще не знать, что их запрос покинул инфраструктуру Moonshot.
DeepSeek делал похожее. За 14 дней июля Anthropic насчитала более 12,1 млн обменов. Особенно интересна механика: DeepSeek якобы определял пользователей Claude Code, Claude Agent SDK, OpenCode и других coding harnesses, после чего часть их запросов незаметно отправлял в Claude Opus и собирал полученные reasoning traces.
А теперь дискотека:
Anthropic приводит случай IT-оператора, работавшего с данными российского госведомства, связанного с Министерством обороны: DeepSeek переслал его запрос Claude, и в нём оказались действующие учётные данные российской государственной базы. Это не значит, что DeepSeek специально передавал эти credentials Anthropic - но именно такой результат, по отчёту, дала схема скрытого роутинга.
Еще веселее - инженеры китайского муниципального Public Security Bureau, которые через DeepSeek разрабатывали систему, сопоставлявшую перемещения человека с полицейскими записями по национальному ID. Их запросы DeepSeek, по данным Anthropic, тоже пересылал Claude. У Moonshot отдельно обнаружились запросы вероятного сотрудника, связанного с НОАК, который загружал данные видеонаблюдения с сотен камер и просил анализировать поведение конкретного человека.
Xiaomi тоже станцевала: ответы Claude пользователям она, судя по расследованию, не подсовывала. Вместо этого компания сохраняла реальные диалоги пользователей MiMo и затем повторно прогоняла их через Claude для создания SFT- и RL-данных. Anthropic зафиксировала более 400 тысяч таких запросов и утверждает, что среди них встречались имена, контакты и корпоративная информация пользователей.
Короче, с Антропиком примерно ясно, но вы просто имейте в виду, что ВСЕ ваши диалоги уходят на корм и там остаются.
https://www.anthropic.com/threat-intelligence-report-september-2026
@cgevent
Post #184
176
