Anthropic发布AI滥用报告:点名7家中国AI实验室“蒸馏”Claude,并披露多起AI参与武器研发案例
Anthropic 发布最新《检测与应对 AI 滥用》威胁情报报告,披露其在过去数月发现的一批 Claude 滥用案例。其中两部分内容受到关注:一是中国 AI 实验室针对 Claude 的大规模模型蒸馏,二是 Claude 被用于常规武器软件、仿真和技术方案开发。
在模型蒸馏方面,Anthropic 称,自 2026 年 2 月以来已发现并阻断来自 7 家中国 AI 实验室、针对 Claude Opus 系列模型的未经授权蒸馏活动。报告点名:
阿里巴巴 Qwen、月之暗面 Moonshot/Kimi、DeepSeek、智谱 Z.ai、小米 MiMo、MiniMax 和商汤 SenseTime。
其中阿里巴巴被 Anthropic 称为其迄今观察到规模最大的蒸馏行动,2026 年 5 月至 7 月期间涉及超过 1.51 亿次 Claude 交互,高峰时每天接近 300 万次,并通过数千个虚假账号获取 Claude 的推理数据,用于 Qwen 模型训练。
Moonshot 则被指曾将部分原本发送给 Kimi 的用户请求转发至 Claude,再保存相关交互用于模型训练;Anthropic 统计其 5 月至 7 月相关交互超过 2300 万次。DeepSeek 被指采用类似方法,在 7 月的 14 天内产生超过 1210 万次相关交互。
Anthropic 还称,小米将部分 MiMo 用户的对话和编程会话重新发送给 Claude,生成用于监督微调和强化学习的数据;智谱则被指提取 Claude 的思维链数据用于 GLM 后训练及网络安全能力训练。MiniMax 被指通过一家表面上与其没有关联的公司搭建代理服务,用于收集用户与美国前沿模型之间的交互;商汤的蒸馏数据中则包含从第三方数据供应商购买的 Claude 用户会话。
报告同时专门讨论了 AI 参与武器研发。
Anthropic 表示,过去一年调查并阻断了 6 起 Claude 涉及常规武器设计、软件研发、采购和情报收集的案例,其中 3 起位于中国、2 起位于俄罗斯、1 起位于也门。涉及反鱼雷系统、无人机蜂群、电子战、防空压制、导弹制导以及定向能武器情报等领域。
其中一项中国案例 GTG-17001 中,Anthropic 称,一名中国境内行为体使用 Claude 同时推进反鱼雷武器系统的三项工作:
起草一份反鱼雷火控系统中文技术规格书,计划提交中国国防制造商审批,并进一步进入技术认证和实装测试;
编写一份超过 200 页的中文技术建议书及管理层汇报材料;
根据公开资料分析美国反鱼雷、反潜项目,并形成美国海军相关系统的中文情报简报。
Anthropic 判断,该行为体可能与一家中国国防工业制造商有关,其目标是为中国人民解放军海军形成武器规格及采购方案,但报告同时明确表示,无法将这一活动归因至具体机构或个人。
另一项中国案例中,一名被 Anthropic 判断与中国军工研究机构有关的行为体使用 Claude 开发约 16 个电子战和压制防空软件模块,用于分析雷达、防空导弹阵地、指挥所和通信节点,并计算干扰效果、目标价值和攻击优先级。项目中途,模拟场景被调整为台湾的 12 个目标,包括预警雷达、爱国者及天弓防空阵地、主要空军基地等。
第三项中国案例则主要涉及情报收集。一名中国境内行为体利用 Claude 搜集先进定向能武器、高功率微波武器及其供应链公开信息,并制作面向中国党政、军事或国家安全高层内部流转的中文报告。
报告还披露了一个更直接体现“AI 软件工程师化”的案例。
Anthropic 称,位于也门北部的一组人员使用 Claude Code 直接替代部分人类软件工程师,开发导弹和火箭所需的制导、导航与控制(GNC)软件。
相关项目包括一枚采用手机级飞控计算机、具备末段制导能力的火箭,以及一款设计目标射程超过 2000 公里的多级弹道导弹。Claude 被用于编写飞控和位置估算代码、调整控制参数、运行固件编译流程以及进行飞行模拟。
相关人员还同时运行多个 Claude 实例,让一个负责写代码、一个负责研究、另一个负责代码审查,工作模式已经接近一个小型软件工程团队。Anthropic 称,该团队后来实际进行了一次制导火箭试射;试验似乎失败,相关人员数小时后再次使用 Claude 分析失败原因。
报告中的无人机蜂群案例则属于俄罗斯相关行动,并非上述 3 起中国案例之一。
Anthropic 已封禁其识别出的相关账号,并称正在强化针对模型蒸馏、武器研发以及其他高风险用途的检测机制。
*本文使用 GPT5.6 Sol 阅读该报告并总结。
📢 频道 @appdopic
Post #3968
2.24K

- 🤣 41
- ❤ 7
- 👀 1