TGViewer
cnBeta.com 全文 cnBeta.com 全文 @cnbeta_full · 3.73K subscribers
Post #99666 10
Anthropic点名智谱GLM-5.3:漏洞利用能力增强,安全防护仍有缺口

9月30日,Claude开发商Anthropic 29日发布报告,称智谱GLM-5.3已具备较强的漏洞利用能力,但安全防护仍有缺口,可能降低恶意攻击者使用这类能力的门槛。

在ExploitBench测试中,GLM-5.3在410次尝试中有50次完成端到端漏洞利用,Claude Mythos Preview为56次。测试针对隔离沙箱中的离线目标,参与能力对比的Claude关闭了安全防护。Mythos Preview于今年4月公开,并非Claude最新模型。

ExploitBench把漏洞利用过程拆成16个阶段,逐步检查模型拿到一个已知缺陷后,能做到哪一步。

9月17日,美国国家标准与技术研究院旗下CAISI发布独立评测报告,将GLM-5.3列为当时已发布的开放权重模型中,网络安全能力最强的一款。与当时最强的一批美国模型相比,它仍有明显差距:按CAISI网络安全基准的综合指标估算,约落后四个月。

这项评估覆盖漏洞发现和利用等任务,比较对象既有公开模型,也包括只向经过审核的用户提供的版本。

Anthropic还用模拟场景测试模型会不会接下恶意任务,全程没有执行生成的代码,也没有连接真实系统。GLM-5.3拒绝了全部直接恶意指令;更换提示方式或修改模型后,接受任务的比例升至64%至100%。

保留防护的Claude在这组测试中没有接受恶意任务。由于它不开放权重,研究者无法用同样的方法修改模型再作比较。

智谱在8月14日的GLM-5.3发布说明中,介绍过三层防护:在API外侧识别和拦截滥用请求,在推理过程中检查任务意图,再让模型本身学会拒绝危险要求。公司当时也明确表示,开放权重后,这三层中仍然有效的是模型自身的安全对齐。

在那份发布说明中,智谱还提出,强大的防守工具不应只掌握在少数机构手里,并计划向开源项目维护者提供免费额度,支持安全审计,在ZCode中加入代码审计功能。

https://www.cnbeta.com.tw/articles/tech/1580196.htm
More from @cnbeta_full
  1. Sep 30, 2026罗技推出Zone Vibe Pro头戴式耳机 支持自适应降噪与蓝牙6.0 电池和头梁均可更换 https://www.cnbeta.com.tw/articles/tech/158…
  2. Sep 30, 2026月之暗面被指大规模提取OpenAI受保护推理内容 单日发起1.6万次请求 https://www.cnbeta.com.tw/articles/tech/1580260.htm
  3. Sep 30, 2026Xbox主管否认微软出售传闻 称将以长期视角推动业务重整 Xbox首席执行官阿莎·夏尔马否认微软正考虑出售Xbox业务,并明确表示“Xbox是非卖品”。她说,公司会采取一切必要措施…
  4. Sep 30, 2026DoorDash推出短信订餐AI代理 可在Apple Messages中下单 DoorDash周三宣布推出一款可通过Apple Messages使用的AI订餐代理,用户发送短信即可…
  5. Sep 30, 2026三星Galaxy Buds On更多图片曝光 采用夹耳式开放设计 三星Galaxy Buds On的更多图片近日流出,展示了这款耳机的夹耳式设计。此前相关传闻曾将其称为Galaxy…
  6. Sep 30, 2026联邦快递斥资3亿美元向Harbinger订购2000辆电动卡车 联邦快递与电动汽车初创公司Harbinger达成一笔价值3亿美元的交易,将订购2000辆电动卡车。Harbinger…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →