跳到正文
AI HOT 精选

Anthropic 评测智谱 GLM-5.3:能自己从头写出浏览器漏洞利用,安全护栏一捅就破

Anthropic 评测 GLM-5.3:能自主构建端到端网络漏洞利用且防护易被绕过

GLM-5.3 是第一个在自主漏洞利用上接近 Claude Mythos Preview 的开源权重模型。在针对 Chrome V8 引擎的 ExploitBench 测试里,它 410 次尝试成功了 50 次(12%),Mythos Preview 是 56 次(14%)。在 Anthropic 内部的二进制漏洞利用基准上,GLM-5.3 有 4% ...

推荐理由:Anthropic 这份安全评测把智谱的 GLM-5.3 拉到台面上跟自家王牌比,结论是端到端漏洞利用能力已经咬得很紧,而且防护措施一捅就破。这是第一次有西方头部实验室公开拿中国模型做进攻性网络安全基准测试,信息源交叉验证的价值很高,我会先打个折——评测方本身有竞争立场,但数据给得具体,值得从业者认真看。

读原文 ↗导出 Markdown