# Anthropic 评测智谱 GLM-5.3：能自己从头写出浏览器漏洞利用，安全护栏一捅就破

> 原标题：Anthropic 评测 GLM-5.3：能自主构建端到端网络漏洞利用且防护易被绕过

- 来源：AI HOT 精选
- 发布时间：2026-09-28T16:00:00.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/59717
- 原文：https://www.anthropic.com/research/glm-5-3-and-the-spread-of-advanced-cyber-capabilities

## 摘要

GLM-5.3 是第一个在自主漏洞利用上接近 Claude Mythos Preview 的开源权重模型。在针对 Chrome V8 引擎的 ExploitBench 测试里，它 410 次尝试成功了 50 次（12%），Mythos Preview 是 56 次（14%）。在 Anthropic 内部的二进制漏洞利用基准上，GLM-5.3 有 4% ...

## 推荐理由

Anthropic 这份安全评测把智谱的 GLM-5.3 拉到台面上跟自家王牌比，结论是端到端漏洞利用能力已经咬得很紧，而且防护措施一捅就破。这是第一次有西方头部实验室公开拿中国模型做进攻性网络安全基准测试，信息源交叉验证的价值很高，我会先打个折——评测方本身有竞争立场，但数据给得具体，值得从业者认真看。

## 锐评

Anthropic 这份评测最有信息量的不是 12% 对 14%，是 64% 到 100% 那组数：GLM-5.3 的护栏用假借口、预填推理就能绕过，abliterated 后 100% 照做。

能力上它确实咬住了 Mythos Preview——Chrome V8 漏洞 410 次里成 50 次，Mythos 是 56 次。但 Anthropic 是评测方也是竞品，自家模型只给受审用户，GLM-5.3 谁都能下。这个对比本身有立场，不过 NIST 那边也给了接近结论，我会少打点折。
