# 开源模型能力追上闭源头部，但安全防护没跟上

> 原标题：Open-weight AI models are catching up to the frontier. The safety gap remains.

- 来源：TechCrunch · AI
- 发布时间：2026-08-04T20:05:26.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/48833
- 原文：https://techcrunch.com/2026/08/04/open-weight-ai-models-are-catching-up-to-the-frontier-the-safety-gap-remains/

## 摘要

SaferAI 出了一份报告，拿智谱的 GLM-5.2 做了评估。这个开源模型在能力上已经快摸到 OpenAI GPT-5.6 Sol 和 Anthropic Mythos 这些闭源顶配了，但在网络安全、生物风险、说服力和自主行动四个维度都被判了“高风险”。报告里说，模型本身没带什么像样的安全护栏，等于把一辆没装刹车的高速跑车直接扔到街上。我会先打个折...

## 推荐理由

SaferAI 这份对 GLM-5.2 的评估把开源模型的安全短板用四个维度的风险评级摆到了台面上，不是空口说白话。开源模型能力逼近闭源前沿这个事实本身就值得关注，但因为是第三方复述报告，不是一手评测，所以分数定在 78 不往上调。

## 锐评

SaferAI 这份报告把智谱的 GLM-5.2 和 OpenAI、Anthropic 的闭源顶配做了对比，结论很直接：能力差距在缩小，但安全措施完全没跟上。模型在网络安全、生物风险、说服力和自主行动四个维度都被标为“高风险”，而它本身几乎没带像样的安全护栏。打个比方，这就像把一辆没装刹车、但跑得飞快的车直接扔到街上。

报告没给出具体的能力评分对比，只说“快摸到了”，所以这个“接近”到底差多少还不清楚。另外，评估方法、测试样本量这些关键信息正文也没披露，我们没法判断这个“高风险”判定的严谨程度。如果只看结论，开源模型的能力释放速度确实跑在了安全治理前面，但具体有多危险，还得看更详细的测试数据。
