# OpenAI 因网络安全风险暂缓发布 Astra 模型

> 原标题：OpenAI：因网络安全风险，延缓 Astra 模型发布

- 来源：AI HOT 精选
- 发布时间：2026-08-07T23:08:56.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/49385
- 原文：https://www.ithome.com/0/987/221.htm

## 摘要

OpenAI 自己把还没发的模型 Astra 拦下来了，原因是它在内部安全测试里达到了“关键”风险级别。按 OpenAI 自己的标准，这意味着 Astra 已经能不用人帮忙就挖出真实系统里的零日漏洞，或者只给一个大致目标就能自己策划并执行完整的网络攻击。OpenAI 强调这模型没参与之前对 Hugging Face 的攻击。现在他们暂停了所有不满足新安...

## 推荐理由

OpenAI 主动披露未发布模型 Astra 在内部安全评估中达到“关键”网络安全风险级别，并因此暂停发布。这在公开信息里非常少见，等于直接承认模型已经具备自主发现零日漏洞和策划完整攻击的能力。文章给出了明确的风险定义和具体行为描述，不是模糊的“存在安全隐患”。OpenAI 还特意撇清与 Hugging Face 攻击事件的关系，说明他们预判了公众的联想方向。对从业者来说，这条消息把内部安全门槛的刻度亮了出来，值得细看。

## 锐评

OpenAI 首次承认一个模型在网络安全上达到了“关键”风险级别。按他们自己的标准，这意味着 Astra 不用人帮忙就能在真实系统里挖出零日漏洞，或者只给一个大致目标就能自己策划并执行完整的网络攻击。这个判断来自内部和外部专家的联合评估，不是随口一说。

OpenAI 现在暂停了所有不满足新安全要求的内部 Astra 活动，加了隔离环境、沙箱、思维链监控这些措施。Sam Altman 说模型很强，但还需要一点时间确保安全再公开发布。正文没给出任何发布时间表，也没说 Astra 的参数量、训练数据或具体架构。

还缺几个关键信息：一是“关键”风险的具体测试场景和成功率没公开，我们不知道这个能力是稳定复现还是偶发；二是 OpenAI 没说明这些安全措施是临时补丁还是长期方案，也没提第三方测试的结论。这些缺口让“延缓发布”看起来更像一次负责任的叫停，但到底要等多久、等到什么标准才算安全，目前全是空白。
