# OpenAI 说未发布模型 Astra 可能摸到“高危”网络攻击门槛

> 原标题：Responding to the next frontier of critical cyber capabilities

- 来源：OpenAI News
- 发布时间：2026-08-07T15:20:00.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/49404
- 原文：https://openai.com/index/responding-next-frontier-critical-cyber-capabilities

## 摘要

OpenAI 在 8 月 7 日公布，内部测试发现即将推出的模型 Astra 在自主编程和网络安全上进步明显，昨晚他们判断已经不能排除模型达到自家安全框架里的“高危”级别。这个级别意味着模型能自己找漏洞、写攻击程序，在没人帮忙的情况下攻破现实中加固过的系统，或者只给一个大致目标就能策划并执行全新的端到端攻击。OpenAI 确认 Astra 没参与之前 ...

## 推荐理由

OpenAI 在 8 月 7 号发了篇博文，说他们内部测试下一代模型 Astra 时，发现这模型在写代码和搞网络安全上进步太猛，已经踩到了自家安全框架里“高危”的红线。我会先打个折，因为正文没披露具体测试细节和样本量，但光凭 OpenAI 自己站出来说“我们还没发布的模型可能已经能自己找漏洞、攻破加固系统了”，这在行业里就是个大新闻。之前没哪个头部实验室这么干过，等于提前给整个圈子敲了警钟。文章里对“高危”的定义写得很清楚，不是空泛的担忧，而是给出了具体的能力描述，这对做安全对齐和关注政策的人有直接参考价值。

## 锐评

OpenAI 这次主动说 Astra 可能摸到了自家安全框架里的“高危”线，这事本身比很多公关稿实在。按他们的定义，高危意味着模型能在没人帮忙的情况下，对现实里加固过的系统找出并写出零日漏洞攻击程序，或者只给一个大致目标就能策划并执行全新的端到端攻击。这个门槛不低，但正文没披露具体评测数据、样本量和误报率，只说“初步评估表现足够强，不能排除高危”。我会先打个折——没数字的判断，说服力有限。

他们同步停掉了 Astra 内部不符合新安全要求的活动，加了隔离测试环境、限制网络和工具访问、加密模型权重，还对所有智能体应用上了通用监控，会读模型的思考链并在高风险行为时打断。这些措施方向对，但效果要看执行。另外，他们明确说 Astra 没参与之前的 Hugging Face 事件，这点澄清了外界猜测。

现在还缺几块关键信息：高危判定具体卡在哪个任务上、第三方红队测试什么时候出结果、以及他们打算怎么在开放和风控之间划线。如果后续能补上这些，这条新闻才不只是“我们很厉害也很小心”的声明。
