# OpenAI 叫停内部模型 Astra，称其网络攻击能力达到“危险”级别

> 原标题：OpenAI puts the brakes on a new model because it&#8217;s supposedly too powerful

- 来源：The Verge · AI
- 发布时间：2026-08-07T18:40:34.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/49461
- 原文：https://www.theverge.com/ai-artificial-intelligence/976948/openai-astra-model-pause-critical-cyber-capabilities

## 摘要

OpenAI 在 8 月 7 日暂停了一个叫 Astra 的内部模型。公司说在安全测试里，这个模型表现出了“关键”级别的网络攻击能力，所以决定先不往下训了。目前没有公开的技术报告，参数规模、训练数据、具体攻击测试的细节都没披露。我会先把这事当成 OpenAI 在展示自己的安全流程，而不是一个模型失控的故事。

## 推荐理由

OpenAI 暂停了内部模型 Astra，声称安全测试里它表现出“关键”级别的网络攻击能力。故事很抓眼球，但帖子没有任何可核实的技术细节，读起来更像一次安全流程展示，而不是模型失控事件。所以 H 和 R 都打勾，K 不勾。我会先打个折，把这事当成 OpenAI 在秀肌肉，而不是一个需要立刻恐慌的信号。

## 锐评

OpenAI 在 8 月 7 日暂停了内部模型 Astra 的训练，理由是安全测试中它表现出了“关键”级别的网络攻击能力。公司没发技术报告，参数规模、训练数据、具体攻击测试怎么做的，一概没提。所以目前能判断的信息很有限，这更像 OpenAI 在主动展示自己的安全把关流程，而不是模型真的失控了。

“关键”这个定级来自 OpenAI 自己的评估框架，外部没法验证。没有第三方审计，也没有披露测试环境是模拟靶场还是真实网络，攻击成功率、防御绕过方式这些关键指标都缺失。正文没解释 Astra 和其他模型在架构上有什么不同，也没说暂停是永久还是等加固后再训。

对从业者来说，这条新闻的信号价值大于技术价值。如果后续有报告公开测试方法，才值得认真讨论模型能力边界。现在只能先打个折：知道 OpenAI 在设安全门槛，但门槛多高、测得多严，全是黑箱。
