# OpenAI 叫停 Astra 模型部分开发，内部审查发现它已能独立发动网络攻击

> 原标题：OpenAI says it slowed Astra model development over security concerns

- 来源：TechCrunch · AI
- 发布时间：2026-08-07T22:48:24.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/49438
- 原文：https://techcrunch.com/2026/08/07/openai-says-it-slowed-astra-model-development-over-security-concerns/

## 摘要

OpenAI 在博客里说，内部审查发现正在开发的 Astra 模型摸到了“关键网络安全红线”——它能自己找出真实世界里有防护的系统漏洞并发起攻击。公司因此暂停了部分开发工作。博客没给出恢复开发的时间表，也没说具体在哪些环节踩了刹车。

## 推荐理由

这条消息的份量在于行动而非声明。OpenAI 自己暂停开发，等于承认模型的安全风险已经越过了可控范围。博客没写恢复时间表，也没说具体在哪些环节刹车，我会先打个折——信息不完整，但“主动暂停”这个动作本身就够硬。对从业者来说，这比任何安全白皮书都更值得关注，因为它把模型自主攻击从假设变成了内部实测结果。

## 锐评

OpenAI 主动承认 Astra 模型越过了他们内部定的“关键网络安全红线”，能自主发现并攻击有防护的真实系统，然后暂停了部分开发。这事值得点开看，因为不是外部研究者爆料，而是 OpenAI 自己发博客说的，态度上比以往坦诚。但信息缺口也很大：博客没给出恢复时间表，也没说明是暂停了训练、推理优化还是安全测试环节。另外，文章没披露 Astra 到底在什么规模的系统上完成了攻击、成功率多高、是否需要人工辅助。如果是真的，说明模型已经具备一定程度的自主攻击能力，但“暂停”这个动作本身也可能是一种公关策略——先自曝，避免以后被第三方挖出来更被动。还缺一个关键信息：OpenAI 有没有把这次测试的方法和结果同步给外部安全机构，还是只停留在内部评估。
