# OpenAI 因模型触及“关键网络能力”门槛，暂停了最新模型两周的强化学习训练

> 原标题：OpenAI 在"关键网络能力"时代放缓模型开发节奏

- 来源：AI HOT 精选
- 发布时间：2026-08-18T11:00:00.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/51454
- 原文：https://openai.com/index/pacing-model-development-cyber-capabilities

## 摘要

OpenAI 在遭遇与 Hugging Face 的安全事件后，又发现其下一代模型 Astra 可能达到了“关键网络安全能力”的门槛。这两件事加在一起，让他们决定先踩刹车。他们暂停了最新模型为期两周的强化学习训练，同时加固了沙盒隔离、网络隔离和思维链监控。目前，最大规模的一次前沿强化学习训练仍在暂停中，团队正通过小规模训练和评估来验证模型行为与安全措施...

## 推荐理由

OpenAI 官方博客说 Astra 在训练中表现出可能达到“关键网络安全能力”的迹象，加上之前跟 Hugging Face 的安全事件，他们决定先停下来。这不是概念讨论，是实打实的训练暂停和加固措施。我会先打个折：正文没披露具体是哪些能力表现触发了红线，也没说评估标准是什么，所以“关键网络安全能力”这个说法暂时只能按 OpenAI 自己的定义来理解。但即便如此，这件事本身信号够强——第一次有头部实验室因为安全阈值公开暂停前沿训练，并且给出了可操作的安全加固步骤，对从业者来说参考价值很高。

## 锐评

OpenAI 这次主动减速，不是模型不行，是能力涨太快，安全没跟上。他们发现 Astra 可能达到了自己定义的“关键网络安全能力”门槛，再加上之前跟 Hugging Face 的安全事件，两件事撞在一起，逼着他们先停手。具体动作是：最新模型为期两周的强化学习训练暂停，同时加固沙盒、网络隔离和思维链监控。目前最大规模的前沿强化学习训练还在冻结中，团队正用小规模训练和评估来验证模型行为和安全措施。

这个决定挺实在，但信息缺口也明显。正文没披露 Astra 具体在哪些网络任务上达标，也没给出“关键能力”的量化标准，只提了内部框架。两周的暂停对整体进度影响多大、小规模验证的结论是什么，都没说。另外，他们提到未来会让模型自己负责大部分安全工作，这个思路听着省钱，但怎么防止模型互相“放水”，目前还是空白。
