跳到正文
The Verge · AI

OpenAI 叫停内部模型 Astra,称其网络攻击能力达到“危险”级别

OpenAI puts the brakes on a new model because it’s supposedly too powerful

OpenAI 在 8 月 7 日暂停了一个叫 Astra 的内部模型。公司说在安全测试里,这个模型表现出了“关键”级别的网络攻击能力,所以决定先不往下训了。目前没有公开的技术报告,参数规模、训练数据、具体攻击测试的细节都没披露。我会先把这事当成 OpenAI 在展示自己的安全流程,而不是一个模型失控的故事。

推荐理由:OpenAI 暂停了内部模型 Astra,声称安全测试里它表现出“关键”级别的网络攻击能力。故事很抓眼球,但帖子没有任何可核实的技术细节,读起来更像一次安全流程展示,而不是模型失控事件。所以 H 和 R 都打勾,K 不勾。我会先打个折,把这事当成 OpenAI 在秀肌肉,而不是一个需要立刻恐慌的信号。

读原文 ↗导出 Markdown