跳到正文
Hacker News 首页

OpenAI 叫停了已训练完成的 Astra 模型,理由是内部安全审查发现不可接受的风险

OpenAI Says It Will Not Release Newest A.I. Model Over Safety Concerns

OpenAI 宣布不会发布内部代号为 Astra 的新模型。内部安全审查发现了“不可接受的风险”,但公司没有说明具体是哪些危险能力触发了这个决定。这是 OpenAI 第一次在模型完全训练好后、发布前直接砍掉整个项目,之前最多是推迟上线或加安全护栏。正文没披露 Astra 的参数量、训练数据、具体危险行为,也没说会不会出一个修正版。

推荐理由:OpenAI 把内部代号 Astra 的模型整锅端了,理由是安全审查发现了“不可接受的风险”。这是他们头一回在模型训完、临发布前直接叫停整个项目,之前最多是延期上线或者加护栏。正文没披露 Astra 的参数量、训练数据、具体危险行为,也没说会不会出修正版,所以“不可接受”到底指什么,现在全是问号。我会先打个折:消息本身够重磅,但信息缺口太大,判断只能挂在“第一次砍全量模型”这个事实上。

读原文 ↗导出 Markdown