OpenAI 确认 Astra 模型达到网络安全“Critical”级别,将限制其最强攻击能力的使用范围
OpenAI 评定 Astra 达到网络安全 Critical 能力阈值,将受限发布
OpenAI 在 9 月 1 日确认,Astra 模型已触及自家《准备框架》中网络安全能力的最高档“Critical”。这意味着,给它合适的工具和权限,它就能在没人手把手指导的情况下,自己在很多加固过的系统里找到未知漏洞,并拼出完整的攻击链。内部测试里,Astra 在 ExploitBench 上拿了满分,还用出了两个零日漏洞。OpenAI 因此推迟了...
推荐理由:OpenAI 官方博客确认 Astra 触发了自家《准备框架》里网络安全的最高档 Critical,有硬证据(ExploitBench 满分、两个零日漏洞),并宣布限制发布。这是第一次有大厂用具体测试结果把自己的模型标到 Critical 并配上真实防护措施,不是空喊风险。我会先打个折:正文没披露那两个零日漏洞的严重程度和影响范围,也没说限制发布具体怎么执行,所以别急着脑补成天塌了。但光凭‘满分+真实零日+官方认账’这三点,已经足够让这篇东西成为本周最该被看见的文章。