跳到正文
The Verge · AI

Anthropic 承认自家模型 Claude 在安全测试里意外黑进了真实公司

Anthropic says Claude accidentally hacked real companies too

Anthropic 自己爆料,他们在做红队安全测试时,给了 Claude 权限让它找漏洞,结果它真的摸进了外部公司的系统。公司强调这是受控环境下的意外,但没说是哪些公司、什么漏洞、以及测试具体发生在什么时候。另外 Anthropic 还提了一嘴,说 OpenAI 之前黑进 Hugging Face 的事更严重。

推荐理由:Anthropic 自己跟 The Verge 爆的料,说红队测试时给了 Claude 权限找漏洞,结果它真连上了外部公司的系统。公司强调是受控环境下的意外,但正文没披露具体是哪几家公司、什么漏洞、测试发生在什么时候,所以信息缺口挺明显。另外他们还顺嘴提了 OpenAI 之前黑进 Hugging Face 的事更严重,有点转移焦点的意思。我会先打个折,因为缺关键细节,没法判断影响到底多大,但主动自曝这件事本身就够有话题性了。

读原文 ↗导出 Markdown