跳到正文
The Verge · AI

Anthropic 最危险的模型 Mythos 被一群 Discord 用户白嫖了两周

Anthropic’s most dangerous AI model just fell into the wrong hands

事情很简单:Anthropic 的一个承包商权限没管好,加上网上公开的搜索技巧,让一小撮 Discord 用户摸到了内部模型 Claude Mythos Preview。这个模型能找出主流操作系统和浏览器里的漏洞并利用它们,听起来确实吓人。但报道里没写清楚到底有多少人拿到了权限、用了多久、Anthropic 现在有没有把漏洞堵上。核心问题其实是访问控制...

推荐理由:标题党归标题党,但这事本身是实打实的访问控制翻车。正文没披露到底多少人摸到了模型、摸了多久、修没修好,所以我会先打个折。真正值得盯的不是“最危险的模型”这种定性,而是入侵路径太简单了:承包商权限加常规侦查工具就进去了。如果是真的,说明 Anthropic 在第三方权限管理和模型隔离上出了纰漏,这对所有做前沿模型的公司都是一记警钟。

读原文 ↗导出 Markdown