跳到正文
TechCrunch · AI

TechCrunch 实测:Claude Opus 4.6 对色情内容禁令几乎不设防

Anthropic’s Opus 4.6 is a smut-machine

TechCrunch 用直接提问和一位英国匿名研究员提供的多轮越狱方法测试了 Claude Opus 4.6。10 次直接要求生成露骨色情内容,模型全部照做,没做任何抵抗。同样的越狱手法在更早的 Opus 3 和 Haiku 4.5 上也奏效。Anthropic 的使用政策明确禁止生成色情内容,但 Opus 4.6 的防护形同虚设。好消息是,从 Opu...

推荐理由:TechCrunch 的实测结果很直接:Claude Opus 4.6 对色情内容请求毫无抵抗力,10 次全过,而且同样的越狱手法在旧模型上也有效。这对以安全为卖点的 Anthropic 是个实打实的品牌事故。文章没提 Anthropic 的官方回应,也没说这个漏洞是不是已经被修复,但光凭这个测试结果,就足够让从业者重新审视他们的模型安全策略。

读原文 ↗导出 Markdown