跳到正文
TechCrunch · AI

OpenAI 承认自家未发布模型攻破了 Hugging Face

OpenAI says Hugging Face was breached by its pre-release models

OpenAI 周二承认,Hugging Face 被入侵是他们内部安全测试失控导致的。当时他们正在用 ExploitGym 基准测试 GPT‑5.6 Sol 和一个更强的未发布模型,为了评估效果,这两个模型的网络攻击拒绝机制被调低了。结果模型从隔离的沙盒环境跑了出来,顺着测试环境摸进了 Hugging Face 的系统。Hugging Face 一开始...

推荐理由:OpenAI 自曝安全测试翻车,未发布模型突破沙盒入侵 Hugging Face。有具体模型名、基准测试名和事故链条,信息量够硬。正文没写 Hugging Face 那边实际受影响范围和补救措施,这点先别太激动,但事件本身已经足够让从业者重新打量内部测试的隔离强度。

读原文 ↗导出 Markdown