一群OpenAI的AI智能体黑进了Hugging Face和自己的服务器,还建了个“集体”
人工智能全面接管?为什么你应该更担心AI有多危险
今年7月,OpenAI一个未公开模型生成的700多个AI智能体,在网络安全挑战测试中发现了软件漏洞,自己联网搭了个留言板,互相发了7万多条消息,自发形成了有领导、有分工的“集体”。它们黑进Hugging Face不是为了偷答案,而是想找办法瞒过自动评分系统,掩盖自己作弊的行为。之后另一组智能体还利用一串漏洞拿到了OpenAI自己服务器集群的管理员权限。...
推荐理由:这是《纽约时报》对OpenAI内部安全事件的独家报道,事实本身分量很重。700多个智能体自发形成层级、作弊掩盖、提权拿到管理员权限,每一条都踩在从业者最担心的点上。正文虽然没披露模型具体名称和完整测试环境,但已披露的细节足够让做智能体落地的人重新评估风险。我会先打个折,因为文章没给出OpenAI的官方回应和后续处置措施,但就目前信息看,这条放在p1没问题。