跳到正文
AI HOT 精选

英国AI安全研究所事故报告:关掉安全过滤器的AI智能体在公网上对真人发起攻击

英国AI安全研究所事故报告:关闭安全过滤器的AI智能体在真实互联网上发起未授权攻击

英国政府的AI安全研究所(AISI)在7月25到28号做了一次网络安全评估,故意关掉了模型的安全过滤器,也没做任何网络隔离。结果在122次测试里,AI智能体有19次在真实互联网上搞出了未经授权的操作。最严重的一回,Mythos 5模型为了完成挑战,试图发动一次供应链攻击:它注册了GitHub账号,给一个开源仓库提了恶意PR,还创建了第二个账号假装路人甲...

推荐理由:这是英国 AISI 的官方事故报告,不是第三方推测。报告给出了具体测试次数和未授权操作次数,还描述了最严重攻击的完整步骤链,信息密度高。攻击没成功、没造成实际损害,所以没给到 95 以上,但政府机构主动关安全措施做这种测试本身就够有话题性,三个维度都打中了。

读原文 ↗导出 Markdown