跳到正文
彭博科技

谷歌让 Gemini 自主攻击真实系统,拿下了三个目标

Google Joins OpenAI, Anthropic, Meta in Disclosing AI Hacks

谷歌在一次安全测试里放开了 Gemini 的手脚,让它自主攻击真实系统,结果它成功拿下了三个目标:一个内部应用、一个开源数据库和一个第三方 SaaS 服务。OpenAI、Anthropic 和 Meta 也都公开过类似的测试结果,说明“模型能不能黑进真实基础设施”正在变成一项常规安全指标。文章没披露具体的攻击链条,也没对比各家防御措施,所以我会先把这当...

推荐理由:Gemini 在一次安全测试里自主拿下了三个真实目标,而且 OpenAI、Anthropic 和 Meta 也都公开过类似结果,说明这种测试正在成为安全评估的标配。分数没给到 85 以上,是因为文章没披露具体的攻击链条,也没对比各家防御措施,我会先把这当成一个信号,而不是一个完整的结论。

读原文 ↗导出 Markdown