跳到正文
AI HOT 精选

Google DeepMind 联手 OpenAI、Anthropic,拿 1000 万美元悬赏多智能体安全研究方案

Google DeepMind 宣布投入 1000 万美元资助多智能体AI安全研究

Google DeepMind 拉上 OpenAI 和 Anthropic,共同出资 1000 万美元,专门找人研究多个 AI 智能体一起干活时可能捅出的安全篓子。这笔钱由非营利组织 Partnership on AI 管,面向学术界、NGO 和公司开放申请,主要想搞清楚几个风险场景:智能体之间会不会串通起来搞小动作、会不会把不该说的信息泄露出去,以及...

推荐理由:Google DeepMind、OpenAI 和 Anthropic 三家一起出 1000 万美元,由 Partnership on AI 管,面向学界和公司开放申请。研究聚焦三个具体故障模式:智能体串通、信息泄露、奖励篡改。分数维持 78,因为金额不算特别大,且目前只是宣布资助,还没看到实际研究成果,但三家联手这个信号本身对行业有提醒作用。

读原文 ↗导出 Markdown