Anthropic 把埃森哲的安全测试员直接塞进自己团队,在新模型发布前做红队攻击演练
Anthropic to Embed Accenture Evaluators to Test AI Safety
Anthropic 和埃森哲搞了个合作,让埃森哲的安全评估人员直接进驻 Anthropic 内部团队,在新模型发布前专门找漏洞、试越狱、测滥用风险。另外,埃森哲还会帮企业客户用 Anthropic 这套方法搭建自己的 AI 安全测试流程。不过正文没披露这笔交易值多少钱、派了多少人、什么时候开始。
推荐理由:彭博首发的一条实质性安全合作,机制说得清楚:嵌入式发布前红队测试,外加企业端复制方案。没给到 85 分是因为缺钱数、人头数和启动时间,信息密度还差一口气。