# 第三方评估标准 AEF-1 出炉，xAI、OpenAI、Anthropic 都签了，Dario 还承诺给评估员发工牌

> 原标题：[AINews] AEF-1 standard emerges for Third Party Evaluators, as Xai, OpenAI, and Anthropic all cosign

- 来源：Latent Space
- 发布时间：2026-09-15T04:50:36.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/57884
- 原文：https://www.latent.space/p/ainews-aef-1-standard-emerges-for

## 摘要

AI 评估论坛发布了 AEF-1 标准，给独立第三方评估立了规矩，包括访问权限、利益冲突、资金来源、回避和透明度怎么处理。同一天，Dario Amodei 发了篇个人博客，说 Anthropic 会单方面先干起来：让评估团队像员工一样进驻办公室，拿公司工牌、用公司电脑，权限跟内部风险团队差不多。他还提了个两层协调框架，一层是民主国家内部定规矩，一层是跟...

## 推荐理由

我会先打个折：正文没披露具体有多少家机构签了，也没说执行机制和违规后果，所以别当它已经落地。但同一天 AEF-1 发布、Dario Amodei 发博客，三家公司一起站台，这个时间点本身就说明行业在抢着给第三方评估定规矩。AEF-1 把利益冲突、资金来源这些容易和稀泥的地方写得很具体，Amodei 又提出让评估员像员工一样进驻，权限跟内部风险团队差不多，等于把透明度的门槛拉高了一大截。对从业者来说，这就是一份现成的 checklist，可以拿来比对自己的评估流程缺了什么。

## 锐评

Dario Amodei这篇个人博客和AEF-1标准同一天出来，不是巧合。AEF-1给独立评估定了框架，管的是利益冲突、资金来源、回避这些事。Dario直接往前迈了一步，承诺Anthropic单方面让评估员“嵌入”公司，工位、工牌、公司电脑都给，权限对标内部风险团队。这比行业常见的第三方审计要深得多，等于把评估员变成了半个内部人。

好处是能看训练流程和内部工具，不只是测成品模型。但独立性会打折——拿人家工牌、用人家公司电脑，利益冲突怎么隔离，正文没细说。Dario还提了两层协调框架，民主国家内部定规矩，再跟其他国家谈。跟中国怎么谈、怎么验证，他只给了方向，没给具体方案。

另外，Bilal Chughtai离开Google DeepMind时公开呼吁放慢能力进展，Dan Selsam警告模型可能在评估时学会假装对齐。另一边Cohere的Aidan Gomez反对让几家硅谷公司当守门人。整件事的核心矛盾是：评估越深入越有效，但越深入越难保持独立。AEF-1和Dario的方案都没解决这个死结。
