跳到正文
热点事件历史事件

Anthropic 和 OpenAI 计划让第三方安全评估员进驻公司

3 篇报道2 个报道来源9 天前更新

先了解这件事

报道摘要

AI 评估论坛发布了 AEF-1 标准,给独立第三方评估立了规矩,包括访问权限、利益冲突、资金来源、回避和透明度怎么处理。同一天,Dario Amodei 发了篇个人博客,说 Anthropic 会单方面先干起来:让评估团队像员工一样进驻办公室,拿公司工牌、用公司电脑,权限跟内部风险团队差不多。他还提了个两层协调框架,一层是民主国家内部定规矩,一层是跟...

摘自 Latent Space

报道时间线

沿着报道,了解事件的不同侧面。

9月17日
  1. TechCrunch · AI精选
    Anthropic 和 OpenAI 都说要让外部安全评估员进驻公司,但独立性能打几折?

    Anthropic 的 CEO Dario Amodei 提议让第三方安全评估员直接进驻 AI 实验室内部,OpenAI 也表达了类似意向。研究人员对能拿到前所未有的内部访问权限表示欢迎,但提醒说钱、数据访问权和发表权都还捏在公司手里,独立性很难保证。文章没给出具体时间表,也没点名是哪家评估机构——目前还只是一次公开表态。

  2. TechCrunch · AI
    AI 实验室想搞内部审计,但也许他们该先把大门关上

    Anthropic 一位研究员因为担心 AI 会导致人类灭绝而辞职后,CEO Dario Amodei 呼吁引入外部机构来核查安全措施、报告事故,并评估模型训练流程是否对齐。OpenAI、Google 和 SpaceXAI 的高管都表态支持。但文章认为,有个更简单有效的办法一直被忽略:先把越狱和滥用的“前门”堵上,再谈建内部审计架构。具体怎么堵,正文没...

9月15日
  1. Latent Space精选
    第三方评估标准 AEF-1 出炉,xAI、OpenAI、Anthropic 都签了,Dario 还承诺给评估员发工牌

    AI 评估论坛发布了 AEF-1 标准,给独立第三方评估立了规矩,包括访问权限、利益冲突、资金来源、回避和透明度怎么处理。同一天,Dario Amodei 发了篇个人博客,说 Anthropic 会单方面先干起来:让评估团队像员工一样进驻办公室,拿公司工牌、用公司电脑,权限跟内部风险团队差不多。他还提了个两层协调框架,一层是民主国家内部定规矩,一层是跟...