# Anthropic 研究员离职：好人拒绝做坏事

> 原标题：Good people refuse to do bad things

- 来源：Hacker News 首页
- 发布时间：2026-09-21T15:31:47.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/57946
- 原文：https://carette.xyz/posts/good_people_refuse_to_do_bad_things/

## 摘要

Jacob Coxon 在股权归属前两个月从 Anthropic 辞职，公开警告 AI 可能在十年内杀死所有人。他的帖子获得超过 1.15 亿次浏览。Anthropic 的对齐团队负责人 Evan Hubinger 确认，公司内部确实认为十年内 AI 导致人类灭绝的概率大于 10%，且目前没有解决超级智能对齐问题的方案。文章将此事与 2021 年 Fa...

## 推荐理由

我会先打个折：核心事实来自个人证词和公司内部人士确认，不是经过同行评审的研究，所以别把它当定论。但信息量很密——一个内部人用放弃股权的方式，把 Anthropic 内部对灭绝风险的估算（>10%）和对齐方案缺失这两件事同时捅了出来。对齐负责人 Evan Hubinger 的确认让这事从个人表态升级为公司层面的认知披露。帖子 1.15 亿次浏览说明公众情绪已经被点燃。对从业者来说，这不是远方的哲学讨论，而是明天上班要不要继续写代码的问题。

## 锐评

这条新闻的冲击力不在离职本身，而在于公司内部的人出来证实了外界的恐惧。Jacob Coxon 在股权归属前两个月辞职，放弃了可能很值钱的东西，就为了说一句“他们真的相信AI会杀死所有人”。Anthropic 的对齐负责人 Evan Hubinger 随后确认，公司内部确实认为十年内人类灭绝的概率大于10%，而且目前没有解决超级智能对齐问题的方案。这等于把行业最深的焦虑公开摊牌了。

文章把这件事和2021年 Facebook 吹哨人 Frances Haugen 做了类比：都是内部知情，拒绝沉默，辞职后公开警告。区别在于，这次赌注从青少年心理健康换成了人类存亡。但文章也指出，问题不只在几家公司，而是整个工程师文化在默许用质量换速度。一个2026年的调查说，53%的科技从业者会劝新人别入行，67%的开发者花在调试AI生成代码上的时间比写代码还多。大家一边抱怨，一边为了薪酬继续干。

文章没披露 Coxon 具体看到了什么内部项目或数据让他下决心走人，也没说 Anthropic 内部对那“大于10%”的概率是怎么算出来的。这些信息缺口让他的警告听起来更像一个基于整体氛围的判断，而不是基于某个具体事件的爆料。
