# Anthropic 联创预测：2028 年底前 AI 自己搞研发的概率超六成

> 原标题：Anthropic联创定下deadline：2028年AI实现自我进化，没有人类了

- 来源：机器之心 · 公众号
- 发布时间：2026-05-05T03:59:00.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/14916
- 原文：https://mp.weixin.qq.com/s?__biz=MzA3MzI4MjgzMw==&mid=2651031346&idx=1&sn=95a7f4e3da2158aca6bfde400b0daec9

## 摘要

Anthropic 联合创始人 Jack Clark 给了个时间点：到 2028 年底，AI 脱离人类独立做研发的概率超过 60%。他拿几个基准测试当证据——Claude Mythos Preview 在软件工程测试 SWE-Bench 上跑到 93.9%，Opus 4.5 在评估 AI 复现研究能力的 CORE-Bench 上拿到 95.5%。Cla...

## 推荐理由

我会先打个折：标题里的“自我进化”和“没有人类了”是媒体写法，Clark 原文说的是无人类参与的 AI 研发概率，不是奇点降临。但他作为联创，拿内部模型跑出来的基准分来押 2028 这个时间点，分量不一样。SWE-Bench 93.9% 说明代码修 bug 这类短任务已经很高，CORE-Bench 95.5% 测的是复现论文的工程能力，真正该盯的是 MLE-Bench 和 PostTrainBench——这两个才碰得到长周期、需要自己调参和做后训练的任务，目前正文没给具体分数，这点先别太激动。整体看，他是在用基准曲线推 timeline，不是纯拍脑...

## 锐评

Anthropic 联合创始人 Jack Clark 放了个时间点：到 2028 年底，AI 脱离人类独立做研发的概率超过 60%。他拿几个基准测试当证据——Claude Mythos Preview 在软件工程测试 SWE-Bench 上跑到 93.9%，Opus 4.5 在评估 AI 复现研究能力的 CORE-Bench 上拿到 95.5%。这些数字确实高，说明模型在写代码和复现实验这类长链条任务上越来越能打。

但问题在于，正文被微信的验证页面挡住了，我们看不到 Clark 具体怎么从这些基准分数推到 60% 这个概率的。SWE-Bench 和 CORE-Bench 测的是特定任务，离真正的独立研发——自己提假设、设计实验、迭代试错——还有多远，正文没披露。另外，Clark 强调信号来自任务时长和后训练能力，而不是什么奇点叙事，这点倒是务实，但具体怎么定义“独立研发”也没说清楚。

还缺几样东西：Clark 这个预测是正式论文里的结论还是随口一说？有没有同行评审或外部验证？60% 这个数字是怎么算出来的，还是纯主观判断？这些信息缺口不补上，这条新闻就只能当个观点看，别急着当趋势。
