# Claude Mythos 预览版风险时间距评估：50% 任务完成时间至少 16 小时

> 原标题：Claude Mythos评估显示16小时风险时距

- 来源：AI HOT 精选
- 发布时间：2026-05-09T01:32:10.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/16486
- 原文：https://x.com/emollick/status/2052924556264796163

## 摘要

METR 在 2026 年 3 月的一个短暂窗口里，对 Claude Mythos 的早期预览版做了风险评估。他们用一套任务测下来，模型有 50% 概率能独立完成的任务，所需时间至少是 16 小时，95% 置信区间在 8.5 到 55 小时之间。这个数字已经碰到了 METR 现有任务能测出的上限，也就是说，再长他们就测不准了。正文没披露具体是什么任务、...

## 推荐理由

METR 在 2026 年 3 月拿 Claude Mythos Preview 早期版做了有限窗口评估，测出一个 50% 时间范围至少 16 小时，95% 置信区间 8.5 到 55 小时。我会先打个折：这只是单次评估、早期版本，窗口也有限，别直接当最终结论。但“16 小时”这个数字本身够直接，说明模型在长时间自主任务上已经能跑一阵子了，安全团队得盯紧。正文没披露具体任务类型和失败模式，这点信息缺口让判断只能停在信号层面。

## 锐评

METR 在 3 月短暂窗口里测了 Claude Mythos 的早期预览版，结论是模型有 50% 概率独立完成的任务，时间跨度至少 16 小时，95% 置信区间在 8.5 到 55 小时之间。这个数字本身不算离谱，但关键信息是：这已经碰到 METR 现有测试套件的上限了。也就是说，不是模型只能干 16 小时的活，而是他们的题目最长就设计到这儿，再往上没法测。

正文没披露具体测了什么任务、任务难度怎么定义、以及模型是在什么条件下跑的。16 小时这个数，如果任务本身是重复性操作或者低难度堆积，意义就打折；如果是需要持续推理和决策的复杂流程，那才值得关注。另外，这只是早期预览版，正式版的能力可能更强，也可能因为安全对齐被砍掉一些。

现在还缺两样东西：一是 METR 需要设计更长周期的任务来突破天花板，二是需要知道模型在接近 16 小时边界时，失败模式是什么——是中间崩了、忘了目标，还是产出质量断崖式下跌。这些比一个孤零零的时间数字更有参考价值。
