# Claude Opus 4.8 发布，主打“老实”：不确定时会直说，瞎编的概率降到前代的四分之一

> 原标题：Claude’s new model is more ‘honest’ when it messes up

- 来源：The Verge · AI
- 发布时间：2026-05-28T17:00:00.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/29660
- 原文：https://www.theverge.com/ai-artificial-intelligence/939094/anthropic-claude-4-8-opus-honesty-effort

## 摘要

Anthropic 周四放出 Claude Opus 4.8，这次没吹性能天花板，而是强调模型更“诚实”。公司说早期测试者发现它更愿意主动标注自己没把握的地方，而不是硬编一个听起来合理的答案。内部评测给了一个具体数字：Opus 4.8 做出无据论断的概率大约是前代模型的四分之一。不过正文没披露这个评测的具体基准和对比对象，我会先打个折——四倍改善听起来...

## 推荐理由

我会先打个折：正文只说了“评估中少约 4 倍无依据声明”，但没披露具体用了哪些基准测试、测试规模多大、在什么任务上测的，也没提价格和上下文窗口有没有变。所以这个“4 倍”只能当个方向性信号看，别直接当成绝对指标。不过对从业者来说，模型肯承认自己不确定而不是硬编，本身就是个值得关注的转向，尤其在需要高可靠性的工作流里。整体信息量够上头条，但细节缺口明显，分数给在 85–94 这个区间是合理的。

## 锐评

Claude Opus 4.8 这次没拼跑分，而是把“诚实”当卖点，说模型更愿意标注自己不确定的地方，而不是硬编答案。内部评测给了一个很抓眼球的数据：做出无据论断的概率大约是前代的四分之一。但正文没披露这个评测的具体基准、对比对象和测试集，四倍改善听起来很猛，实际效果得看第三方怎么复现。

对从业者来说，这条更新指向一个很实际的问题：模型在业务流程里干活时，能不能在没把握的时候主动停住，而不是悄悄出错。Anthropic 没提这种“诚实”是靠对齐训练还是推理时的机制实现的，也没说主动标注不确定性会不会让模型变得过于保守、拒绝回答正常问题。这两点会直接影响它能不能真的进生产环境。
