# Anthropic 发布 Claude Opus 4.8，主打代理任务判断力和诚实度，价格不变

> 原标题：Claude Opus 4.8

- 来源：Hacker News 首页
- 发布时间：2026-05-28T16:49:14.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/29524
- 原文：https://www.anthropic.com/news/claude-opus-4-8

## 摘要

Anthropic 推出了 Claude Opus 4.8，直接升级自 4.7，价格没涨。这次的重点不是刷榜，而是让模型在干具体活时更靠谱：多位早期测试者提到它判断力变好，会主动质疑不靠谱的计划、自己揪错，而不是硬着头皮往下编。模型还新增了“诚实”倾向，遇到证据不足时会主动说“不确定”，而不是假装有进展。同时发布的还有几个配套功能：网页版可以控制模型思...

## 推荐理由

我会先打个折：这条只有标题和 HN 热度，正文没披露任何能力、参数或发布时间，所以别当正式发布来看。但 Claude Opus 4.8 这个名字本身就是信号，Anthropic 的旗舰线更新，从业者一定会盯。HN 139 分、49 条评论说明社区已经在猜了，这种关注度本身就值得推一条。如果是真的，模型选型和工具链可能都要跟着调，这点先别太激动，等官方补信息再说。

## 锐评

Anthropic 这次给 Opus 4.8 的定位很明确：不跟你卷跑分，而是卷“别瞎编”。从早期测试者的反馈看，模型新增了一种“诚实”倾向，遇到证据不足会主动说“不确定”，在写代码时会质疑不靠谱的方案、自己抓 bug，而不是像以前那样硬着头皮往下编。这对把模型放进实际业务流程干活的人来说，比刷榜实在得多。

配套的几个功能也指向同一个方向：网页版可以控制模型思考的用力程度，Claude Code 加了“动态工作流”去啃大项目，快速模式速度提到 2.5 倍、成本降到之前的三分之一。这些改动都在降低“用起来不放心”和“用起来太贵”两个门槛。

但正文没给出 80% 这个“诚实”倾向的具体测试方法和数据，也没说盈利情况。这笔钱到底是续命还是加速扩张，暂时看不出来。另外，所有测试者反馈都来自 Anthropic 自己选的合作方，独立第三方的横评还缺位，所以“最靠谱”这个结论目前只能算厂商自述。
