# Claude 发布 Opus 4.7，称是其最强 Opus 模型，主打长任务更稳、指令跟得更准、回复前会自己检查一遍

> 原标题：Introducing Claude Opus 4.7, our most capable Opus model yet.

- 来源：X · @claudeai
- 发布时间：2026-04-16T14:29:31.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/3251
- 原文：https://x.com/claudeai/status/2044785261393977612

## 摘要

Anthropic 在 X 上发了条推文，说 Opus 4.7 是他们目前最能打的 Opus 模型。推文提了三个点：跑长任务时更严谨，不会半路掉链子；对指令的理解和执行更精准；输出结果前会先自我验证一轮，相当于自己先审一遍再交差。意思是你可以把最难搞的活丢给它，少盯几眼。不过正文没给任何跑分、上下文窗口多大、怎么收费、哪些人能用到，这些关键信息全都没提...

## 推荐理由

这是一次有分量的模型发布，HKR 三项都站得住：新 Opus 本身就有话题性，三条改进可以实测验证，Claude 重度用户会立刻上手对比。分数没给更高，是因为正文没放基准分数、上下文长度、价格和上线范围，这些关键信息缺了，实际能省多少成本、延迟高不高都还说不准。

## 锐评

Anthropic 发了条推文说 Opus 4.7 是他们目前最能打的 Opus 模型，给了三个卖点：跑长任务时更严谨，不会半路掉链子；对指令的理解和执行更精准；输出结果前会先自我验证一轮，相当于自己先审一遍再交差。听起来像是把可靠性当核心升级方向，而不是单纯堆推理分。

但这条推文信息量很薄。没给任何基准测试分数，没提上下文窗口多大，没讲定价，也没说哪些用户现在能用。这些恰恰是判断“最能打”到底值不值的关键。自我验证具体怎么做的、验证失败会不会重跑、延迟增加多少，正文全都没披露。

我会先打个折：这更像一次产品定位的预告，不是技术发布。等公开评测和实际延迟数据出来，才能判断它是不是真能让你少盯几眼。
