# Anthropic 发布 Claude Sonnet 5：自主干活能力追平 Opus 4.8，价格还便宜一截

> 原标题：Claude Sonnet 5

- 来源：Hacker News 首页
- 发布时间：2026-06-30T17:59:52.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/41498
- 原文：https://www.anthropic.com/news/claude-sonnet-5

## 摘要

Claude Sonnet 5 是 Anthropic 目前最能自主干活的中档模型。它能自己定计划、用浏览器和终端跑任务，在推理、写代码、工具使用这些指标上比上一代 Sonnet 4.6 强出一大截，表现已经接近旗舰 Opus 4.8。价格方面，正式定价是输入每百万 token 3 美元、输出 15 美元，8 月 31 号前有尝鲜价，输入 2 美元、输...

## 推荐理由

Anthropic 的中档主力模型做了一次大的 agent 升级，定价也清楚，当天就该写。分数没上 90，因为文章只给了基准对比，没放任务完成率或延迟数据，实际表现还得等社区跑完再看。

## 锐评

Sonnet 5 最大的变化不是跑分，而是它终于能自己定计划、用浏览器和终端跑完一整件事，不再像前代那样半路卡住。Anthropic 自己的测试显示，它在 BrowseComp 和 OSWorld 这类需要多步操作的评测上，把 Sonnet 4.6 甩开了一大截，表现已经贴近 Opus 4.8。价格方面，正式定价是输入每百万 token 3 美元、输出 15 美元，8 月底前有尝鲜价输入 2 美元、输出 10 美元，比 Opus 4.8 便宜不少。安全评估说它比 Sonnet 4.6 更少出格，网络安全能力也远低于 Opus 系列，这点对放出去干活的场景算个加分项。

不过正文没给出具体的绝对准确率数字，只放了成本-性能曲线图，没法直接判断它在真实任务里到底比 Opus 差多少。早期测试者的反馈都是定性描述，没有量化对比。另外，Sonnet 5 的自主性提升到底来自模型本身还是靠外部工具链配合，文章也没说清楚。如果你现在用 Sonnet 4.6 跑 agent 任务总觉得差口气，Sonnet 5 值得试，但别指望它完全替代 Opus 4.8 做高精度活。
