跳到正文
AI HOT 精选

Claude Sonnet 5.5 在 AA 智能指数排到第二,靠的是每次任务狂吐近 20 万 token

Claude Sonnet 5.5 达到 Artificial Analysis 智能指数第 2 名

Anthropic 发了 Claude Sonnet 5.5,在 Artificial Analysis 的智能指数上拿了 56 分,比顶配 Opus 5.5 只低 2 分。价格没涨,还是每百万 token 输入 2 美元、输出 10 美元,但实际跑一次任务要花大约 7.6 美元,比 Sonnet 5 贵了五成,因为它开足马力时平均每次任务会输出约 1...

推荐理由:Anthropic 发了 Sonnet 5.5,Artificial Analysis 给了实打实的跑分:智能指数 56 分排第二,Terminal-Bench 4.0 正确率 64% 追平自家旗舰和 GPT-6 Astra,但单次任务实际开销约 7.6 美元,比 Sonnet 5 贵了 50%。三个维度都踩中了:性能逼近顶配但价格没涨造成的张力,有具体分数和成本可以横向对比,以及让用 Claude 搭 agent 的人不得不重新算性价比。

读原文 ↗导出 Markdown