热点事件历史事件
Claude Opus 5.5 在编程智能体评测里拿了第一,但跑一次任务要花 13 美元
1 篇报道1 个报道来源6 天前更新
先了解这件事
事实说明
Artificial Analysis 把 Claude Opus 5.5 放在 Claude Code 的“最大出力”模式下跑了一遍 Coding Agent Index,得分 66,比上一代 Opus 5 的 60 分高出 6 分。三项子测试全线上涨:Terminal-Bench 4.0 正确率 63.1%,DeepSWE v1.1 正确率 68....
报道时间线
沿着报道,了解事件的不同侧面。
9月24日
- AI HOT 精选精选Claude Opus 5.5 在编程智能体评测里拿了第一,但跑一次任务要花 13 美元
Artificial Analysis 把 Claude Opus 5.5 放在 Claude Code 的“最大出力”模式下跑了一遍 Coding Agent Index,得分 66,比上一代 Opus 5 的 60 分高出 6 分。三项子测试全线上涨:Terminal-Bench 4.0 正确率 63.1%,DeepSWE v1.1 正确率 68....