跳到正文
热点事件历史事件

Claude Opus 5.5 在编程智能体评测里拿了第一,但跑一次任务要花 13 美元

1 篇报道1 个报道来源6 天前更新

先了解这件事

事实说明

Artificial Analysis 把 Claude Opus 5.5 放在 Claude Code 的“最大出力”模式下跑了一遍 Coding Agent Index,得分 66,比上一代 Opus 5 的 60 分高出 6 分。三项子测试全线上涨:Terminal-Bench 4.0 正确率 63.1%,DeepSWE v1.1 正确率 68....

报道时间线

沿着报道,了解事件的不同侧面。

9月24日
  1. AI HOT 精选精选
    Claude Opus 5.5 在编程智能体评测里拿了第一,但跑一次任务要花 13 美元

    Artificial Analysis 把 Claude Opus 5.5 放在 Claude Code 的“最大出力”模式下跑了一遍 Coding Agent Index,得分 66,比上一代 Opus 5 的 60 分高出 6 分。三项子测试全线上涨:Terminal-Bench 4.0 正确率 63.1%,DeepSWE v1.1 正确率 68....