跳到正文
AI 群聊日报

Opus 5.5 双盲实测:high 模式多花三成 token,但能揪出测试漏掉的真实 bug

2026-09-23 群聊日报

一份基于 11 个真实仓库、88 次 A/B 测试的数据显示,Opus 5.5 的 high 模式比 medium 慢约三成、多花三成 token,但在盲评中以 16 比 7 胜出,主要靠抓到测试覆盖不到的真 bug。Claude Code Cloud Sessions 正式上线,合盖后任务在云端继续跑,Pro 和 Max 用户分别拿到 100 和 2...

读原文 ↗导出 Markdown