# Kimi K2.6 开源了，SWE-Bench Pro 跑分 58.6，声称超过 GPT-5.4 和 Claude Opus 4.6

> 原标题：Kimi K2.6 is open-source!

- 来源：X · @Yuchenj_UW
- 发布时间：2026-04-20T15:41:06.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/6942
- 原文：https://x.com/Yuchenj_UW/status/2046252829506228370

## 摘要

Kimi K2.6 宣布开源，在 SWE-Bench Pro（一个测代码修 bug 能力的基准）上拿了 58.6 分。推文说这个分数压过了 GPT-5.4（xhigh 模式）和 Claude Opus 4.6（max effort 模式）。不过正文没披露模型权重、开源协议和具体的评测设置，可复现性要打个问号。发帖人觉得 Kimi 发版节奏越来越快，属于...

## 推荐理由

三条都踩中了：开源本身就是强钩子，SWE-Bench Pro 58.6 这个数可以验证但信息不全，开源对闭源的代码能力竞赛又是当下热点。分数我维持 81，因为目前看只有标题级信息，权重、许可证、评测设置全都没披露，先别太激动。

## 锐评

Kimi K2.6 宣布开源，在 SWE-Bench Pro（一个测代码修 bug 能力的基准）上拿了 58.6 分，推文说压过了 GPT-5.4 的 xhigh 模式和 Claude Opus 4.6 的 max effort 模式。这个分数看着挺高，但先别太激动——发帖人只贴了 RSS 片段，没披露模型权重、开源协议，也没说评测是怎么跑的、有没有用对方最强的配置对齐。没有这些，分数很难复现，也没法判断是实打实的进步还是挑着比的结果。

发帖人觉得 Kimi 发版节奏越来越快，属于开源模型里的第一梯队。这点从发布频率上看确实有感觉，但快不等于稳。如果每次都是先放分数再补细节，社区拿到手可能发现跑出来的结果对不上。

还缺几样东西：权重下载链接、开源协议类型、完整的评测配置和对比基线。这些补上了，58.6 这个数字才有分量。
