# 月之暗面发布 Kimi K2.6 开源模型，在长任务执行上对标 Claude Opus 4.6

> 原标题：[AINews] Moonshot Kimi K2.6: the world's leading Open Model refreshes to catch up to Opus 4.6 (ahead of DeepSeek v4?)

- 来源：Latent Space
- 发布时间：2026-04-21T00:19:33.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/10423
- 原文：https://www.latent.space/p/ainews-moonshot-kimi-k26-the-worlds

## 摘要

月之暗面推出了 Kimi K2.6，一个总参数 1 万亿的混合专家模型，每次推理激活 320 亿参数，支持 25.6 万 token 的上下文窗口。它主打的是长时间、多步骤的智能体任务，官方宣称能连续跑 12 小时以上、调用超 4000 次工具、并行管理 300 个子智能体。在 SWE-Bench Pro 编程基准上得分 58.6，HLE 带工具得分 ...

## 推荐理由

我会先打个折：SWE-Bench Pro 58.6 这个数正文没给对比基线，不知道和 Opus 4.6 的差距到底多大，这点先别太激动。但 Kimi K2.6 真正值得盯的不是基座跑分，而是它把 agent 执行时长拉到 12 小时、能并行跑 300 个子代理，这在开源模型里算往前拱了一步。国内大模型旗舰发布本身就自带信号，加上抢在 DeepSeek v4 前出牌，对关注开源模型进展的人有信息差价值，所以给到 P1。

## 锐评

月之暗面这次发的 Kimi K2.6，是一个总参数1万亿、每次推理激活320亿的混合专家模型。相比三个月前的 K2.5，它最大的变化不是纸面分数，而是把力气花在了让模型能长时间、多步骤地执行任务上。官方说它能连续运行超过12小时，调用超4000次工具，还能同时管理300个子智能体，这比单纯在编程基准 SWE-Bench Pro 上拿58.6分更值得关注。

不过，这次发布有个明显的信息缺口：正文没披露具体增加了多少训练数据或计算量，只说“继续预训练和后训练”。所以这些智能体能力的提升，到底来自算法创新还是单纯堆资源，目前没法判断。另外，它在前端设计任务上声称对 Gemini 3.1 Pro 有68.6%的胜平率，但这类主观评测的波动性一向很大，看看就好。

整体看，K2.6 更像是一次务实的工程迭代，把模型往真实业务流程里推了一步。但缺少技术细节，让它的领先优势能持续多久要打个问号，尤其 DeepSeek V4 已经在传闻中了。
