# 月之暗面 Kimi K3 和阿里 Qwen 3.5 同天开源，都号称能打 GPT-5 和 Claude Sonnet 4.5

> 原标题：China delivers a one-two punch to America’s AI dominance

- 来源：The Verge · AI
- 发布时间：2026-07-20T10:16:33.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/45629
- 原文：https://www.theverge.com/ai-artificial-intelligence/967781/chinese-ai-models-open-source-moonshot-kimi-k3-alibaba-qwen

## 摘要

7 月 20 日，月之暗面发了 Kimi K3，阿里发了 Qwen 3.5，两个模型都开源。Kimi K3 在 AIME 2025 数学测试上拿了 96.2 分，Qwen 3.5 在 MMLU-Pro 上拿了 85.3 分，各自声称在特定跑分上追平甚至超过 GPT-5 和 Claude Sonnet 4.5。不过正文没公布参数量、推理成本和实际部署情况...

## 推荐理由

月之暗面 Kimi K3 和阿里 Qwen 3.5 同一天开源，各自在数学和通用知识跑分上声称追平 GPT-5 和 Claude Sonnet 4.5，这种集中发布本身就值得关注。我会先打个折：正文没公布参数量、推理成本和实际部署情况，跑分高不代表用起来便宜或稳定，这点先别太激动。但两个模型都给了具体数字，不是模糊宣传，加上开源动作本身在中美 AI 竞赛语境里有话题性，所以给到 82 分，放在 featured 档。

## 锐评

7 月 20 日，月之暗面发了 Kimi K3，阿里发了 Qwen 3.5，两个模型都开源。Kimi K3 在 AIME 2025 数学测试上拿了 96.2 分，Qwen 3.5 在 MMLU-Pro 上拿了 85.3 分，各自声称在特定跑分上追平甚至超过 GPT-5 和 Claude Sonnet 4.5。一天内两个开源前沿模型同时出现，对闭源厂商的定价和生态压力是实打实的。

不过正文没披露参数量、推理成本和实际部署情况。单榜跑分能说明的问题有限——AIME 是数学竞赛题，MMLU-Pro 是知识选择题，都测不出模型在真实业务里的表现。没有参数量就判断不了这是靠堆算力硬拉分，还是真的效率更高。推理成本不公布，开源对开发者的实际吸引力也要打折扣。

还缺的信息：两个模型在长文本、代码、多轮对话这些日常场景下的表现，以及各自的商业授权条款。开源不等于免费商用，授权细节会直接影响企业能不能用。
