# 月之暗面发布新 Kimi 模型，跑分追上 OpenAI o3 和 Claude Sonnet 4.5，英伟达盘前跌超 3%

> 原标题：China’s Moonshot Unveils AI Model, Fueling Tech Rout

- 来源：彭博科技
- 发布时间：2026-07-17T07:01:58.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/45036
- 原文：https://www.bloomberg.com/news/articles/2026-07-17/china-s-powerful-new-moonshot-ai-model-closes-gap-with-us-rivals

## 摘要

月之暗面在 7 月 17 日推出了新一代 Kimi 模型，在 MATH、HumanEval 等基准测试里，成绩跟 OpenAI o3 和 Anthropic Claude Sonnet 4.5 打平甚至略高。现在通过 Kimi 聊天机器人就能试，API 也已经上线。市场反应很直接——英伟达盘前跌了超过 3%，大家担心这会压降美国 AI 公司的定价空间。...

## 推荐理由

月之暗面这次发模型，跑分直接叫板 o3 和 Claude Sonnet 4.5，而且不是论文阶段，是已经能用的产品。我会先打个折——没看到模型大小和实际推理成本，光看跑分容易高估。但市场反应很诚实，英伟达股价先跌为敬，说明大家认真在考虑这会不会压降美国公司的定价空间。对国内从业者来说，这至少是个值得上手测一下的信号。

## 锐评

月之暗面这次放出的新 Kimi，在 MATH 和 HumanEval 这类数学、代码基准上，分数跟 OpenAI o3 和 Anthropic Claude Sonnet 4.5 打平甚至略高，说明纯能力上确实追得很紧。模型已经能在聊天机器人和 API 里用，英伟达盘前跌超 3%，市场担心这会压降美国 AI 公司的定价空间。

不过正文没披露参数量、训练成本和推理延迟，这几个才是工程落地时真正要命的东西。跑分高不代表实际用起来快、便宜、稳定。另外，基准测试本身有没有针对性刷榜、评测环境是否公平，文章也没提。

我会先打个折：能力追上是事实，但离“全面对标”还差成本、效率和第三方实测这几块拼图。
