# Kimi K3 登顶前端编程榜，权重将开源，但实测发现它有时会烧光额度原地打转

> 原标题：2026-07-16 群聊日报

- 来源：AI 群聊日报
- 发布时间：2026-07-17T10:23:38.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/45024
- 原文：https://louyu2015.github.io/AI-chatgroup-daily/daily/2026/07/16/daily/

## 摘要

Kimi K3 在 Frontend Code Arena 拿了 1679 分，压过 Claude Fable 5，七个前端领域赢了六个。模型有 2.8 万亿参数，支持 1M 上下文，定价是每百万 token 3 到 15 美元，完整权重会在 7 月 27 日前放出来。群友上手后评价两极：有人花 199 元月费让它重做了之前搞砸的粒子特效，效果惊艳；也...

## 推荐理由

Kimi K3 在 Frontend Code Arena 拿了第一，七个前端方向赢了六个，权重还要开源，属于国产大模型一次硬碰硬的亮相。群聊日报给了分数、参数量、价格和真实用户反馈，信息够用。没打更高是因为来源是社区整理，不是一手官方公告，我会先打个折。

## 锐评

K3 这次最值得关注的点不是跑分，而是“性能登顶、成本三分之一、权重全开”三件事第一次同时成立。2.8 万亿参数、1M 上下文、定价每百万 token 3 到 15 美元，完整权重 7 月 27 日前放出——如果属实，对开源生态的冲击会比跑分本身大得多。

但群友实测暴露了两个关键问题。一是稳定性：有人冲了 40 刀 coding plan，模型在仓库里分不清 ranchen 和 rancheng，在思考链里疯狂打转，5 小时额度几乎全烧光。官方也承认 K3 遇到小问题或意图模糊时“可能替用户做非预期决定”。二是榜单保真度：GLM-5.2 榜上分数不低，实际用下来群友觉得比 5.5 还差，K3 的跑分同样需要等更多独立验证。

文风方面，群友评价是 AI 味确实少了，但“强行加模拟人的语气词”，远没达到当年 Opus 4.6 的自然中文水平。正文没披露 K3 在非前端编程任务上的表现，也没说芯片设计那项测试的可复现性——这些缺口会让“开源斩杀线”这个定位暂时只能打七折。
