# 阮一峰实测智谱 GLM-5：跟 Claude Opus 4.6、GPT-5.3-Codex 比编程，互有胜负

> 原标题：智谱旗舰 GLM-5 实测：对比 Opus 4.6 和 GPT-5.3-Codex

- 来源：阮一峰的网络日志
- 发布时间：2026-02-12T01:26:13.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/3582
- 原文：http://www.ruanyifeng.com/blog/2026/02/glm-5.html

## 摘要

阮一峰拿四个编程任务对比了 GLM-5、Claude Opus 4.6 和 GPT-5.3-Codex。网页设计上 GLM-5 和 Opus 4.6 都挺好看，GPT-5.3 页眉没粘住往下拉就没了；3D 太阳系沙盒都能跑，但 GLM-5 缺了引力网格线，Opus 4.6 动画效果最好；愤怒的小鸟游戏 Opus 4.6 还原度最高，GLM-5 能玩但弹...

## 推荐理由

这篇文章靠单人实测和视频对比撑起来，不是标准化基准测试，所以我会先打个折。但它给了 4 个具体任务和明确的时间差，对正在挑编程模型的团队有直接参考价值。正文没披露 GLM-5 的规模、训练成本或更多样本量，这点先别太激动。整体看，它把一个国产旗舰拉到和两款闭源顶配同场比较，信息密度和时效性都够，放在 featured 档合理。

## 锐评

阮一峰这次对比挺实在，没跑分，直接拿四个编程任务上手测。网页设计上 GLM-5 和 Opus 4.6 都好看，GPT-5.3 的页眉没粘住，往下拉就没了。3D 太阳系沙盒都能跑，但 GLM-5 缺了引力网格线，动画效果 Opus 4.6 最好。愤怒的小鸟游戏 Opus 4.6 还原度最高，GLM-5 能玩但弹跳感不足，GPT-5.3 直接翻车，小鸟弹不出去。最后的 Laravel 转 Next.js 任务，GLM-5 和 GPT-5.3 都用了约 5 分钟，Opus 4.6 却花了约 20 分钟，速度差距明显。

整体看，GLM-5 作为开源模型，在编程任务上确实能跟两个闭源旗舰掰手腕，尤其系统迁移任务效率很高。但得注意，这只是一个人的非标准化测试，样本量太小，不能当通用结论。另外，文章没提 GLM-5 的硬件消耗和推理成本，也没说这些任务是一次生成还是多次调试后的结果，这点对评估实际可用性挺关键。
