# 智谱上线并开源 GLM-5.2，主攻编程和长链条任务，综合跑分进了全球前三

> 原标题：GLM-5.2 上线并开源：专注 Coding 与长程任务

- 来源：AI HOT 精选
- 发布时间：2026-06-16T16:00:00.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/38899
- 原文：https://www.zhipuai.cn/zh/research/161

## 摘要

智谱把 GLM-5.2 放出来了，代码开源，MIT 协议，可以商用。这个模型在 Artificial Analysis 综合榜上拿了 51 分，跟 Anthropic、OpenAI 排在前三，是开源模型里目前最好的。前端开发盲测 Code Arena 上拿了全球可用模型第一。这次最大的升级是实打实的 100 万 token 无损上下文，专门用来跑长链条...

## 推荐理由

智谱把 GLM-5.2 完整开源了，MIT 协议，商用没限制。模型在 Artificial Analysis 综合榜拿 51 分，跟 Anthropic、OpenAI 排在前三，是开源模型里目前最好的成绩；Code Arena 前端开发盲测也拿了全球可用模型第一。这次最大的升级是实打实的 100 万 token 无损上下文，专门跑长链条任务，FrontierSWE 和 SWE-Marathon 两个长程基准上的分数落在 Claude Opus 4.7 和 4.8 之间，还放出了一个 88 万 token 的完整跑通案例。对做 AI 工程的人来说，这...

## 锐评

GLM-5.2这次把重点放在了“长程任务”上，也就是让模型能连续干几个小时的复杂工程活，而不是只回答一个代码片段。它实打实做到了100万token的无损上下文，官方演示里一个覆盖Web、移动端和小程序的多端应用，从开发到打包上线累计处理了88万多token，一口气跑完。这个能力在开源模型里确实是头一份。

从跑分看，它在FrontierSWE上只比Claude Opus 4.8低1%，超过了GPT-5.5和Opus 4.7，说明在数小时级别的复杂技术项目上已经能跟闭源顶配掰手腕。但SWE-Marathon这个考察超长周期软件工程的数据集上，它比Opus 4.8低了13%，官方也承认这块还需要提高。所以“长程”目前更偏向中等长度的工程任务，真正马拉松式的自主开发还有差距。

另外，模型已经在华为昇腾、寒武纪等国产芯片上跑通了推理，这对国内开发者是个实用加分项。MIT协议商用也没限制。不过正文没披露模型参数量、训练成本和推理延迟的具体数字，实际部署成本还得自己测。
