# GPT-5.6 Sol 发布但可能拿不到，GLM 5.2 抢不到货，STOC 现场跑通 AI 自动证数学题

> 原标题：2026-06-26 群聊日报

- 来源：AI 群聊日报
- 发布时间：2026-06-27T07:38:55.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/40989
- 原文：https://louyu2015.github.io/AI-chatgroup-daily/daily/2026/06/26/daily/

## 摘要

OpenAI 预览了 GPT-5.6，分 Sol、Terra、Luna 三档，Sol Ultra 在 TerminalBench 2.1 跑出 91.9% 排第一，最便宜的 Luna 也超过了上一代旗舰 Claude Opus 4.8。但受前一天出口管制消息影响，群里有人泼冷水说“5.6 也发不出来了”。另一边，GLM 5.2 的 Coding Pla...

## 推荐理由

GPT-5.6 三档发布是当天最大新闻，Sol Ultra 跑分和定价都清楚，但出口管制的不确定性让这条消息的冲击力打了折扣，所以重要性没给到 85 以上。GLM 5.2 卖断货和自动化证明流水线是加分项，不过日报本身是二手信息源，不是一手公告，整体判断就定在这个档位。

## 锐评

这期日报最有意思的不是某个模型跑分多高，而是两条线撞在一起：OpenAI 发了最强模型，但前一天白宫刚出了分阶段出口管制，群里直接有人泼冷水说“5.6 也发不出来了”。越强的模型越难到手，这个矛盾现在从地缘政治直接砸到了开发者的日常选择上。Sol Ultra 在 TerminalBench 2.1 跑出 91.9%，最便宜的 Luna 82.5% 都超过了上一代旗舰 Claude Opus 4.8 的 78.9%，纸面数据确实拉开了代差。但正文没披露 TerminalBench 具体测什么、样本量多大，这个分能不能反映真实开发场景要打个问号。

另一边的 GLM 5.2 供需紧张更接地气。Coding Plan 全平台缺货，火山引擎显示库存不足，群友说每天十点放量但被脚本抢光。有人转向 Ollama Cloud，速度比官方快十倍，还带零数据保留——这点对带敏感数据的开发者是刚需，正文提到 GLM 官方会留存数据用于训练。但 Ollama 的额外用量不便宜，群友用 5 美元额度从零写了个 SSO 管理工具就烧完了。STOC 现场那条“GPT-5.5 Pro 生成证明、Claude Opus 4.8 验证”的自动流水线也值得留意，但正文只给了一张幻灯片照片，没有具体成功率或跑通的问题数量，目前只能当个方向信号看。
