# OpenAI 发布 GPT-5.6 三款模型，Codex 并入 ChatGPT 超级应用

> 原标题：[AINews] OpenAI launches GPT 5.6 Sol/Terra/Luna, Codex becomes ChatGPT superapp

- 来源：Latent Space
- 发布时间：2026-07-10T06:19:40.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/43970
- 原文：https://www.latent.space/p/ainews-openai-launches-gpt-56-solterraluna

## 摘要

OpenAI 在 7 月 10 日推出了 GPT-5.6 系列，按规模分 Sol、Terra、Luna 三个版本。旗舰款 Sol 在 Agents' Last Exam 上拿到 53.6 分，比 Claude Fable 5 高出 13.1 分，但成本只有后者的四分之一左右。API 定价上，Sol 每百万输入/输出 token 收 5 美元和 30 美...

## 推荐理由

OpenAI 主版本更新，旗舰模型在关键 agent 基准上领先 Claude Fable 5 超过 13 分，定价又很激进，加上 Codex 并入 ChatGPT 变成超级应用，属于多事件叠加，三个维度都打中了。正文没披露 Sol 的具体参数量，这点先别太激动。

## 锐评

OpenAI 这次把 GPT-5.6 拆成 Sol、Terra、Luna 三个尺寸，思路很直白：用不同大小的模型去打不同价位。旗舰 Sol 在 Agents' Last Exam 上拿了 53.6 分，比 Claude Fable 5 高出 13.1 分，API 定价每百万 token 输入 5 美元、输出 30 美元，官方说成本大约是 Fable 5 的四分之一。如果这个性价比能坐实，对高频调用 agent 的团队确实省钱。

但这里有几个信息缺口要先指出来。第一，所有跑分和成本对比都来自 OpenAI 自己的口径，没有独立评测或第三方基准验证。第二，新加的“ultra”模式默认并行跑四个 agent，听起来能加速复杂任务，但正文没给出 token 消耗量级和延迟数据，实际账单可能比想象中高。第三，Meta 同一天发了 Muse Spark 1.1，直接被这条新闻盖过去了，但那个模型进了 Meta 自己的 API，说明 Meta 对稳定性有一定信心，后续值得单独对比。

总的来说，GPT-5.6 在纸面上把性能和成本的账算得很漂亮，但能不能兑现，还得等社区跑完真实任务再说。
