# OpenAI 发布 GPT-5.6 系列：Sol、Terra、Luna，主打用更少的钱跑出更高的分

> 原标题：GPT-5.6 系列模型发布：Sol、Terra、Luna

- 来源：AI HOT 精选
- 发布时间：2026-07-09T10:00:00.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/43372
- 原文：https://openai.com/index/gpt-5-6

## 摘要

OpenAI 在 7 月 9 日推出了 GPT-5.6 系列，包含旗舰模型 Sol、均衡型 Terra 和低成本 Luna。旗舰 Sol 在 Agents' Last Exam（一个覆盖 55 个专业领域的长流程测试）上拿了 53.6 分，比 Claude Fable 5 高出 13.1 分，但预估成本只有后者的四分之一左右。新加的 `ultra` 模...

## 推荐理由

OpenAI 旗舰模型换代，一次发三个变体，在长流程 agent 测试上直接赢了 Claude Fable 5 两位数，还打出四分之一成本的牌。这是 2026 年至今最重量的模型发布，会立刻影响 agent 工作流的选型决策。

## 锐评

OpenAI 这次一口气发了三个模型：Sol 是旗舰，Terra 走均衡路线，Luna 主打低成本。最抓眼球的数字是 Sol 在 Agents' Last Exam 上拿了 53.6 分，这个测试覆盖 55 个专业领域的长流程任务，比 Claude Fable 5 高出 13.1 分，预估成本却只有后者的四分之一左右。在编程方面，Sol 在 Artificial Analysis 的 Coding Agent Index 上拿了 80 分，比 Fable 5 高 2.8 分，输出 token 量不到对方一半，耗时也少一半多，成本低约三分之一。Terra 和 Luna 更夸张，性能超过 Fable 5，成本只要大约十六分之一。

这些数字如果属实，性价比确实拉得很开。但要注意，所有对比都来自 OpenAI 自己引用的评测，Agents' Last Exam 和 Artificial Analysis 的测试方法、样本量、评分细则正文没展开，Fable 5 的具体配置也没说清。新加的 ultra 模式号称能协调多个 agent 并行干活来降延迟，但实际延迟降多少、多任务下稳定性如何，同样没给具体数据。

安全方面，OpenAI 说做了大量红队测试和自动化检测，预览期也找了外部伙伴一起压测。但安全措施具体挡住了什么攻击、误拦率多高，正文没披露。总的来说，纸面性能很强，但缺少独立复现和更细的测试条件说明，实际落地效果还得等第三方验证。
