# GPT-5.6 全线降价 20%-80%：四个月前旗舰模型的智力，现在只要十三分之一的价格

> 原标题：[AINews] GPT 5.6 price cut by 20%-80%: Cost of GPT 5.4 Intelligence dropped 13x in 4 months due to GPT 5.6 recursive self-optimization

- 来源：Latent Space
- 发布时间：2026-07-31T04:40:54.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/48391
- 原文：https://www.latent.space/p/ainews-gpt-56-price-cut-by-20-80

## 摘要

OpenAI 把 GPT-5.6 Luna 的价格砍到了每百万 token 输入 0.2 美元、输出 1.2 美元，降幅 80%。Terra 降了 20%，Sol 则多了一个 2.5 倍速模式，价格翻倍但智力不变。最狠的是，Luna 在 AA 基准测试上拿了 51 分，跟今年三月 GPT-5.4 开满推理强度时的分数一样，但 token 成本只有当时的...

## 推荐理由

四个月把同等智力成本压到十三分之一，这个信号比单纯降价狠得多。AA 基准 51 分直接对标 GPT-5.4 满血推理，让降价有了硬参照，不是拿弱化版糊弄人。文章没展开“递归自优化”具体怎么做的，这点先别太激动，但光看价格和分数，已经够让所有调 API 的人重新打算盘了。

## 锐评

OpenAI 这次降价不是简单的市场促销，而是模型自己动手改写了 Triton 和 Gluon 生产内核，把端到端服务成本压低了 20%，再叠加上投机解码和 KV 缓存优化，才把 Luna 的价格砍到输入 0.2 美元、输出 1.2 美元每百万 token。最直观的对比是：今年三月 GPT-5.4 开满推理强度在 AA 基准上拿 51 分，成本是 2.5/15 美元；现在 Luna 同样拿 51 分，成本只要 0.2/1.2 美元，四个月智力成本降到约 1/13。

不过原文也提醒，AA 这类公开基准可能被部分训练数据污染，所以 51 分这个对齐不能全信。另外 Sol 新增的 2.5 倍速模式价格翻倍、智力不变，适合对延迟敏感的场景，但正文没披露具体延迟数字，也没说这个加速是靠硬件还是纯软件优化。

还缺的信息是：这些成本下降在真实业务负载里能兑现多少，以及自我优化过程中有没有引入新的稳定性风险。如果后续有第三方在私有测试集上复现这个性价比曲线，才算真正坐实。
