# OpenAI 发布 GPT-5.5，跑分涨了但延迟没变，还顺手发了 Codex

> 原标题：OpenAI 发布 GPT-5.5，目前向 ChatGPT 的 Plus、Pro、Business 和 Enterprise 用户开放，同步上线 Codex。API 将"很快"跟进。

- 来源：X · @dotey（宝玉）
- 发布时间：2026-04-23T18:52:31.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/9068
- 原文：https://x.com/dotey/status/2047388162687684615

## 摘要

GPT-5.5 现在向 ChatGPT 付费用户和 Codex 开放，API 随后到。OpenAI 说它每 token 延迟跟 GPT-5.4 一样，但完成同样任务用的 token 更少，相当于能力涨了、效率也涨了。跑分上，Terminal-Bench 2.0 从 75.1% 提到 82.7%，FrontierMath Tier 4 从 27.1% 跳...

## 推荐理由

这是一次核心模型发布，带了基准、定价和百万 token 上下文，HKR 三项都踩中。标题说 API“很快”跟进，摘要里却已经给了 API 定价，这个不一致让我对时效性稍微打个折，但整体还是必须写的 p1 级别。正文最值得盯的是那句“同等智能下总 token 消耗约为前沿竞品编码模型的一半”——如果属实，成本优势不小，但没给出具体对比对象和测试条件，这点先别太激动。

## 锐评

OpenAI 这次把 GPT-5.5 的升级重点放在了效率上，而不是单纯堆跑分。每 token 延迟跟 GPT-5.4 一样，但完成同样任务用的 token 更少，Artificial Analysis 的数据说消耗量大约是竞品前沿编码模型的一半。这对按 token 付费的 API 用户是实打实的省钱，输入 5 美元、输出 30 美元每百万 token 的定价，配合 token 效率提升，实际成本可能比 GPT-5.4 还低。

跑分有亮点也有短板。Terminal-Bench 2.0 从 75.1% 提到 82.7%，FrontierMath Tier 4 从 27.1% 跳到 35.4%，数学和命令行能力涨得明显。但 SWE-Bench Pro 上 58.6% 仍低于 Claude Opus 4.7 的 64.3%，OpenAI 自己标注了该基准存在记忆化问题，这点先别太激动。正文没披露这个基准的具体污染程度，也没说他们怎么测的。

安全评级归在 Preparedness Framework 的 High 级别，没到 Critical，同时开了个面向安全研究人员的 Trusted Access 计划。内部使用数据挺实在，85% 员工每周用 Codex，财务团队审了 24,771 份 K-1 税表提前两周收工，说明产品化程度比上一代成熟。但 API 还是"很快"跟进，没给具体日期，急着接入的开发者得再等等。
