# OpenAI 发布 GPT-5.5，强调能干活、会检查，但没给参数和跑分

> 原标题：Introducing GPT-5.5

- 来源：X · @OpenAI
- 发布时间：2026-04-23T18:06:25.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/9058
- 原文：https://x.com/OpenAI/status/2047376561205325845

## 摘要

OpenAI 在 X 上宣布推出 GPT-5.5，已经接入 ChatGPT 和 Codex。官方说法是它面向实际工作和 agent 场景，能理解复杂目标、调用工具、自我检查，把更多任务从头跑到尾。我会先打个折：正文没披露参数量、价格、上下文窗口和任何基准测试结果，所以现在只能看到一句“新的智能形态”和“新的干活方式”，具体强在哪、贵不贵、跑多快都还不知道。

## 推荐理由

OpenAI 在 ChatGPT 和 Codex 上线 GPT-5.5，属于当天必须覆盖的发布。HKR 三项全中：新模型发布本身就有话题性，正文给出了 agent 工作流和工具调用的具体方向，对日常做 AI 应用的人有直接影响。我会先打个折——参数、价格、上下文窗口和基准分正文都没披露，所以重要性停在 92，不往上拉。真正值得盯的是落地链路，不是标题里的“新一类智能”。

## 锐评

OpenAI 在 X 上宣布 GPT-5.5 上线，接入 ChatGPT 和 Codex。官方说它能理解复杂目标、调用工具、自我检查，把更多任务从头跑到尾，面向实际工作和 agent 场景。但这条帖子没披露任何硬指标：参数量、上下文窗口、价格、延迟、基准测试结果全都没有。所以“新的智能形态”和“新的干活方式”目前只是一句定位，具体强在哪、贵不贵、跑多快都还不知道。

值得关注的点是它强调“把任务跑完”而不是只给答案，这暗示模型可能内置了更长的执行循环和工具调用链，适合让模型进业务流程干活。但没看到实测之前，我会先打个折：没有对比数据，就没法判断它比 GPT-5 或 Claude 好多少。

还缺的信息：多语言表现、幻觉率、长上下文下的稳定性，以及 agent 场景里的任务完成率。这些才是判断它能不能真干活的关键。
