# OpenAI 发布 GPT-Image-2，图像生成模型开始能看懂文字、画 UI 和做排版了

> 原标题：[AINews] OpenAI launches GPT-Image-2

- 来源：Latent Space
- 发布时间：2026-04-22T00:23:52.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/10422
- 原文：https://www.latent.space/p/ainews-openai-launches-gpt-image

## 摘要

OpenAI 正式推出了 GPT-Image-2，在 ChatGPT、Codex 和 API 里都能用。这次更新最明显的变化是文字渲染、排版和编辑能力大幅提升，能直接生成幻灯片、信息图、UI 稿和二维码，还支持多语言。模型分“思考”和“不思考”两个版本，思考版可以自己上网搜资料、生成多个候选图并自我检查。在 Arena 的图像排行榜上，GPT-Imag...

## 推荐理由

OpenAI 把 GPT-Image-2 同时铺到 ChatGPT、Codex 和 API，还特意强调 thinking 版本和文字渲染、布局编辑这些实用能力。Arena 上 Elo 1512、领先第二名 242 分，这个差距不小，说明在盲测里用户确实更愿意选它。我会先打个折——Arena 分数受采样和用户群影响，不能直接当绝对性能看，但三个第一同时拿下，至少说明在文生图这个赛道上它目前压了别人一头。对从业者来说，能不能稳定出可编辑、多语、带 QR 码的图，比单纯画质更重要，这条更新直接踩中了选型决策点。

## 锐评

OpenAI 这次把图像生成重新当回事了。GPT-Image-2 最明显的进步是文字渲染和排版，能直接生成幻灯片、信息图、UI 稿甚至二维码，还支持多语言。模型分“思考”和“不思考”两个版本，思考版可以自己上网搜资料、生成多个候选图再自我检查，听起来像把 agent 那套流程搬进了图像生成。

Arena 排行榜上它拿了三个第一，文生图 Elo 1512，领先第二名 242 分，差距不小。但 Arena 分高主要说明大家觉得它比别的模型好看，不代表你的特定需求它能稳定执行。正文没披露推理成本、生成延迟和 API 定价，也没说思考版比不思考版慢多少、贵多少。这点先别太激动。

另外，这次发布是在 Sora 团队被传解散之后，说明 OpenAI 内部对图像生成的产品优先级有过摇摆。现在还缺第三方大规模实测，尤其是多轮编辑的一致性、复杂排版下的文字准确率，以及商用场景的版权和内容安全边界。
