# OpenAI 把 GPT-5 调成了专门干活的编程助手 Codex，一个模型同时搞定聊天写码和长时间自主跑任务

> 原标题：Introducing upgrades to Codex

- 来源：OpenAI News
- 发布时间：2025-09-15T10:00:00.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/472
- 原文：https://openai.com/index/introducing-upgrades-to-codex

## 摘要

OpenAI 发布了 GPT-5-Codex，并把它设为 Codex 云端任务和代码审查的默认模型。这个模型专门针对真实软件工程任务训练过，既能跟你快速交互式写代码，也能自己独立跑复杂任务，测试中最长连续干了超过 7 个小时。在 OpenAI 内部员工的使用数据里，对于 token 消耗最少的那 10% 的简单对话，GPT-5-Codex 比 GPT-...

## 推荐理由

OpenAI把GPT-5-Codex设为Codex云任务和代码审查的默认模型，给了几个硬数字：7小时自主执行、低端请求token省93.7%、高端请求耗时翻倍。这说明他们想把交互编程和长时代理执行揉在一起，但定价和完整可用性正文没披露，所以先别急着算账。

## 锐评

这次更新核心是把交互式编程和能独立跑任务的 agent 能力塞进同一个模型 GPT-5-Codex 里。它不再只是补全代码，而是能像人一样长时间执行任务，测试中最长连续干了超过 7 个小时，自己改实现、修测试。内部数据说，对最简单的对话，它比 GPT-5 省了 93.7% 的 token；对最复杂的任务，它花在推理、编辑和测试上的时间反而多了 2 倍。这个“看人下菜碟”的动态思考机制是亮点，意味着简单请求响应更快，复杂活更靠谱。

不过，文章只提了模型能力，没给具体定价。虽然 9 月 23 日的更新说 API 价格和 GPT-5 一样，但原文正文里没写，得去开发者文档里翻。另外，7 小时连续运行的成功率、失败模式都没披露，实际用起来稳定性要打个问号。代码审查能抓什么级别的 bug 也没说清楚。
