# OpenAI 发布云端编程代理 Codex，能并行处理多个开发任务

> 原标题：Introducing Codex

- 来源：OpenAI News
- 发布时间：2025-05-16T08:00:00.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/557
- 原文：https://openai.com/index/introducing-codex

## 摘要

OpenAI 在 5 月 16 日推出了 Codex 的研究预览版，这是一个跑在云端的软件工程代理，底层是专门为编程优化过的 codex-1 模型（基于 o3）。你可以把它当成一个能同时干好几件事的远程开发助手：在 ChatGPT 侧边栏里给它派活，比如写新功能、修 bug、回答代码库的问题或者直接提 PR。每个任务都在独立的沙盒环境里跑，它会自己读代...

## 推荐理由

OpenAI 这次不是给代码补全加功能，而是直接扔出一个云端软件工程代理 Codex。它能在隔离沙箱里读写仓库、跑命令和测试，单个任务耗时 1 到 30 分钟，还会把终端日志和测试结果吐出来给你看——这点挺实在，不是光说“能写代码”就完了。首发给了 Pro、Business、Enterprise 用户，6 月 3 日才扩到 Plus，正文在价格和完整限制上截断了，所以我会先打个折：产品方向够硬，但商业细节没讲透，先给 88 分。

## 锐评

OpenAI 在 5 月 16 日发布了 Codex 研究预览版，你可以把它理解成一个跑在云端的软件工程代理。底层模型 codex-1 是基于 o3 专门为编程任务优化过的版本，训练时用了强化学习，让模型学会模仿人类的代码风格和 PR 偏好，并且能自己反复跑测试直到通过。

它的工作方式是在 ChatGPT 侧边栏里接活，每个任务在独立的沙盒环境里运行，能读代码库、改文件、执行命令，通常 1 到 30 分钟出结果，最后会提交更改并附上终端日志和测试输出作为证据。官方给出的内部基准测试成绩不错，但正文没说明这些测试任务的具体难度分布，也没给出与主流开源模型的横向对比，所以这个“强”要打个问号。

目前先推给了 Pro、Business 和 Enterprise 用户，Plus 用户 6 月 3 号才用上。最大的信息缺口是定价和用量限制，正文只提了“可用”，没写清楚每次任务花多少 token 或多少钱，也没说沙盒环境的计算资源上限。另外，安全部分只开了个头就被截断，具体有哪些护栏措施、会不会审查代码内容，这些都没展开。
