# 改完代码自己定闹钟盯 CI：OpenAI 源码里的自唤醒机制

- 来源：Computing Life · Share · 鸭哥调研
- 发布时间：2026-09-03T00:00:00.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/54746
- 原文：https://yage.ai/share/codex-persistent-mode-20260903.html

## 摘要

OpenAI 在 8 月底合入开源仓库的一份系统提示模板，透露了 Codex Persistent mode 的真实运作方式：它不是 24 小时常驻进程，而是一个每 1 到 3 分钟唤醒、检查、再休眠的循环。每次睡下前，模型必须记下目标、当前状态、收工条件和下次检查时间，醒来后自己判断该干什么。一条硬规矩是持续运行不扩大授权范围，超出权限必须先请示。W...

## 推荐理由

信息密度高，有开源仓库的源码依据，把唤醒-检查-休眠的循环和授权范围限制这两点讲清楚了。扣分是因为这是对模板的解读，不是官方发布，实际产品体验未知。

## 锐评

这条消息最值得看的是代码和媒体标题之间的温差。媒体说“永不停歇”，但源码里写的是“再次采样”，本质是一个每 1 到 3 分钟唤醒、检查、再休眠的循环，没有常驻进程。每次睡下前，模型必须记下目标、当前状态、收工条件和下次检查时间，醒来后自己判断该干什么。一条硬规矩是持续运行不扩大授权范围，超出权限必须先请示。

OpenAI 按住开关不上线，原因很具体。ProAgentBench 的评测显示，模型判断“现在该不该主动帮忙”的准确率最高只有 64.4%，三个决定里错一个。Anthropic 的工程博客也给了个数字：模型自动审查时，对真实过度行为的漏检率是 17%。把三分之一的时机误判和两位数的漏检率放在一个自唤醒系统里，出事只是频率问题。正文没披露 OpenAI 自己的内部评测数据，也没给出计费模型的具体方案。

适合交给它的任务是 CI、部署、构建这类“执行一分钟、等待十分钟”的交付型任务。不适合的是写方案、做设计这种下一步依赖人类反馈的开放式任务。监控任务要特别小心，因为模板规定不能自行提前收工，成本没有天然上限。今天就能搬走的三条纪律是：写好检查点四要素、无实质变化保持静默、优先复用确定性机制。
