# 伯克利 RDI 把 AI 写代码分成三级：从替你写 PR，到替你决定该做什么

> 原标题：当编码不再是瓶颈：Berkeley RDI 提出软件自主开发三级框架

- 来源：AI HOT 精选
- 发布时间：2026-07-27T07:51:26.272Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/46888
- 原文：https://rdi.berkeley.edu/blog/auto-software-dev

## 摘要

伯克利 RDI 发了一篇立场文章，给 AI 自主开发软件划了三个等级。一级叫“代码自主”，AI 负责设计和实现，直接交完整的 PR，但人还得拍板做什么、审 PR、管上线。二级叫“流水线自主”，人只提需求，AI 包揽设计、测试、审计到部署，中间代码人不用看。三级叫“需求自主”，AI 自己看系统数据、用户行为和安全公告，决定接下来该开发什么，人只在最初定个...

## 推荐理由

伯克利 RDI 这篇立场文章不是产品发布，但它把 AI 软件开发的讨论从“能不能写代码”推到了“谁来决定做什么”，对从业者来说是个认知上的推进。三级框架（代码自主、流水线自主、需求自主）给了一个可操作的评估尺度，跨机构的作者名单也增加了分量。我会先打个折：正文没披露任何实验数据或落地案例，目前还是观点输出，但观点本身够尖锐，值得放进精选。

## 锐评

这篇文章最有价值的地方是给“AI自主开发软件”画了条清晰的边界线，而不是吹一个模糊的未来。它把自主性拆成三级：一级是AI负责设计和实现，直接交完整的PR，但人还得决定做什么、审PR、管上线；二级是流水线自主，人只提需求，AI包揽设计、测试、审计到部署，中间代码人不用看；三级是需求自主，AI自己看系统数据、用户行为和安全公告，决定接下来该开发什么，人只在最初定个使命。

文章里有个很实在的对比：16个并行的Claude agent花不到2万刀就搭出一个能跑的C编译器，这成本低得吓人。但一跑需要持续演化的基准测试，前沿agent就露馅了——它们能加新功能，却很难在连续改动中保持正确性和架构不乱。这说明现在的模型能完成单次任务，但还没学会“维护一个活着的系统”。

文章没给落地时间表，但判断高可靠领域会长期卡在一级，内部工具可能更快摸到二级。缺的东西也很明确：怎么把人的意图写成足够完整的规格说明，让AI在没人看中间产物的情况下不出岔子，这个前提今天还不成立。另外，三级里AI自己定需求，怎么保证它不悄悄把最初使命给改了，文章只提了问题，没给解法。
