# Lilian Weng 用 35 篇论文讲清一件事：让 AI 自我进化的关键在外挂程序，不在模型本身

> 原标题：[AINews] Lilian Weng summarizes 35 papers on Harness Engineering for RSI

- 来源：Latent Space
- 发布时间：2026-07-08T02:20:25.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/43973
- 原文：https://www.latent.space/p/ainews-lilian-weng-summarizes-35

## 摘要

Lilian Weng 发了一篇长综述，把 AI 的递归自我改进（RSI）重新聚焦到“外挂程序层”（harness），而不是直接去改模型权重。她翻了 35 篇论文，拆解了目前被验证过的外挂设计趋势，重点提到了 ACE 和 Meta-Harnesses 这类让外挂程序自己优化自己的方法。她的核心判断是：就算未来很多外挂能力会被内化进模型里，“设定目标和上...

## 推荐理由

Lilian Weng 发了一篇 35 篇论文的综述，核心观点是把递归自我改进的重心从模型权重挪到外挂程序层。她管这叫“外挂工程”，重点讲了 ACE 和 Meta-Harnesses 这类让外挂自己优化自己的设计。我会先打个折：这是个人博客综述，不是正式论文，但判断本身有论文支撑，对做 agent 和推理的人有实操参考价值。

## 锐评

Lilian Weng 这篇综述最值得看的地方，是她把“递归自我改进”这个听起来很玄的概念，拆解成了具体的外挂程序（harness）设计趋势。她翻了 35 篇论文，重点提了 ACE 和 Meta-Harnesses 这类让外挂程序自己优化自己的方法，相当于给 AI 的自我改进画了张工程图纸。

她的核心判断很务实：别指望模型自己搞定一切，设定目标和上下文这件事，永远需要人来（或外挂程序来）定义。这其实也间接解释了 Thinky 这家公司想做什么——正文没披露产品细节，但框架已经暗示了方向。

文章还提到 Anthropic 把 Claude Cowork 做成了后台队友，Google 给 Gemini 加了后台执行，这些产品动作都在印证同一个趋势：让模型进业务流程干活，而不是只停留在对话框里。不过，这些产品到底能稳定处理多复杂的任务，正文没给具体数据，这点先别太激动。
