# 模型正在吃掉 Agent 的外骨骼，剩下的那层壳只用来管理人的注意力

> 原标题：The Evolution of the Agent Harness

- 来源：Latent Space
- 发布时间：2026-08-22T07:30:52.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/52462
- 原文：https://www.latent.space/p/attention-interface

## 摘要

Dan McAteer 梳理了模型能力和外部“外骨骼”（工具、记忆、护栏这些不在模型权重里的东西）之间的拉锯战。2022 年底的 ReAct 还只是纸面上的提示循环；2023 年春的 AutoGPT 给了模型它根本驾驭不了的自主权——单步 95% 的可靠性跑 20 步，整体成功率只剩约 36%。Cursor 和 Copilot 学乖了，把外骨骼压到模型...

## 推荐理由

Dan McAteer 用具体的可靠性数学把 agent 框架的演化串了起来，角度够刁。分数定在 78 是因为这属于评论性文章，不是产品发布或一手信源，价值在框架本身，不在新闻性。

## 锐评

Dan McAteer 用“外骨骼”这个比喻把 agent 的演进串起来了：模型权重之外的工具、记忆、护栏，一直在和模型能力拔河。2022 年底的 ReAct 还只是纸面上的提示循环，2023 年春的 AutoGPT 给了模型它根本驾驭不了的自主权——单步 95% 的可靠性跑 20 步，整体成功率只剩约 36%，这个数字很直观地解释了为什么当时的 agent 动不动就翻车。Cursor 和 Copilot 学乖了，把外骨骼压到模型能力曲线以下，靠人留在循环里兜底。真正的交叉点出现在 2024 年底 o1 推理模型上线，以及 2025 年 2 月 Claude Code 发布之后。

文章的核心判断是：模型会不断把外骨骼的功能吸收进权重里，工程师删掉被吸收的部分，最后剩下的外骨骼管的不再是模型，而是人的注意力。这个方向判断有道理，但正文没给出任何时间表或产品路线图，也没说清楚“吸收”的具体机制——是训练数据里加了工具调用轨迹，还是架构上做了改动，这些都没展开。引用的 Lukasz Kaiser 原话也承认“很难说清楚到底发生了什么”，所以整篇更像一个观察框架，而不是可验证的结论。
