跳到正文
AI HOT 精选

工具调用代理的认知与行动脱节机制研究

工具使用代理认知与行动脱节机制研究

这篇可解释性论文专门研究了让模型调用工具的代理,发现一个挺要命的问题:模型经常心里知道该调工具了,但手上就是没动作。这种“知道却做不到”的比例在 26% 到 54% 之间,而且毛病全出在从认知到行动的过渡阶段,不是模型没看懂。内部探测显示,模型在后期层处理最后一个 token 时,会把信号转歪,转出来的方向几乎和要执行的动作正交,导致行动失败。研究想通...

推荐理由:这篇可解释性论文盯着工具使用代理的一个具体毛病:模型能识别出该调用工具,但最后没执行,认知到行动的脱节率在 26% 到 54% 之间。我会先打个折——正文没披露具体模型、任务设置和论文全名,所以数字的适用范围还不清楚。但这点先别太激动,它确实点出了一个很常见的 agent 翻车场景:不是模型不懂,是懂了但没做。对做 agent 可靠性的同学来说,这个视角比单纯说“模型不会用工具”更有诊断价值。

读原文 ↗导出 Markdown