跳到正文
MIT Technology Review · AIThore Graepel

Thore Graepel 论大语言模型为何不具备推理能力

Don’t be fooled—LLMs don’t reason

Thore Graepel 主张,大语言模型的思维链仍依赖下一 token 预测,缺少 AlphaGo 那样独立的搜索与推理机制。他指出,聊天机器人通常缺乏显式、持久且可检查的知识状态,知识与推理没有清晰分离,生成的思维链也可能与实际得出答案的路径不一致。他提出借鉴 AlphaGo 的架构,维护可更新的知识状态,由独立机制依据证据评估每一步是否减少不确定性,使结论形成过程可以审计。

读原文 ↗导出 Markdown