# 用确定性工具把大模型的笨手笨脚自动化掉

> 原标题：Automating AI Away

- 来源：Hacker News 首页
- 发布时间：2026-07-07T15:11:08.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/42951
- 原文：https://replicated.live/blog/away

## 摘要

作者在开发 Beagle SCM 时发现，Claude 这类大模型虽然聪明，但做事不精确、不稳定，比如会把 build/ 目录重复提交两次。这种笨拙是模型本身的特性，不会随着进步消失。解决办法是用快速、可靠的确定性工具把模型夹在中间：下层是工具层，上层是工作流层，让模型在严格的流程里干活。如果模型反复做同一组操作，就写成脚本自动化；如果总在某个地方出错...

## 推荐理由

一篇工程师视角的实战反思，用 Claude 的翻车案例引出“用确定性工具夹住模型”的架构思路。不是产品发布或研究突破，但问题真实、解法具体，对正在把 AI 接入开发流程的团队有直接参考价值。

## 锐评

这篇文章来自 Beagle SCM 的开发者，讲的是怎么对付大模型“聪明但毛手毛脚”的老毛病。他举了个具体例子：Claude 在代码仓库里把 build/ 目录提交了两次，这种事不是模型变强就会消失，因为大模型天生不精确、不稳定。他的解法是把模型夹在两层确定性结构中间——下层是快速可靠的工具，上层是严格的工作流，让模型在框死的流程里干活。如果模型反复做同一组操作，就写成脚本自动化；如果总在某个地方出错，就把验证步骤自动化。Beagle SCM 的做法是让模型用 JavaScript 给自己写例行脚本，底层重活在 C 里跑，工具层和工作流层全是 JS，可以像 node_modules 一样从文件系统加载。

这个思路的亮点在于承认模型的笨拙是结构性的，不指望它自己变稳，而是用工程手段把不确定性关进笼子。但正文没披露这套机制在实际项目里的成功率或节省了多少人工，也没说脚本自动生成后会不会引入新的维护负担。另外，所有逻辑都绑在 Beagle 这套特定工具链上，通用性存疑。如果只看概念，方向是对的，落地效果还得等更多数据。
