# Statewright：用可视化状态机给 AI 智能体上把锁，让它干活更靠谱

> 原标题：Show HN: Statewright – Visual state machines that make AI agents reliable

- 来源：Hacker News 首页
- 发布时间：2026-05-12T14:24:55.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/19042
- 原文：https://github.com/statewright/statewright

## 摘要

这是一个刚在 Hacker News 上展示的开源项目，核心思路是用 Rust 写一个状态机引擎，把 Claude Code 能调哪些工具、能跑多少轮、怎么跳转、什么条件下才能执行下一步，全部用状态图管起来。作者说 130 亿到 200 亿参数的模型在真实的 SWE-bench 任务上表现都有稳定提升，但正文没披露具体的基准分数、样本量和评测流程，这点...

## 推荐理由

我会先打个折：SWE-bench 具体分数没披露，没法判断改进幅度有多大。但用状态机硬约束工具调用这个思路本身靠谱，尤其对 Claude Code 这类编程 agent 的稳定性有帮助。小模型能跑是个加分项，说明不是堆算力的玩法。整体值得推荐，但别把“一致改进”当成碾压性提升。

## 锐评

Statewright 做的事很直白：用 Rust 写一个状态机引擎，把 Claude Code 能调哪些工具、能跑多少轮、怎么跳转、什么条件下才能执行下一步，全部用状态图管起来。这相当于给 AI 编程助手套了个硬约束的流程控制器，不让它乱跑。

作者声称 130 亿到 200 亿参数的模型在真实的 SWE-bench 任务上表现都有稳定提升。但正文没披露具体的基准分数、样本量和评测流程，也没说对比的是裸 Claude Code 还是加了其他约束的版本。没有这些，很难判断提升到底有多大、是不是靠状态机本身带来的。

项目刚在 Hacker News 上展示，代码开源，但还没看到第三方复现或独立评测。如果后续能补上完整的实验记录和可复现的评测脚本，这个思路对需要把 AI 编程助手放进生产流程的团队会更有说服力。
