# 用有限状态机给 GUI Agent 合成训练轨迹，每条成本压到 0.04 美元

> 原标题：GUI Agent轨迹获取新范式：有限状态机合成无限轨迹数据，平均每条轨迹成本低至0.04美元

- 来源：量子位 · 公众号
- 发布时间：2026-05-28T13:15:00.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/30555
- 原文：https://mp.weixin.qq.com/s?__biz=MzIzNjc1NzUzMw==&mid=2247893592&idx=2&sn=b0bb834be9ebe25b9fb552f9fbb659b4

## 摘要

这篇讲的是 AutoWebWorld 这个项目，它没有靠人工标注或大模型当裁判，而是用有限状态机（FSM）来定义网页的状态、前置条件和跳转规则，自动生成并验证 GUI Agent 的操作轨迹。最终合成了 29 个网页环境、875 个页面和 11663 条经过验证的轨迹，平均每条轨迹的成本大约 0.04 美元。正文没披露具体用了哪些模型做测试，也没给出任...

## 推荐理由

我会先打个折：这不是顶级大厂的发布，所以分数压在 78–84 的研究工具档位。但 H、K、R 三条都站得住。0.04 美元一条轨迹是个能让人点进去的数字；放出的环境和轨迹量不算小，而且 FSM 内置状态验证这个设计，比靠人标或 LLM 打分更可复现，对做 GUI 智能体的人有直接参考价值。

## 锐评

AutoWebWorld 的思路挺直接：不靠人标，也不用大模型当裁判，而是用有限状态机把网页环境定义成状态、前置条件和跳转规则，自动合成并验证 GUI Agent 的操作轨迹。最终产出 29 个网页环境、875 个页面、11663 条经过验证的轨迹，平均每条成本约 0.04 美元。这个成本数字确实低，对比人工标注或调用大模型做验证，省钱是实打实的。

但正文没披露用哪些模型做了测试，也没给出任何成功率或任务完成度的数据。也就是说，轨迹便宜是便宜，但用这些轨迹训出来的 agent 到底好不好用，目前没答案。另外，状态机能覆盖的网页复杂度有限，真实网页里那些动态加载、验证码、弹窗之类的坑，这套方法能不能扛住，也没提。

还缺的是：和现有基准的横向对比、开源代码的实际可用性验证，以及轨迹多样性是否足够支撑模型泛化。这些信息补上之前，先当它是一个低成本造训练数据的思路，别急着当完整方案。
