# Sentinel：一个先读代码再动手的开源 QA 智能体

> 原标题：Show HN: Sentinel – open-source QA agent that reads your code before it clicks

- 来源：Hacker News 首页
- 发布时间：2026-07-16T15:35:13.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/44762
- 原文：https://blog.simbastack.com/announcing-sentinel/

## 摘要

SimbaStack 在 MIT 协议下开源了 Sentinel，一个会先通读代码库、自己梳理业务流程，再做端到端测试的 QA 智能体。他们拿自家酒店管理系统做实验，只给了代码仓库和管理员账号，没给任何测试计划。Sentinel 读完代码后判断这是个精品酒店系统，自动梳理出九条关键业务流，包括完整的预订生命周期、团队预订和夜审。它把最重要的两条流程各跑...

## 推荐理由

一个开源 QA agent 的新玩家，拿真实的酒店管理系统做了端到端实验，不是玩具 demo。分数没上 80，因为目前只有一篇博客，还没有第三方复现或横向对比。

## 锐评

SimbaStack 开源的这个 Sentinel 有点意思，它不是那种上来就乱点的测试机器人。它先通读代码仓库，自己判断出这是个精品酒店管理系统，然后自动梳理出预订生命周期、团队预订、夜审等九条关键业务流，跟一个熟手 QA 第一天列的计划差不多。测试时它不光看界面，还会直接调 API 查后端状态，结果抓到了三个藏在状态机里的 bug：比如一个已经占房的预订，确认时后端却报“无可用房间”；日历显示有空房，API 却说已订出；客人入住返回成功，但服务器里的登记状态根本没变。这些问题是纯界面测试发现不了的。

它的做法是把代码结构先用 grep 这类确定性工具扫一遍，再交给小米的 Mimo 模型去理解业务并生成测试计划，然后用 Playwright 操作浏览器，同时用 api_request 工具验证后端。每个流程默认跑两遍，因为单次运行可能漏掉 bug，他们实测一次零发现、另一次抓到五个。每次尝试有 90 次工具调用的硬上限。最后还会对访问过的页面做一轮视觉评分，看层级、间距和对比度。

目前只支持 Next.js、Express 这类常见的 JS 技术栈，其他栈需要自己写适配。正文没提它对非 Web 应用或复杂权限场景的支持程度，也没给出在更大规模项目上的误报率或资源消耗数据。如果是真的像他们演示的这样省事，对中小团队会挺实用，但别指望它能完全替代懂业务的测试工程师。
