# Greptile 推出 TREX：一个会真跑代码的 AI 审查员

> 原标题：TREX: An AI code reviewer that runs your code

- 来源：Hacker News 首页
- 发布时间：2026-06-17T15:29:01.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/38955
- 原文：https://www.greptile.com/blog/trex-code-execution

## 摘要

Greptile 给代码审查加了一层执行能力，不只是看代码改动，而是把代码跑起来、截图、抓运行时 bug。TREX 不是独立产品，而是主审查员手下的子代理，共享上下文、并行干活，不用重复扫代码库。他们踩过坑：独立代理生成的测试跟用户需求不沾边，合并成一个代理又因为要管启动服务、截图、跑测试这些事导致上下文过载。现在的方案是让主审查代理当调度员，针对每个...

## 推荐理由

Greptile 给 AI 代码审查加了个执行层，不是光看代码改动，而是真跑代码、截图、抓运行时问题。文章把踩坑过程摊开来讲——独立代理写的测试跟需求脱节，合并成一个代理又因为要管启动服务、截图、跑测试这些事导致上下文过载，最后让主审查代理当调度员、子代理并行干活才跑通。架构教训实在，但受众窄，所以 H 和 K 都站得住，R 就弱一些。

## 锐评

Greptile 这篇讲的是他们给 AI 代码审查加了一个叫 TREX 的执行层，让审查代理不只是读代码改动，而是把代码跑起来、截图、抓运行时才会暴露的 bug，比如 UI 加载后的错位、需要特定状态触发的逻辑错误。

他们踩过的坑挺实在：一开始把 TREX 做成独立代理，结果它生成的测试跟用户实际需求不沾边；后来想合并成一个代理，又因为要同时管启动服务、截图、跑测试这些事，上下文直接过载。现在的方案是让主审查代理当调度员，针对每个问题单独派一个 TREX 子代理去跑，共享上下文但并行干活，不用重复扫代码库。

文章把架构演进讲清楚了，但缺了最关键的东西——没给任何量化数据。不知道 TREX 抓运行时 bug 的召回率是多少，误报率多少，也没说跑一次审查要多花多少时间和算力。如果是真的能稳定抓到静态审查漏掉的 bug，这个思路有价值；但在看到数字之前，只能当工程实践参考，不能当效果背书。
