跳到正文
Hacker News 首页

能放多少活给 AI 干,不看模型看任务本身

How much can you delegate to agents?

PostHog 的 Jina Yoon 给了一个判断框架:先看两件事——AI 干完活好不好检查,搞砸了能不能轻松回滚。根据这两个维度,任务可以分成四档。最难检查又最难回滚的,只让 AI 当助手,比如改核心功能标记引擎,风险大的部分人写,把 SDK 适配这种相对独立的活交给 AI。好检查但难回滚的,是目前大多数开发任务的默认上限。好检查又好回滚的,可以放...

推荐理由:这篇是 PostHog 工程师 Jina Yoon 写的,核心就一个判断框架:把任务按“AI 干完好不好检查”和“搞砸了能不能轻松回滚”分成四档。最难检查又最难回滚的,只让 AI 当助手,比如改核心功能标记引擎,风险大的部分人写,把 SDK 适配这种相对独立的活交给 AI。好检查但难回滚的,是目前大多数开发任务的默认上限。好检查又好回滚的,可以放更多。框架本身不复杂,但胜在来自真实工程实践,每个象限都有具体例子,对正在往 workflow 里塞 agent 的团队有参考价值。正文没给量化数据,所以重要性给 72,不往上拔。

读原文 ↗导出 Markdown