# 宜信做了一个金融 Agent 的“外挂控制台”，单任务能跑 16 小时，计划下半年开源

> 原标题：单任务狂飙16小时！模型+Harness双轮驱动，金融Agent跑通了

- 来源：新智元 · 公众号
- 发布时间：2026-04-17T13:10:00.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/3327
- 原文：https://mp.weixin.qq.com/s?__biz=MzI3MTA0MTk1MA==&mid=2652693051&idx=2&sn=3ebf8768d8ef1aafd0e497f667097d72

## 摘要

宜信公开了一个金融 Agent 的工程方案，核心是一个叫 Harness 的控制层，让模型在 12 个会话窗口里接力干活，单个任务最长能跑 16 小时。目前自主交付率 65%，每个案子有 5 万 token 的上下文上限。他们给出的预估数据是审批提速超过 150%，单件成本降到人工的五分之一。文章说计划 2026 年下半年开源，但没给仓库地址、开源协议...

## 推荐理由

这篇东西我会先打个折，因为所有数据都是易鑫自己报的，仓库、许可证、可复现评测正文都没给。但它确实扔出了几个少见的量产数字：单任务跑16小时、跨12个会话、自主交付率65%，而且每单token压在5万以内，审批提速说能超150%，单均成本号称降到人工的五分之一。开源时间只提了2026年下半年，具体怎么开没说。真正值得盯的不是标题里的“更聪明”，而是他们怎么设计治理层来兜住这么长链条的Agent——这点正文有提，但细节不够。整体看，信息量够上推荐，但别当已验证的结论用。

## 锐评

宜信公开的这套金融 Agent 方案，核心不是模型本身，而是他们叫 Harness 的控制层。它把长任务拆到 12 个会话窗口里接力，让模型能持续干活 16 小时，每个案子有 5 万 token 的上下文上限。目前自主交付率 65%，意味着还有三分之一以上的案子需要人接手。文章给出的预估是审批提速超 150%，单件成本降到人工的五分之一，但这些都是他们自己的测算，没有第三方验证。

文章说计划 2026 年下半年开源，但正文没披露仓库地址、开源协议，也没给出可复现的评测基准。所以现在能判断的只有工程思路：用会话接力突破单次对话的长度限制，把模型塞进一个带治理规则的业务流程里。这个方向本身不新鲜，但能在金融场景跑通 16 小时，说明他们在状态管理和异常兜底上做了不少脏活。

还缺的东西很明确：真实业务场景下的交付质量数据、人工介入的具体原因分布，以及那个 5 万 token 上限在实际复杂案件里够不够用。如果开源时能把这些补上，会比现在这篇宣传稿有说服力得多。
