# 小米罗福莉：Agent 时代算力跟不上 Token 烧法，出路不是降价而是省 Token

> 原标题：小米 MiMo 团队负责人罗福莉：

- 来源：X · @dotey（宝玉）
- 发布时间：2026-04-05T18:08:28.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/3618
- 原文：https://x.com/dotey/status/2040854097838952598

## 摘要

小米 MiMo 团队负责人罗福莉指出，现在 Agent 干活时反复带着超过 10 万 Token 的长上下文去调工具，请求次数是 Claude Code 自身框架的好几倍，真实 API 成本可能冲到订阅价的几十倍，全球算力根本扛不住。她认为短期阵痛反而是好事，第三方框架被 API 付费逼着去改进上下文管理、提高缓存命中率、砍掉无效消耗。同时她呼吁大模型...

## 推荐理由

小米 MiMo 负责人罗福莉这次发言没绕弯子，直接拿 OpenClaw 和 Claude Code 的请求次数做对比，把 Agent 多轮工具调用带来的 Token 消耗和成本膨胀讲得很清楚。10 万 Token 上下文反复携带、请求量高出数倍、API 计费后成本翻几十倍，这些数字让“算力跟不上”的判断有了抓手。正文没给具体定价方案，也没公开测试环境，所以结论先打个折，但方向对做推理优化和框架选型的人有参考价值。

## 锐评

罗福莉点出了一个被低价 Token 掩盖的问题：Agent 干活时，框架会反复把超过 10 万 Token 的上下文扔给工具，请求次数比 Claude Code 自身框架高出好几倍。这意味着用户付的订阅费，可能只覆盖了真实 API 成本的几十分之一。她说的 OpenClaw 就是个典型，一次用户请求触发一堆低价值工具循环，每次都把整套工作上下文重发一遍。全球算力确实扛不住这种烧法。

我觉得这个判断方向是对的。Claude Code 好用，不光是模型本身强，还在于它对缓存、文件选取和工具调用比较克制。现在第三方框架仗着 Token 便宜，把浪费转嫁给模型厂商，降价解决不了框架设计上的问题。短期看，API 账单会逼着框架去优化上下文管理和缓存命中率，这对行业是好事。

不过正文没披露具体的定价公式和实测成本对比，OpenClaw 那边的数据也看不到。如果后续有第三方跑出实际消耗数字，这个论点会更有说服力。
