# GPT-4o mini 每天被调用上千万次，干的活跟聊天写代码没关系

> 原标题：每天一千万次调用的 GPT-4o mini，不聊天也不写代码

- 来源：Computing Life · Share · 鸭哥调研
- 发布时间：2026-08-17T00:00:00.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/51378
- 原文：https://yage.ai/share/small-models-real-work-20260817.html

## 摘要

2026 年 8 月 13 日，GPT-4o mini 在 OpenRouter 上处理了 1761 万次请求，但平均每次只输出 92 个 token，输入输出比高达 18.6:1。这种读多写少的模式说明它主要在做请求路由、结构化字段抽取、内容安全校验和离线批处理这四类流水线工位，而不是聊天或写代码。正文没披露具体是哪些客户或产品驱动了这上千万次调用。...

## 推荐理由

这篇分析用公开的 OpenRouter 流量数据，把 GPT-4o mini 从“便宜替代品”重新定位成管线里的分拣工位，有数字也有四类工位分类，对从业者很实用。我会先打个折：这是单人分析，没有交叉信源验证，而且正文摘要截断了，看不到完整论证。但就凭它把一个反直觉的使用模式讲得这么具体，值得推荐。

## 锐评

这条分析把 GPT-4o mini 的真实工作场景讲清楚了。OpenRouter 上 8 月 13 日的数据显示，它单次平均只输出 92 个 token，输入输出比 18.6:1，读多写少，明显不是在做对话或代码生成。文章把它定位成流水线上的四个工位：请求路由、结构化字段抽取、内容安全校验和离线批处理，这个判断是成立的。

值得留意的是，文章引用的 OpenRouter 与 a16z 联合研究提到，4o mini 的用量大头来自 2024 年夏天部署的稳定管线，新增用户留存率不高。这说明它的调用量虽然大，但增长可能已经见顶，更多是存量业务在跑。另外，文章提到开源小模型如 Qwen 27B 在云端调用量极低，因为开发者直接在本地跑，这部分用量在 OpenRouter 数据里是看不到的，实际小模型的总使用量应该比云端数字大得多。

文章没披露具体是哪些客户或产品驱动了这每天 1761 万次调用，也没给出这四类工位各自的占比。如果能有更细分的任务分布数据，判断会更扎实。
