# 开源模型自己部署，推理成本能砍到闭源模型的五分之一

> 原标题：The Economics of Open-Weight Inference

- 来源：Hacker News 首页
- 发布时间：2026-09-22T13:45:32.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/58164
- 原文：https://data.ornn.com/publications/the-economics-of-open-weight-inference

## 摘要

Ornn Data 这份报告算了一笔账：自己租 GPU 跑开源模型，生成每百万 token 的成本可以压到 0.12 到 0.35 美元，差不多是调用闭源模型价格的五分之一。有意思的是，在跑 gpt-oss-120b 这种稀疏模型（实际干活只用 51 亿参数）时，老款 A100 反而比 H100 更省钱，满负荷下每百万 token 只要 0.12 美元...
