# OpenAI 的 Jalapeño 芯片专为大规模快速推理而生，首批跑分出来了

> 原标题：OpenAI’s Jalapeño chip is built for fast inference at scale, benchmarks show

- 来源：TechCrunch · AI
- 发布时间：2026-08-25T14:22:04.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/52851
- 原文：https://techcrunch.com/2026/08/25/openais-jalapeno-chip-is-built-for-fast-inference-at-scale-benchmarks-show/

## 摘要

OpenAI 在 Hot Chips 大会上公布了自研推理芯片 Jalapeño 的第一批测试成绩。在 SemiAnalysis 的 InferenceX 基准测试里，它比当前市面上最强的竞品，每用户能处理的 token 更多，每度电的吞吐量也更高。不过正文没提具体跟谁比，也没给延迟数据。我会先打个折，等第三方实测出来再看。

## 推荐理由

OpenAI 自研推理芯片首次公开基准测试，有 SemiAnalysis 的第三方数据，话题性很强。但正文没提对比对象、没给延迟数据，也没有独立实测验证，所以分数停在 78。

## 锐评

OpenAI 在 Hot Chips 大会上亮出了自家推理芯片 Jalapeño 的第一批成绩。在 SemiAnalysis 的 InferenceX 基准测试里，它比“当前市面上最强的竞品”每用户能处理的 token 更多，每度电的吞吐量也更高。这两个指标指向的是大规模部署时的成本和并发能力——简单说，就是同样一度电、同样一批用户同时用，它能吐出更多回答。

但正文有两个关键缺口：一是没点名对比对象，不知道打的是英伟达的哪张卡还是其他家的方案；二是完全没有延迟数据。吞吐量高不代表响应快，如果每句话都要等很久，用户体验照样不行。另外，测试用的是 SemiAnalysis 的 InferenceX 基准，不是 MLPerf 这类行业通用标准，第三方实测也还没出来。

现在能说的是，OpenAI 在推理芯片上确实拿出了能跑的东西，而且跑分看着不错。但要判断它能不能真省钱、能不能大规模替换现有方案，还得等延迟、功耗细节和独立评测。
