# OpenAI 首款推理芯片 Jalapeño 跑分出炉：每瓦性能比 Blackwell 高 1.5–1.9 倍

> 原标题：[AINews] Hot Chips: OpenAI’s Jalapeño, Cerebras CS-5, Groq 3 LPX, Apple M6

- 来源：Latent Space
- 发布时间：2026-08-27T01:31:22.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/53864
- 原文：https://www.latent.space/p/ainews-hot-chips-openais-jalapeno

## 摘要

OpenAI 在 Hot Chips 37 上公布了自研推理芯片 Jalapeño 的首批实测数据。跟 NVIDIA 的 GB200/GB300 比，Jalapeño 在峰值吞吐量下每瓦能干 1.5 到 1.9 倍的活，端到端延迟低了 1.7 到 3.6 倍，在交互密集的任务上性能高出 2.1 到 4.1 倍。芯片标称功耗 700W，但实际测试中基本没...

## 推荐理由

OpenAI 在 Hot Chips 上把自研芯片 Jalapeño 的底牌亮了，声称每瓦性能是 GB200/GB300 的 1.5 到 1.9 倍，端到端延迟低了 1.7 到 3.6 倍。这是他们第一次用硬数据证明自研芯片不是画饼，而且确实有竞争力。我会先打个折，因为目前只有 Latent Space 的现场报道，还没看到更完整的第三方验证，但光凭这些数字已经足够让行业里做推理部署的人认真看一眼了。

## 锐评

OpenAI 在 Hot Chips 上亮出了 Jalapeño 的实测成绩，核心就一句话：用更少的电干更多的活。跟英伟达的 GB200/GB300 比，它在峰值吞吐量下每瓦性能高出 1.5 到 1.9 倍，端到端延迟低了 1.7 到 3.6 倍。芯片标称功耗 700W，但实际跑起来基本没超过 550W，这点挺实在。SemiAnalysis 的评价是“对第一代自研芯片来说强得反常”，这个判断值得参考，但先别太激动——所有数据都来自 OpenAI 自己的测试环境，不是第三方独立评测。

另一个有意思的点是，他们用 GPT-Astra 加 Codex 帮忙写底层代码，两个月内让三款原本没计划适配的开源模型跑了起来，部分模块比人类专家写的代码还快 1.5 到 1.8 倍。这说明模型辅助芯片优化的路子开始走通了。

正文没披露价格、量产规模，也没说会不会卖给外部客户。年底前只部署在 OpenAI 自己的机房，所以对普通开发者来说，暂时还摸不着。Gen 2 已经在深研，Gen 3 也启动了，节奏很快，但能多快摆脱对英伟达的依赖，还得看后续产能和实际部署后的稳定性数据。
