OpenAI 公布自研推理芯片 Jalapeño 的首份实测成绩
The full stack behind abundant intelligence
OpenAI 第一次亮出了自家推理芯片 Jalapeño 的跑分数据。在跑 GPT‑OSS 120B 的公开测试 InferenceX 上,它每千瓦能处理的峰值吞吐量比对比的商业系统更高,生成每个词的延迟也更低;在 DeepSeek R1 和 Kimi K2 上表现同样不错。这意味着 OpenAI 现在有了一条能用的自研芯片路线,可以直接控制模型服务的...
推荐理由:OpenAI 终于把自家推理芯片 Jalapeño 的底牌亮出来了。在公开测试 InferenceX 上跑 GPT-OSS 120B,每千瓦吞吐量比对比的商业系统高,每个词的延迟还更低,DeepSeek R1 和 Kimi K2 上也没拉胯。这等于告诉外界,OpenAI 现在有了一条能用的自研芯片路线,以后不用完全看英伟达脸色,推理服务的成本和响应速度都能自己说了算。不过正文没披露具体对比的是哪家商业系统、测试环境细节和量产时间表,所以实际落地效果还得再观望。