# OpenAI 给 GPT-5.6 Sol 加了“极速模式”，用 Cerebras 芯片跑到 14 倍快

> 原标题：Previewing Ultrafast mode: GPT-5.6 Sol at up to 14X the speed

- 来源：OpenAI News
- 发布时间：2026-08-13T10:00:00.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/50571
- 原文：https://openai.com/index/previewing-ultrafast

## 摘要

OpenAI 在 API 里先放出了一个叫 Ultrafast 的预览版，让 GPT-5.6 Sol 最快每秒能吐 750 个 token，比标准模式快 14 倍。这背后是换了 Cerebras 的芯片来跑推理。速度快到这种程度，主要想解决那些等不起的场景：比如线上事故时实时扒日志、找代码改动、辅助定位问题；金融交易里一边看行情一边扫异常；客服电话里不...

## 推荐理由

OpenAI 在 API 里放出了 GPT-5.6 Sol 的 Ultrafast 预览版，靠 Cerebras 芯片把推理速度拉到标准模式的 14 倍，每秒能吐 750 个 token。文章给了三个等不起的真实场景，信息量够硬。但没公布价格，也没说什么时候正式上线，所以分数停在 82，没冲到必须当天写的那档。

## 锐评

OpenAI 给 GPT-5.6 Sol 加了个 Ultrafast 模式，推理速度拉到每秒 750 个 token，是标准模式的 14 倍。这背后是换了 Cerebras 的芯片做推理，不是简单的软件优化。速度快到这种程度，确实能打开一些新场景：线上事故时实时扒日志找根因、金融交易里边看行情边扫异常、客服电话里不打断对话就查完多套系统。OpenAI 自己的 on-call 团队已经在用这个模式做故障排查，说能把以前要跑一晚上的研究循环压缩到当天交互完成。

但正文没披露价格，也没说什么时候公开发布，现在只能申请试用。这点先别太激动——速度快 14 倍听着很猛，但如果成本也翻十几倍，那性价比就得重新算。另外，文章只提了输出速度，没说首 token 延迟是多少，这对实时对话场景其实更关键。合作方 Jane Street 和 Podium 的反馈都是正面引用，没有独立测试数据，说服力要打个折。
