# OpenAI 给 GPT-5.6 Sol 加了“超快模式”，推理速度拉到 14 倍

> 原标题：OpenAI introduces &#8216;Ultrafast,&#8217; a new mode that makes GPT-5.6 Sol work at 14x the speed

- 来源：TechCrunch · AI
- 发布时间：2026-08-13T19:22:40.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/50618
- 原文：https://techcrunch.com/2026/08/13/openai-introduces-ultrafast-a-new-mode-that-makes-gpt-5-6-sol-work-at-14x-the-speed/

## 摘要

OpenAI 推出了一个叫 Ultrafast 的预览模式，让自家最强的 GPT-5.6 Sol 模型跑到每秒 750 个 token，是标准速度的 14 倍。以前想要实时响应，通常得换个小模型，这次相当于让大模型自己快起来。这个模式跑在 Cerebras 的芯片上，目前只开放给一小批客户，后续会扩大范围。Anthropic 的 Claude 也有快速...

## 推荐理由

GPT-5.6 Sol 直接提速 14 倍，对需要实时响应的场景是个实打实的推理突破。没给更高分是因为现在还只是小范围预览，没有正式上线时间，而且绑定了 Cerebras 的硬件，能不能大规模铺开还不确定。

## 锐评

OpenAI 给自家最强的 GPT-5.6 Sol 加了个“Ultrafast”模式，跑在 Cerebras 芯片上，生成速度拉到每秒 750 个 token，是标准速度的 14 倍。以前想让大模型实时响应，通常得换个小模型，这次相当于让大模型自己快起来，不用牺牲回答质量。目标场景是事故响应、客服、金融分析和电商这类对延迟敏感的活儿。

不过，目前这只是小范围预览，只开放给一小批客户。最关键的信息——这个模式要花多少钱、首 token 延迟到底多少、什么时候全面开放——正文全都没说。Anthropic 的 Claude 也有快速模式，但吞吐量没到这个数，可人家至少公开了定价。

所以这条新闻的价值在于告诉你“大模型也能跑这么快”这件事技术上走通了，但离你能用上、用得起，中间还隔着价格、稳定性和规模这三道坎。
