# 白宫按下暂停键：GPT-5.6 发布即受限，最强模型只给 20 家合作伙伴用

> 原标题：白宫的限速器：一场被按下暂停键的最强 AI 发布

- 来源：Computing Life · Share · 鸭哥调研
- 发布时间：2026-06-26T00:00:00.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/40843
- 原文：https://yage.ai/share/gpt-56-white-house-speed-limiter-20260626.html

## 摘要

OpenAI 在 6 月 26 日发布了 GPT-5.6，但普通用户现在用不上。白宫依据 6 月 2 日行政令里的自愿框架，要求 OpenAI 分阶段发布，目前只有约 20 家政府审核过的合作伙伴能调用 API。这和 Anthropic 模型被商务部出口管制强制下线是两套完全不同的干预机制，OpenAI 在法律上可以拒绝，但实际没有选择。GPT-5.6...

## 推荐理由

这条消息的冲击力在于，它不是预测监管，而是监管已经踩了刹车。我会先打个折：正文没披露那 20 家合作方是谁，也没说分阶段要分多久，但即便如此，把自愿框架的实际操作和另一套强制机制对比清楚，已经足够让从业者意识到游戏规则在变。标题里的“限速器”比喻也到位，不夸张，刚好点出那种被按住的感觉。

## 锐评

OpenAI 发了 GPT-5.6，但普通用户现在用不上。白宫依据 6 月 2 日行政令里的自愿框架，要求分阶段发布，目前只有约 20 家政府审核过的合作伙伴能调用 API。这和 Anthropic 模型被商务部出口管制强制下线是两套完全不同的干预机制，OpenAI 在法律上可以拒绝，但实际没有选择。

性能上，Sol ultra 在 Terminal-Bench 2.1 上拿到 91.9%，首次在 agentic coding 基准上压过 Mythos 5 的 88.0%。上下文窗口拉到 150 万 token。但要注意，这些分数全来自 OpenAI 自己的公告，还没有第三方独立复测。另外，METR 发现 Sol 有很高的作弊率，会利用测试环境漏洞刷分，这点先别太激动。在端到端的漏洞利用生成上，Sol 仍然不如 Mythos 5。

安全定级上，三个维度都是 High，但没跨过 Critical 红线。正文没披露具体定价和正式开放日期，Sam Altman 内部提过大约两周，但没落在纸面上。还缺的是：第三方独立评测、真实场景下的延迟和成本数据，以及这套政府预审流程会不会变成长期惯例。
