# OpenAI 放出 GPT-6 Astra 跑分，把 Claude Fable 5.1 刚坐两天的榜首挤下去了

> 原标题：OpenAI 发布 GPT-6 Astra，基准全面超越 Claude Fable 5.1

- 来源：AI HOT 精选
- 发布时间：2026-09-03T19:06:08.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/54602
- 原文：https://x.com/kimmonismus/status/2095589174686400914

## 摘要

OpenAI 贴了 GPT-6 Astra 的官方基准成绩：ARC-AGI-3 直接拉到 99.9%，基本饱和；ExploitBench 拿了满分 100%，全面压过 Claude Fable 5.1——后者才当了两天 SOTA。帖子还说价格更低，但没给具体定价、参数量和发布时间，我会先打个折，等第三方实测再说。

## 推荐理由

OpenAI 贴了 GPT-6 Astra 的官方基准成绩，ARC-AGI-3 基本饱和，ExploitBench 满分，全面压过 Claude Fable 5.1。帖子说价格更低，但没给具体定价、参数量和发布时间，我会先打个折，等第三方实测再说。

## 锐评

OpenAI 放出的 GPT-6 Astra 成绩单确实好看：ARC-AGI-3 拿了 99.9%，基本把这项测试打穿了；ExploitBench 满分 100%，全面压过 Anthropic 的 Claude Fable 5.1——后者才当了两天最强模型。帖子还提了一嘴价格更低，但正文没披露具体定价、参数量和开放时间，这些关键信息全缺。

对从业者来说，基准饱和意味着现有测试已经区分不出顶尖模型的能力差异，需要看更刁钻的第三方评测。另外，没有定价和延迟数据，就没法判断它是不是真的比 Claude 便宜、能不能上生产环境。我会等独立机构跑完 SWE-bench、Chatbot Arena 这类实测再下结论，现在这些数字只能说明 OpenAI 在内部测试上跑赢了，不代表实际用起来也稳。
