# GPT-6 Astra 在 ARC-AGI-3 上标准跑分 66%，靠持续对话硬拉到接近满分，但每道题烧掉 360 美元

> 原标题：François Chollet 评 GPT-6 Astra 在 ARC-AGI-3 上的表现

- 来源：AI HOT 精选
- 发布时间：2026-09-03T19:42:59.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/54597
- 原文：https://x.com/fchollet/status/2095598451115614371

## 摘要

François Chollet 放出了 GPT-6 Astra 在 ARC-AGI-3 上的成绩。用标准测试流程只拿到 66%，但换成持续对话模式，加上自定义的上下文压缩，分数直接逼近 100%。这个接近满分的表现不是模型自己一次答出来的，而是靠多轮对话和额外处理堆上去的，所以别把它当成模型已经具备通用推理能力。每道题的成本大约 360 美元，正文没...

## 推荐理由

Chollet 自己公布了 GPT-6 Astra 在 ARC-AGI-3 上的成绩：标准流程只拿 66%，换成持续对话加自定义上下文压缩才逼近满分，每道题烧掉约 360 美元。我会先打个折——这不是模型自己一次答对的，是反复对话和额外处理堆出来的，别直接当成通用推理能力。但分数反差和成本摆在那，做推理评估的人不看说不过去。
