# GPT-6 Astra 跑分打架，但在 ARC-AGI-3 上效率首次超过普通人，Chollet 把 AGI 时间表提前了

> 原标题：GPT-6 Astra 基准表现分歧，ARC-AGI-3 效率超人类令 Chollet 提前 AGI 预测

- 来源：AI HOT 精选
- 发布时间：2026-09-04T11:07:36.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/54763
- 原文：https://the-decoder.com/benchmarks-disagree-on-gpt-6-astra-but-its-human-beating-efficiency-on-arc-agi-3-pulls-chollets-agi-forecast-forward

## 摘要

GPT-6 Astra 的评测结果很分裂：Epoch AI 把它排第一，Artificial Analysis 却说它跟前代 Sol 打平。真正的信号在 ARC-AGI-3 测试里——这个测试会把模型丢进它没见过的游戏世界，让它自己摸索规则。Astra 拿到了 62.7% 的分数，而 Sol 只有 7.8%，并且首次在效率上超过了人类平均水平。ARC ...

## 推荐理由

GPT-6 Astra 在 ARC-AGI-3 上首次在效率上超过人类平均，Chollet 因此提前了 AGI 预测，这是个硬信号。Epoch AI 和 Artificial Analysis 的排名打架增加了话题性。没给更高分是因为文章只给了 62.7% 这个最终数字，没展开讲测试细节和失败案例，信息量有限。
