跳到正文
AI HOT 精选

Gary Marcus 评 GPT-6 Astra:进步明显,但能不能稳定发挥、好不好监控还是未知数

Gary Marcus 评 GPT-6 Astra:进步明显但鲁棒性与可监控性存疑

GPT-6 Astra 在 ARC-AGI-3 上拿了 63% 的分数,加一个适配器能冲到 99%,而且它解题时会自己建一套符号化的“世界模型”来推理。Gary Marcus 觉得这个方向让他多年的呼吁被验证了,但他提醒别急着喊 AGI。正文没披露这套能力在开放场景下有多稳,也没说清楚系统内部怎么运作的。另外,新模型看起来比旧版更难监控,安全性上让人不...

推荐理由:Gary Marcus 对 GPT-6 Astra 的点评自带叙事分量——ARC-AGI-3 的 63%/99% 是实打实的数据,他直接挑战 Brockman 的 AGI 定调,把热度、干货和受众面都拉满了。分数压在 85 以下,因为这是第三方评论而非一手发布,我会先打个折。

读原文 ↗导出 Markdown