# GPT-6 Astra 开真车跑完锥桶赛道，Claude Fable 5.1 只走到 45%

> 原标题：GPT-6 Astra has gained the ability to drive a car

- 来源：Hacker News 首页
- 发布时间：2026-09-23T15:14:22.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/58424
- 原文：https://drivingbench.com/

## 摘要

DrivingBench 直接把 GPT-6 Astra、Claude Fable 5.1、Grok 4.6 和 GPT-5.6 Sol 接上了一辆真丰田卡罗拉的方向盘、油门和刹车，让它们在同一个锥桶赛道里各跑三圈。GPT-6 Astra 第二次尝试就跑完全程，用时 5 分 22 秒，API 调用费花了 7.74 美元。Claude Fable 5.1...

## 推荐理由

实车测试、固定赛道、多模型对比，加上明确的时间和费用数字，三个传播点都踩中了。不是仿真而是真硬件，比大多数 benchmark 论文更容易被转发。分数没再往上打，是因为目前只有项目页面，正文没披露更多技术细节和失败案例。

## 锐评

DrivingBench 这个测试挺直接：把 GPT-6 Astra、Claude Fable 5.1、Grok 4.6 和 GPT-5.6 Sol 接上一辆真丰田卡罗拉的方向盘、油门和刹车，让它们在同一个锥桶赛道里各跑三圈。GPT-6 Astra 第二次尝试就跑完全程，用时 5 分 22 秒，API 调用费花了 7.74 美元。Claude Fable 5.1 最好成绩是 45% 进度，Grok 4.6 和 GPT-5.6 Sol 都没超过 11%。

差距很明显，但信息缺口也很大。正文没披露赛道总长、锥桶间距，也没说安全员有没有踩过刹车或打过方向。GPT-6 Astra 第一次尝试只跑了 49%，第二次就 100%，这种跳跃在真车测试里不太常见，可能是模型学会了，也可能是外部条件变了。另外，所有模型都在同一个连续对话里跑三次，意味着后两次尝试能“记住”前一次的错误，这和从零开始的独立测试不一样。

7.74 美元跑一圈听起来不贵，但这是 API 标价，没算传感器、车辆改装和人工成本。想看这个结果能不能复现，得等他们放出完整的轨迹回放和车内视频，看看是丝滑过弯还是不停修正。
