# Arena 更新图片转网页排行榜：GPT-6 Astra 1733 分登顶，领先第二名 129 分

> 原标题：Arena 更新 Image-to-WebDev 榜单：GPT-6 Astra 以 1733 分登顶

- 来源：AI HOT 精选
- 发布时间：2026-09-15T21:20:53.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/56761
- 原文：https://x.com/arena/status/2099971741993050236

## 摘要

Arena 把四个新模型丢进了图片转网页的评测榜单。GPT-6 Astra（Max）拿了 1733 分排第一，比第二名的 GPT-5.6 Sol（xHigh）高出 129 分。Claude Fable 5.1（Max）1710 分排第三，Muse Spark 1.3（Max）1645 分第四，GLM-5.3-Flash 1588 分第十。正文没披露具体...

## 推荐理由

GPT-6 Astra 首秀就登顶，领先幅度 129 分，这个信号够硬，值得上首页。但正文只给了分数和排名，没展开方法细节或模型差异，读起来像一条快讯。H 和 K 都踩中了，R 缺位，整体重要性我给 72 分，放在 featured 里刚好。

## 锐评

Arena 把四个新模型丢进了图片转网页的评测，GPT-6 Astra（Max）1733 分登顶，比第二名的 GPT-5.6 Sol（xHigh）高出 129 分。这个差距看着不小，但正文没披露具体测了什么任务、用了多少样本，所以分数的含金量要打个折。Claude Fable 5.1（Max）1710 分排第三，和 Sol 咬得很紧，Muse Spark 1.3（Max）1645 分第四，GLM-5.3-Flash 1588 分第十。

这个榜单测的是模型看图写网页代码的能力，对前端开发场景有参考价值，但 Arena 没说明评测维度——是只看还原度，还是也考虑代码质量、响应速度？也没交代图片类型和难度分布。如果样本量小或者任务偏简单，129 分的领先可能没那么大意义。另外，不同模型的 Max 和 xHigh 推理档位不一样，算力投入不同，直接比分数不太公平。

还缺的信息：评测集是否公开、有没有人工评估、各模型在复杂布局和交互逻辑上的表现差异。这些不补上，榜单就只能当个粗略参考。
