# GPT-6 Sol 和 Luna 评测：价格砍半，但知识类任务表现有退步

> 原标题：Artificial Analysis 评测 GPT-6 Sol 和 Luna：成本减半但各评测有升有降

- 来源：AI HOT 精选
- 发布时间：2026-09-22T19:41:37.417Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/58221
- 原文：https://artificialanalysis.ai/articles/gpt-6-sol-and-luna-push-the-cost-efficiency-frontier

## 摘要

OpenAI 新发布的 GPT-6 Sol 和 Luna 把价格直接砍了一半：Sol 输入/输出每百万 token 降到 2/10 美元，Luna 降到 0.1/0.5 美元。在 Artificial Analysis 的智能指数跑分中，Sol 单次任务成本从 1.99 美元降到 1.06 美元，Luna 从 0.18 美元降到 0.07 美元，整体分...

## 推荐理由

OpenAI 把 GPT-6 价格砍半，Sol 单次任务成本 1.06 美元，Luna 0.07 美元，但能力变化不是一边倒的好——Luna 在 Coding Agent 指数上还倒退了。有第三方跑分数据撑着，对开发者做决策很实用。没给 p1 是因为这属于模型迭代的价格调整，不是底层架构级的大新闻。

## 锐评

OpenAI 这次更新最实在的就是降价：Sol 输入/输出每百万 token 降到 2/10 美元，Luna 降到 0.1/0.5 美元，单次任务成本分别从 1.99 和 0.18 美元降到 1.06 和 0.07 美元。幻觉率也大幅下降，Sol 从 92% 降到 60%，Luna 从 93% 降到 77%，但代价是模型更爱拒答了——Sol 只尝试回答 83% 的问题，比上一代少了 16 个百分点，正确率反而从 59% 掉到 54%。

代码能力上 Sol 涨了 2 分到 57，Luna 反而跌了 2 分到 41，方向不一致。更值得留意的是知识工作类评测 GDPval-AA v2.1 上两个模型都退步了，Sol 掉了约 100 Elo，Luna 掉了约 75。Artificial Analysis 团队人工抽查了几百条输出，发现主要是交付物变短、漏掉了评分标准里要求的要素。

正文没披露推理延迟和并发限制的变化，也没说明拒答率上升是安全策略调整还是能力边界收缩。成本降了一半是实打实的，但如果你用这类模型做需要完整交付物的长任务，建议先在自己的场景里跑一遍，确认输出完整度没缩水。
