# SpaceXAI 发布 Grok 4.5，主打编程和自动化任务，用更少的输出 token 解决问题

> 原标题：Grok 4.5

- 来源：Hacker News 首页
- 发布时间：2026-07-08T18:00:32.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/43157
- 原文：https://x.ai/news/grok-4-5

## 摘要

Grok 4.5 是 SpaceXAI 目前最强的模型，专门为写代码、让模型进业务流程干活和知识类工作优化。在 SWE Bench Pro 这类编程基准测试里，它的解决率是 64.7%，虽然比 Fable 和 GPT 5.5 低，但有个很实在的优点：平均每次任务只输出约 1.6 万个 token，比 Opus 4.8 少了 4.2 倍，意味着推理成本更...

## 推荐理由

SpaceXAI 推出 Grok 4.5，定位是写代码和让模型进业务流程干活，跟 Cursor 联合训练算是个实在的差异化。SWE Bench Pro 上 64.7% 的解决率没超过 Fable 和 GPT 5.5，这点先别太激动，但它的省钱优势很具体：平均每次任务输出约 1.6 万个 token，比 Opus 4.8 少了 4.2 倍，意味着推理成本低不少。正文没披露定价和延迟，这两个才是决定它能不能打的关键。

## 锐评

Grok 4.5 是 SpaceXAI 目前最强的模型，主攻写代码、让模型进业务流程干活和知识类工作。在 SWE Bench Pro 这类编程基准测试里，它的解决率是 64.7%，比 Fable 的 80.4% 和 Opus 4.8 的 69.2% 都低，但有个很实在的优点：平均每次任务只输出约 1.6 万个 token，比 Opus 4.8 少了 4.2 倍。这意味着跑同样任务，推理成本能压下来不少。推理速度标称 80 TPS，API 定价是每百万输入 token 2 美元、输出 6 美元。

训练用了数万块 GB300 GPU，强化学习阶段重点练多步软件工程任务。正文没披露参数量、上下文窗口长度，也没说欧洲具体哪天上线，只提了七月中旬。另外，DeepSWE 1.1 这个测试里它只拿了 53%，比 Opus 4.8 还低，这点先别太激动。

现在可以在 Grok Build、Cursor 和 API 里用。整体看，Grok 4.5 走的是“够用且省 token”的路线，不是跑分王，但如果你在意推理开销，它值得试试。
