# xAI 发布 Grok 4.6 和 Grok Bot，AI 同事赛道来了个狠角色

> 原标题：[AINews] SpaceXAI Grok 4.6 and Grok @Bot

- 来源：Latent Space
- 发布时间：2026-08-13T01:53:47.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/51162
- 原文：https://www.latent.space/p/ainews-spacexai-grok-46-and-grok

## 摘要

xAI 一口气发了两个东西：新模型 Grok 4.6，和一个能直接登你的工具、像人一样操作、最后交活儿的早期测试版 Grok Bot。Grok 4.6 是个 1.5 万亿参数的模型，在 AA-Briefcase 这个知识工作基准测试里，分数跟 GPT-5.6 Sol Max 差不多，但便宜一大截：输入每百万 token 2 美元，输出 6 美元。训练上...

## 推荐理由

Grok 4.6 在知识工作基准上追平 GPT-5.6 Sol Max，价格却砍到零头，这个性价比信号很强。同时发布的 Grok Bot 直接杀进 AI 队友战场，背后是前 Cursor 团队，早期口碑还行。没给更高分是因为 Bot 还在早期测试，正文没披露具体完成率和稳定性数据，实际干活能力得再观察。

## 锐评

Grok 4.6 是个 1.5 万亿参数的模型，在 AA-Briefcase 这个知识工作基准测试里，分数和 GPT-5.6 Sol Max 咬得很紧，但成本优势明显。训练上，它复用了 Grok 4.5 来重新生成训练数据，并加入了针对编程、网页、CAD 甚至内核优化的强化学习，目标就是让模型能跑通更复杂的业务流程。这直接服务于新发布的 Grok Bot，一个能登录你的工具、像人一样操作、最后交活的 AI 队友。这个方向是今年的大热点，但正文没披露 Bot 在处理模糊指令或意外报错时的具体表现，也没提安全测试的细节。另外，同一天 Qwen 也开源了一个 2.4 万亿总参数、950 亿活跃参数的 MoE 模型，竞争很激烈。Grok 4.6 的性价比听着很诱人，但 Bot 的实际可靠性，得等更多用户用过一段时间再下判断。
