跳到正文

xAI / Grok

马斯克 xAI 与 Grok 系列的全部动态:模型迭代、算力扩张与 X 平台整合的持续追踪。

最新精选

第 21–40 条 · 共 100 条

7月30日星期四

The Verge · AI

xAI 赶在明尼苏达州反“一键脱衣”法生效前起诉,称 Grok 生成露骨图片是言论自由

明尼苏达州一项禁止用 AI 生成未经同意的假裸照的法律马上要生效,xAI 在最后一刻提起了诉讼。xAI 认为这条法律写得太宽泛,会连带限制 Grok 的图像生成功能,违反了第一修正案对言论自由的保护。在法庭文件里,xAI 把 Grok 描述成一个“有态度、爱讽刺”的 AI 助手,说它生成的露骨图片是一种表达形式。州总检察长反驳说,法律只针对未经同意的伪...

推荐理由:xAI 起诉明尼苏达州的反 AI 假裸照法,把 Grok 的图像生成能力绑上第一修正案的言论自由辩护,法律冲突很尖锐。分数没给更高是因为目前只是一纸诉状,法院还没判,实际影响要等后续进展。

7月21日星期二

AI HOT 精选

Grok 出了个 Excel 插件,在表格里用大白话提问、写公式、跑预测

xAI 给 Microsoft 365 做了个免费插件,把 Grok 塞进了 Excel。你框选一片数据,直接问“总收款为什么涨了”,它会告诉你原因,并标出引用了哪些单元格,生成的图表也能直接插到表里。想写公式但不想记函数,描述你要的结果就行,公式会正常出现在编辑栏里,你还能手动改。插件还能通过 Grok 的连接器去翻 SharePoint 或 Goo...

推荐理由:xAI 发了个免费的 Excel 插件,让 Grok 能在表里直接回答问题、写公式、跑场景。功能描述具体,比如引用单元格、公式可编辑、外接数据源,但这是发布首日的官方说法,没有第三方实测或用户反馈,实际体验和稳定性还得等等看。我会先打个折,等有人上手跑过真实表格再说。

7月19日星期日

Computing Life · Share · 鸭哥调研

Grok Build 开源了客户端执行层,模型和云端没开

xAI 把 Grok Build 在本地管理文件、命令和权限的客户端 harness 用 Apache-2.0 协议公开了,代码可以看、可以自己编译。但 Grok 模型、云端服务以及官方安装包的构建链还是闭源的。仓库不接受外部 PR,官方二进制用的内部 commit 也不在公开历史里,所以下载到的程序不一定对应公开的源码。7 月初的上传争议发生在旧版,...

推荐理由:xAI 把 Grok Build 的客户端 harness 用 Apache-2.0 放出来,支持无头模式和 ACP,不算纯作秀。但模型和构建链还是闭源,仓库也不接外部 PR,所以上限到不了 85。三个 HKR 维度都踩中了,放 featured 合适。

7月17日星期五

AI HOT 精选

xAI 不再嘴硬说 Grok 不会生成儿童性虐待图像,转而起诉用户

xAI 第一次起诉了一名用 Grok 生成儿童性虐待图像的用户。公司之前一直说这种内容是用户自己搞出来的,但这次起诉等于变相承认模型确实能被用来产出非法内容。文章没提具体用了什么安全措施、哪个模型版本,也没说有多少用户受影响。这看起来更像是法律层面的止损操作,而不是技术上的修复。

推荐理由:xAI 第一次起诉用户用 Grok 生成儿童性虐待图像,这等于在法律层面承认模型能被滥用,之前公司一直说内容是用户自己搞出来的。文章没写具体安全措施、模型版本和受影响用户数,所以分数压在 85 以下。但这件事从口头否认变成法律止损,对行业来说是个信号,我会先打个折,等更多技术细节出来再调整。

7月16日星期四

The Verge · AI

xAI 起诉一名用户,指控他用 Grok 生成儿童性虐待材料的深度伪造图

马斯克的 xAI 向联邦法院起诉了 Terry Harwood,说他绕过了 Grok 的安全护栏,用“提示词注入”之类的手段生成了儿童性虐待材料(CSAM)的深度伪造图。这是 AI 公司主动起诉用户生成违法内容的罕见案例,但报道没披露他具体用了什么技术、生成了多少张图。xAI 在诉状里要求赔偿名誉损失和法律费用,不过这种“用户滥用模型”的官司,能不能真...

推荐理由:xAI 起诉用户用 Grok 生成 CSAM 深度伪造图,是少见的 AI 公司追着终端用户打的案例。话题够硬,但正文没披露具体技术手段和生成数量,事实密度偏薄,所以分数没往上拉。

AI HOT 精选

xAI 把编程助手 Grok Build 的完整代码开源了

xAI 在 GitHub 上公开了 Grok Build 的全部源码,包括智能体的工作循环(怎么拼上下文、怎么解析模型回复、怎么调用工具)、终端界面、以及技能、插件、MCP 服务器等扩展系统。你可以直接读源码搞清楚它的内部机制,也可以自己编译后连上本地模型跑起来,完全离线使用。

推荐理由:xAI 开源了 Grok Build 的全部代码,包括智能体循环、终端界面和扩展系统,还支持本地离线运行,在开发者圈子里同时踩中了好奇心、干货和实用价值三个点。目前只有官方公告,还没有第三方评测或实际跑通后的反馈,所以分数先定在 featured 这一档,等有人上手验证了再调整。

7月15日星期三

The Verge · AI

SpaceXAI 的 Grok 编程工具会默认把用户整个代码仓库上传到云端

有用户发现 Grok 的编程工具在后台悄悄把本地整个代码仓库同步到了云存储,而且是默认开启的。马斯克回应说之前上传的数据都会被删掉,但没提这个行为持续了多久、影响了多少用户。如果你正在用这个工具,我会先检查一下自己的仓库有没有被同步上去。

推荐理由:默认全量上传代码仓库是个严重的产品事故,曝光面大且用户完全不知情。The Verge 首发、马斯克回应,可验证。没给更高分是因为正文没披露这个行为持续了多久、影响了多少用户——这些关键事实缺失,所以我会先打个折。

7月13日星期一

AI HOT 精选

xAI 官方 Grok CLI 被曝静默打包上传整个代码库和用户密钥

安全研究者发现,xAI 的 Grok CLI(npm 包 0.2.93 版)会在每次任务前后,把你当前工作目录整个打包成 tar.gz 文件,通过一条独立旁路通道上传到 xAI 的 Google Cloud 存储桶——哪怕模型只回了一个单词,上传照样发生。更糟的是,上传内容还超出了代码库本身,包括 ~/.claude.json、Claude Code ...

推荐理由:安全研究者实锤 xAI 官方 CLI 静默上传整个工作目录和密钥文件,给出了具体版本号、上传路径和受影响文件清单。三条 HKR 全部打满。这是行业级安全事件,重要性 92 没毛病。

7月12日星期日

Hacker News 首页

抓包实测:xAI 的 Grok Build 命令行工具会偷偷上传你的 .env 和整个代码仓库

有人对 Grok Build CLI(v0.2.93)做了抓包分析,发现它默认会把整个项目仓库上传到 xAI 的谷歌云存储桶里,包括 .env 文件里的明文密钥和完整的 git 提交历史。就算你给模型的指令是“只回复 OK,别读任何文件”,整个仓库照样被上传。在一个 12 GB 的测试仓库上,存储上传量达到 5.10 GiB,是模型对话通道数据量的约 ...

推荐理由:这篇文章的价值在于它做了别人没做的事:直接抓包看 Grok Build CLI 到底传了什么。结果比很多人担心的更糟——整个仓库默认上传,连 .env 明文密钥和 git 历史都不放过,而且跟你的 prompt 指令无关。5.10 GiB 的上传量也说明这不是轻量级的元数据同步,是实打实的全量上传。对开发者来说,这是直接的安全和隐私风险提示,不是概念层面的担忧。我会先打个折:文章没披露 xAI 服务端怎么处理这些数据、存多久、谁有权限访问,这些关键信息缺失。但就凭抓包证据本身,已经足够让用 Grok Build 的人重新评估风险。

7月11日星期六

r/LocalLLaMA

Grok Build CLI 会把你的整个仓库(含完整 git 历史、.env 密钥)上传到 xAI 云端,关掉上传开关也没用

有 Reddit 用户抓包发现,xAI 的 Grok Build CLI 工具会把整个项目仓库上传到云端,包括完整的 git 提交历史和 .env 文件里的密钥。工具里有个“不上传”的选项,但实测关掉之后照样传。帖子正文因为 Reddit 屏蔽看不了,所以触发条件、影响哪些版本、xAI 官方有没有回应,目前都不清楚。

推荐理由:这是一起有抓包证据的安全/隐私事件,可信度高,对考虑用 Grok Build CLI 的开发者直接相关。分数卡在 85 以下,因为 Reddit 帖子正文被屏蔽,触发条件、影响版本、xAI 官方回应都还不清楚,信息有缺口。

7月9日星期四

Latent Space

SpaceXAI 发布 Grok 4.5,跟 Cursor 联手训了个主打编程和干活儿的模型

SpaceXAI 赶在 GPT-5.6 发布前一天放出了 Grok 4.5。这是个 1.5 万亿参数的大模型,比上一代 Grok 4.3 大了三倍,专门冲着编程和让模型进业务流程干活儿去设计的。Cursor 说这是他们头一回把模型能力扩展到纯写代码之外。马斯克自己讲,这模型跟 Opus 4.7 性能差不多,但更快更省钱——输入每百万 token 收 2...

推荐理由:SpaceXAI 在 GPT-5.6 发布前一天扔出 Grok 4.5,光这个时间点就值得看一眼。1.5 万亿参数,比 Grok 4.3 大了三倍,输入每百万 token 收 2 美元,规模和成本都有具体数字。马斯克说性能跟 Opus 4.7 差不多但更快更便宜——这点先别太激动,正文没给第三方跑分,只能当官方说法。真正有意思的是 Cursor 被收购后第一次把模型推到纯写代码之外,直接瞄准 agent 工作流,对做工具链的人是个信号。

Hacker News 首页

我们让 Grok 4.5、GPT-5.5 和 Claude 写同样的三个小应用,比速度和成本

TryAI 给 Grok 4.5、GPT-5.5、Claude Opus 4.8 和 Fable 5 发了三个相同的编程任务:一个 3D 魔方、一个粒子重力沙盒、一个打砖块游戏,要求一次生成、不调提示词。Claude 两款模型在魔方上第一把就做对了,Grok 4.5 第一次只渲染出空白画面,用掉唯一一次重试机会后才成功,GPT-5.5 则只画出一个暗色...

推荐理由:TryAI 做了场编程实战,不是跑分,而是让几个模型一次生成三个应用,把翻车、重试、耗时和花费都摆出来。Claude 两款在魔方上第一把就过,Grok 4.5 第一次白屏、用掉唯一重试机会才成功,GPT-5.5 只画了个暗色画面——这些具体失败比榜单分数更有参考价值。我会先打个折:TryAI 不是一线评测机构,正文也只给了摘要,完整数据得点进去看,所以分数没给更高。

AI HOT 精选

诉讼称一男子用 Grok 生成 7000 张继女色情图片后自杀,xAI 只上报了一条轮奸提示词

一起新诉讼指控 xAI 的 Grok 被用来生成了超过 7000 张用户继女的儿童性虐待图片,该男子随后开枪自杀。xAI 只向美国国家失踪与受虐儿童中心上报了一条涉及轮奸的提示词,其余数千次生成均未报告。诉讼指责 X 和 xAI 在庇护儿童侵害者。文章没有解释为什么 xAI 的安全过滤器漏掉了绝大多数图片,也没有说明 Grok 的图像生成功能是否默认禁...

推荐理由:Ars Technica 独家报道了一起针对 xAI 的诉讼,揭示其安全上报存在严重漏洞:在 7000 张儿童性虐待图像中,仅上报了一条提示词。事件涉及未成年人、自杀和平台责任,三条硬指标全中。我会先打个折,因为文章没解释 Grok 的安全过滤器为什么漏掉这么多,也没说明图像生成功能默认是否关闭,信息缺口明显,所以分数压在 90 以下。

7月1日星期三

AI HOT 精选

xAI 发布 Voice Agent Builder 测试版:不用写代码,两分钟搭一个语音助手

xAI 把 Grok Voice 打包成了一个无代码平台,7 月 1 日上线测试版。你用大白话描述通话流程,上传文档当知识库,再连上日历、工单系统这类工具,就能得到一个能接打电话的语音助手。它走的是语音到语音的直通路线,而不是传统的“语音转文字→大模型→文字转语音”三件套拼接,xAI 说这样延迟更低、出错的环节也更少。费用是每分钟音频 0.05 美元,...

推荐理由:xAI 把 Grok Voice 做成了无代码平台,语音到语音直通、每分钟 0.05 美元、两分钟搭建,都是实打实的数字。没给更高分是因为目前只有官方公告,缺少第三方实测和横向对比,所以定在 78 分。

6月28日星期日

AI HOT 精选

马斯克说 Grok 4.5 已在 SpaceX 和 Tesla 内部测试,性能接近 Opus

Grok 4.5 基于一个 1.5 万亿参数的 V9 基础模型,训练时额外喂了 Cursor 的数据,现在在 SpaceX 和 Tesla 内部试用。马斯克说初步跑分接近甚至可能超过 Opus,但没说是哪个版本的 Opus、用的什么基准测试、测了多大样本。强化学习还在继续拉性能,Grok Build 工具链也在完善。另外 SpaceX 今年打算每个月发...

推荐理由:马斯克自己出来说 Grok 4.5 跑分接近甚至可能超 Opus,还提到用 Cursor 数据训练,信号很强。但正文没披露 Opus 具体版本、用的什么基准、测了多少样本,这些缺口让判断得打个折。1.5 万亿参数和内部试用是实打实的信息,所以给 78 分,先别太激动。

AI HOT 精选

SpaceX 注册了 SpaceXAI 商标,马斯克说 xAI 会并入 SpaceX 变成一条产品线

SpaceX 刚拿下了“SpaceXAI”商标。马斯克的说法是 xAI 会解散独立公司身份,直接变成 SpaceX 的 AI 产品线。推文没提合并时间表、团队怎么整合,也没说 Grok 这类现有产品后续归谁管。如果是真的,xAI 就不再是独立玩家,而是 SpaceX 内部的一个 AI 部门。

推荐理由:xAI 并入 SpaceX 是结构性变动,不是常规产品更新。商标申请提供了硬证据,但推文没给时间表和团队整合细节,信息缺口明显,所以分数压在 85 以下。我会先打个折:马斯克在 X 上放话经常跳票,这点先别太激动,但商标动作本身已经够让行业重新算账了。

6月24日星期三

Hacker News 首页

Reid Hoffman 说 SpaceX“不是 AI 公司”,xAI 是“彻底翻车现场”

LinkedIn 联合创始人 Reid Hoffman 在播客里直接开火:SpaceX 上市后收购 AI 编程工具 Cursor,在他看来是“用市值买存在感”,其算力租赁业务也就是个“溢价版 CoreWeave”,算不上 AI 公司。对马斯克的 xAI,他更不客气,说公司 11 位联合创始人全跑光了,已经“第三次推倒重来”,是“彻底翻车现场”。他还对美...

推荐理由:知名投资人公开用尖锐语言给 AI 圈划阵营、拆台,三个维度都踩中了。扣分是因为这只是一期播客观点,不是产品发布或可验证的研究进展,所以放在 78 分的 featured 档。

6月22日星期一

AI HOT 精选

Grok Build 上线 /goal 模式,给 AI 一个目标让它自己跑完整个任务

xAI 在 Grok Build 里加了一个 /goal 指令,你只需要告诉它要干什么,比如“把认证模块迁到新 API”,它就会自己拆任务、列清单、一步步执行,中间你可以随时查看进度、暂停或继续。完成后清单会全部打勾。正文没提最长能跑多久、消耗多少资源、要不要额外付费,这点先别太激动。

推荐理由:xAI 给 Grok Build 加了个 /goal 模式,让 agent 能自主完成一个任务,形态上和 Cursor Agent、Claude Code 的长时间执行很像。交互细节有,但正文没披露最长运行时间、资源消耗、要不要额外付费,我会先打个折——如果是真的能稳定跑长任务,对开发者挺有吸引力,现在只能说方向对了,细节还得等。

6月19日星期五

Latent Space

对话 Anjney Midha:顶级 AI 实验室的算力利用率不到 10%,他打算建一个独立的算力电网

Anjney Midha 在播客里聊了 AI 基础设施里被严重低估的浪费问题。他提到,xAI 训练模型时的实际算力利用率(MFU)不到 10%,而谷歌当年把 95% 的利用率视为故障;目前业界顶尖水平也就 60% 到 70%。这意味着前沿 AI 的瓶颈已经不是买多少 GPU,而是怎么把已有的卡用好,这是个系统工程问题。他投资过 Anthropic、Mi...

推荐理由:Anjney Midha 把 xAI 训练时的算力利用率钉在一个具体数字上(不到 10%),把平时大家模糊抱怨的算力浪费变成了可量化的讨论。我会先打个折,因为这是播客里的个人说法,不是论文或产品发布,没有可复现的验证路径,所以分数卡在 78。但这段话对从业者来说很实在,直接点出了当前 AI 竞赛里被严重低估的工程债。

6月18日星期四

Hacker News 首页

OpenRouter 让 11 个大模型打了 30 场吃鸡赛,Grok 4.1 Fast 赢了 43%,成本只有 Claude 的 1/27

OpenRouter 的 Jacky Liang 把 11 个模型扔进一个 2D 吃鸡游戏里打了 30 局。Grok 4.1 Fast 赢了 13 局,每赢一局成本 0.97 美元;Claude Sonnet 4.6 赢了 5 局,每赢一局要 26.78 美元,差了 27 倍。GPT 5.4 杀了 38 个人头,全场最高,但只赢了 2 局——杀得多不等...

推荐理由:OpenRouter 官方博客,作者 Jacky Liang 自己跑了 30 局并公开了完整数据和回放。Grok 4.1 Fast 的成本优势很扎眼,Claude Sonnet 4.6 贵但表现稳定,GPT 5.4 人头最多却赢不了——三个发现都有具体数字支撑,可复现、可验证。对正在选模型搭 agent 的人来说,这种实战对比比跑分表有用。