跳到正文

xAI / Grok

马斯克 xAI 与 Grok 系列的全部动态:模型迭代、算力扩张与 X 平台整合的持续追踪。

最新精选

第 61–80 条 · 共 100 条

5月21日星期四

AI HOT 精选

SpaceX 的上市文件显示,xAI 去年亏了 64 亿美元,烧钱还远没到头

SpaceX 的 IPO 文件第一次公开了 xAI 的财务底牌:2025 年营收 32 亿美元,运营亏损却高达 64 亿美元。文件还提到 xAI 计划把 Grok 模型的参数量推到“数万亿”级别,这意味着买卡、建数据中心的投入只会更大。不过,正文没披露具体的扩容规模、资本开支和融资条款,所以这个“万亿参数”计划到底要花多少钱、钱从哪来,目前还不清楚。

推荐理由:我会先打个折:64亿美元亏损是SpaceX IPO文件里披露的,来源不常见,但正文没写xAI的扩张规模、资本开支或融资安排,所以别急着下结论说它撑不住。这个数字说明xAI烧钱速度很快,Grok要继续砸钱,但具体怎么砸、砸多少,文件没提。对关注AI烧钱和模型竞赛的人来说,这是个硬数据点,但信息不全,只能当个引子。

TechCrunch · AI

xAI 正因数据中心燃气发电机被起诉,转头又宣布要花 28 亿美元再买一批

SpaceX 的 IPO 文件里提到,xAI 计划在未来三年内再采购价值 28 亿美元的天然气涡轮发电机,用来扩建 AI 基础设施。就在这个消息出来的同时,xAI 在孟菲斯附近的数据中心正因为使用高污染发电机而惹上官司。不过这篇报道没披露起诉方是谁、具体索赔内容、在哪个法院,也没说涡轮机供应商是哪家。一边被诉污染,一边加码买发电机,这个时间点挺尴尬的。

推荐理由:这条消息的看点全在标题制造的反差——被诉还要加码买发电机,但正文没披露谁起诉、告什么、涡轮机找谁买,信息缺口很大。28 亿美元这个数字本身够硬,说明 xAI 在算力基建上押注极重,但我会先打个折:没供应商、没交付时间、没诉讼细节,只能当一条有话题性的信号看,别急着下结论。

r/LocalLLaMA

HalBench 基准测试:用 3200 个带坑问题测了 4 个头部模型,看谁更会拒绝瞎编

一位开发者自己搭了个叫 HalBench 的测试,专门看模型在遇到“前提本身是错的”的问题时,是会顺着瞎编(谄媚)还是直接指出问题。他拿 3200 个这种带坑提示词跑了 4 个模型:Sonnet 4.6 平均分 0.565 排第一,最敢反驳;Gemini 3.1 Pro 0.339 垫底,更容易顺着错误前提往下编。分数越高,代表模型越能识别出问题里的假...

推荐理由:HKR 三项都成立:HalBench 有个清晰的定制评测钩子,3200 条提示加分数,话题踩在模型信任和安全评测的痛点上。来源只有 Reddit 一个帖子,基准本身也没经过外部验证,所以放在低 featured 档。

TechCrunch · AI

Anthropic 每月要付给 xAI 12.5 亿美元买算力

Anthropic 租下了 xAI 在孟菲斯 Colossus 1 数据中心的全部算力,每月账单 12.5 亿美元,合同签到 2029 年 5 月。头两个月有折扣,因为 xAI 那边还在爬坡。这笔钱来自 SpaceX 的上市文件,xAI 自己说这是在把闲置算力变现。说白了,Grok 用户量最近掉得厉害,服务器空出来了,正好租给竞争对手回血。不过正文没披...

推荐理由:TechCrunch 爆出 Anthropic 每月要给 xAI 付 12.5 亿美元买算力,对手方和价格都挺意外。正文只给了金额,没写买了多少卡、签了多久、跑在什么环境里,所以信息缺口不小。我会先打个折:金额够大,但缺关键细节,没法给到 90 分以上。

5月18日星期一

AI HOT 精选

Grok 现在能直接看懂你上传的视频了

Grok 新增了视频理解功能,你可以把整个视频文件丢给它,让它实时分析画面、总结内容、做翻译、解释场景或提取关键上下文。它不只是看单张图片或读文字,而是能理解完整的视频。马斯克这条推文没提视频时长上限、支持哪些格式,也没说这个功能是全员推送还是灰度测试。

推荐理由:Grok 这次更新把视频理解加进来了,能上传整段视频做分析、总结、翻译和解释场景,对多模态产品来说是个实打实的进步。我会先打个折:正文没写支持多长的视频、什么格式、是不是全量上线,这些关键信息都缺着。所以虽然功能本身有看点,但只能按中等偏上的产品更新来处理,先别太激动。

AI HOT 精选

Grok 上线“技能”功能,教它一次偏好就能跨对话记住

xAI 在 5 月 18 日给 Grok 加了个“技能”功能,覆盖网页、iOS 和安卓。你可以把格式偏好、工作流步骤或常用规则教给 Grok 一次,之后所有对话都会自动沿用,不用每次重复。内置了生成 Word 文档、PPT 幻灯片、Excel 表格和 PDF 的技能,开箱即用;不满意可以自己覆盖。还能通过对话或上传文件新建自定义技能,做完的格式和流程可...

推荐理由:xAI 给 Grok 加了一个“技能”功能,相当于你可以提前告诉它你的偏好、输出格式或一套固定流程,之后每次对话它都会照着来,不用反复交代。跨网页和手机端都能生效,这点对日常用的人挺省事。我会先打个折:正文没写这个功能是免费还是付费、能存多少条规则、会不会跟已有的系统指令冲突。目前看是个实用的更新,但实际好不好用还得看上线后的限制和稳定性。

5月17日星期日

AI HOT 精选

Grok Imagine 图像生成上线 X,所有用户都能用,但没公布模型参数和收费

Grok Imagine 在 X 上开放给所有人了,用他们最新的文本到图像模型,能生成写实风格的高质量图片,支持多种宽高比。正文没提模型参数量、是否收费、有没有地区限制,也没给生成速度或样本对比。我会先打个折:功能是开了,但关键信息全缺,别急着当主力工具。

推荐理由:我会先打个折:正文只说了能用、能调比例,模型参数、价格、地区限制一概没提,所以别当完整评测看。但 Grok 把生图直接嵌进 X 的时间线,等于在社交场景里抢了 Midjourney 和 DALL·E 的入口,从业者会盯着两点——一是生成质量和审核尺度,二是这功能到底免不免费、能撑多久。

5月15日星期五

AI HOT 精选

X 把“为你推荐”的算法开源了,用的还是 Grok 同款 Transformer

X 在 GitHub 上公开了“For You”信息流的推荐管道,代码、预训练模型和内容理解服务都给了。核心是一套叫 Phoenix 的 Transformer 模型,基于 Grok 架构,负责给候选帖子打分。它会看用户最近跟谁互动,同时预测点赞、回复、转发这些行为的概率,揉成一个相关性分数。排序前会先捞候选内容,补上上下文,再让模型评分,最后做多样性...

推荐理由:HKR 三项都踩中了,但正文只说了开源和 Phoenix Transformer 打分机制,仓库细节、许可证、能不能复现都没提,所以先给 featured 里偏低的位子。

AI HOT 精选

xAI 把 Grok 订阅接入了 Nous Research 的开源智能体 Hermes

现在你可以用 Grok 的付费账号,直接在 Hermes Agent 里跑 Grok 4.3 的文字聊天和推理、用语音合成让智能体出声回复,还能让智能体调用 Grok Imagine 生成图片和视频。Hermes 本身是个开源、能自我改进的智能体,可以在电脑、沙盒或 VPS 上持续运行,跨会话积累长期记忆,也能连 WhatsApp、Discord 等消...

推荐理由:这是一次中等体量的产品集成,把 Grok 塞进开源的 Hermes 智能体里,不是旗舰模型发布。有实际可玩性,但冲击力没到当天必看级别,放 featured 刚好。

彭博科技

马斯克的 xAI 发布首个编程助手 Grok Build,直接对标 Anthropic

xAI 推出了 Grok Build,一个能直接参与软件开发流程的 AI 编程助手,目标直指 Anthropic 的 Claude。目前公开信息很少,正文没披露定价、能用哪些代码编辑器、性能跑分,也没说什么时候正式开放。

推荐理由:H 和 R 都成立:xAI 跳进编程 Agent 这个坑,还点名 Anthropic,对开发者来说是个明确的竞争信号,话题够。但 K 不成立,因为正文除了说有个叫 Grok Build 的东西能写代码,别的什么都没给——价格、开放范围、跑分全缺,信息量撑不起一篇硬核更新。整体只能算中等偏轻的产品消息,我会先打个折,别太激动。

5月14日星期四

AI HOT 精选

xAI 发布 Grok Build 早期测试版,一个在终端里干活的编程助手

xAI 给 SuperGrok Heavy 订阅用户推了个早期测试版 Grok Build,是个直接跑在终端里的编程助手。它有几个特点:干活前会先出计划让你审,能同时派多个子任务并行跑,还支持无头模式(-p 参数)方便写脚本和自动化。官方说它兼容你现有的 AGENTS.md、插件、钩子和 MCP 服务器,进到仓库就能用。目前是早期测试,正文没披露具体定...

推荐理由:xAI 给 Grok 加了个 Build 模式,让它能直接在终端里写代码、跑命令,还支持计划模式、并行派活和无头运行。目前只开放给 SuperGrok Heavy 用户,属于早期测试,功能细节和实际效果正文没展开说。我会先打个折:东西看着挺省钱,但没披露定价和稳定性数据,先别太激动。

TechCrunch · AI

马斯克的 xAI 在密西西比数据中心偷偷跑了近 50 台燃气轮机,没做环保审查

xAI 在密西西比的 Colossus 2 数据中心用了将近 50 台燃气轮机供电,但把这些设备登记成“移动式”的,绕过了固定电厂的审批流程。现在公司因为这个操作被告了。正文没披露具体的排放数据、许可细节和诉讼里的具体指控内容,所以环保影响到底多大、官司赢面如何,现在都还说不准。

推荐理由:这条新闻不是模型或产品发布,但冲突点很直接:xAI 在密西西比的数据中心被曝用近 50 台燃气轮机供电,还被起诉把“移动”轮机当电厂用。正文没披露这些轮机到底有没有拿到排放许可,这点先别太激动,但“未经检查”这个说法本身已经够扎眼。对从业者来说,它把 AI 算力增长背后的电力合规风险摆到了台面上,所以放在 featured 档是合适的。

5月11日星期一

量子位 · 公众号

马斯克申请 SpaceXAI 商标,要把 AI 算力搬上卫星

SpaceX 提交了 SpaceXAI 商标申请,覆盖的业务范围很广:卫星数据中心、轨道计算、AI 软件即服务、云存储、通信硬件,甚至还有社交网络。文章提到 xAI 已经通过全股交易成为 SpaceX 的子公司,并引用了一个 2500 亿美元的 xAI 估值。不过正文因为环境异常被屏蔽了,具体交易条款和商标申请细节都没披露,这个估值数字也先别太当真。

推荐理由:我会先打个折:目前只有商标申请文件,正文说xAI已并入SpaceX,但没披露交易条款或官方公告,这点先别太激动。商标覆盖范围很广,从卫星数据中心到AI SaaS都有,说明马斯克在铺路,但离真正跑起来还差落地细节。重要性给76、放featured是合理的,属于信号而非实锤重组。

5月10日星期日

AI HOT 精选

SpaceXAI 商标已提交申请,xAI 并入 SpaceX 后品牌统一的第一步

一份商标申请文件显示,“SpaceXAI”在 2026 年 5 月 6 日提交,目前状态是待审查。这个时间点正好是马斯克宣布把 xAI 并入 SpaceX 的时候,等于把 AI 能力和航天业务挂到同一个品牌下面,想把“上火星”和“搞超级智能”两件事放在一个实体里做。正文没披露商标覆盖的具体产品范围、审批进度和实际落地时间,所以现在只能看到品牌整合的意图...

推荐理由:标题写着“正式官宣”,但正文只给了一个待审查的商标申请,没披露交易条款、产品计划或官方公告原文。我会先打个折:关注度够高,但事实很薄,所以放 featured 而不是 p1。

5月7日星期四

Latent Space

Anthropic 租下 xAI 孟菲斯超算,年费或达 50 亿美元,Claude 推理能力几天内就要搬上去

Anthropic 在第二届开发者活动上宣布,将租用 xAI 在孟菲斯的 Colossus I 超算集群来跑 Claude 的推理任务,预计几天内就开始迁移。外界根据 300 兆瓦的功耗规模估算,这笔交易一年可能花掉 Anthropic 约 50 亿美元,相当于 xAI 变相成了一家提供算力租赁的云厂商。活动上没有发新模型,主要更新了三件事:一是 Cl...

推荐理由:这条消息最炸的点是 Anthropic 可能要从 SpaceX/xAI 租 300MW 算力,一年砸 50 亿美元——不过正文也说了这俩数字还不是官方口径,先打个折看。对开发者更实在的是 Claude Code 的 5 小时限额翻倍了,Pro、Max、Team 和席位制 Enterprise 都受益,Opus API 限额也往上调了,用起来没那么容易撞墙。整篇信息量够,既有大 deal 的传闻钩子,又有马上能用的产品变动,所以放在 featured 档。

机器之心 · 公众号

马斯克宣布 xAI 解散,Grok 并入 SpaceXAI,22 万张 GPU 算力租给 Anthropic

马斯克确认 xAI 解散,Grok 和 X 平台相关业务全部并入新实体 SpaceXAI。同时,SpaceX 和 Anthropic 签了协议,Claude 将接入 Colossus 1 超算——超过 22 万张 Nvidia GPU、300 兆瓦的算力集群。对用户来说最直接的变化是配额:Claude Code 的五小时速率限制翻倍,Pro 和 Max...

推荐理由:我会先打个折:目前只有单一信源,还没看到 Anthropic 或 SpaceX 的官方公告,所以先不拉满。但消息本身冲击力很强——xAI 解散、Grok 并入 SpaceXAI,Colossus 1 那 22 万张 GPU 和 300 兆瓦算力直接租给 Anthropic,等于把自家训练底座送给了对手。对开发者来说,Claude Code 五小时速率翻倍、Pro 和 Max 高峰配额限制移除是马上能感知的变化。正文没披露租约时长和价格,也没说 Grok 后续怎么迭代,这些缺口让消息还差一口气,但已经够格进 p1。

Computing Life · Share · 鸭哥调研

Anthropic 半年签下四笔算力大单,xAI 把自家超算中心整租给了对手

Anthropic 在六个月内接连锁定了 AWS Trainium、Google TPU、SpaceXAI Colossus 1 和 CoreWeave 的算力,覆盖了市面上三种主流芯片架构。同一时间,xAI 把拥有 22 万张 GPU 的 Colossus 1 数据中心全部租给了 Anthropic,而自家 GPU 利用率只有 11%。这两件事拼在一...

推荐理由:我会先打个折:这更像一篇策略分析,不是突发新闻,所以分数没给到 85 以上。但它的信息密度够硬——Anthropic 四处锁算力,xAI 却把自家超算租给对手,还带出 11% 利用率这个反直觉数字。对关注大模型算力战的人来说,这比单纯宣布合作要有意思得多。正文没披露租约的具体价格和时长,这点先别太激动,但现有的数字已经足够让从业者重新琢磨两家公司的算力策略了。

5月5日星期二

The Verge · AI

Google、微软和 xAI 同意让美国政府在新模型发布前先做安全审查

三家大模型公司跟美国政府的 AI 标准与创新中心(CAISI)达成了协议,以后新模型在公开前会先交给 CAISI 跑一遍评估。CAISI 说从 2024 年到现在已经审了 40 个模型,但这次公告没提具体审了哪些模型、审多久、审完能不能卡发布。我会先打个折:这更像是一个流程上的公开表态,实际约束力要看后续审查范围和发布时间线怎么定,正文没披露这些细节。

推荐理由:Google DeepMind、Microsoft 和 xAI 都点头让 CAISI 在公开发布前审新模型,CAISI 自称 2024 年起已完成 40 次审查。我会先打个折:正文没披露具体审了哪些模型、审查标准是什么、会不会卡发布。真正值得盯的是审查边界和发布节奏,而不是单次合作公告。

Hacker News 首页

Google、微软和 xAI 同意把早期 AI 模型交给美国商务部做安全评估

Google、微软和马斯克的 xAI 跟特朗普政府谈好了,会在模型公开发布前,先把早期版本交给美国商务部的一个中心做能力和安全审查。这个中心叫 AI 标准与创新中心,已经测过 40 多个模型,包括一些还没发布的。OpenAI 和 Anthropic 在 2024 年就签过类似的协议。不过正文没披露具体要交哪些模型、审查标准是什么、有没有时间表,也没说如...

推荐理由:标题信息量不小,但正文只给了一个事实:三家同意共享早期模型。谁接收、看哪些模型、怎么审、什么时候开始,正文全都没写。我会先打个折——这件事的后续影响取决于审查机制怎么落地,现在只能按已知事实给到 featured 中段。HKR 三条都踩中了,但信息缺口明显,分数暂时不动。

FT · 科技

Google、xAI 和微软同意让美国政府对新的 AI 模型做国家安全审查

三家大模型公司跟美国政府达成了协议,以后发布新模型前要先过一道国家安全审查。起因是 Anthropic 最新的 Mythos 模型让官方有些紧张。不过这篇报道正文被付费墙挡住了,具体怎么审、审哪些模型、什么时候开始执行,这些关键细节都没披露。

推荐理由:我会先打个折:正文只说了三家同意审查,起因是 Anthropic 的 Mythos 模型引发了担忧,但怎么审、审哪些模型、什么时候开始,全都没写。所以这条消息更像一个政策风向标,而不是一份可操作的合规指南。对从业者来说,知道大厂开始接这种审查就够了,具体影响还得等细节出来再判断。