跳到正文

NVIDIA 英伟达

英伟达的 AI 芯片与生态动态:GPU 新品、CUDA 生态、机器人平台与 AI 算力市场的风向。

290 条精选相关主题部署工程行业动态具身智能

最新精选

第 41–60 条 · 共 290 条

8月29日星期六

TechCrunch · AI

英伟达的护城河,已经从 GPU 延伸到整个机柜的调度能力

英伟达刚发完财报,市场开始重新算它的账。以前大家担心 AWS 和谷歌用自研芯片抢 GPU 的份额,但现在焦点变了:当数据中心的用电量涨到吉瓦级别,怎么调度、怎么让几万张卡高效互联,比单颗芯片的算力更难做。英伟达这次推的 Vera Rubin 方案,把 NVLink 交换机、Spectrum-X 以太网和 BlueField DPU 打包在一起,直接在机...

推荐理由:这是一篇财报后的策略分析,把竞争焦点从芯片算力转移到了整机柜的互联调度上。观点驱动而非硬新闻,所以分数没破 85。我会先打个折:正文没给出具体的性能对比数据或客户案例,更多是逻辑推演,但逻辑本身站得住脚,对关注基础设施的从业者来说值得一读。

TechCrunch · AI

开源模型公司成了硅谷最抢手的收购标的

Nvidia 被曝要花 130 亿美元买下 Hugging Face,一个分享开源模型权重和跑分的平台,你可以把它理解成 AI 时代的 GitHub。在这之前,Nvidia 已经用 60 亿美元收了开源模型开发商 Poolside,Stripe 也花了超过 70 亿美元买下为企业提供开源模型服务的 OpenRouter。这三家公司的共同点是:模型权重都...

推荐理由:TechCrunch 独家报道了三起大额收购,金额和标的都明确,把开源模型公司的并购趋势讲得很实。三条 HKR 都踩中了,但本质是行业趋势分析而非产品发布,所以分数取 78-84 区间的下限。

8月27日星期四

Hacker News 首页

英伟达预测 2028 财年收入冲到 6730 亿美元,增速 70%,但被零件短缺卡着脖子

英伟达 CFO 在 8 月 26 日给了个远期的业绩指引:2028 财年收入约 6730 亿美元,比现在分析师平均预期的 44% 增速高出一大截,直接达到 70%。刚公布的季度收入是 962 亿,数据中心那块就占了 890 亿,同比翻了一倍多。黄仁勋说实际需求远不止 70%,但内存等零件供不上,只能先按这个数交货。客户群也在变,以前主要靠几家大云厂商,...

推荐理由:英伟达第一次甩出 2028 财年 6730 亿的远期数字,比市场共识高出一大截,而且 CFO 直接说需求不止 70%,是被零件卡住了。这对算力供给和成本预期是顶层信号,重要性给 88 没问题。我会先打个折:正文没披露这个 6730 亿是怎么拆的,也没说内存瓶颈具体卡在哪几个型号上,但光是这个量级和增速,就足够让所有做 AI 基础设施的人重新算账了。

TechCrunch · AI

英伟达被曝将以129亿美元收购开源模型社区Hugging Face,但协议还没签

据The Information消息,英伟达已同意以129亿美元收购Hugging Face——就是那个开发者扎堆分享、下载开源AI模型的大本营。这笔交易能让英伟达在开源AI圈站稳脚跟,同时保护它的芯片生意,因为现在OpenAI、Google等大客户都在自研芯片,英伟达的垄断地位没那么稳了。不过Business Insider说双方还没签正式协议,谈判...

推荐理由:The Information和Business Insider都报了这件事,129亿的规模在AI基础设施交易里算顶级的。但Business Insider说正式协议还没签,所以先别当板上钉钉的事来看——目前只是接近成交,不是已经成交。

Latent Space

英伟达 130 亿美元收购 HuggingFace,开源阵营又赢一局

英伟达确认以 130 亿美元收购 HuggingFace,这个价格大约是后者 1.5 亿美元年经常性收入的 80 倍。相比今年 1 月英伟达最初 70 亿美元的报价,最终成交价几乎翻了一倍,背后是 HuggingFace 今年客户数翻了一倍。OpenAI 也发了一篇关于 HuggingFace 事件的复盘,但正文没披露具体细节。另外,Z.ai 发布了开...

推荐理由:英伟达130亿收购HuggingFace,价格比年初70亿报价翻了近一倍,对应1.5亿年收入约80倍估值,客户数一年翻倍是涨价的核心原因。这是今年AI基础设施领域最大的并购,直接牵动开源模型生态的走向。同期OpenAI发了HuggingFace事件复盘,但正文没给具体细节,信息量远不如收购本身。

Latent Space

OpenAI 首款推理芯片 Jalapeño 跑分出炉:每瓦性能比 Blackwell 高 1.5–1.9 倍

OpenAI 在 Hot Chips 37 上公布了自研推理芯片 Jalapeño 的首批实测数据。跟 NVIDIA 的 GB200/GB300 比,Jalapeño 在峰值吞吐量下每瓦能干 1.5 到 1.9 倍的活,端到端延迟低了 1.7 到 3.6 倍,在交互密集的任务上性能高出 2.1 到 4.1 倍。芯片标称功耗 700W,但实际测试中基本没...

推荐理由:OpenAI 在 Hot Chips 上把自研芯片 Jalapeño 的底牌亮了,声称每瓦性能是 GB200/GB300 的 1.5 到 1.9 倍,端到端延迟低了 1.7 到 3.6 倍。这是他们第一次用硬数据证明自研芯片不是画饼,而且确实有竞争力。我会先打个折,因为目前只有 Latent Space 的现场报道,还没看到更完整的第三方验证,但光凭这些数字已经足够让行业里做推理部署的人认真看一眼了。

Hacker News 首页

英伟达正在谈收购 Hugging Face,开价超过 130 亿美元

英伟达最近几周在跟 Hugging Face 谈收购,估值超过 130 亿美元。Hugging Face 是开源模型社区,很多开发者在那上面分享和调用模型。目前还没签协议,谈判也可能谈崩。正文没披露英伟达为什么想买、交易结构怎么设计,也没提反垄断风险。先当早期接触看,别当板上钉钉的事。

推荐理由:英伟达收购Hugging Face会直接改变开源模型的获取方式。130亿美元报价和未签约状态是实打实的信息。正文没提收购动机、交易结构和反垄断风险,所以先当早期信号看,别当板上钉钉的事。

彭博科技

英伟达被曝与 Hugging Face 谈过收购,但交易状态和报价都没披露

彭博社援引知情人士消息称,英伟达曾就收购 Hugging Face 进行过讨论。Hugging Face 是目前最大的开源模型和数据集托管平台,也是很多开发者找模型、测模型的第一站。如果这笔交易做成,英伟达等于直接拿下了 AI 开发者社区的核心入口和模型分发渠道。但报道没说明谈判是否还在继续、英伟达出价多少、Hugging Face 那边是什么态度。目...

推荐理由:彭博社独家确认了双方有过接触,话题分量够重。但我会先打个折,因为关键信息全是缺口:没报价、没谈判状态、没双方立场,目前只停留在“讨论过”的阶段,离“快成了”还差得远。

AI HOT 精选

英伟达预测 2028 财年营收增长 70%,黄仁勋说真实需求比这高得多

英伟达在二季度财报会上给了一个 2028 财年的增长指引:营收同比大约涨 70%。黄仁勋补了一句,70% 是他们按现有供应能力能保底的数,市场实际要的货远不止这些。他提到 AI 需求正在从几家大云厂商往外溢,企业和政府这类“主权 AI”客户还没被市场充分算进去。二季度公司营收 962.2 亿美元,同比翻了一倍多,其中数据中心业务占了 92%。三季度指引...

推荐理由:英伟达给了 2028 财年营收同比涨 70% 的指引,黄仁勋补了一句这只是供应能力下的保底数,实际要的货多得多,还提到主权 AI 需求没被市场充分计入。这是市场最盯着的算力需求信号,但毕竟是远期指引而非已实现业绩,所以分数没给到 85 以上。

AI HOT 精选

亚马逊把英伟达芯片订单加码到三倍,再追订200万颗GPU

亚马逊在英伟达财报电话会上宣布,将在2027到2028年向AWS数据中心追加部署200万颗英伟达GPU,涵盖Blackwell Ultra、Rubin和Rubin Ultra三代芯片。五个月前亚马逊刚承诺部署超过100万颗,英伟达说实际需求已经超出当时的预期。按单颗成本估算,这笔订单价值数百亿美元,但双方都没公布具体财务条款。文章没说明这批新算力会分给...

推荐理由:亚马逊在英伟达财报电话会上把GPU订单翻到三倍,直接报出200万颗这个数,是实打实的基建信号。HKR三条都踩中了,但文章没披露财务条款,也没说算力会怎么分配,所以分数压在85以下。

The Verge · AI

英伟达单季收入逼近千亿美元,数据中心业务占大头

英伟达刚公布的最新季度收入超过 960 亿美元,离单季千亿只差临门一脚。这个数字有多夸张?很多科技巨头一年的收入都没它一个季度多。收入绝大部分来自数据中心业务,也就是卖 AI 训练和推理用的 GPU。不过文章没披露利润、毛利率和同比增速,所以不知道这 960 亿里实际赚了多少,以及增长是在加快还是放缓。

推荐理由:英伟达一个季度做到 960 亿美元,离千亿只差一口气,说明 AI 算力需求还在往上走。但文章只给了收入数,没提利润、毛利率和增长是加速还是放缓,所以没法判断这波增长的质量。分数没打更高,就是因为关键财务指标全缺。

TechCrunch · AI

Anthropic 又砸 450 亿美元租算力,这次找上了英国新公司 Nscale

Anthropic 签了一份六年长约,花大约 450 亿美元租用 AI 算力,供应商是 2024 年才成立的英国公司 Nscale。Nscale 会用英伟达最新的 Vera Rubin 芯片系统来提供计算资源,这套系统把六块不同芯片绑在一起干活,预计 2027 年底开始向 Anthropic 交付。Anthropic 最近在算力上花钱不手软,这已经是它...

推荐理由:Anthropic跟一家2024年才成立的英国公司Nscale签了六年450亿美元的算力长约,用英伟达最新的Vera Rubin芯片系统,2027年底开始交付。金额、时间、芯片规格都摆出来了,不是虚的。我会先打个折:供应商太新,交付还有三年,中间变数不小,但Anthropic敢这么签,说明它对算力饥渴到什么程度。这条消息对关注模型能力天花板的人很实在——钱和芯片在哪,上限就在哪。

AI HOT 精选

英伟达半年净赚1180亿美元,数据中心收入翻倍,下季度指引1080亿

英伟达发了2027财年半年报,半年营收1778亿美元,归母净利润1180亿,同比涨了161%。毛利率稳在75%,这个赚钱效率在硬件公司里很夸张。第二财季单季营收962亿,其中数据中心业务占了890亿,同比翻了一倍多,说明大客户们还在疯狂抢购AI算力。公司说新的Vera Rubin平台已经全面量产,还拉上了金融机构准备撬动5000亿美元第三方资本去建AI...

推荐理由:英伟达这份半年报本身数字就够硬,数据中心增速和Vera Rubin量产是实打实的行业信号。没给更高分是因为财报属于定期披露,不是突发产品发布,而且5000亿美元第三方资本那部分正文没展开讲具体怎么落地,我会先打个折。

8月26日星期三

FT · 科技

英伟达的 2000 亿美元“资产负债表即服务”生意

FT 把英伟达的生意重新定义为“资产负债表即服务”:它用自己的股票和客户承诺,帮云厂商和创业公司融资买 GPU。文章估算英伟达通过担保、投资和供应商融资撬动了约 2000 亿美元资金,但没给出具体拆分明细。核心风险在于,如果 AI 需求降温,英伟达的资产负债表会同时受到股价下跌和客户违约的双重打击。

推荐理由:FT 这篇把英伟达的玩法讲透了——它不只是在卖芯片,更像在用资产负债表给整个 AI 生态放杠杆。约 2000 亿美元这个数我会先打个折,因为正文没拆开担保、投资和供应商融资各自占多少,但方向是对的。核心风险写得很直白:一旦需求退潮,英伟达的股价和客户还款能力会一起塌,这点先别太激动,但值得每个关注 AI 基建的人心里有数。

FT · 科技

FT 算了一笔账:全球 AI 数据中心投资计划已超 7 万亿美元,但下游应用还没证明能赚回本

FT 把各家公开的 AI 数据中心投资计划加总,得出一个超过 7 万亿美元的数字。先打个折,这是多年累计的意向性总额,不是一年就烧掉的钱。但核心风险没变:现在 AI 收入大头还在英伟达这类硬件商手里,真正用 AI 做业务的应用层公司还没交出能匹配这笔投资的回报。如果企业客户最终不愿意为 AI 服务付足够多的钱,这些机房和芯片就可能变成没人接盘的闲置资产。

推荐理由:FT 把各家公开的 AI 数据中心投资计划加总,得出超过 7 万亿美元的数字,先提醒这是多年累计的意向性总额,不是一年烧掉的钱。核心判断是:现在 AI 收入大头还在英伟达这类硬件商手里,应用层公司还没交出能匹配这笔投资的回报,如果企业客户最终不愿付够钱,这些机房和芯片可能变成没人接盘的闲置资产。文章是评论性质,没有新数据,但把投资规模和收入错配的风险讲得很直白,对从业者有提醒价值。

AI HOT 精选

英伟达单季营收指引首破千亿,但回款周期从 45 天拉长到 60 天

英伟达第二财季营收 960 亿美元,下季指引 1080 亿,年增速 106%。超大规模云厂商的采购增速放缓到 13%,而新云厂商和 AI 创业公司贡献了 25% 的增长,并首次成为数据中心净增收入的大头。为了支撑这些资金实力较弱的买家,英伟达放宽了付款条件,应收账款激增 64% 至 630 亿美元,回款天数从过去八个季度稳定的 45 天左右跳升到 60...

推荐理由:Tunguz 把数字拆得很清楚,营收破千亿是里程碑,但更关键的是增长引擎换了。大厂采购增速放缓,新云厂商和创业公司成了主力,英伟达为此放宽付款条件,应收账款和回款天数双双跳升。这个结构变化比营收数字本身更值得从业者留意,所以给了 featured。

Hacker News 首页

Perplexity 推出“便携电脑”:AI 干活时私密数据不离开你的机器

Perplexity 发布了一个叫 Portable Computer 的本地版 AI 助手,专门跑在 NVIDIA DGX Spark 这台桌面小机器上。它用 Qwen 3.8 27B 或 PPLX 27B 模型在本地处理文件、代码和工作流,私密数据不用上传,也不消耗云端积分。当任务需要联网搜索或更强的推理能力时,本地的调度器会先征求你的同意,再把那...

推荐理由:Perplexity 跟 NVIDIA 合作,把 Computer 搬到了 DGX Spark 上做本地执行,产品形态有差异化,隐私控制也给得具体。分数定在 78 是因为现在还绑着特定硬件,正文也没展开讲实际用起来顺不顺手,我会先打个折。

8月25日星期二

FT · 科技

英伟达员工被美国司法部指控,涉嫌向中国走私受出口管制的先进芯片

美国司法部对一名英伟达员工提起走私指控,说他偷偷把受出口管制的先进芯片运往中国。目前 FT 的报道只放出了标题,正文被付费墙挡住,具体是什么型号的芯片、通过什么渠道走私、涉及多少数量和金额,这些关键信息都没披露。这件事发生在中美芯片管制持续收紧的背景下,直接把英伟达的合规风险摆到了台面上。

推荐理由:FT 独家爆料英伟达员工因走私芯片被起诉,话题分量很重,毕竟中美芯片管制背景下英伟达是焦点。但正文付费墙挡住了所有关键信息,只能按标题打分。冲击力和相关性都拉满,知识增量为零,所以给了 featured 但没给 k。

8月24日星期一

AI HOT 精选

NVIDIA 说 Vera Rubin NVL72 跑 AI 智能体每瓦能干 H100 30 倍的活

NVIDIA 官方博客放出一组内部测试数据:用 Llama 3.3 70B 模型跑智能体工作流(让模型进业务流程干活),Vera Rubin NVL72 整机柜系统每瓦完成的工作量是 H100 的 30 倍。这个 30 倍是峰值数字,正文没披露延迟数据和完整的测试配置,所以实际部署时我会先打个折。新系统定在 2026 年下半年上市,主打推理和智能体场景。

推荐理由:NVIDIA 的 30 倍能效提升有具体模型和场景撑着,不是空喊口号。但正文没披露延迟和完整测试配置,实际跑起来肯定要缩水。对搞基础设施的人有用,对更广泛的 AI 从业者来说,时间还早,先观望。

8月23日星期日

AI HOT 精选

AI 硬件瓶颈像鞭子一样从 GPU 一路抽到存储和机房外壳

Tomasz Tunguz 用牛鞭效应解释 AI 基础设施的连锁短缺:2023 年大家疯抢 GPU,导致服务器出货量暴跌 22%,内存厂跟着遭殃。18 个月后,内存厂为了利润转产 HBM(高带宽内存),挤占了普通内存的产能,企业级固态硬盘一个季度就涨了 80%。到 2025 年底,让模型进业务流程干活的 agent 模式把 CPU 和 GPU 的配比从...

推荐理由:Tunguz 用牛鞭效应把 AI 硬件短缺串成一条有数据支撑的因果链——固态硬盘季度涨 80%、数据中心每吉瓦 200 亿美元造价——对基础设施买家和投资者直接有用。没给更高分是因为这是单人分析文章,不是一手数据或产品发布,但判断和数字都扎实,我会先打个折。