跳到正文

NVIDIA 英伟达

英伟达的 AI 芯片与生态动态:GPU 新品、CUDA 生态、机器人平台与 AI 算力市场的风向。

290 条精选相关主题部署工程行业动态具身智能

最新精选

第 81–100 条 · 共 290 条

8月11日星期二

AI HOT 精选

英伟达拉上贝莱德、黑石等六家金融巨头,要给 AI 算力凑 5000 亿美元贷款

英伟达和六家顶级金融机构签了备忘录,打算撬动最多 5000 亿美元(约 3.38 万亿人民币)的第三方资金,专门给 AI 基础设施项目放贷。黄仁勋把这叫“AI 工厂”模式:算力本身就能直接产生收入,而英伟达的 GPU 因为可以在不同客户间流转、还能通过 CUDA 软件持续提升性能,被包装成了一种适合投资的资产。在这个平台里,英伟达主要做供需撮合,但在部...

推荐理由:英伟达和六家金融机构签了备忘录,目标是撬动最多 5000 亿美元第三方资金,专门放贷给 AI 基础设施项目。核心看点不是金额,而是他们把 GPU 重新包装成“AI 工厂”资产——声称因为 GPU 可跨客户流转、CUDA 能持续提升性能,所以它适合作为贷款抵押物。英伟达在中间只做供需撮合,不出资。正文没披露具体贷款条件、利率和风控标准,所以这个 5000 亿目前还是意向数字,我会先打个折看。但这件事标志着 AI 基建开始被当成一个正经的资产类别来金融化,对从业者判断上游资金松紧很有参考价值。

AI HOT 精选

英伟达拉上六家资管巨头,想撬动5000亿美元建AI工厂

英伟达找了Apollo、BlackRock、Blackstone、Brookfield、Goldman Sachs和KKR,打算搞一个独立融资平台,目标是动员超过5000亿美元的第三方资金来铺AI基础设施。原文就一句话,没拆开说钱怎么分、分几年花、具体建什么。我会先打个折:这5000亿更像是一个募资目标,不是已经到账的钱。

推荐理由:黄仁勋亲自宣布跟Apollo、BlackRock等六家资管巨头搞了个独立融资平台,目标是撬动5000亿美元第三方资金铺AI基础设施。数字和名单都很具体,但原文就一句话,没拆开说钱分几年花、具体建什么、各家出多少。我会先打个折:这5000亿更像是一个募资目标,不是已经到账的钱。正文没披露资金结构、时间表和项目细节,所以判断上留了余地。

8月10日星期一

AI HOT 精选

NVIDIA 开源 NemotronLabs VoiceChat 11B:一个模型搞定语音对话,抢话延迟约 450 毫秒,还能边聊边调工具

NVIDIA 把 NemotronLabs VoiceChat 11B 的权重和代码都公开了。这是一个 110 亿参数、端到端的语音模型,不再走传统的“语音识别转文字、大模型思考、文字转语音”流水线,而是把听和说塞进同一个网络里流式处理。实测抢话反应延迟是 448 毫秒,基本跟人对话的节奏差不多。它支持全双工,也就是双方可以同时说话、随时打断,模型能实...

推荐理由:NVIDIA 这次把 NemotronLabs VoiceChat 11B 完整开源,448 毫秒的打断反应时间和全双工能力是硬指标,不是刷榜。但原文像产品发布稿,没有第三方对比测试,也没说清楚工具调用在嘈杂环境下的成功率。我会先打个折:技术方向对,实际落地效果还得等社区跑完分再看。

8月7日星期五

纽约时报中文网

宇树科技上市:机器人翻跟头很酷,但赚钱的故事还没讲圆

宇树科技周四在上海上市,发行价150.8元,公司估值约610亿元。这家杭州公司去年卖出了全球最多的人形机器人,2025年营收约17亿元,但2026年一季度利润同比跌了55%,原因是竞争加剧、研发烧钱。招股书自己都提示了美国贸易政策和需求疲软的风险——上个月美国FCC刚以国家安全为由提议禁掉新的中国机器狗和人形机器人,北京这周也反制了。今年6月英伟达和宇...

推荐理由:宇树IPO的看点很集中:出货量第一的具身智能公司首次上市,估值610亿,但一季度利润腰斩,中美政策风险同时压在头上。故事够新、争议够大,适合放在featured。利润大跌和政策不确定性让它到不了p1,但作为行业风向标,今天市场怎么投票本身就值得关注。

8月5日星期三

AI HOT 精选

SpaceX 要把 AI 算力搬上太空,全线押注 Nvidia Vera Rubin,AMD 股价应声跌了 8%

SpaceX 在财报电话会上说,以后地面和太空的 AI 算力全用 Nvidia 的 Vera Rubin 架构。到 2026 年底总算力超过 2GW,2027 年底接近 10GW——正文没说明这是装机容量还是实际功耗,如果是实际跑起来的数字,规模确实很大。他们还公布了一个叫 Starmind 的计划,明年开始发射搭载 Rubin GPU 和 Vera ...

推荐理由:SpaceX 独家采用 Nvidia Vera Rubin 架构在轨道上部署 AI 算力,起步就是 2GW 规模,还命名了 Starmind 卫星计划明年发射。没给更高分是因为正文没澄清 2GW 是装机容量还是实际功耗——这个区别挺关键的,我会先打个折。

AI HOT 精选

NVIDIA 开源 Alpamayo 2 Super:一个 340 亿参数的视觉-语言-动作模型,专治自动驾驶里的罕见突发状况

NVIDIA 把 Alpamayo 2 Super 开源了,用的是允许商用的 OpenMDW-1.1 协议。这个模型有 340 亿参数,核心思路是解决自动驾驶里那些不常见但很要命的“长尾场景”,比如多辆车在路口互相博弈的复杂情况。它内部结构分两块:一个 320 亿参数的视觉语言模型当大脑(基于 Cosmos 3 Super Reasoner,还用强化学...

推荐理由:NVIDIA 开源一个可商用的自动驾驶大模型,这件事本身分量不轻。文章把模型结构、训练方法和针对的长尾场景都讲清楚了,但它是 MarkTechPost 的改写稿,没有实测数据和部署细节,所以分数定在 78,不往上拔。

8月4日星期二

Computing Life · Share · 鸭哥调研

Perplexity 开源 Numbat:把 Claude Code、Codex 等不同编程助手的动作翻译成一套统一的安全规则

工程师日常会同时用好几个编程助手,比如 Claude Code、Codex 和 OpenCode,但每个工具的拦截钩子命名、日志格式和阻断能力都不一样,想统一做安全管理非常麻烦。Perplexity 开源了一个叫 Numbat 的工具(Apache 2.0 协议),它是一个用 Go 写的静态二进制文件,能把不同客户端发出的动作统一翻译成 command...

推荐理由:Perplexity 开源 Numbat 解决多 agent 客户端安全管理碎片化的问题,Apache 2.0 协议,技术方案具体。对同时跑多个编程助手的团队有直接参考意义。没给更高分是因为这更像工程工具层面的改进,不是模型能力或产业格局级别的变化。

Hacker News 首页

AI 公司的债务狂欢快撑不住了:半年发债涨了近 10 倍,藏在表外的借款冲到 1.65 万亿美元

S&P Global 的数据显示,2026 上半年,微软、亚马逊这类大模型算力巨头(hyperscaler)和英伟达一共发了 2250 亿美元债券,比去年同期暴增 973.7%,照这个速度全年要发 4000 亿。市场已经开始消化不良,这些公司发债的利率溢价在走高。更隐蔽的风险在表外:日经的分析发现,美国前五大科技公司签下的长期 GPU 采购、数据中心租...

推荐理由:Fortune 和日经把 AI 资本开支的另一本账翻了出来:上半年发债 2250 亿美元,表外还有 1.65 万亿的长期采购和租赁承诺,市场已经在用更高利差投票。三条都打中了,所以给 featured。分数卡在 82 没再往上,是因为这本质上是财务分析,不是技术突破或产品发布,对一线做模型和应用的从业者来说,直接冲击没那么大,但作为风险信号足够重要。

7月31日星期五

Hacker News 首页

月之暗面 Kimi 的训练算力来自阿里云一个 2 万张 Nvidia 芯片的集群

月之暗面的 Kimi 模型跑在阿里云一个 2 万张 Nvidia 芯片的集群上。这是中国 AI 公司绕开出口管制的一个具体例子:阿里负责采购和运营芯片,月之暗面以云服务的方式租用。文章没披露具体芯片型号、训练成本,也没给出 Kimi 的跑分对比,所以实际性能和性价比都还不好判断。

推荐理由:Bloomberg 独家消息,月之暗面的 Kimi 跑在阿里云一个 2 万张 Nvidia 芯片集群上,这是中国 AI 公司绕开出口管制的具体例子。H、K、R 全中:集群规模有冲击力,操作路径是新的信息,而且直接回应了国内从业者最实际的芯片来源问题。不过文章没给芯片型号、训练成本和性能对比,实际性价比还不好说,这点先别太激动。

7月29日星期三

AI 群聊日报

Kimi K3 全量开源,老黄拉联盟,Anthropic 被孤立

Kimi K3 这次不只是放出了模型权重,连 47 页技术报告和训练用的三件核心基础设施(专家并行通信库 MoonEP、高性能算子 FlashKDA、分布式 agent 沙箱 AgentENV)也一并开源了。模型本身是 2.8 万亿总参数、每次推理激活 1040 亿参数、896 个专家里挑 16 个干活,原生支持视觉和 100 万 token 上下文。...

推荐理由:月之暗面这次把 K3 从权重到技术报告再到训练基础设施全开源,是本周国内 AI 圈最大的事。2.8 万亿参数的 MoE 架构文档齐全,社区已经用 80 张 5090 跑通了,说明部署成本没想象中高。技术报告 47 页,不是那种两页纸的公关稿,对想复现或魔改的人有实际参考价值。

Hacker News 首页

芯片股在美亚市场大跌,AI 烧钱焦虑引发抛售

Nvidia 周一下跌 5%,把全球市值第一的位置让给了苹果。导火索是《华尔街日报》一篇报道,说 Nvidia 正谈着给 OpenAI 一个数据中心项目投大约 2500 亿美元,这让市场再次担心:砸这么多钱搞 AI,到底能不能赚回来。韩国 Kospi 指数盘中触发熔断,收盘跌了 10.8%,三星和 SK 海力士都跌超 13%。日本日经 225 指数也跌...

推荐理由:全球芯片股集体跳水,Nvidia 丢掉市值第一的位置,韩国触发熔断,背后是市场对 AI 投入产出比的集体怀疑。三条 HKR 都踩中了,但本质是市场反应报道而非一手爆料,所以定在 78 分,featured 门槛。

7月28日星期二

Computing Life · Share · 鸭哥调研

美国“开放权重”大论战:谁在站台,谁在反对,各自打的什么算盘

7月24日,英伟达、Meta、微软等25家硬件商、云厂商和风投联名发公开信,主张开放权重模型是美国AI领先的关键。OpenAI和Google在周末补签,Anthropic和Amazon没签。各家的生意经很直白:卖硬件的想拉动更多私有算力需求;Meta要用Llama绑定开发者工具链;a16z和YC投的初创公司付不起闭源API每百万token 15美元的费...

推荐理由:一封公开信把美国AI行业的派系地图画了出来,每家签字方的算盘都摊在桌上。Anthropic拒绝签字和Dario的后续回应让故事有持续张力。扣分是因为这是二手分析,不是一手爆料,而且部分判断依赖公开表态,没有内幕佐证。

FT · 科技

英伟达向 Ilya Sutskever 的 SSI 投了 50 亿美元,公司估值冲到 400 亿

英伟达领投了 Ilya Sutskever 新公司 Safe Superintelligence(SSI)的一轮融资,金额 50 亿美元,直接把这家成立不到一年、还没发布任何产品的公司估值推到了 400 亿美元。SSI 的目标是搞“安全的超级智能”,但正文被付费墙挡了,没披露具体的技术路线、研发进度和投资条款。标题里说的“AI 突破”只是标题写法,文章...

推荐理由:Ilya Sutskever 的新公司 SSI 拿了英伟达领投的 50 亿美元,估值冲到 400 亿,是今年最重的一笔 AI 融资。但文章被付费墙挡了,技术路线、研发进度、投资条款全没披露,标题里的“突破”目前只是个标题。我会先打个折,等有具体产品或者论文再说。

Hacker News 首页

英伟达两年撒出 7500 亿美元投 AI 公司,钱转一圈又回来买自家 GPU

英伟达过去两年向 AI 公司投了大约 7500 亿美元,其中很大一部分又流回英伟达,变成 GPU 采购款。这个循环融资的套路让人想起当年软银和 WeWork 的操作。文章没拆开这 7500 亿里多少是英伟达自己的钱、多少是外部资金,也没说清楚哪些算股权投资、哪些只是采购承诺。在搞清楚这笔账之前,我会先给这个数字打个折。

推荐理由:Bloomberg 把英伟达 7500 亿美元循环融资的结构摆上了台面,还直接类比了当年软银和 WeWork 的争议操作。文章没拆开这 7500 亿里英伟达自有资金和外部资金各占多少,也没分清股权投资和采购承诺,所以分数压在 85 以下。但这个故事本身够猛,数字够具体,闭环逻辑也讲清楚了,值得放在 featured 位置。

7月27日星期一

TechCrunch · AI

Ilya Sutskever 的安全超级智能公司抱上英伟达大腿,拿到下一代 GPU 来堆算力

Ilya Sutskever 创立的安全超级智能(SSI)在隐身两年后,宣布跟英伟达达成长期合作。英伟达会提供下一代的 Vera Rubin GPU 平台,按他们自己的说法,这能让 SSI 的算力提升一个数量级。英伟达还投了一笔钱,具体金额没披露。SSI 说自己取得了重大研究进展,但正文没展开说到底是什么进展。这次合作标志着 SSI 从纯研究转向大规模...

推荐理由:SSI 隐身两年后首次公开合作,英伟达既给下一代 GPU 又投钱,HKR 全中。但 SSI 说的“重大研究进展”正文没展开,投资金额也没披露,信息有缺口,分数压到 82。

7月26日星期日

AI HOT 精选

OpenAI 和 Anthropic 在华盛顿游说限制中国开源模型,黄仁勋、马斯克等大佬公开反对

OpenAI 和 Anthropic 正在华盛顿游说,想推动限制中国的开源 AI 模型。他们的理由是,中国企业不当获取了他们的系统数据来训练模型,还搬出一次安全测试说 OpenAI 的模型自己突破限制、黑进了 Hugging Face 的服务器,以此证明模型太危险必须严控。另一边,黄仁勋首次在 X 上发文力挺开放模型,马斯克、扎克伯格、纳德拉、皮查伊等...

推荐理由:OpenAI 和 Anthropic 联手游说限制中国开源模型,黄仁勋首次在 X 上发声支持开放,马斯克、扎克伯格、纳德拉、皮查伊也公开反对,政策事件分量够重,阵营线画得清清楚楚。H、K、R 三点全中,唯一的小扣分是文章没给出游说进展和具体法案细节,但整体信息量已经足够让从业者关注。

7月25日星期六

AI HOT 精选

英伟达、微软和Meta联手喊话:别急着给开放权重模型上枷锁

英伟达、微软和Meta联合向特朗普政府表态,反对对开放权重模型(也就是把训练好的模型参数直接公开、允许大家下载微调的那种)施加出口管制或许可要求。他们的核心论点是:管得太早会伤到美国的开源生态,反而把优势拱手让给竞争对手。报道没列出具体的政策提案,但三家态度很明确——别锁太快。这三家都靠开放模型赚钱,立场不意外,但三家一起站出来施压还是值得留意。

推荐理由:英伟达、微软和 Meta 联合向特朗普政府喊话,反对对开放权重模型加出口管制或许可要求。核心逻辑是管太早会伤美国开源生态,把优势送给对手。报道没列出具体政策提案,但三家一起站出来,说明内部讨论已经到了企业必须公开表态的阶段。我会先打个折:这三家都靠开放模型赚钱,立场不意外,但联合施压的时机值得留意,政策窗口可能比外界想的更紧。

7月24日星期五

TechCrunch · AI

美国考虑限制开源模型,英伟达、Meta 等公司联名反对一刀切

英伟达、Meta、微软、Mistral 和 Hugging Face 等公司发了一封公开信,劝美国政策制定者别急着对开放权重模型(也就是把模型参数公开、允许大家自由下载微调的那种)搞大范围限制。这封信的背景是华盛顿正在琢磨怎么回应中国 AI 实验室——美方怀疑他们用“蒸馏”技术从美国模型里学东西,把能力差距拉近了。不过信里压根没提中国,只说开放模型对创...

推荐理由:一群顶级 AI 公司联手反对美国可能对开放权重模型搞出口管制,阵容够硬,时机也敏感。信里绕开了中国,但谁都知道这是在回应中美 AI 角力。分数没给更高是因为这本质上是政策游说,不是技术突破,正文也没披露具体管制方案会怎么落地,先别太激动。

FT · 科技

英伟达和 Palantir 游说白宫别禁开源模型,说禁令会先伤到美国自己

白宫正在考虑限制开源权重大模型出口,起因是有报道说 DeepSeek 用美国的开源模型训练了军用 AI。英伟达和 Palantir 跳出来反对一刀切禁掉,他们的理由是:开源生态是美国 AI 领先地位的核心,全面禁止等于自断手脚,本土公司会先遭殃。他们提的替代方案是收紧最终用户管控,而不是封模型本身。文章没给出立法时间表,也没说白宫目前倾向哪边。

推荐理由:FT 独家,信源扎实。英伟达和 Palantir 联手反对开源模型出口禁令,提出的替代方案是收紧最终用户管控,而不是封模型。政策张力真实存在,对开源 AI 圈子直接相关。没给 85 是因为文章没披露白宫目前倾向哪边,也没立法时间表,判断先打个折。

r/LocalLLaMA

微软牵头,20 多家公司联名呼吁:别急着禁开源模型权重

微软发起了一封公开信,NVIDIA、Meta、Palantir、Hugging Face 等 20 多家公司都签了名,核心诉求是让政策制定者别过早限制开源模型的权重公开。信里特别提了一句,要把正常的模型蒸馏(用大模型教小模型)和恶意盗用区分开,别一刀切。有意思的是,OpenAI、Anthropic 和 Google 这三家做闭源大模型的公司全都没签字。...

推荐理由:20 多家公司联名反对过早限制开源权重,这事本身信号很强,但正文没附上完整信函,也没给出具体政策条文或时间线,所以判断先打个折。阵营缺席比签字名单更有信息量:OpenAI、Anthropic、Google 全都不在,说明闭源和开源两边的博弈已经摆上台面。蒸馏和盗用的区分是个实在的政策抓手,但信里没展开技术细节,落地效果还得看后续。