跳到正文

#产品更新

今日 22 条

3月12日星期四

NVIDIA 博客

英伟达开源 Nemotron 3 Super:120B 模型只激活 12B 参数,跑 agent 任务吞吐量翻五倍

英伟达发了 Nemotron 3 Super,一个总参数量 120B、但每次推理只激活 12B 参数的混合专家模型。它用了混合 MoE、隐式 MoE 和一次预测多个 token 的技术,上下文窗口拉到 100 万 token。官方说在跑 agent 这类多步骤任务时,吞吐量比之前方案高 5 倍;如果搭配 Blackwell 的 NVFP4 精度,推理速...

推荐理由:这是一条扎实的模型发布消息,H、K、R 三点都踩中了。H 靠 5 倍吞吐这个具体承诺抓眼球;K 把参数量、激活量、上下文长度、训练规模和硬件对比都列清楚了,信息密度高;R 在于开放权重和配方,不是只给个模型让你猜。没给更高分是因为关键性能数据都来自 NVIDIA 自家博客,还没看到第三方验证,这点先别太激动。

3月11日星期三

OpenAI News

OpenAI 给 Responses API 加了个电脑环境,让模型能自己敲命令行干活

OpenAI 在 2026 年 3 月 11 日说,他们的 Responses API 现在能调用一个 shell 工具,在托管的隔离容器里执行命令。模型(GPT-5.2 及之后版本)会自己提议该敲什么命令,API 负责在后台跑、把结果流式传回来,还能同时开多个会话并行处理。容器里带了文件系统、可选的 SQLite 和受限的网络访问。这相当于给模型配了...

推荐理由:这次更新把 Responses API 从“调工具”升级成“给模型一台隔离电脑”,shell 执行、流式输出、并行跑命令、上下文压缩都实装了,对 agent 开发者是实打实的新能力。正文后半段截断,定价、配额和完整安全边界都没写,所以实际落地成本和安全兜底还得等后续披露。

3月10日星期二

OpenAI News

ChatGPT 上线数学和科学互动图解,覆盖 70 多个核心概念

OpenAI 给 ChatGPT 加了一个学习功能:问勾股定理、理想气体方程这类问题时,它会直接弹出一个可拖拽的图表模块。你可以手动调参数、改公式,图表会跟着实时变,把抽象公式变成能上手试的东西。首批覆盖 70 多个数学和科学概念,所有付费和免费用户都能用。官方说每周有 1.4 亿人用 ChatGPT 学数学和科学,但正文没披露这个互动功能背后的模型、...

推荐理由:我会先打个折:这是个中等体量的产品更新,不是模型能力突破。钩子在于把抽象概念变成能动手玩的画面,对教学场景有直接吸引力。1.4 亿周活和 70+ 概念是实打实的数字,说明铺量已经很大。但正文完全没提模型怎么支撑这些交互、有没有做过学习效果验证,这点先别太激动。整体判断是产品化动作值得关注,技术深度和效果证据还缺位。

3月7日星期六

彭博科技

甲骨文和 OpenAI 叫停了得州旗舰数据中心的扩建计划

双方谈崩了,不再一起扩建位于得州阿比林的那座旗舰 AI 数据中心。原因是融资进度拖后腿,加上 OpenAI 自己的需求变了。现在 Meta 在考虑从运营商 Crusoe 手里租下这个场地,英伟达也在中间帮忙牵线。这类项目的造价动辄上百亿美元,正文没披露具体的分手条款和后续时间表。

推荐理由:Oracle 和 OpenAI 在得州阿比林那个旗舰数据中心的扩建计划谈崩了,原因是融资没谈拢,加上 OpenAI 自己的需求也变了。Meta 正考虑从开发商 Crusoe 手里租下原本要扩建的那块地,Nvidia 在中间帮忙牵了线。项目总成本只说在几百亿美元级别,具体数字没披露。我会先打个折:这事说明超大集群先卡在资本结构和多方协同上,不是先卡在芯片,这点比标题本身更值得盯。

彭博科技

OpenAI 放出一个安全工具的研究预览版,让 AI 自己去数据库里找漏洞、打补丁

OpenAI 发了一个给安全团队用的 AI agent 研究预览版,主要用途是扫描大型数据库里的漏洞并自动修补。目前公开信息很少——正文没披露具体模型名、支持哪些数据库、怎么收费、什么时候正式上线。我会先打个折:这还是个研究预览,离生产环境能用还有距离,别看到“agent”就觉得能直接上岗。

推荐理由:我会先打个折:这还是个研究预览,离生产环境有距离。但 OpenAI 把代理放进安全流程里,不是再发一个聊天机器人,这个动作本身就值得盯。正文没披露模型、覆盖范围、定价和上线时间,所以别急着激动。真正让人在意的是它试图让 AI 直接碰漏洞修补,这会牵出责任、误报、权限控制一连串问题,企业安全团队不可能不关注。

彭博科技

Anthropic 要学亚马逊开 AI 软件商店,让企业客户在它的平台上买第三方工具

Anthropic 正在搞一个类似亚马逊的 AI 软件市场,企业客户可以直接在上面买第三方开发的软件,不再只卖自家模型。这步棋说明它想从卖模型转向做渠道分发。不过正文被 Bloomberg 的机器人验证挡住了,具体上线时间、抽成比例、首批上架哪些软件都没披露。另外文章提到公司正因五角大楼的合作争议面临业务不确定性,这个背景可能跟它急着铺渠道有关。

推荐理由:我会先打个折:上线时间、抽成、具体卖什么软件,正文全没给,所以别当马上落地的产品看。但方向值得盯——Anthropic 从卖模型转向做企业软件分发,等于在学亚马逊搭应用商店。这点先别太激动,因为没披露的东西太多,可它发生在跟 Pentagon 对峙带来业务不确定的节骨眼上,渠道动作本身就说明它在找模型销售之外的收入支点。

3月6日星期五

OpenAI News

OpenAI 把代码安全扫描工具 Codex Security 开放给付费用户试用,下个月免费

OpenAI 在 3 月 6 日上线了 Codex Security 的研究预览版,面向 ChatGPT Pro、Enterprise、Business 和 Edu 用户,下个月可以免费用。这个工具相当于一个应用安全助手,会先读懂你的项目结构,生成一份可编辑的威胁模型,再根据这个模型去找漏洞、做验证、给修复建议。过去 30 天里,它扫了外部仓库超过 1...

推荐理由:这是 OpenAI 给开发和安全团队的一个实质性产品更新,不是泛泛的安全宣传。切入点新、有具体扫描和误报数据、回应了 AI 编码风险和告警疲劳,三个点都站得住。不过目前还是研究预览,正文没披露误报下降的具体测试条件和补丁的采纳率,效果得等正式版再看。

3月5日星期四

OpenAI News

OpenAI 发布 GPT-5.4,把写代码、操作电脑和做报表揉进了一个模型里

OpenAI 推出了 GPT-5.4,一个面向专业工作的新模型,在 ChatGPT、API 和 Codex 里都能用。它把之前 GPT-5.3-Codex 的代码能力整合了进来,还首次让通用模型能直接操作电脑软件,比如跨应用完成复杂流程。模型支持最长 100 万 token 的上下文,方便处理长线任务。在模拟 44 种职业工作的 GDPval 测试里,...

推荐理由:这条消息的新闻价值在于 OpenAI 放出了一个新模型名,所以 H 和 R 都成立。但正文除了标题什么都没有,模型到底多大、贵不贵、能处理多长的上下文、跑分怎么样,一概没提,所以 K 不成立,分数只能停在 80 分这个区间。真正该盯的是后续的技术页,不是这条标题本身。

OpenAI News

OpenAI 把 ChatGPT 塞进 Excel 了,还接上了 Moody's、Factiva 等金融数据源

OpenAI 在 2026 年 3 月 5 日发布了 ChatGPT for Excel 的测试版,相当于在 Excel 里直接装了一个 GPT-5.4 助手。你可以用大白话让它帮你搭财务模型、跑情景分析、查公式错误,它改表之前会先问你,改完还能告诉你改了哪个格子、为什么。OpenAI 自己跑了一遍投行工作流测试,GPT-5 的正确率是 43.7%,换...

推荐理由:OpenAI 把 ChatGPT 塞进 Excel 测试版,不只是加个聊天框,而是让模型能直接在单元格里建模、追溯改动,还接入了 Moody's、道琼斯 Factiva、MSCI 等金融数据源。内部投行场景的基准分从 43.7% 跳到 87.3%,幅度很大,但这是内部测试,实际表现得等用户上手再看。企业版和教育版默认关闭,说明对合规和隐私留了后路。FactSet 标注“即将上线”,数据生态还在铺。整体看,这是 OpenAI 在抢专业工作流入口的一次重注,比单纯发个模型更有战略意味。

3月3日星期二

OpenAI News

GPT-5.3 Instant 发布:少说废话、少拒绝,日常对话更干脆

OpenAI 在 2026 年 3 月 3 日更新了 ChatGPT 里用得最多的模型,叫 GPT-5.3 Instant。这次改动主要冲着日常对话体验去的:模型不再动不动就拒绝回答,也不会在回答前先啰嗦一堆免责声明。文章给了一个具体对比——问远程射箭弹道计算,旧版 GPT-5.2 Instant 直接拒绝,说这能提高武器效能所以不能帮;新版 GPT-...

推荐理由:OpenAI 更新了 ChatGPT 最常用的日常模型,这篇帖子靠一个具体的 5.2 vs 5.3 行为对比把安全边界的变化讲清楚了,所以 HKR 三项都站得住。我会先打个折:正文没给系统卡、基准分、API 价格,信息缺口明显,所以重要性停在 84 不进 85。

2月28日星期六

36 氪 · 直链

阿里千问计划推出 AI 眼镜、耳机和指环,把点外卖、打车功能搬出手机

阿里内部人士透露,千问将在 2026 年面向全球发布三款 AI 可穿戴硬件:眼镜、耳机和指环。眼镜会在 MWC 2026 亮相,3 月 2 日开放预约。千问 App 上已有的点外卖、打车等功能会直接迁移到这些设备上。阿里把这件事看得很重,去年底已经将千问 App、夸克和 AI 硬件业务合并成一个“千问 C 端事业群”。模型端也做了配合,新开源的 Qwe...

推荐理由:这篇独家把阿里的硬件路线图摊开了,三款设备一起上,摆明是要把千问 App 里的外卖、打车能力搬到眼镜和耳机上。我会先打个折,毕竟还没看到真机和实测,但 Qwen3.5-Plus 的成本和吞吐数据如果属实,跑端侧推理确实省钱了。值得从业者盯的是生态联动那部分,正文没细说硬件和支付宝、高德的具体打通方式,这点先别太激动,但方向本身比单品参数重要。

2月27日星期五

36 氪 · 直链

抖音把资讯交给AI:长文上限提到8000字,AI写的新闻摘要也要进信息流了

抖音在2025年底正式上线了长图文功能,字数从内测时的4000字放宽到8000字,目前只能在网页端发布。内容多是深度故事、社会新闻这类非即时性的东西。同时,抖音热点频道里多了个“AI智选资讯”,AI会实时抓取全网热点,自动生成新闻摘要和总结。内部人士说,这些AI资讯很快会进入抖音的信息流,跟原创长文抢同一批流量。字节的思路很明确:用AI把内容生产成本打...

推荐理由:抖音把长文和 AI 资讯塞进同一个流量池,但正文没交代推荐权重、版权怎么谈、事实错了谁兜底。我会先打个折:功能上线是真的,可责任边界没画清楚之前,别急着把它当内容生态升级。

2月14日星期六

阮一峰的网络日志

字节 Seed 2.0 模型搭配 TRAE 工具,用 Skill 文件给 AI 编程加技能

阮一峰用字节刚发的 Seed 2.0 Code 模型和 TRAE 编程工具,跑了一个把 ASCII 字符画转成手绘风格图的网页应用,本地预览直接能用。Seed 2.0 是字节的通用基座模型,分 Pro、Lite、Mini 和 Code 四个版本,能处理文字、图片、视频等多种数据,也支持让模型调用外部工具。文章重点讲了 Skill 怎么用:把反复要写的提...

推荐理由:这篇文章不是官方通稿,而是一个能跟着跑的通路演示。H 和 K 都站得住,因为既有完整应用产出,又有模型矩阵和 Skill 机制的具体拆解。R 也成立,Skill 文件的设计直接踩中 coding agent 工作流复用的痛点。整体是强教程而非重大发布,所以重要性停在 75。

MIT Technology Review · AI

渐冻症夺走了这位音乐人的声音,AI 让他重新站上舞台唱歌

32 岁的 Patrick Darling 在确诊渐冻症两年后,用 AI 克隆了自己的歌声,2 月 11 日在伦敦重新和乐队一起演出。他的声音克隆不是用录音棚素材做的,而是从嘈杂的手机视频和厨房录音里拼出来的,ElevenLabs 的音乐工具花了大约六周调校。这件事的信号不在感人,在于门槛:ElevenLabs 把工具免费开放给因渐冻症等疾病失声的人,...

推荐理由:我会先打个折:这不是模型或产品大更新,而是一个应用案例。但案例本身够硬——ALS 患者用旧录音唱歌,不是概念演示,是真实上台。正文给了两个关键条件:10 分钟清晰语音和 6 周从噪音片段里抠出歌声,说明门槛和代价。ElevenLabs 把这个流程做成免费项目,但正文没披露底层模型细节,这点先别太激动。整体看,故事性强、有可复现信息、踩中声音权利话题,适合放低 featured。

2月13日星期五

OpenAI News

OpenAI 给 Codex 和 Sora 换了一套“先用额度,超了再扣钱”的访问系统

OpenAI 发了一篇工程博文,解释他们怎么解决 Codex 和 Sora 用户老撞速率限制的问题。核心做法是自研了一套实时访问引擎,把速率限制和预购点数揉在一起:请求先走免费速率额度,额度用完了自动从点数余额里扣,用户不用切换系统。文章说这套“决策瀑布”模型能在一个请求里同步完成判断,点数扣减异步处理,并且有三套独立数据(产品用量、计费事件、余额变动...

推荐理由:这是 OpenAI 官方的产品更新,标题抛出了“超越速率限制”这个钩子,对开发者来说很抓眼球,所以 H 和 R 都成立。但正文完全没披露具体怎么调、调多少、谁受益、花多少钱、什么时候上,信息密度极低,K 不成立。我会先打个折,把它放在 featured 底线,等后续有参数再重新评估。

2月12日星期四

OpenAI News

OpenAI 发布 GPT-5.3-Codex-Spark,一个跑在专用芯片上、主打实时交互的写代码模型

OpenAI 放出了一个研究预览版模型 GPT-5.3-Codex-Spark,专门为在 Codex 里实时写代码设计。它是个 GPT-5.3-Codex 的缩小版,跑在 Cerebras 的晶圆级芯片上,推理速度超过每秒 1000 个 token,体感上几乎没有延迟。目前只开放给 ChatGPT Pro 用户,上下文窗口 128k,纯文本输入。模型默...

推荐理由:OpenAI 这条更新只给了一个标题,确认型号叫 GPT-5.3-Codex-Spark,正文没有任何实质内容。名字里带 Codex 和 Spark,大概率是代码相关的新模型,但没披露参数、定价、上下文窗口、跑分,也没说是不是只做代码。我会先打个折:名字有话题性,能吸引开发者注意,所以重要度给到 72、放在 featured 没问题;但信息缺口太大,没法判断实际能力,这点先别太激动。

2月9日星期一

36 氪 · 直链

小红书把搜索框改成了语音问答,想让你用说话代替打字来搜生活经验

小红书在1月27日全量上线了“语音问一问”,用户在搜索页长按就能用语音提问,最长能说三分钟,也支持外语和方言。它给出的答案不是通用百科,而是把站内用户分享的真人经验总结成结构化回复,比如剪头发怎么跟理发师沟通这种非标问题。正文没披露背后的语音识别和模型技术方案,也没提延迟和准确率数据。这次改动的核心是把搜索从三四个字的关键词匹配,拉长到口语化的长句提问...

推荐理由:小红书把搜索框改成能长按语音提问,这事我会先打个折——正文没披露用的什么语音识别方案、模型延迟和准确率,所以实际体验稳不稳还不好说。但值得盯的是,它把原本短关键词搜索变成了长语音问题入口,等于在抢更细颗粒度的查询需求。对AI从业者来说,这是内容平台用语音+外挂资料库做搜索的落地样本,虽然技术细节缺位,但产品方向和上线节奏本身就有信号意义。

OpenAI News

OpenAI 开始在 ChatGPT 里测试广告,目前只在美国小范围跑,免费和 Go 用户会看到

OpenAI 发了一篇公告,确认正在美国测试 ChatGPT 广告,面向登录的成年免费和 Go 用户,Plus、Pro、企业版和教育版不涉及。广告不会影响 ChatGPT 的回答,聊天记录对广告主保密,只给汇总数据。正文没披露具体广告位、流量占比、定价和测试时长。更新提到早期数据没伤到用户信任,广告关闭率低,接下来会扩展到加拿大、澳大利亚和新西兰。我会...

推荐理由:这条消息来自官方,分量够上 featured。我会先打个折:正文是空的,所有细节都靠标题撑着,所以别急着下结论。钩子很直给——ChatGPT 要放广告,从业者一眼就知道这关系到流量入口的商业化。风险点也实在,广告怎么插、插在哪,会直接决定用户还信不信这个产品。信息缺口大,但话题本身值得盯。

36 氪 · 直链

千问的1000万杯奶茶:阿里大发赛博鸡蛋始末

2月6日,阿里千问App搞了一场“免单喝奶茶”活动,一天涌进超1000万笔订单,直接把系统挤崩了。上午10点到中午12点,点单页面卡死、转圈,甚至弹出提示说自己“没有实体的手脚,无法连接支付系统”。宕机是因为千问的算力没扛住——AI处理下单、比价、支付比普通电商秒杀更吃资源,而初始服务器容量只有预估峰值的1/3,也没做充分的压力测试和扩容预案。线下门店...

推荐理由:我会先打个折:这本质是阿里的一场促销压力测试,不是模型突破。但1000万杯奶茶把服务器打崩的现场感很强,数字也够具体——10点到12点宕机、12点前200万单、算力只备了1/3,这些事实让文章有信息增量。对从业者来说,值得看的是阿里怎么用补贴把AI推到消费场景里,以及基础设施在真实并发下的表现,比单纯刷榜更有烟火气。

1月30日星期五

彭博科技

苹果收购以色列 AI 初创公司 Q.ai,技术能读懂面部动作和无声交流

苹果买下了一家叫 Q.ai 的以色列公司,他们做的技术是通过分析面部肌肉的细微动作来理解人在说什么——哪怕不出声。收购价格、团队规模和具体会用在苹果哪款产品上,正文都没披露。我会先打个折:目前能看到的只是彭博社的摘要片段,原文被付费墙挡了,所以细节有限。从已知信息推测,这项能力最可能被塞进辅助功能(比如帮语言障碍者沟通)、AirPods 的交互,或者 ...

推荐理由:Bloomberg 的信源给了这条消息 featured 的底气:苹果买无声交流视觉技术,话题性和关联度都够。但正文没给交易金额、团队规模和集成路线图,所以知识密度偏弱。我会先打个折,等后续有产品落地细节再往上调。

1月29日星期四

阮一峰的网络日志

Kimi 把模型和智能体绑在一起发,Manus 则靠别人的模型做上层应用

Kimi 这次发布的重点不是 K2.5 模型本身,而是它同时推出了一个基于该模型的智能体应用,直接在官网上线了。这跟 Manus 的做法正好相反:Manus 用的是 Anthropic 的 Claude 模型,自己只做上层的智能体产品,属于分层开发。Kimi 走一体化路线,把底层模型和上层应用打包发布。文章实测了 K2.5 智能体的“视觉编程”功能,上...

推荐理由:这篇值得看,因为它讲的是产品形态的转向,而不只是模型跑分。Kimi 这次把 K2.5 模型和 Agent 模式一起塞进官网切换入口,等于告诉用户“你不用管底下是什么,直接用就行”。1500 步操作和 100 个 Agent 并发的数字,说明他们在长任务和并发上做了工程投入;视觉编程那条路,是从设计稿或录屏直接出页面,想法挺直接。但我会先打个折:正文没写价格、上下文长度和 API 条件,这些才是工程落地的硬指标。另外消息源本身是评论性质,不是一手技术报告,所以判断要留余地。整体来说,它把“一体化还是分层”这个老问题又拉回台面上,对做 Agent 产品...

OpenAI News

OpenAI 宣布将在 ChatGPT 里停用 GPT-4o 等四款旧模型

OpenAI 计划在 2026 年 2 月 13 日从 ChatGPT 里撤掉 GPT-4o、GPT-4.1、GPT-4.1 mini 和 o4-mini 这四款模型。API 暂时不受影响。这次下线的核心原因是绝大部分用户已经切到了 GPT-5.2,每天还在用 GPT-4o 的人只剩 0.1%。文章提到,之前因为部分付费用户反馈需要更多时间迁移创意类工...

推荐理由:官方帖子确认了四个模型会在 ChatGPT 里退役,这对依赖固定模型版本的用户是实打实的工作流风险,所以 H 和 R 都成立。但 K 不成立,因为下线时间、替代方案、API 范围、迁移指引全都没披露,目前只有名字,没法做判断。我会先打个折:标题够抓人,但信息密度很低,真正该盯的是兼容性断点,不是“退役”这两个字。

1月28日星期三

Mistral AI

Mistral 发布终端编码智能体 Mistral Vibe 2.0

Mistral 发布终端编码智能体 Mistral Vibe 2.0,由 Devstral 2 模型系列驱动,新增自定义子智能体、多选项澄清、斜杠命令技能、统一智能体模式和自动更新。

推荐理由:原文列出 Vibe 2.0 的自定义子智能体、斜杠命令技能等具体能力与订阅入口,可据此判断终端编码智能体的工作流变化。

1月27日星期二

MIT Technology Review · AI

OpenAI 成立科学团队,想让 GPT-5 帮科学家干活

OpenAI 在 2025 年 10 月成立了新团队“OpenAI for Science”,由产品出身、读过粒子物理博士的 Kevin Weil 带队。团队目标是测试 GPT-5 这类模型能不能当科学家的助手,比如帮忙想点子、找研究方向和翻出几十年前冷门期刊里的老论文。Weil 说 GPT-5.2 在 GPQA 这个博士级理化生选择题测试上拿了 92...

推荐理由:这篇不是产品发布,而是战略分析,但信息量够硬。我会先打个折:GPQA 92% 看着漂亮,正文没披露测试条件和题型分布,别直接当科学推理能力暴涨。真正有意思的是 OpenAI 自己承认删过一条夸大解读的帖子,说明内部也在踩刹车。对做 AI 应用的同行来说,这比单纯秀分数更有参考价值——模型进实验室之前,先得管住嘴。

1月23日星期五

MIT Technology Review · AI

ChatGPT Health 上线了,它比“谷歌医生”靠谱多少?

OpenAI 本月推出了 ChatGPT Health,不是新模型,更像一个加了健康指导和外挂工具(比如可选的病历、健身数据)的包装壳。OpenAI 说每周有 2.3 亿人用 ChatGPT 问健康问题。但真正的考验是评估:有研究让 GPT-4o 在看不到选项的情况下答医学执照题,专家打分只有大约一半的回答完全正确;另一项用更贴近真人提问方式的研究里,...

推荐理由:H、K、R 三条都站得住:标题的替代叙事比普通产品发布更有钩子,正文给了具体使用量和两项评估结果,医疗场景天然高风险。分数留在 79 不变,因为这是 OpenAI 在现有模型上加的一层产品包装,不是新模型发布,而且落地细节、监管和法律责任正文都没展开,我会先打个折。

1月12日星期一

36 氪 · 直链

何小鹏放话:未来顶尖 AI 公司都得自己造芯片,小鹏四款新车全换自研图灵芯片

何小鹏在 2026 年 1 月 8 日的新车发布会上说,未来最好的 AI 公司都会选择自己定制芯片,这决定了 AI 产品的性能上限。小鹏当天发布的四款新车全部用上了自研的图灵 AI 芯片,其中 Ultra SE 和 Ultra 版本还搭载了第二代 VLA 模型(视觉-语言-动作模型,让车能像人一样理解路况并做出驾驶决策),号称能实现初阶 L4 级辅助驾...

推荐理由:这篇不是空喊口号,而是用4款车、三档芯片配置和欧洲路测把路线图摊开了。我会先打个折:这还只是规划披露,不是已量产交付的事实,所以放在featured里偏保守的那一端。真正值得盯的是“自研芯片+自研模型+自建部署”这条链条,它把性能天花板从供应商手里拿回来了,对行业比单一产品发布更有长期影响。

1月6日星期二

NVIDIA 博客

NVIDIA 用 RTX 显卡在本地跑 4K AI 视频生成,显存占用降了 60%

NVIDIA 在 CES 上放出了一套本地 AI 视频生成方案,核心是开源模型 LTX-2 和升级版 ComfyUI。在 GeForce RTX 显卡上,生成速度比之前快 3 倍,显存占用最多能降 60%。这主要靠 PyTorch-CUDA 的底层优化,以及 ComfyUI 原生支持了 NVFP4/FP8 低精度计算。下个月还会推一个 RTX Vide...

推荐理由:我会先打个折:这是厂商博客发的生态优化更新,不是新模型发布或平台级变动,所以重要性停在 76 不动。但 HKR 三项都站得住——提速降显存的数据够具体,技术路径也交代清楚了,对玩本地 ComfyUI 的人来说是实打实的好消息。正文没提 LTX-2 模型本身的画质对比,这点先别太激动,等实测。

NVIDIA 博客

NVIDIA 在 CES 2026 说 Rubin 平台已量产,跑大模型的成本能降到上一代的十分之一

NVIDIA 在 CES 2026 上宣布,由六颗芯片组成的 Rubin AI 平台已经进入全面量产。最直接的好处是生成 token 的成本能压到上一代平台的十分之一左右。Rubin 的 GPU 在 NVFP4 精度下推理算力达到 50 petaflops,并且通过一个叫 KV-cache 的存储层把性能又提升了 5 倍。另外,他们还发布了一套叫 Al...

推荐理由:HKR-H 成立,因为 Rubin 进入量产状态本身就是信号,不是路线图更新。HKR-K 靠 50 PFLOPS、5 倍吞吐和约 1/10 成本这几组数字撑起来,比口号实在。HKR-R 成立,因为推理经济学和 NVIDIA 的节奏仍然牵动整个行业,不过公司博客的包装感让它到不了 90 分。

NVIDIA 博客

英伟达预告基于 Rubin 架构的 DGX SuperPOD,单柜 260TB/s 带宽,推理成本号称能降 10 倍

英伟达在博客里公布了下一代 DGX SuperPOD 的规划,核心是换装 Rubin GPU。今年下半年会先出两款机型:DGX Vera Rubin NVL72 和 DGX Rubin NVL8。一个 SuperPOD 可以把 8 台 NVL72 拼在一起,总共塞进 576 颗 Rubin GPU,FP4 算力 28.8 exaflops,总显存 60...

推荐理由:这是一份有硬数字的NVIDIA基础设施路线图:576颗Rubin GPU、28.8 exaflops FP4、600TB内存、260TB/s NVLink,以及推理token成本最多降10倍。HKR三项都站得住,但本质上还是厂商路线图预告,不是已发货的产品或大规模公开发布,所以我会先打个折,重要性给到81。

NVIDIA 博客

NVIDIA 把跑千亿参数大模型的机器塞进了桌面

NVIDIA 在 CES 上展示了两台桌面设备 DGX Spark 和 DGX Station,能在本地跑 1000 亿到 1 万亿参数的开源模型。DGX Station 有 775GB 的统一内存,可以把模型压缩到 NVFP4 格式,压缩率最高 70%,跑 llama.cpp 时推理速度平均提升 35%。现场还演示了每秒处理 25 万个 token ...

推荐理由:HKR 三项都站得住:桌面跑大模型的 hook 够强,性能数字和演示数据把事实撑住了,而且整件事指向本地开发闭环能不能替代部分云端迭代这个真问题。不过说到底这是英伟达的产品发布,性能证据都来自厂商自己的演示,我会先打个折,所以重要性停在 75 分。

NVIDIA 博客

NVIDIA 的 DRIVE AV 软件将首发搭载于新款奔驰 CLA

新款奔驰 CLA 会成为美国市场第一辆用上 NVIDIA DRIVE AV 的量产车,今年底交付。这套系统是双架构设计:核心驾驶决策靠一个端到端 AI 模型,同时外面包了一层基于 Halos 的传统安全校验模块,用来兜底。功能上支持点到点辅助驾驶、城市道路导航、主动避撞和自动泊车,后续还能 OTA 升级。不过,博客里没提这套系统要加多少钱、用了哪些传感...

推荐理由:我会先打个折:正文没披露传感器配置、具体价格和 ODD,所以没法判断这套系统到底多能打。但亮点在于量产时间给了,双栈设计把端到端驾驶和传统安全冗余绑在一起,不是纯 demo。对从业者来说,这是看端到端方案能不能过车规安全关的一个真实样本,所以放在 featured 低位。

2025年12月18日星期四

OpenAI News

OpenAI 发了 GPT-5.2-Codex,但正文是空的

标题只确认了模型名叫 GPT-5.2-Codex,版本号 5.2。正文没披露任何细节——不知道价格、上下文长度、是否开放 API,也不清楚它跟旧版 Codex 是什么关系。等官方补全文档再判断。

推荐理由:这条消息就一个标题,正文是空的,所以我会先打个折——能确认的只有 OpenAI 发了个叫 GPT-5.2-Codex 的东西,版本号 5.2。没写定价、没写上下文长度、没写是取代旧 Codex 还是并行跑,也没写谁现在能用。真正该盯的是后续正文和 API 文档什么时候补上。但光这个名字就够让做代码 agent 和开发工具的人盯一眼,因为 OpenAI 在编程模型上再推新版,直接影响工具链选型和成本预期。

2025年12月16日星期二

OpenAI News

OpenAI 发了新版 ChatGPT 图片生成,说是更快、编辑更听话

OpenAI 在 12 月 16 日上线了新版 ChatGPT 图片功能,底层换了一个新的主力生图模型,API 里叫 GPT Image 1.5。官方说生成速度比之前快 4 倍,编辑图片时能更精准地只改你要求的部分,保留原图的光线、构图和人脸一致性。这次还加了一个独立的图片创作入口,内置了一些预设风格,不用写提示词也能玩。正文没披露具体画质指标、免费用...

推荐理由:OpenAI 官方发了个上线帖,所以 H 和 R 都成立:新图片功能是真实的产品事件,从业者肯定会讨论。K 不成立是因为正文没披露任何关键参数,连一张效果图都没有,信息量撑不起深度解读,所以保持在 featured 门槛附近。

2025年12月11日星期四

OpenAI News

OpenAI 发布 GPT-5.2,在专业任务和长时间跑流程的智能体上又往前迈了一步

OpenAI 推出了 GPT-5.2,主要卖点是处理专业工作(做表格、写代码、读图、理解长文档)和让模型在业务流程里干活的能力更强了。在衡量 44 种职业任务的 GDPval 测试里,GPT-5.2 Thinking 版在 70.9% 的对比中赢了或打平了行业专家,而且生成速度是专家的 11 倍以上,成本不到 1%。代码方面,SWE-Bench Pro...

推荐理由:官方来源加上旗舰模型更新,H 和 R 都拉满,进 featured 没问题。但 K 完全挂掉——正文空荡荡,所有关键参数都欠奉,所以分数没给到顶。真正该盯的是后续的 API 文档和定价页,现在只能先打个折。

2025年11月13日星期四

OpenAI News

OpenAI 发布 GPT-5.1,主打动态思考:简单问题少费 token,复杂问题多花时间

OpenAI 在 API 平台上线了 GPT-5.1,这是 GPT-5 系列的新模型,核心卖点是“自适应推理”——它会根据任务难度自己决定思考多久。简单问题(比如问个 npm 命令)2 秒就能出答案,比 GPT-5 快了 5 倍,消耗的 token 也少得多;遇到复杂任务则会持续推敲,在 SWE-bench Verified 编程基准上跑到了 76.3...

推荐理由:这条靠的是 OpenAI 官方身份和开发者群体的关注度撑起来的:新模型发布意味着马上要面对要不要切、花多少钱、能力差多少的问题。但正文什么都没给,参数、价格、上下文长度、API 变化一概欠奉,所以知识密度直接打折扣。我会先打个折——这条值得推,但别指望从摘要里挖出干货,真正该盯的是后续技术细节。

2025年11月12日星期三

OpenAI News

OpenAI 发了 GPT-5.1,说更聪明也更会聊天了,但没给具体数据

OpenAI 在 11 月 12 号发了篇公告,宣布把 ChatGPT 里的模型升级到 GPT-5.1,分两个版本:Instant 和 Thinking。Instant 是大家最常用的那个,这次改得更暖、更口语化,还加了自适应推理,遇到难题会自己先想一下再回答,数学和编程题的表现有提升。Thinking 版是专门做复杂推理的,现在思考时间更灵活,简单问...

推荐理由:标题是真的,但信息量约等于零。OpenAI 说 GPT-5.1 更聪明、更会聊天,可正文没披露任何硬指标,连是不是全量推送都不知道。我会先打个折:这件事值得关注,但别把一句宣传语当成完整产品说明。

2025年10月24日星期五

Mistral AI

Mistral AI 发布 Mistral AI Studio 生产平台

Mistral AI 发布 Mistral AI Studio,一个面向企业团队的生产级 AI 平台,由 Observability、Agent Runtime 和 AI Registry 三大支柱组成。

推荐理由:原文给出企业级 AI 生产化的三大支柱与私有 beta 入口,可据此判断其与现有 MLOps 工具的差异。

2025年10月23日星期四

OpenAI News

OpenAI 收购了 Mac 端 AI 助手 Sky 的开发商

OpenAI 宣布买下 Software Applications Incorporated,这家公司做了个叫 Sky 的 Mac 应用,能读懂屏幕内容、直接操作其他 App 帮你干活。收购后整个团队会并入 OpenAI,Sky 的深度系统集成能力将被整合进 ChatGPT,让 ChatGPT 不再只是回消息,而是能跨应用执行任务。公告没透露收购金额和...

推荐理由:这条消息是 OpenAI 官方披露的并购动作,所以 H 和 R 都成立:收购会改变产品栈策略和竞争格局。K 偏弱,因为页面只给了标的和 Sky 的关联,价格、交割时间、产品细节都缺,所以放在 featured 而不是 breaking。正文没披露收购金额、交割时间、Sky 的产品形态,别被“收购”二字带跑,真正该盯的是整合方向与团队去向。

2025年10月22日星期三

OpenAI News

ChatGPT 将在 2026 年 1 月 15 日后退出 WhatsApp

OpenAI 说因为 WhatsApp 改了政策和条款,ChatGPT 在 WhatsApp 上的服务到 2026 年 1 月 15 日就停了。之前有超过 5000 万人在 WhatsApp 上用过 ChatGPT。想保留聊天记录的话,得在截止日期前把 WhatsApp 账号和 ChatGPT 账号绑在一起,不然聊天记录不会自动迁移,而且 WhatsA...

推荐理由:这不是普通的功能更新,而是 OpenAI 官方通知要关掉一个 5000 万用户的 WhatsApp 渠道。钩子在于“ChatGPT 离开 WhatsApp”这个动作本身不常见;知识点是截止时间和政策变更原因;风险点直接落在平台依赖和数据迁移上——用户如果不主动链接账户,聊天记录就没了,而且 WhatsApp 不给导出,这点对实际使用者影响挺实在。

2025年10月21日星期二

Hugging Face 博客

Hugging Face 的 AI Sheets 现在能直接处理图片了

AI Sheets 是一个开源表格工具,之前只能处理文字,现在加入了视觉能力。你可以把图片(比如收据、文档、产品图)直接拖进表格,用自然语言让模型帮你提取里面的信息、生成描述、甚至编辑图片。它背后调用的是 Inference Providers 上的几千个开源模型。你在表格里手动改错、点“赞”的操作,会被当成少样本示例来优化后续结果。处理完的数据可以导...

推荐理由:Hugging Face 给 AI Sheets 加了视觉能力,现在你可以在表格里直接分析图片、抽信息、生成和编辑图像。我会先打个折:正文没披露延迟和并发限制,实际用起来可能没那么丝滑。真正该盯的是它把视觉任务放进同一个数据清洗流,而且人工修正能自动变成 few-shot 数据,这点挺省钱。不过别太激动,这还是个工具层面的改进,没到改写规则的程度。