跳到正文

产品更新

AI 产品与应用的功能上新、改版与商业化动态——谁家的产品变强了、变贵了、能用了。

842 条精选相关主题模型发布行业动态AI 编码

最新精选

第 741–760 条 · 共 842 条

2月13日星期五

OpenAI News

OpenAI 给 Codex 和 Sora 换了一套“先用额度,超了再扣钱”的访问系统

OpenAI 发了一篇工程博文,解释他们怎么解决 Codex 和 Sora 用户老撞速率限制的问题。核心做法是自研了一套实时访问引擎,把速率限制和预购点数揉在一起:请求先走免费速率额度,额度用完了自动从点数余额里扣,用户不用切换系统。文章说这套“决策瀑布”模型能在一个请求里同步完成判断,点数扣减异步处理,并且有三套独立数据(产品用量、计费事件、余额变动...

推荐理由:这是 OpenAI 官方的产品更新,标题抛出了“超越速率限制”这个钩子,对开发者来说很抓眼球,所以 H 和 R 都成立。但正文完全没披露具体怎么调、调多少、谁受益、花多少钱、什么时候上,信息密度极低,K 不成立。我会先打个折,把它放在 featured 底线,等后续有参数再重新评估。

2月12日星期四

OpenAI News

OpenAI 发布 GPT-5.3-Codex-Spark,一个跑在专用芯片上、主打实时交互的写代码模型

OpenAI 放出了一个研究预览版模型 GPT-5.3-Codex-Spark,专门为在 Codex 里实时写代码设计。它是个 GPT-5.3-Codex 的缩小版,跑在 Cerebras 的晶圆级芯片上,推理速度超过每秒 1000 个 token,体感上几乎没有延迟。目前只开放给 ChatGPT Pro 用户,上下文窗口 128k,纯文本输入。模型默...

推荐理由:OpenAI 这条更新只给了一个标题,确认型号叫 GPT-5.3-Codex-Spark,正文没有任何实质内容。名字里带 Codex 和 Spark,大概率是代码相关的新模型,但没披露参数、定价、上下文窗口、跑分,也没说是不是只做代码。我会先打个折:名字有话题性,能吸引开发者注意,所以重要度给到 72、放在 featured 没问题;但信息缺口太大,没法判断实际能力,这点先别太激动。

2月9日星期一

36 氪 · 直链

小红书把搜索框改成了语音问答,想让你用说话代替打字来搜生活经验

小红书在1月27日全量上线了“语音问一问”,用户在搜索页长按就能用语音提问,最长能说三分钟,也支持外语和方言。它给出的答案不是通用百科,而是把站内用户分享的真人经验总结成结构化回复,比如剪头发怎么跟理发师沟通这种非标问题。正文没披露背后的语音识别和模型技术方案,也没提延迟和准确率数据。这次改动的核心是把搜索从三四个字的关键词匹配,拉长到口语化的长句提问...

推荐理由:小红书把搜索框改成能长按语音提问,这事我会先打个折——正文没披露用的什么语音识别方案、模型延迟和准确率,所以实际体验稳不稳还不好说。但值得盯的是,它把原本短关键词搜索变成了长语音问题入口,等于在抢更细颗粒度的查询需求。对AI从业者来说,这是内容平台用语音+外挂资料库做搜索的落地样本,虽然技术细节缺位,但产品方向和上线节奏本身就有信号意义。

OpenAI News

OpenAI 开始在 ChatGPT 里测试广告,目前只在美国小范围跑,免费和 Go 用户会看到

OpenAI 发了一篇公告,确认正在美国测试 ChatGPT 广告,面向登录的成年免费和 Go 用户,Plus、Pro、企业版和教育版不涉及。广告不会影响 ChatGPT 的回答,聊天记录对广告主保密,只给汇总数据。正文没披露具体广告位、流量占比、定价和测试时长。更新提到早期数据没伤到用户信任,广告关闭率低,接下来会扩展到加拿大、澳大利亚和新西兰。我会...

推荐理由:这条消息来自官方,分量够上 featured。我会先打个折:正文是空的,所有细节都靠标题撑着,所以别急着下结论。钩子很直给——ChatGPT 要放广告,从业者一眼就知道这关系到流量入口的商业化。风险点也实在,广告怎么插、插在哪,会直接决定用户还信不信这个产品。信息缺口大,但话题本身值得盯。

36 氪 · 直链

千问的1000万杯奶茶:阿里大发赛博鸡蛋始末

2月6日,阿里千问App搞了一场“免单喝奶茶”活动,一天涌进超1000万笔订单,直接把系统挤崩了。上午10点到中午12点,点单页面卡死、转圈,甚至弹出提示说自己“没有实体的手脚,无法连接支付系统”。宕机是因为千问的算力没扛住——AI处理下单、比价、支付比普通电商秒杀更吃资源,而初始服务器容量只有预估峰值的1/3,也没做充分的压力测试和扩容预案。线下门店...

推荐理由:我会先打个折:这本质是阿里的一场促销压力测试,不是模型突破。但1000万杯奶茶把服务器打崩的现场感很强,数字也够具体——10点到12点宕机、12点前200万单、算力只备了1/3,这些事实让文章有信息增量。对从业者来说,值得看的是阿里怎么用补贴把AI推到消费场景里,以及基础设施在真实并发下的表现,比单纯刷榜更有烟火气。

1月30日星期五

彭博科技

苹果收购以色列 AI 初创公司 Q.ai,技术能读懂面部动作和无声交流

苹果买下了一家叫 Q.ai 的以色列公司,他们做的技术是通过分析面部肌肉的细微动作来理解人在说什么——哪怕不出声。收购价格、团队规模和具体会用在苹果哪款产品上,正文都没披露。我会先打个折:目前能看到的只是彭博社的摘要片段,原文被付费墙挡了,所以细节有限。从已知信息推测,这项能力最可能被塞进辅助功能(比如帮语言障碍者沟通)、AirPods 的交互,或者 ...

推荐理由:Bloomberg 的信源给了这条消息 featured 的底气:苹果买无声交流视觉技术,话题性和关联度都够。但正文没给交易金额、团队规模和集成路线图,所以知识密度偏弱。我会先打个折,等后续有产品落地细节再往上调。

1月29日星期四

阮一峰的网络日志

Kimi 把模型和智能体绑在一起发,Manus 则靠别人的模型做上层应用

Kimi 这次发布的重点不是 K2.5 模型本身,而是它同时推出了一个基于该模型的智能体应用,直接在官网上线了。这跟 Manus 的做法正好相反:Manus 用的是 Anthropic 的 Claude 模型,自己只做上层的智能体产品,属于分层开发。Kimi 走一体化路线,把底层模型和上层应用打包发布。文章实测了 K2.5 智能体的“视觉编程”功能,上...

推荐理由:这篇值得看,因为它讲的是产品形态的转向,而不只是模型跑分。Kimi 这次把 K2.5 模型和 Agent 模式一起塞进官网切换入口,等于告诉用户“你不用管底下是什么,直接用就行”。1500 步操作和 100 个 Agent 并发的数字,说明他们在长任务和并发上做了工程投入;视觉编程那条路,是从设计稿或录屏直接出页面,想法挺直接。但我会先打个折:正文没写价格、上下文长度和 API 条件,这些才是工程落地的硬指标。另外消息源本身是评论性质,不是一手技术报告,所以判断要留余地。整体来说,它把“一体化还是分层”这个老问题又拉回台面上,对做 Agent 产品...

OpenAI News

OpenAI 宣布将在 ChatGPT 里停用 GPT-4o 等四款旧模型

OpenAI 计划在 2026 年 2 月 13 日从 ChatGPT 里撤掉 GPT-4o、GPT-4.1、GPT-4.1 mini 和 o4-mini 这四款模型。API 暂时不受影响。这次下线的核心原因是绝大部分用户已经切到了 GPT-5.2,每天还在用 GPT-4o 的人只剩 0.1%。文章提到,之前因为部分付费用户反馈需要更多时间迁移创意类工...

推荐理由:官方帖子确认了四个模型会在 ChatGPT 里退役,这对依赖固定模型版本的用户是实打实的工作流风险,所以 H 和 R 都成立。但 K 不成立,因为下线时间、替代方案、API 范围、迁移指引全都没披露,目前只有名字,没法做判断。我会先打个折:标题够抓人,但信息密度很低,真正该盯的是兼容性断点,不是“退役”这两个字。

1月28日星期三

Mistral AI

Mistral 发布终端编码智能体 Mistral Vibe 2.0

Mistral 发布终端编码智能体 Mistral Vibe 2.0,由 Devstral 2 模型系列驱动,新增自定义子智能体、多选项澄清、斜杠命令技能、统一智能体模式和自动更新。

推荐理由:原文列出 Vibe 2.0 的自定义子智能体、斜杠命令技能等具体能力与订阅入口,可据此判断终端编码智能体的工作流变化。

1月27日星期二

MIT Technology Review · AI

OpenAI 成立科学团队,想让 GPT-5 帮科学家干活

OpenAI 在 2025 年 10 月成立了新团队“OpenAI for Science”,由产品出身、读过粒子物理博士的 Kevin Weil 带队。团队目标是测试 GPT-5 这类模型能不能当科学家的助手,比如帮忙想点子、找研究方向和翻出几十年前冷门期刊里的老论文。Weil 说 GPT-5.2 在 GPQA 这个博士级理化生选择题测试上拿了 92...

推荐理由:这篇不是产品发布,而是战略分析,但信息量够硬。我会先打个折:GPQA 92% 看着漂亮,正文没披露测试条件和题型分布,别直接当科学推理能力暴涨。真正有意思的是 OpenAI 自己承认删过一条夸大解读的帖子,说明内部也在踩刹车。对做 AI 应用的同行来说,这比单纯秀分数更有参考价值——模型进实验室之前,先得管住嘴。

1月23日星期五

MIT Technology Review · AI

ChatGPT Health 上线了,它比“谷歌医生”靠谱多少?

OpenAI 本月推出了 ChatGPT Health,不是新模型,更像一个加了健康指导和外挂工具(比如可选的病历、健身数据)的包装壳。OpenAI 说每周有 2.3 亿人用 ChatGPT 问健康问题。但真正的考验是评估:有研究让 GPT-4o 在看不到选项的情况下答医学执照题,专家打分只有大约一半的回答完全正确;另一项用更贴近真人提问方式的研究里,...

推荐理由:H、K、R 三条都站得住:标题的替代叙事比普通产品发布更有钩子,正文给了具体使用量和两项评估结果,医疗场景天然高风险。分数留在 79 不变,因为这是 OpenAI 在现有模型上加的一层产品包装,不是新模型发布,而且落地细节、监管和法律责任正文都没展开,我会先打个折。

1月12日星期一

36 氪 · 直链

何小鹏放话:未来顶尖 AI 公司都得自己造芯片,小鹏四款新车全换自研图灵芯片

何小鹏在 2026 年 1 月 8 日的新车发布会上说,未来最好的 AI 公司都会选择自己定制芯片,这决定了 AI 产品的性能上限。小鹏当天发布的四款新车全部用上了自研的图灵 AI 芯片,其中 Ultra SE 和 Ultra 版本还搭载了第二代 VLA 模型(视觉-语言-动作模型,让车能像人一样理解路况并做出驾驶决策),号称能实现初阶 L4 级辅助驾...

推荐理由:这篇不是空喊口号,而是用4款车、三档芯片配置和欧洲路测把路线图摊开了。我会先打个折:这还只是规划披露,不是已量产交付的事实,所以放在featured里偏保守的那一端。真正值得盯的是“自研芯片+自研模型+自建部署”这条链条,它把性能天花板从供应商手里拿回来了,对行业比单一产品发布更有长期影响。

1月6日星期二

NVIDIA 博客

NVIDIA 用 RTX 显卡在本地跑 4K AI 视频生成,显存占用降了 60%

NVIDIA 在 CES 上放出了一套本地 AI 视频生成方案,核心是开源模型 LTX-2 和升级版 ComfyUI。在 GeForce RTX 显卡上,生成速度比之前快 3 倍,显存占用最多能降 60%。这主要靠 PyTorch-CUDA 的底层优化,以及 ComfyUI 原生支持了 NVFP4/FP8 低精度计算。下个月还会推一个 RTX Vide...

推荐理由:我会先打个折:这是厂商博客发的生态优化更新,不是新模型发布或平台级变动,所以重要性停在 76 不动。但 HKR 三项都站得住——提速降显存的数据够具体,技术路径也交代清楚了,对玩本地 ComfyUI 的人来说是实打实的好消息。正文没提 LTX-2 模型本身的画质对比,这点先别太激动,等实测。

NVIDIA 博客

NVIDIA 在 CES 2026 说 Rubin 平台已量产,跑大模型的成本能降到上一代的十分之一

NVIDIA 在 CES 2026 上宣布,由六颗芯片组成的 Rubin AI 平台已经进入全面量产。最直接的好处是生成 token 的成本能压到上一代平台的十分之一左右。Rubin 的 GPU 在 NVFP4 精度下推理算力达到 50 petaflops,并且通过一个叫 KV-cache 的存储层把性能又提升了 5 倍。另外,他们还发布了一套叫 Al...

推荐理由:HKR-H 成立,因为 Rubin 进入量产状态本身就是信号,不是路线图更新。HKR-K 靠 50 PFLOPS、5 倍吞吐和约 1/10 成本这几组数字撑起来,比口号实在。HKR-R 成立,因为推理经济学和 NVIDIA 的节奏仍然牵动整个行业,不过公司博客的包装感让它到不了 90 分。

NVIDIA 博客

英伟达预告基于 Rubin 架构的 DGX SuperPOD,单柜 260TB/s 带宽,推理成本号称能降 10 倍

英伟达在博客里公布了下一代 DGX SuperPOD 的规划,核心是换装 Rubin GPU。今年下半年会先出两款机型:DGX Vera Rubin NVL72 和 DGX Rubin NVL8。一个 SuperPOD 可以把 8 台 NVL72 拼在一起,总共塞进 576 颗 Rubin GPU,FP4 算力 28.8 exaflops,总显存 60...

推荐理由:这是一份有硬数字的NVIDIA基础设施路线图:576颗Rubin GPU、28.8 exaflops FP4、600TB内存、260TB/s NVLink,以及推理token成本最多降10倍。HKR三项都站得住,但本质上还是厂商路线图预告,不是已发货的产品或大规模公开发布,所以我会先打个折,重要性给到81。

NVIDIA 博客

NVIDIA 把跑千亿参数大模型的机器塞进了桌面

NVIDIA 在 CES 上展示了两台桌面设备 DGX Spark 和 DGX Station,能在本地跑 1000 亿到 1 万亿参数的开源模型。DGX Station 有 775GB 的统一内存,可以把模型压缩到 NVFP4 格式,压缩率最高 70%,跑 llama.cpp 时推理速度平均提升 35%。现场还演示了每秒处理 25 万个 token ...

推荐理由:HKR 三项都站得住:桌面跑大模型的 hook 够强,性能数字和演示数据把事实撑住了,而且整件事指向本地开发闭环能不能替代部分云端迭代这个真问题。不过说到底这是英伟达的产品发布,性能证据都来自厂商自己的演示,我会先打个折,所以重要性停在 75 分。

NVIDIA 博客

NVIDIA 的 DRIVE AV 软件将首发搭载于新款奔驰 CLA

新款奔驰 CLA 会成为美国市场第一辆用上 NVIDIA DRIVE AV 的量产车,今年底交付。这套系统是双架构设计:核心驾驶决策靠一个端到端 AI 模型,同时外面包了一层基于 Halos 的传统安全校验模块,用来兜底。功能上支持点到点辅助驾驶、城市道路导航、主动避撞和自动泊车,后续还能 OTA 升级。不过,博客里没提这套系统要加多少钱、用了哪些传感...

推荐理由:我会先打个折:正文没披露传感器配置、具体价格和 ODD,所以没法判断这套系统到底多能打。但亮点在于量产时间给了,双栈设计把端到端驾驶和传统安全冗余绑在一起,不是纯 demo。对从业者来说,这是看端到端方案能不能过车规安全关的一个真实样本,所以放在 featured 低位。

2025年12月18日星期四

OpenAI News

OpenAI 发了 GPT-5.2-Codex,但正文是空的

标题只确认了模型名叫 GPT-5.2-Codex,版本号 5.2。正文没披露任何细节——不知道价格、上下文长度、是否开放 API,也不清楚它跟旧版 Codex 是什么关系。等官方补全文档再判断。

推荐理由:这条消息就一个标题,正文是空的,所以我会先打个折——能确认的只有 OpenAI 发了个叫 GPT-5.2-Codex 的东西,版本号 5.2。没写定价、没写上下文长度、没写是取代旧 Codex 还是并行跑,也没写谁现在能用。真正该盯的是后续正文和 API 文档什么时候补上。但光这个名字就够让做代码 agent 和开发工具的人盯一眼,因为 OpenAI 在编程模型上再推新版,直接影响工具链选型和成本预期。

2025年12月16日星期二

OpenAI News

OpenAI 发了新版 ChatGPT 图片生成,说是更快、编辑更听话

OpenAI 在 12 月 16 日上线了新版 ChatGPT 图片功能,底层换了一个新的主力生图模型,API 里叫 GPT Image 1.5。官方说生成速度比之前快 4 倍,编辑图片时能更精准地只改你要求的部分,保留原图的光线、构图和人脸一致性。这次还加了一个独立的图片创作入口,内置了一些预设风格,不用写提示词也能玩。正文没披露具体画质指标、免费用...

推荐理由:OpenAI 官方发了个上线帖,所以 H 和 R 都成立:新图片功能是真实的产品事件,从业者肯定会讨论。K 不成立是因为正文没披露任何关键参数,连一张效果图都没有,信息量撑不起深度解读,所以保持在 featured 门槛附近。

2025年12月11日星期四

OpenAI News

OpenAI 发布 GPT-5.2,在专业任务和长时间跑流程的智能体上又往前迈了一步

OpenAI 推出了 GPT-5.2,主要卖点是处理专业工作(做表格、写代码、读图、理解长文档)和让模型在业务流程里干活的能力更强了。在衡量 44 种职业任务的 GDPval 测试里,GPT-5.2 Thinking 版在 70.9% 的对比中赢了或打平了行业专家,而且生成速度是专家的 11 倍以上,成本不到 1%。代码方面,SWE-Bench Pro...

推荐理由:官方来源加上旗舰模型更新,H 和 R 都拉满,进 featured 没问题。但 K 完全挂掉——正文空荡荡,所有关键参数都欠奉,所以分数没给到顶。真正该盯的是后续的 API 文档和定价页,现在只能先打个折。