跳到正文

全部动态

今日 22 条

2月9日星期一

36 氪 · 直链

小红书把搜索框改成了语音问答,想让你用说话代替打字来搜生活经验

小红书在1月27日全量上线了“语音问一问”,用户在搜索页长按就能用语音提问,最长能说三分钟,也支持外语和方言。它给出的答案不是通用百科,而是把站内用户分享的真人经验总结成结构化回复,比如剪头发怎么跟理发师沟通这种非标问题。正文没披露背后的语音识别和模型技术方案,也没提延迟和准确率数据。这次改动的核心是把搜索从三四个字的关键词匹配,拉长到口语化的长句提问...

推荐理由:小红书把搜索框改成能长按语音提问,这事我会先打个折——正文没披露用的什么语音识别方案、模型延迟和准确率,所以实际体验稳不稳还不好说。但值得盯的是,它把原本短关键词搜索变成了长语音问题入口,等于在抢更细颗粒度的查询需求。对AI从业者来说,这是内容平台用语音+外挂资料库做搜索的落地样本,虽然技术细节缺位,但产品方向和上线节奏本身就有信号意义。

OpenAI News

OpenAI 开始在 ChatGPT 里测试广告,目前只在美国小范围跑,免费和 Go 用户会看到

OpenAI 发了一篇公告,确认正在美国测试 ChatGPT 广告,面向登录的成年免费和 Go 用户,Plus、Pro、企业版和教育版不涉及。广告不会影响 ChatGPT 的回答,聊天记录对广告主保密,只给汇总数据。正文没披露具体广告位、流量占比、定价和测试时长。更新提到早期数据没伤到用户信任,广告关闭率低,接下来会扩展到加拿大、澳大利亚和新西兰。我会...

推荐理由:这条消息来自官方,分量够上 featured。我会先打个折:正文是空的,所有细节都靠标题撑着,所以别急着下结论。钩子很直给——ChatGPT 要放广告,从业者一眼就知道这关系到流量入口的商业化。风险点也实在,广告怎么插、插在哪,会直接决定用户还信不信这个产品。信息缺口大,但话题本身值得盯。

36 氪 · 直链

千问的1000万杯奶茶:阿里大发赛博鸡蛋始末

2月6日,阿里千问App搞了一场“免单喝奶茶”活动,一天涌进超1000万笔订单,直接把系统挤崩了。上午10点到中午12点,点单页面卡死、转圈,甚至弹出提示说自己“没有实体的手脚,无法连接支付系统”。宕机是因为千问的算力没扛住——AI处理下单、比价、支付比普通电商秒杀更吃资源,而初始服务器容量只有预估峰值的1/3,也没做充分的压力测试和扩容预案。线下门店...

推荐理由:我会先打个折:这本质是阿里的一场促销压力测试,不是模型突破。但1000万杯奶茶把服务器打崩的现场感很强,数字也够具体——10点到12点宕机、12点前200万单、算力只备了1/3,这些事实让文章有信息增量。对从业者来说,值得看的是阿里怎么用补贴把AI推到消费场景里,以及基础设施在真实并发下的表现,比单纯刷榜更有烟火气。

1月30日星期五

彭博科技

苹果收购以色列 AI 初创公司 Q.ai,技术能读懂面部动作和无声交流

苹果买下了一家叫 Q.ai 的以色列公司,他们做的技术是通过分析面部肌肉的细微动作来理解人在说什么——哪怕不出声。收购价格、团队规模和具体会用在苹果哪款产品上,正文都没披露。我会先打个折:目前能看到的只是彭博社的摘要片段,原文被付费墙挡了,所以细节有限。从已知信息推测,这项能力最可能被塞进辅助功能(比如帮语言障碍者沟通)、AirPods 的交互,或者 ...

推荐理由:Bloomberg 的信源给了这条消息 featured 的底气:苹果买无声交流视觉技术,话题性和关联度都够。但正文没给交易金额、团队规模和集成路线图,所以知识密度偏弱。我会先打个折,等后续有产品落地细节再往上调。

1月29日星期四

阮一峰的网络日志

Kimi 把模型和智能体绑在一起发,Manus 则靠别人的模型做上层应用

Kimi 这次发布的重点不是 K2.5 模型本身,而是它同时推出了一个基于该模型的智能体应用,直接在官网上线了。这跟 Manus 的做法正好相反:Manus 用的是 Anthropic 的 Claude 模型,自己只做上层的智能体产品,属于分层开发。Kimi 走一体化路线,把底层模型和上层应用打包发布。文章实测了 K2.5 智能体的“视觉编程”功能,上...

推荐理由:这篇值得看,因为它讲的是产品形态的转向,而不只是模型跑分。Kimi 这次把 K2.5 模型和 Agent 模式一起塞进官网切换入口,等于告诉用户“你不用管底下是什么,直接用就行”。1500 步操作和 100 个 Agent 并发的数字,说明他们在长任务和并发上做了工程投入;视觉编程那条路,是从设计稿或录屏直接出页面,想法挺直接。但我会先打个折:正文没写价格、上下文长度和 API 条件,这些才是工程落地的硬指标。另外消息源本身是评论性质,不是一手技术报告,所以判断要留余地。整体来说,它把“一体化还是分层”这个老问题又拉回台面上,对做 Agent 产品...

OpenAI News

OpenAI 宣布将在 ChatGPT 里停用 GPT-4o 等四款旧模型

OpenAI 计划在 2026 年 2 月 13 日从 ChatGPT 里撤掉 GPT-4o、GPT-4.1、GPT-4.1 mini 和 o4-mini 这四款模型。API 暂时不受影响。这次下线的核心原因是绝大部分用户已经切到了 GPT-5.2,每天还在用 GPT-4o 的人只剩 0.1%。文章提到,之前因为部分付费用户反馈需要更多时间迁移创意类工...

推荐理由:官方帖子确认了四个模型会在 ChatGPT 里退役,这对依赖固定模型版本的用户是实打实的工作流风险,所以 H 和 R 都成立。但 K 不成立,因为下线时间、替代方案、API 范围、迁移指引全都没披露,目前只有名字,没法做判断。我会先打个折:标题够抓人,但信息密度很低,真正该盯的是兼容性断点,不是“退役”这两个字。

1月28日星期三

Mistral AI

Mistral 发布终端编码智能体 Mistral Vibe 2.0

Mistral 发布终端编码智能体 Mistral Vibe 2.0,由 Devstral 2 模型系列驱动,新增自定义子智能体、多选项澄清、斜杠命令技能、统一智能体模式和自动更新。

推荐理由:原文列出 Vibe 2.0 的自定义子智能体、斜杠命令技能等具体能力与订阅入口,可据此判断终端编码智能体的工作流变化。

1月27日星期二

MIT Technology Review · AI

OpenAI 成立科学团队,想让 GPT-5 帮科学家干活

OpenAI 在 2025 年 10 月成立了新团队“OpenAI for Science”,由产品出身、读过粒子物理博士的 Kevin Weil 带队。团队目标是测试 GPT-5 这类模型能不能当科学家的助手,比如帮忙想点子、找研究方向和翻出几十年前冷门期刊里的老论文。Weil 说 GPT-5.2 在 GPQA 这个博士级理化生选择题测试上拿了 92...

推荐理由:这篇不是产品发布,而是战略分析,但信息量够硬。我会先打个折:GPQA 92% 看着漂亮,正文没披露测试条件和题型分布,别直接当科学推理能力暴涨。真正有意思的是 OpenAI 自己承认删过一条夸大解读的帖子,说明内部也在踩刹车。对做 AI 应用的同行来说,这比单纯秀分数更有参考价值——模型进实验室之前,先得管住嘴。

1月23日星期五

MIT Technology Review · AI

ChatGPT Health 上线了,它比“谷歌医生”靠谱多少?

OpenAI 本月推出了 ChatGPT Health,不是新模型,更像一个加了健康指导和外挂工具(比如可选的病历、健身数据)的包装壳。OpenAI 说每周有 2.3 亿人用 ChatGPT 问健康问题。但真正的考验是评估:有研究让 GPT-4o 在看不到选项的情况下答医学执照题,专家打分只有大约一半的回答完全正确;另一项用更贴近真人提问方式的研究里,...

推荐理由:H、K、R 三条都站得住:标题的替代叙事比普通产品发布更有钩子,正文给了具体使用量和两项评估结果,医疗场景天然高风险。分数留在 79 不变,因为这是 OpenAI 在现有模型上加的一层产品包装,不是新模型发布,而且落地细节、监管和法律责任正文都没展开,我会先打个折。

1月12日星期一

36 氪 · 直链

何小鹏放话:未来顶尖 AI 公司都得自己造芯片,小鹏四款新车全换自研图灵芯片

何小鹏在 2026 年 1 月 8 日的新车发布会上说,未来最好的 AI 公司都会选择自己定制芯片,这决定了 AI 产品的性能上限。小鹏当天发布的四款新车全部用上了自研的图灵 AI 芯片,其中 Ultra SE 和 Ultra 版本还搭载了第二代 VLA 模型(视觉-语言-动作模型,让车能像人一样理解路况并做出驾驶决策),号称能实现初阶 L4 级辅助驾...

推荐理由:这篇不是空喊口号,而是用4款车、三档芯片配置和欧洲路测把路线图摊开了。我会先打个折:这还只是规划披露,不是已量产交付的事实,所以放在featured里偏保守的那一端。真正值得盯的是“自研芯片+自研模型+自建部署”这条链条,它把性能天花板从供应商手里拿回来了,对行业比单一产品发布更有长期影响。

1月6日星期二

NVIDIA 博客

NVIDIA 用 RTX 显卡在本地跑 4K AI 视频生成,显存占用降了 60%

NVIDIA 在 CES 上放出了一套本地 AI 视频生成方案,核心是开源模型 LTX-2 和升级版 ComfyUI。在 GeForce RTX 显卡上,生成速度比之前快 3 倍,显存占用最多能降 60%。这主要靠 PyTorch-CUDA 的底层优化,以及 ComfyUI 原生支持了 NVFP4/FP8 低精度计算。下个月还会推一个 RTX Vide...

推荐理由:我会先打个折:这是厂商博客发的生态优化更新,不是新模型发布或平台级变动,所以重要性停在 76 不动。但 HKR 三项都站得住——提速降显存的数据够具体,技术路径也交代清楚了,对玩本地 ComfyUI 的人来说是实打实的好消息。正文没提 LTX-2 模型本身的画质对比,这点先别太激动,等实测。

NVIDIA 博客

NVIDIA 在 CES 2026 说 Rubin 平台已量产,跑大模型的成本能降到上一代的十分之一

NVIDIA 在 CES 2026 上宣布,由六颗芯片组成的 Rubin AI 平台已经进入全面量产。最直接的好处是生成 token 的成本能压到上一代平台的十分之一左右。Rubin 的 GPU 在 NVFP4 精度下推理算力达到 50 petaflops,并且通过一个叫 KV-cache 的存储层把性能又提升了 5 倍。另外,他们还发布了一套叫 Al...

推荐理由:HKR-H 成立,因为 Rubin 进入量产状态本身就是信号,不是路线图更新。HKR-K 靠 50 PFLOPS、5 倍吞吐和约 1/10 成本这几组数字撑起来,比口号实在。HKR-R 成立,因为推理经济学和 NVIDIA 的节奏仍然牵动整个行业,不过公司博客的包装感让它到不了 90 分。

NVIDIA 博客

英伟达预告基于 Rubin 架构的 DGX SuperPOD,单柜 260TB/s 带宽,推理成本号称能降 10 倍

英伟达在博客里公布了下一代 DGX SuperPOD 的规划,核心是换装 Rubin GPU。今年下半年会先出两款机型:DGX Vera Rubin NVL72 和 DGX Rubin NVL8。一个 SuperPOD 可以把 8 台 NVL72 拼在一起,总共塞进 576 颗 Rubin GPU,FP4 算力 28.8 exaflops,总显存 60...

推荐理由:这是一份有硬数字的NVIDIA基础设施路线图:576颗Rubin GPU、28.8 exaflops FP4、600TB内存、260TB/s NVLink,以及推理token成本最多降10倍。HKR三项都站得住,但本质上还是厂商路线图预告,不是已发货的产品或大规模公开发布,所以我会先打个折,重要性给到81。

NVIDIA 博客

NVIDIA 把跑千亿参数大模型的机器塞进了桌面

NVIDIA 在 CES 上展示了两台桌面设备 DGX Spark 和 DGX Station,能在本地跑 1000 亿到 1 万亿参数的开源模型。DGX Station 有 775GB 的统一内存,可以把模型压缩到 NVFP4 格式,压缩率最高 70%,跑 llama.cpp 时推理速度平均提升 35%。现场还演示了每秒处理 25 万个 token ...

推荐理由:HKR 三项都站得住:桌面跑大模型的 hook 够强,性能数字和演示数据把事实撑住了,而且整件事指向本地开发闭环能不能替代部分云端迭代这个真问题。不过说到底这是英伟达的产品发布,性能证据都来自厂商自己的演示,我会先打个折,所以重要性停在 75 分。

NVIDIA 博客

NVIDIA 的 DRIVE AV 软件将首发搭载于新款奔驰 CLA

新款奔驰 CLA 会成为美国市场第一辆用上 NVIDIA DRIVE AV 的量产车,今年底交付。这套系统是双架构设计:核心驾驶决策靠一个端到端 AI 模型,同时外面包了一层基于 Halos 的传统安全校验模块,用来兜底。功能上支持点到点辅助驾驶、城市道路导航、主动避撞和自动泊车,后续还能 OTA 升级。不过,博客里没提这套系统要加多少钱、用了哪些传感...

推荐理由:我会先打个折:正文没披露传感器配置、具体价格和 ODD,所以没法判断这套系统到底多能打。但亮点在于量产时间给了,双栈设计把端到端驾驶和传统安全冗余绑在一起,不是纯 demo。对从业者来说,这是看端到端方案能不能过车规安全关的一个真实样本,所以放在 featured 低位。

2025年12月18日星期四

OpenAI News

OpenAI 发了 GPT-5.2-Codex,但正文是空的

标题只确认了模型名叫 GPT-5.2-Codex,版本号 5.2。正文没披露任何细节——不知道价格、上下文长度、是否开放 API,也不清楚它跟旧版 Codex 是什么关系。等官方补全文档再判断。

推荐理由:这条消息就一个标题,正文是空的,所以我会先打个折——能确认的只有 OpenAI 发了个叫 GPT-5.2-Codex 的东西,版本号 5.2。没写定价、没写上下文长度、没写是取代旧 Codex 还是并行跑,也没写谁现在能用。真正该盯的是后续正文和 API 文档什么时候补上。但光这个名字就够让做代码 agent 和开发工具的人盯一眼,因为 OpenAI 在编程模型上再推新版,直接影响工具链选型和成本预期。

2025年12月16日星期二

OpenAI News

OpenAI 发了新版 ChatGPT 图片生成,说是更快、编辑更听话

OpenAI 在 12 月 16 日上线了新版 ChatGPT 图片功能,底层换了一个新的主力生图模型,API 里叫 GPT Image 1.5。官方说生成速度比之前快 4 倍,编辑图片时能更精准地只改你要求的部分,保留原图的光线、构图和人脸一致性。这次还加了一个独立的图片创作入口,内置了一些预设风格,不用写提示词也能玩。正文没披露具体画质指标、免费用...

推荐理由:OpenAI 官方发了个上线帖,所以 H 和 R 都成立:新图片功能是真实的产品事件,从业者肯定会讨论。K 不成立是因为正文没披露任何关键参数,连一张效果图都没有,信息量撑不起深度解读,所以保持在 featured 门槛附近。

2025年12月11日星期四

OpenAI News

OpenAI 发布 GPT-5.2,在专业任务和长时间跑流程的智能体上又往前迈了一步

OpenAI 推出了 GPT-5.2,主要卖点是处理专业工作(做表格、写代码、读图、理解长文档)和让模型在业务流程里干活的能力更强了。在衡量 44 种职业任务的 GDPval 测试里,GPT-5.2 Thinking 版在 70.9% 的对比中赢了或打平了行业专家,而且生成速度是专家的 11 倍以上,成本不到 1%。代码方面,SWE-Bench Pro...

推荐理由:官方来源加上旗舰模型更新,H 和 R 都拉满,进 featured 没问题。但 K 完全挂掉——正文空荡荡,所有关键参数都欠奉,所以分数没给到顶。真正该盯的是后续的 API 文档和定价页,现在只能先打个折。

2025年11月13日星期四

OpenAI News

OpenAI 发布 GPT-5.1,主打动态思考:简单问题少费 token,复杂问题多花时间

OpenAI 在 API 平台上线了 GPT-5.1,这是 GPT-5 系列的新模型,核心卖点是“自适应推理”——它会根据任务难度自己决定思考多久。简单问题(比如问个 npm 命令)2 秒就能出答案,比 GPT-5 快了 5 倍,消耗的 token 也少得多;遇到复杂任务则会持续推敲,在 SWE-bench Verified 编程基准上跑到了 76.3...

推荐理由:这条靠的是 OpenAI 官方身份和开发者群体的关注度撑起来的:新模型发布意味着马上要面对要不要切、花多少钱、能力差多少的问题。但正文什么都没给,参数、价格、上下文长度、API 变化一概欠奉,所以知识密度直接打折扣。我会先打个折——这条值得推,但别指望从摘要里挖出干货,真正该盯的是后续技术细节。

2025年11月12日星期三

OpenAI News

OpenAI 发了 GPT-5.1,说更聪明也更会聊天了,但没给具体数据

OpenAI 在 11 月 12 号发了篇公告,宣布把 ChatGPT 里的模型升级到 GPT-5.1,分两个版本:Instant 和 Thinking。Instant 是大家最常用的那个,这次改得更暖、更口语化,还加了自适应推理,遇到难题会自己先想一下再回答,数学和编程题的表现有提升。Thinking 版是专门做复杂推理的,现在思考时间更灵活,简单问...

推荐理由:标题是真的,但信息量约等于零。OpenAI 说 GPT-5.1 更聪明、更会聊天,可正文没披露任何硬指标,连是不是全量推送都不知道。我会先打个折:这件事值得关注,但别把一句宣传语当成完整产品说明。

2025年10月24日星期五

Mistral AI

Mistral AI 发布 Mistral AI Studio 生产平台

Mistral AI 发布 Mistral AI Studio,一个面向企业团队的生产级 AI 平台,由 Observability、Agent Runtime 和 AI Registry 三大支柱组成。

推荐理由:原文给出企业级 AI 生产化的三大支柱与私有 beta 入口,可据此判断其与现有 MLOps 工具的差异。

2025年10月23日星期四

OpenAI News

OpenAI 收购了 Mac 端 AI 助手 Sky 的开发商

OpenAI 宣布买下 Software Applications Incorporated,这家公司做了个叫 Sky 的 Mac 应用,能读懂屏幕内容、直接操作其他 App 帮你干活。收购后整个团队会并入 OpenAI,Sky 的深度系统集成能力将被整合进 ChatGPT,让 ChatGPT 不再只是回消息,而是能跨应用执行任务。公告没透露收购金额和...

推荐理由:这条消息是 OpenAI 官方披露的并购动作,所以 H 和 R 都成立:收购会改变产品栈策略和竞争格局。K 偏弱,因为页面只给了标的和 Sky 的关联,价格、交割时间、产品细节都缺,所以放在 featured 而不是 breaking。正文没披露收购金额、交割时间、Sky 的产品形态,别被“收购”二字带跑,真正该盯的是整合方向与团队去向。

2025年10月22日星期三

OpenAI News

ChatGPT 将在 2026 年 1 月 15 日后退出 WhatsApp

OpenAI 说因为 WhatsApp 改了政策和条款,ChatGPT 在 WhatsApp 上的服务到 2026 年 1 月 15 日就停了。之前有超过 5000 万人在 WhatsApp 上用过 ChatGPT。想保留聊天记录的话,得在截止日期前把 WhatsApp 账号和 ChatGPT 账号绑在一起,不然聊天记录不会自动迁移,而且 WhatsA...

推荐理由:这不是普通的功能更新,而是 OpenAI 官方通知要关掉一个 5000 万用户的 WhatsApp 渠道。钩子在于“ChatGPT 离开 WhatsApp”这个动作本身不常见;知识点是截止时间和政策变更原因;风险点直接落在平台依赖和数据迁移上——用户如果不主动链接账户,聊天记录就没了,而且 WhatsApp 不给导出,这点对实际使用者影响挺实在。

2025年10月21日星期二

Hugging Face 博客

Hugging Face 的 AI Sheets 现在能直接处理图片了

AI Sheets 是一个开源表格工具,之前只能处理文字,现在加入了视觉能力。你可以把图片(比如收据、文档、产品图)直接拖进表格,用自然语言让模型帮你提取里面的信息、生成描述、甚至编辑图片。它背后调用的是 Inference Providers 上的几千个开源模型。你在表格里手动改错、点“赞”的操作,会被当成少样本示例来优化后续结果。处理完的数据可以导...

推荐理由:Hugging Face 给 AI Sheets 加了视觉能力,现在你可以在表格里直接分析图片、抽信息、生成和编辑图像。我会先打个折:正文没披露延迟和并发限制,实际用起来可能没那么丝滑。真正该盯的是它把视觉任务放进同一个数据清洗流,而且人工修正能自动变成 few-shot 数据,这点挺省钱。不过别太激动,这还是个工具层面的改进,没到改写规则的程度。

OpenAI News

OpenAI 发布 ChatGPT Atlas 浏览器,把 ChatGPT 直接嵌进浏览器里

OpenAI 在 2025 年 10 月 21 日推出了 ChatGPT Atlas,一个把 ChatGPT 内置在核心的浏览器,目前 macOS 版全球上线,免费、Plus、Pro 和 Go 用户都能用。Atlas 让 ChatGPT 能跟着你浏览网页,看懂你当前在看什么,不用复制粘贴就能回答问题或帮你干活。它还能记住你浏览过的网站内容(叫“浏览器记...

推荐理由:OpenAI 把 ChatGPT 做成一个独立浏览器,而不是继续在别人浏览器里当插件,这是分发层面的动作,不是日常功能更新,所以给到 88 分、p1。HKR 三项全中:钩子够新,不是又一个模型升级;信息量扎实,上线范围、付费策略、隐私开关都给了;从业者会盯着它怎么用浏览器记忆和页面可见性控制来卡位,这点先别太激动,但确实值得盯。

2025年10月6日星期一

OpenAI News

OpenAI 的 Codex 编程助手正式上线,新增 Slack 集成、SDK 和管理后台

OpenAI 在 10 月 6 日宣布 Codex 结束预览、进入正式可用阶段。这次主要加了三个东西:一是能在 Slack 频道里直接 @Codex 派活,像喊同事帮忙一样;二是放出了 Codex SDK,让你把驱动命令行版 Codex 的那个智能体嵌进自己的工具或流程里,官方说配合 GPT‑5‑Codex 模型不用额外调优就能用;三是给企业管理员上了...

推荐理由:OpenAI 把 Codex 从预览推到正式版,顺手加了 Slack 集成、SDK 和管理员控制,这比发个模型补丁重得多。我会先打个折:正文没披露云端任务的具体价格,这点先别太激动。但用量数据摆在那里,10 倍增长和 40 万亿 token 说明调用量是真金白银在跑。更值得盯的是内部数据——工程师全上、PR 合并效率提 70%,这是企业买单前最想看到的验证。整体看,这不是一次功能更新,是编码助手开始抢工作流入口和团队席位的明确动作。

OpenAI News

ChatGPT 里能直接调用 Booking、Canva 这些 App 了,OpenAI 还发了套开源 SDK 让开发者自己做

OpenAI 在 10 月 6 号给 ChatGPT 加了个新功能:你可以在聊天里直接喊 App 出来干活,比如让 Spotify 帮你排歌单,或者让 Zillow 在地图上筛房源。首批上线的有 Booking.com、Canva、Coursera、Expedia、Figma、Spotify 和 Zillow 这七家,后面还有 11 家会在年内跟上。目...

推荐理由:OpenAI 给 ChatGPT 装了个应用层,同时把开发工具包开源出来,等于把聊天界面升级成一个小型应用商店。我会先打个折:覆盖范围排除了欧洲经济区、瑞士和英国,应用怎么审核、怎么分成正文都没说,所以商业闭环还不完整。但首批 7 家合作方已经上线,年内还要再上 11 家,SDK 走的是 MCP 协议,开发者能直接触达 OpenAI 自称的 8 亿多用户,这对做工具和 agent 的团队是个实打实的信号。

OpenAI News

OpenAI 发布 AgentKit:一套工具把智能体开发、评测和微调打包在一起

OpenAI 在 10 月 6 日推出了 AgentKit,把做智能体需要的三块拼图拼到了一起:Agent Builder 是个画布,拖拽节点就能搭多智能体流程,支持版本管理和安全护栏;ChatKit 让你把对话界面嵌进自家产品,省掉两周前端开发时间;Connector Registry 统一管理 Dropbox、Google Drive、ShareP...

推荐理由:这次发布对 agent 开发者来说信息量挺大,Agent Builder、Connector Registry、ChatKit 三个组件都给了具体机制。Evals 那边 trace grading 和自动提示优化是实打实的新能力,第三方模型支持也扩大了适用范围。但标题里提到的 RFT,正文截出来的部分完全没讲训练怎么搞、多少钱、哪些人能先用,这点先别太激动。整体够重磅,但缺关键细节,所以给 84 分而不是顶格。

2025年9月30日星期二

OpenAI News

OpenAI 发布 Sora 2 系统卡,视频生成模型能同时出画面和声音了

OpenAI 在 9 月 30 日公布了 Sora 2 的系统卡,说这个新模型在物理规律、画面真实度、音画同步和风格控制上都比上一代强,能更准地跟着用户的指令走。这次发布先走邀请制,在 sora.com 和独立的 iOS App 上小范围开放。安全方面,上线初期禁止上传视频,也禁止上传带真人照片的图片,对涉及未成年人的内容有更严的审核门槛。正文没提 A...

推荐理由:这条落在 78–84 分档。H 来自 Sora 2 加独立 App 的钩子;K 来自明确的上线限制和安全规则;R 来自竞争和肖像滥用风险。没给更高分是因为价格、评测分数、上下文长度和 API 时间点正文全都没披露,我会先打个折。

OpenAI News

OpenAI 发布 Sora 2,能生成带同步对白和音效的视频,还做了一个社交 App

OpenAI 在 9 月 30 日发布了视频生成模型 Sora 2,同时上线了一个叫 Sora 的 iOS 社交 App。Sora 2 比上一代更遵守物理规律,比如投篮不进会弹框而不是球直接瞬移进筐,也能生成同步的人物对白和环境音效。App 里有个“角色”功能,你录一段视频和音频验证身份后,就能把自己的形象和声音放进任何生成的场景里。OpenAI 说这...

推荐理由:我会先打个折,因为价格和时长这些关键限制都没披露,没法判断实际可用性。但这条消息值得立刻写:OpenAI 在同一天发了 Sora 2 模型和独立的 Sora App,产品形态直接从技术演示跳到了带推荐流的社交应用。模型能同步出视频、对白和音效,还有个“characters”功能,用一次性录像验明正身再把真人形象注入视频——这点先别太激动,正文没讲清楚隐私和滥用防护细节。真正该盯的是分发方式变了,OpenAI 开始用消费级产品逻辑铺视频生成,而不是只给开发者或研究者玩。

2025年9月29日星期一

OpenAI News

OpenAI 给 ChatGPT 加了家长控制,能管孩子用 AI 的时间和功能

OpenAI 在 9 月 29 日上线了家长控制功能,所有 ChatGPT 用户都能用。家长把自己的账号和孩子的绑定后,就能在自己的账号里管理孩子的使用设置。绑定后的青少年账号默认会加强内容过滤,减少暴力、色情角色扮演和极端审美之类的内容。家长还可以单独设置禁用时段、关掉语音模式、关掉记忆功能、禁止图片生成,以及拒绝把孩子的对话拿去训练模型。比较关键的...

推荐理由:OpenAI 把家长控制推给了所有 ChatGPT 用户,但真正值得看的是自残风险上报链路:系统检测到风险后,先由人工小组复核,确认是急性痛苦状态再通过邮件、短信和推送通知家长。这不是一个简单的设置面板,而是一套带人工介入的安全流程。我会先打个折,因为这次没有模型层面的变动,属于产品安全更新,但信息量够实,流程也说得清楚。

OpenAI News

ChatGPT 开始内嵌购物功能,先拿 Etsy 试水,并开源了一套让 AI 帮你下单的协议

OpenAI 在 9 月 29 日给 ChatGPT 加了个“即时结账”功能,美国 Plus、Pro 和免费用户现在能在聊天界面里直接买 Etsy 卖家的东西,目前只支持单件购买。Shopify 上像 Glossier、SKIMS 等一百多万商家之后也会接入。ChatGPT 每周有超过 7 亿人用,这次它不只是推荐商品,而是直接充当“数字导购”帮你完成...

推荐理由:OpenAI 让 ChatGPT 能直接结账,不是小功能补丁,是产品边界的一次硬扩张。我会先打个折:目前只覆盖美国用户和美国 Etsy 卖家,单件下单,规模还小。但真正值得盯的是它和 Stripe 一起推的开源 Agentic Commerce Protocol——商家最少一行代码就能接入,等于在铺结算管道。商品排序说按相关性自然展示,商家付小额成交费,但费率正文没披露,这点先别太激动。整体看,从聊天到成交的链路打通了,对从业者来说,这意味着模型开始进交易流干活,而不只是回话。

2025年9月25日星期四

OpenAI News

ChatGPT 企业版上线共享项目,团队能一起调教同一个 AI 了

OpenAI 给付费的 Business、Enterprise 和 Edu 用户推了个共享项目功能。简单说,就是团队可以建一个项目空间,把文件、指令都扔进去,所有成员跟 ChatGPT 聊天时,它都会基于这个共享的上下文来回答,不用每次都重新解释背景。创建者能通过邮件或链接拉人,权限分两档:只能看和聊,或者还能改指令、传文件。项目有自己的独立记忆,敏感...

推荐理由:我会先打个折,这不是模型发布,是协作层的产品更新。共享项目、8 个连接器、按提示自动路由连接器,这三件事合在一起,让 ChatGPT 从单人对话框往团队工作流里又挤了一步。权限和记忆的设计看得出在认真做企业控制,但正文没披露自动选择连接器的准确率和延迟,这点先别太激动。整体是扎实的迭代,不是概念车。

OpenAI News

ChatGPT Pulse 预览:让模型主动推消息,每天一次

OpenAI 给 Pro 用户上了个移动端新功能 Pulse,ChatGPT 不再等你问,而是每天主动推一版个性化信息卡片。它会翻你的聊天记录、记忆和反馈,还能选接 Gmail 和 Google 日历(默认关着),晚上做功课,早上把结果推给你。你可以点赞点踩、直接告诉它明天想看什么,所有输出会过一道安全检查。正文没提用了哪个模型、会不会涨价、Plus ...

推荐理由:我会先打个折:正文没提模型有没有换、Pro 之外怎么收费、Plus 什么时候上,所以别当完整发布看。但亮点是交互逻辑变了——从你问它答,变成它每天主动塞一张卡片给你,信息源还能挂上你的邮箱和日历。如果是真的,省掉你每天手动去问“今天有什么我该知道的”,但前提是你敢把 Gmail 交出去。安全检查说做了,集成默认关着,这点先别太激动,等更多实测再说。

2025年9月16日星期二

OpenAI News

OpenAI 在给 ChatGPT 加年龄预测,拿不准就默认当未成年人处理

OpenAI 正在开发一套年龄预测系统,用来判断用户是否满 18 岁。一旦系统判定用户未成年,会自动切到一个内容受限的青少年模式,比如屏蔽露骨的性内容,极端情况下还可能联系执法部门。如果系统拿不准年龄,宁可误判也会先按未成年人处理,成年人可以再通过验证解锁完整功能。月底前会上线家长控制,家长能关联孩子的账号、关掉记忆和聊天记录、设置禁用时段,孩子遇到严...

推荐理由:OpenAI 没在发一篇泛泛的安全声明,而是把年龄估算直接嵌进了 ChatGPT 的分流逻辑里。我会先打个折:正文没披露年龄预测的具体技术方案和准确率,这点先别太激动。但产品思路很明确——宁可误判也不漏判,低置信度默认走青少年版,成年人想回来得自证。家长控制那边,能关记忆和历史记录,等于给了监护人一把更实在的钥匙。整体看,这不是模型能力升级,是一次产品路由规则的调整,但牵动的隐私和合规神经够多,值得放进 featured。

2025年9月15日星期一

OpenAI News

OpenAI 把 GPT-5 调成了专门干活的编程助手 Codex,一个模型同时搞定聊天写码和长时间自主跑任务

OpenAI 发布了 GPT-5-Codex,并把它设为 Codex 云端任务和代码审查的默认模型。这个模型专门针对真实软件工程任务训练过,既能跟你快速交互式写代码,也能自己独立跑复杂任务,测试中最长连续干了超过 7 个小时。在 OpenAI 内部员工的使用数据里,对于 token 消耗最少的那 10% 的简单对话,GPT-5-Codex 比 GPT-...

推荐理由:OpenAI把GPT-5-Codex设为Codex云任务和代码审查的默认模型,给了几个硬数字:7小时自主执行、低端请求token省93.7%、高端请求耗时翻倍。这说明他们想把交互编程和长时代理执行揉在一起,但定价和完整可用性正文没披露,所以先别急着算账。

2025年9月4日星期四

OpenAI News

OpenAI 画了个大饼:2030 年前要让一千万美国人拿 AI 证书,还搭了个求职平台

OpenAI 宣布了两件事:一是推出 OpenAI 认证,分不同等级,从基础办公用法到提示词工程都覆盖,承诺到 2030 年让 1000 万美国人拿到证。备考可以直接在 ChatGPT 的“学习模式”里完成。二是上线 OpenAI 求职平台,用 AI 撮合懂 AI 的人和需要这些技能的公司,合作方包括沃尔玛、Indeed 和德州商业协会。OpenAI ...

推荐理由:OpenAI 把就业争论变成具体动作:到 2030 年认证 1000 万美国人,还搭了个职位平台。HKR 三项都踩中了,有真实数字,也抓住了就业这个核心痛点。但说到底这是生态和政策站位,不是模型或能力上的硬突破,所以重要性给到中等偏上。

2025年9月2日星期二

Mistral AI

Mistral AI 为 Le Chat 推出 Memories 记忆功能(beta)

Mistral AI 为 Le Chat 上线 Memories(beta)记忆功能,可自动保存有用信息,但回忆过程可见、可溯源,并附来源链接。用户可随时关闭记忆、开启不使用记忆的隐身对话、编辑或删除单条记忆,还能导出和从外部导入记忆。同步推出 Memory Insights,基于用户自身数据提示记忆趋势与摘要。

Mistral AI

Mistral 为 Le Chat 上线自定义 MCP 连接器与 Memories 记忆功能

Mistral 为 Le Chat 推出 20+ 个基于 MCP 的安全连接器目录(beta),覆盖数据、生产力、开发、自动化与商务等类别,支持接入 Databricks、Snowflake、GitHub、Atlassian、Asana、Outlook、Box、Stripe、Zapier 等工具,并可添加自定义 MCP 连接器或连接任意远程 MCP 服务器。

推荐理由:原文列出 20+ 连接器覆盖的具体工具类别与部署方式,可据此判断 Le Chat 在企业工作流中的接入范围。

OpenAI News

OpenAI 要在 120 天内给 ChatGPT 加安全机制,下个月先上家长控制

OpenAI 公布了一版安全更新计划,核心是两件事:一是把检测到严重情绪危机的对话自动转给推理模型(比如 GPT‑5‑thinking)去处理,理由是这类模型在安全规范上更稳、更不容易被诱导;二是下个月内推出家长控制功能,家长可以绑定 13 岁以上孩子的账号,关掉记忆和聊天记录,并在系统判定孩子处于严重情绪波动时收到通知。正文没披露危机检测的触发阈值和...

推荐理由:OpenAI 说接下来 120 天要推安全改进,下个月先上家长控制。最值得看的是那条路由规则:检测到急性痛苦迹象的对话,会自动转给 GPT-5-thinking 这类推理模型处理。这比加个免责声明实在,但正文没公布触发条件和误报率,实际效果得等上线再看。青少年账户那边,家长能关 memory 和聊天记录,算是给了控制权,不过也没说默认开关状态。整体是产品动作,不是技术突破,我会先打个折。