跳到正文

产品更新

AI 产品与应用的功能上新、改版与商业化动态——谁家的产品变强了、变贵了、能用了。

842 条精选相关主题模型发布行业动态AI 编码

最新精选

第 541–560 条 · 共 842 条

5月1日星期五

The Verge · AI

Meta 用“快速致富”风格的广告推销自家 AI 工具

Meta 收购的 Manus 在 Instagram 和 Facebook 上投了一批广告,话术很像“别去打工了,用 AI 躺着赚钱”。广告瞄准的是本地小商家,尤其是那些没有网站或者网站做得很烂的店主,让他们用 Meta 的 AI 工具生成网站。Manus 还花钱请创作者在 Instagram、YouTube 和 TikTok 上发推广内容,其中一些 ...

推荐理由:The Verge 挖出 Meta 花 20 亿美元买的 Manus,在投广告教人用 AI 快速赚钱。套路是找没网站或网站很烂的本地商家,AI 自动建站再电话推销。Manus 还付钱让创作者运营社媒账号,部分 TikTok 账号被问后就下架了。这不是产品发布,是调查报道,但把平台自己搞 AI 垃圾生意的链条扒得很清楚,对行业名声打击不小。

4月30日星期四

MIT Technology Review · AI

Goodfire 发布 Silico,一个能让你像调试代码一样调试大模型内部参数的工具

Goodfire 推出了一款叫 Silico 的工具,让工程师可以在训练过程中直接查看和调整模型的参数,也就是决定模型行为的那些“旋钮”。它能把模型里的神经元和通路画成地图,比如他们在 Qwen 3 里发现一个神经元,激活后模型回答会变成电车难题式的道德困境。Silico 用智能体自动完成了大量原本需要人工做的可解释性工作,目标是让模型开发少点炼丹味,...

推荐理由:HKR 三项都成立:Silico 给出了一个可操作的机械可解释性调试手段。分数停在 76,因为目前只是一家创业公司的产品预览,正文没披露定价,也没有任何实际部署规模或客户数量的数据,所以我会先打个折,不往更高里推。

Ben's Bites

搭东西变简单了:Cloudflare 让 AI 能自己买域名部署,Stripe 给 AI 发了钱包

Ben 这期聊的是工具链在变,他最近迷上了 Codex 应用,用自然语言指挥 AI 写了个恐龙跳跳游戏、搭了套 Gmail 自动分类系统。重点在后面的产品更新:Cloudflare 现在允许 AI 代理自己创建账户、买域名、拿 API 令牌并部署,人只需要最后点个头,中间那些繁琐的后台配置被包装成了 AI 能读懂的接口。Stripe 在 Session...

推荐理由:这是一篇产品线索汇总,不是单一重磅发布,但 Cloudflare 和 Stripe 把代理权限落到了开户、支付、部署这些硬环节上,我会先打个折放在 featured 低段。正文没披露具体延迟或成本数字,如果是真的,代理跑通账号和支付流程确实省钱省事,但权限敞口也大,这点先别太激动。

彭博科技

三星芯片部门利润暴增 48 倍,全靠 AI 数据中心抢内存

三星电子芯片部门在 2026 年第一季度利润同比翻了 48 倍,创下历史新高并超出市场预期。这波增长直接来自 AI 数据中心对内存的疯狂采购,导致供应紧张。不过正文没披露具体的利润金额、是哪种内存(比如 HBM 还是普通 DRAM)以及主要客户是谁。

推荐理由:三星半导体部门一个季度利润翻了48倍,这个涨幅放在任何行业都算炸裂。我会先打个折:正文没写具体赚了多少钱,也没说是哪类内存(HBM还是普通DRAM)在拉动,客户是谁也一概没提。所以这条消息的价值在于信号——AI数据中心在疯狂下单,内存供给可能进一步收紧。如果是真的,对做推理优化和硬件采购的团队来说,成本压力会更大。Bloomberg的报道本身可信度不低,但信息缺口明显,我维持74分,不往上调。

TechCrunch · AI

微软说 Copilot 付费用户超过 2000 万,但没讲清楚大家到底怎么用

微软 CEO 纳德拉在财报会上说,嵌在 Word、Excel 和 Outlook 里的 M365 Copilot 现在有 2000 万个企业付费席位。这个数字说明愿意掏钱的公司确实在变多,但文章没披露活跃度、留存率、每个用户平均贡献多少收入,也没说这 2000 万是怎么统计的——是买过就算,还是真正在用。所以“他们真的在用”这个说法,目前只能先打个折看。

推荐理由:HKR-K 的强度在于微软罕见地公布了付费用户数,这是市场最缺的采纳证据。但正文只说了用户数和参与度在涨,活跃率、留存、ARPU 和统计方法一概没提,所以分数卡在 featured 门槛附近,没往上拉。

彭博科技

Meta 上调 2026 年资本支出到 1250 亿至 1450 亿美元,股价应声大跌

Meta 把今年的资本开支预期从之前的数字拉高到了 1250 亿到 1450 亿美元,CFO Susan Li 解释是因为零部件涨价和数据中心要多花钱。消息一出股价直接跳水。市场担心的不是这一天的涨跌,而是砸这么多钱搞 AI 模型,什么时候才能看到回报——这个问题正文没给出时间表。

推荐理由:Meta 把全年资本开支预期拉到 1250 亿到 1450 亿美元,CFO 解释是组件贵了、数据中心要多花钱,股价应声下跌。这不是模型或产品发布,而是 AI 投入的经济账信号,所以分数没给到 78 以上。

The Verge · AI

Google 搜索量上季度创历史新高,但没公布具体数字

Alphabet 一季度财报电话会上,CEO Sundar Pichai 说 Google 搜索的查询量达到了“历史最高”,搜索广告收入涨了 19%。他把增长归因于 AI 功能(比如 AI Overviews 那种直接在搜索结果顶部给答案的体验)和 Gemini App 的拉动。另外,YouTube 订阅和 Google One 这类付费服务总订阅数超...

推荐理由:HKR 三项全中:Alphabet 报出搜索查询量历史新高、搜索收入涨 19%、付费订阅破 3.5 亿。但正文没给查询量基数,也没拆 AI Overviews 带来的增量,所以信息有缺口。整体够得上 72–77 分的 featured 档位。

r/LocalLLaMA

用 Kokoro 82M 和 Qwen 在本地把 PDF 转成有声书

Reddit 用户 purellmagents 搭了一套完全跑在本地的 PDF 转有声书流程,用 Kokoro 82M 做语音合成,Qwen 3.5 0.8B 或 2B 处理文本,llama.cpp 做推理,整个应用用 Tauri 2.0 打包,在 M1 Mac 上运行。工作方式是先读前 15 句,边读边准备下 15 句,减少等待。作者说真正的难点不在...

推荐理由:HKR 三项都踩中了,但本质是 Reddit 上的个人工作流展示,不是模型或平台发布。具体组件和 15 句预处理窗口让它能进低分 featured 档。我会先打个折:正文没披露代码和表格朗读的具体处理逻辑,这点先别太激动。

彭博科技

Meta 的路易斯安那 AI 数据中心让电力公司 Entergy 追加 140 亿美元,新建 10 座燃气电厂

Entergy 把四年资本开支计划上调了近三分之一,到 570 亿美元,大头是给 Meta 在路易斯安那的数据中心供电。新增的 140 亿美元主要用来建燃气电厂,一共要上 10 座。报道没提这些电厂的总装机容量和投产时间,所以暂时没法判断对当地电价和碳排放的具体影响。Meta 急着要稳定电力,直接跳过电网自己拉专线,这种操作在 AI 大厂里越来越常见,...

推荐理由:这条消息本身够硬——Meta 一个数据中心的用电需求,就让 Entergy 把四年投资计划直接拉高近三分之一,多掏 140 亿美元建天然气电厂。我会先打个折:正文没披露电站具体容量和投运时间,所以没法判断这钱花得划不划算、什么时候能缓解供电压力。但光是这个数字就说明,大模型训练和推理背后的电力账单正在变成基础设施投资的主驱动,不是未来时,是现在进行时。这点先别太激动,但值得放进雷达里让同行看到。

4月29日星期三

r/LocalLLaMA

Mistral 发布 Medium 3.5,开放权重但商用要付费

Mistral 推出了新模型 Medium 3.5,权重开放,用的是修改过的 MIT 许可证——非商业用途免费,商业用途得掏钱买授权。帖子本身因为 Reddit 的反爬机制没抓到正文,所以参数量、跑分成绩、API 价格这些关键信息目前都看不到。光看标题和摘要片段,没法判断它跟上一代比强了多少,也不知道具体适合哪些场景。我会先打个折:等官方技术报告或实测...

推荐理由:Mistral Medium 3.5 标题确认上线,开放权重这点对本地部署是好事,但 modified MIT 许可里商用要付费授权,我会先打个折——正文没给参数量、跑分和具体价格,没法判断性价比。HKR 三项都踩中了:模型发布本身有热度,许可细节是新信息,商用收费又戳到本地模型社区的敏感点。不过信息缺口明显,分数停在 74 合理。

The Verge · AI

ChatGPT 下载量增速放缓,可能给 OpenAI 的 IPO 添堵

Sensor Tower 的数据显示,ChatGPT 的卸载量在 4 月同比上升了 132%,用户要么走了,要么去试了竞品。OpenAI 在 2 月跟五角大楼签了合同后,上个月的卸载率更是暴涨了 413%。月活用户的增速也从 1 月的 168% 掉到了 4 月的 78%。

推荐理由:HKR 三项都站得住:钩子是 ChatGPT 增长踩刹车 vs IPO 的故事张力,知识来自 Sensor Tower 的卸载和月活增速数据,相关性直接打在行业对 OpenAI 增长质量和用户流失的焦虑上。分数没给更高,因为数据源是第三方移动端估算,不是 OpenAI 自己的财报或产品发布,我会先打个折。

X · @op7418(歸藏)

DeepSeek 多模态模型全量上线,网页版识图模式能用了

DeepSeek 把多模态模型全量推上线了,现在打开网页版就能用识图模式。从体验看,这应该是一个独立的多模态模型,不是把图片转文字再丢给纯文本模型那种拼接方案。正文没披露模型名字、参数量、定价和 API 开放时间,这些关键信息都还缺着,想接进自己流程的朋友得再等等。

推荐理由:我会先打个折:这条消息本身够重磅,DeepSeek 的多模态终于从传闻变成可试用的东西了。但正文只确认了网页版识图入口,模型叫什么、多大、多少钱、什么时候上 API 全都没说,信息密度其实挺薄的。HKR 三条都踩中了,不过来源只有一条 X 帖,验证不够硬,所以分数压在 78–84 这个区间是合理的。这点先别太激动,等 API 和 benchmark 出来再重新评估。

新智元 · 公众号

谷歌翻译 20 岁,劈柴哥说它换了四代 AI,现在能直接听懂语气了

劈柴哥发帖庆祝谷歌翻译上线 20 年,月活用户到了 10 亿。他梳理了背后的四代技术:最早是统计机器翻译,2016 年换成神经网络翻译,后来用上 PaLM 2 大模型,2024 年一口气加了 110 种语言。最新的是 Gemini 2.5 Flash 的原生音频翻译,不再先把语音转文字再翻译,而是直接处理声音,能保留原话的语调、停顿和节奏。劈柴哥形容这...

推荐理由:核心事件是谷歌翻译过生日和架构回顾,不是新品发布,但 10 亿月活、110 种语言扩增和原生语音翻译的细节撑得起 featured 档位。我会先打个折,因为正文没给出原生语音功能的具体上线时间或实测数据,这点先别太激动。不过它点到了语音 AI 产品眼下最纠结的问题:级联管线 vs. 原生多模态,所以值得从业者看一眼。

量子位 · 公众号

DeepSeek 多模态模型开始灰度测试,能识别图片里的饮料和杯子

DeepSeek 研究员确认 V4 视觉版已经在灰度测试,官网首页上线了图片识别入口。一张截图显示,模型花了 4 秒识别出一张文字不多的图片里的饮料种类和杯子类型。正文没披露灰度覆盖范围、API 是否开放以及定价,所以能不能用上、花多少钱还不清楚。

推荐理由:HKR 三项都站得住:DeepSeek V4 视觉灰度测试是实打实的国内旗舰更新,有截图和 4 秒思考样本。分数维持 80,因为正文没披露开放范围、API 怎么接、价格和跑分,信息缺口不小,先别太激动。

量子位 · 公众号

生数科技认领了那个神秘登顶的机器人模型,叫 MotuBrain,在两项评测里拿了高分,还放了个三台机器人接力干活的演示

4 月中旬有个叫 MotuBrain 的模型在 WorldArena 和 RoboTwin2.0 两个榜单上突然登顶,生数科技在 4 月 29 日认领了它。RoboTwin2.0 的干净环境和随机干扰环境分别拿了 95.8 和 96.1 分。演示里用三台不同的人形机器人接力完成了五项任务,核心是一套叫“世界动作模型”的设计,把视频、动作和语言用混合专家...

推荐理由:我会先打个折:分数和 Demo 都来自公司自己,没有独立部署数据,所以 82 分不往上调。但悬念认领加三台机器人实物演示,H 轴直接拉满;RoboTwin2.0 双场景高分和三流 MoT 架构把 K 轴撑实了;视频公司跨进具身智能这条线,R 轴也站得住。整体判断没变,三个轴都过,分数保持。

r/LocalLLaMA

DeepSeek V4 定价低到离谱,有人算完账开始怀疑自己的技术栈

Reddit 上有人算了笔账:DeepSeek V4-Pro 输入价格是每百万 token 0.145 美元,比 Claude Opus 4.7 便宜约 34 倍。五月有个促销直接砍到 0.036 美元,缓存命中更是只要 0.0036 美元,比 Opus 的缓存价低了约 173 倍。发帖人最在意的是 agent 循环跑起来的成本,但帖子没验证 100 ...

推荐理由:HKR 三项都踩中了:价格冲击力强、数字具体可算、对 agent 场景的成本压力点抓得准。但这是 Reddit 用户自己算的账,不是官方发布或生产环境实测,所以分数压在 77,不往上给。

TechCrunch · AI

微软独家协议刚结束一天,AWS 就把 OpenAI 模型搬上了 Bedrock

OpenAI 和微软修改协议、不再有独家授权后,亚马逊隔天就在 AWS 的 Bedrock 服务里上线了 OpenAI 最新模型、代码工具 Codex,以及一个叫 Bedrock Managed Agents 的新东西,专门用来搭 OpenAI 驱动的 AI 智能体。亚马逊说这只是“更深合作的开头”,但正文没披露具体上了哪些模型、怎么收费、在哪些区域可...

推荐理由:我会先打个折:正文只说了 AWS 要卖 OpenAI 产品,连具体模型名都没列,所以重要性停在 78 是合理的。真正值得盯的是分发渠道从 Azure 独占转向多云,这对企业采购和云厂商竞争格局都有影响。agent 服务被点名,说明 OpenAI 在推让模型进业务流程干活的产品,但没细节就先别太激动。

彭博科技

苹果要在 iOS 27 和 macOS 27 里重做照片编辑,主打 AI 修图

彭博社这篇报道的正文被付费墙挡住了,只抓到了标题和一段机器人验证页面,所以具体功能、用了什么模型、支持哪些机型、什么时候上线,正文都没披露。从标题看,苹果准备在系统自带的照片 App 里塞进一批 AI 编辑工具,关键词是“扩展、增强、重新构图”,听起来像是能自动补全画面边缘、提画质、帮你重新裁切构图。RSS 提要里提了一句这是为了跟安卓阵营的 AI 修...

推荐理由:消息来自 Bloomberg,可信度还行,而且照片编辑是系统自带的高频功能,所以 hook 和 reach 都成立。但 knowledge 这块确实撑不起来——功能细节、模型方案、上线时间全是空白,只能给到 featured 的底线分 72。

The Verge · AI

Claude 现在能直接操控 Photoshop、Blender 和 Ableton 了

Anthropic 给 Claude 装上了“创意连接器”,让它能直接读写 Adobe 全家桶、Affinity、Blender、Ableton 和 Autodesk 这些专业软件。以 Blender 为例,Claude 可以帮你排查 3D 场景哪里出了问题、写自定义工具,还能批量修改一堆物体的属性。另外,Anthropic 还给 Blender 基金...

推荐理由:HKR 三项都成立:Claude 进入主流创作软件是明确的跨工具钩子,连接器覆盖广且 Blender 端有具体操作能力,这件事踩中了 agent 进入专业工作流的神经。正文没提价格和完整上线地区,所以先别太激动,但方向本身值得关注。

NVIDIA 博客

英伟达发布 Nemotron 3 Nano Omni:一个模型同时看懂图文、听懂语音,做 AI 代理时吞吐量号称是同类 9 倍

英伟达在 2026 年 4 月 28 日开源了 Nemotron 3 Nano Omni,一个能同时处理文字、图片、音频、视频、文档、图表和屏幕界面的多模态模型。它用了 30B-A3B 的混合专家架构(MoE),实际激活的参数量是 3B,配合 Conv3D 和 EVS 技术来处理音视频,上下文窗口拉到 256K。官方说在保持交互延迟不变的前提下,跑 A...

推荐理由:NVIDIA 这次把视觉、语音、文字塞进一个 30B-A3B 的混合专家模型里,还开放了权重和训练技术。我会先打个折:9 倍效率提升是跟谁比、测什么任务,正文没细说,这点先别太激动。但 256K 上下文、Conv3D 和 EVS 这些配置,加上直接上 Hugging Face 和 OpenRouter,对想用开源方案搭多模态 agent 的团队确实省事。单信源,信息够用但不算独家,所以放在 featured 里。