跳到正文

产品更新

AI 产品与应用的功能上新、改版与商业化动态——谁家的产品变强了、变贵了、能用了。

842 条精选相关主题模型发布行业动态AI 编码

最新精选

第 301–320 条 · 共 842 条

5月20日星期三

AI HOT 精选

Claude Code 团队把主力输出格式从 Markdown 换成了 HTML

Claude Code 团队发现让模型直接生成 HTML 页面,比用 Markdown 更能把事说清楚。文章举了四个具体用法:用表格做对比、用 CSS 控制排版样式、用 SVG 画图表、用 JavaScript 加交互操作。他们没说性能数据或成本变化,更像是一篇内部实践分享,告诉你“我们这么用下来效果不错”。

推荐理由:Claude Code 团队把默认输出从 Markdown 切到 HTML,这篇官方博文列出了表格、CSS、SVG 和 JS 交互四种用法,说明 HTML 在展示结构化结果和可交互内容上比纯文本强。对写代码的人有实操参考价值,但不算重大产品发布,放在 featured 档合适。

AI HOT 精选

ChatGPT 图像生成周用量冲到 15 亿次,OpenAI 聊了聊 Images 2.0 带来的新玩法

OpenAI 发推说,现在大家每周在 ChatGPT 里生成超过 15 亿张图片。研究员 kenjihata、产品负责人 adele__li 和主持人 AndrewMayne 一起聊了 Images 2.0 上线后冒出来的新用法和趋势。正文没展开具体是哪些用例,也没给技术细节,就提了个数字和一场对谈。

推荐理由:我会先打个折:正文只给了 15 亿这个总数,没拆地区、模型版本或付费/免费比例,也没说 Images 2.0 具体改了啥。但光这个量级就够说明图像生成已经从尝鲜变成高频刚需,对算力规划和竞品压力都有参考价值。没有新能力或定价信息,所以分数停在 78 不往上拉。

TechCrunch · AI

Gmail 现在能直接语音问收件箱了,Google I/O 2026 上演示了用 Gemini 翻找邮件细节

Google 给 Gmail 的 AI 收件箱加上了语音对话搜索,你可以直接开口让 Gemini 帮你从邮件堆里挖出具体信息。目前正文没披露这个功能会推给哪些用户、支持什么语言、要不要额外付费、响应有多快,也没说背后是用什么检索机制把邮件捞出来的。

推荐理由:我会先打个折:这功能听起来挺方便,开车时动嘴就能查邮件里的航班号或报销金额。但正文只说了“可以语音搜 Gmail”,没交代支持哪些语言、是不是全球推送、要不要额外付费,也没讲清楚 Gemini 到底怎么从邮件里捞出答案——是直接扫全文还是先建索引。这点先别太激动,等有实测再判断到底省不省事。

AI HOT 精选

谷歌把 AI 概览和 AI 模式揉进一个搜索框,现在能传图、传文件、传视频问问题

谷歌上线了一个基于 Gemini 3.5 的新搜索框,把之前的 AI Overviews 和 AI Mode 合并成一个入口。你可以打字、传图片、丢文件或发视频,搜索会跨这些格式一起理解你的问题。支持多轮对话,回答会结合上下文更贴近你。桌面和手机端全球同步上线,正文没披露具体延迟和成本数据。

推荐理由:谷歌搜索这次更新,等于把 AI 对话直接嵌进了搜索框,支持文字、图片、文件、视频混着问,还能多轮追问。底层是 Gemini 3.5,把之前的 AI Overviews 和新的 AI Mode 整合在一起,桌面和移动端都上了。对做搜索、做内容、做 AI 产品的人来说,这意味着谷歌的流量分发逻辑在变,跟 Perplexity 那种 AI 搜索的竞争也更直接。不过原文信息偏薄,没写具体交互细节、覆盖地区有没有限制、实际回答质量怎么样,所以重要性我给 86,先别往 90 以上冲。

The Verge · AI

Google I/O 画了一堆 AI 大饼,但前提是你得把个人数据交出来

Google 在 I/O 2026 上发布了 Gemini Spark(常驻 AI 助手,能帮你张罗活动)、Daily Brief(每日简报)和 Gmail AI 收件箱(根据邮件自动生成待办和回信草稿)。这些功能听起来都挺实用,但核心都是靠大量个人数据喂出来的。文章点出了这个信任问题,不过正文没披露具体的数据处理条款,所以先别急着说它安全还是不安全。

推荐理由:Google 在 I/O 2026 亮出的几个新工具,核心卖点是替你读邮件、替你整理信息,但前提是你得把大量个人数据交出去。正文只说了这些功能依赖个人信息,没写数据怎么处理、存多久、会不会拿去训练模型。我会先打个折:产品方向很明确,就是让 AI 住进你的邮箱和日程里,但隐私和信任那部分目前只有表态,没有细节。这点先别太激动,等 Google 把数据处理规则说清楚再判断值不值得跟进。

FT · 科技

Google 要出智能眼镜,还会在搜索引擎里塞进 AI 代理

Google 准备发布智能眼镜,同时给搜索引擎加上 AI 代理功能。CEO Sundar Pichai 说这些功能靠新的 Gemini 模型驱动,目标是缩小跟 Anthropic 和 OpenAI 的差距。不过这篇付费墙后面的正文没披露具体规格、上市时间和价格,所以眼镜长什么样、卖多少钱、什么时候能买到,现在都还不知道。

推荐理由:我会先打个折:正文没披露参数、时间表和价格,所以没法判断落地有多快。但 Google 把 Gemini agent 塞进搜索,再配上智能眼镜,等于在用户每天用的入口上同时推两个 AI 触点。Pichai 自己说新功能要缩小跟 Anthropic、OpenAI 的差距,这话本身就说明他们承认落后,也在用产品动作追。对从业者来说,看点不是技术多新,而是 Google 怎么用分发优势把 agent 推到普通人面前。这点先别太激动,等具体上线和实测再说。

AI HOT 精选

Claude 操控真实界面的生产实践指南:点击更准、长任务不跑偏、操作可回放

Claude 现在能直接操作真实软件界面了,这篇博客讲的是怎么把它用到生产环境里,而不是只跑个 demo。文章给了四个具体机制:一是提高点击准确率,减少点错按钮的概率;二是可以选“思考努力级别”,在速度和效果之间做取舍;三是在长会话里保持上下文,避免任务跑到一半忘了前面在干嘛;四是把 Claude 的操作录成可重放的演示日志,方便排查和复现。正文没给出...

推荐理由:我会先打个折:这不是官方模型或产品发布,更像一份实战经验总结,所以放在质量教程档位。但它把 Claude 操控真实界面的四个关键机制讲得很清楚——怎么提高点击准头、怎么控制模型思考深度、怎么处理长会话不丢上下文、怎么把操作录下来复现。对正在把 agent 塞进业务流程的团队来说,这些点比 benchmark 数字更有用。

AI HOT 精选

OpenAI 卖算力期货:交钱锁定长期 GPU,正文没写价格和最低消费

OpenAI 上线 Guaranteed Capacity 服务,让客户提前锁定长期算力,避免高峰期排队。官方说法是帮企业在算力紧张时也能跑关键任务。但公告没披露价格、合同年限、最低配额,也没说锁的是哪种 GPU。我会先打个折——这更像给大客户吃定心丸,小团队暂时不用激动。

推荐理由:我会先打个折:正文没给价格、期限和容量配额,所以现在只能知道 OpenAI 开始卖算力预留,但不知道划不划算。H 来自 OpenAI 把算力稀缺变成一种可预订的服务,对 API 用户是个实在的钩子。K 只到产品名和规划机制这一步,缺关键商业细节。R 踩中了生产可靠性和预算规划这两个痛点,所以能进 featured,但信息缺口把分数压在中段。

AI HOT 精选

Google 把 Tensor 芯片的 AI 能力开放给开发者,Pixel 10 手机上的 TPU 现在可以直接跑模型了

Google 发布了 Tensor ML SDK 的公开测试版,开发者现在能把 PyTorch 或 TFLite 模型转换、编译后,直接调用 Pixel 10 系列手机里的 TPU 芯片来跑推理。整个流程通过 LiteRT 这个统一框架完成,不用再分别对接底层硬件驱动。官方还提供了一个模型库,里面有超过 100 个现成的经典模型和生成式 AI 模型,包...

推荐理由:HKR-K 很扎实:文章给出了 Pixel 10 TPU 上的具体工作流和一个 100+ 模型库。H 和 R 也够得上 featured,但这是个测试版开发者 SDK,不是旗舰模型或面向大众的产品发布,所以我会先打个折。

AI HOT 精选

Gemini Omni 发布:能理解物理世界的视频生成模型,面向付费用户开放

Gemini Omni 不只是生成画面,它会判断场景里接下来该发生什么——比如物体掉落、碰撞这类物理规律,同时结合历史、科学和文化知识来构建内容。视频生成功能今天起向全球 Google AI Plus、Pro 和 Ultra 订阅用户开放,可以在 Gemini 应用、Google Flow 和 YouTube Shorts 里用。正文没披露推理的具体技...

推荐理由:我会先打个折:正文只给了发布和接入渠道,没放任何物理推理的测试案例、视频生成的质量对比或具体定价,所以信息密度其实偏薄。但“物理推理+视频生成”这个标签本身够硬,加上直接打通 YouTube Shorts,对关注多模态生成和平台竞争的从业者来说是个明确的信号。基于现有信息,放在 85–94 这个区间偏低的位置是合理的,等有实测数据再往上调。

AI HOT 精选

Gemini Omni:谷歌新模型,先拿视频开刀,号称什么输入都能生成内容

谷歌发了条推文介绍 Gemini Omni,说这个模型能从任意输入生成内容,首发支持视频。正文没披露参数量、定价、上线时间,也没给任何跑分数据。我会先打个折:目前只有一段营销推文和一条线索串,实际能力、成本和延迟全都不清楚。

推荐理由:Google AI 发了一条 Gemini Omni 的预告帖,核心卖点是“从任意输入创造内容”,听着像是要把视频、音频、文本这些全揉进一个生成入口里。我会先打个折:正文没披露参数、没提定价、没给可用时间,也没贴任何基准测试结果,所以现在只能当概念验证看。如果是真的,对做多模态产品的团队来说挺省事,但没见到具体东西之前,这点先别太激动。

TechCrunch · AI

Google 学 Meta 做音频眼镜,在 I/O 2026 上发了款靠语音交互的智能眼镜

Google 在 I/O 大会上宣布和 Warby Parker、Gentle Monster 合作,推出新的“音频眼镜”。这副眼镜没有屏幕,主要靠语音指令来操作 Google 自家的应用和服务,包括调用 Gemini 助手。它会同时支持 Android 和 iOS,设计上有三星参与,预计今年晚些时候上市。正文没披露具体价格、硬件参数和确切发售日期,所...

推荐理由:我会先打个折:正文没给价格、上市时间和硬件参数,所以只能当个信号看,别太激动。但 Google 在 I/O 上亮出这副音频眼镜,摆明了要跟 Meta 抢 AI 穿戴入口,语音调用 Gemini 这条信息本身是实的。对从业者来说,这比单纯发个模型更能说明大厂在把 AI 往硬件里塞的节奏。

AI HOT 精选

谷歌发了 Gemini Omni,一个能把图文视频混着输入、直接出视频的多模态模型

谷歌在推上宣布了 Gemini Omni,说它能吃图像、视频和文本,吐出来的是基于 Gemini 现实世界知识生成的视频。目前只展示了视频生成这一个方向,正文没提模型大小、推理成本、能不能公开用、什么时候上线。我会先打个折:这更像一个预告,不是能立刻上手的东西。

推荐理由:谷歌扔了个 Gemini Omni,能拿图片、视频和文字一起喂进去,直接吐视频出来。我会先打个折:正文没披露模型多大、收不收费、什么时候能用,所以现在只能当个预告看。对跑视频管线的从业者来说,这个输入组合有点意思,但缺了价格和落地时间,暂时没法算账。

AI HOT 精选

Google I/O 发了几个 Gemini 新东西:新设计、智能体功能、Omni 和 3.5 Flash 模型

Google 在 I/O 大会上扔了一串 Gemini 更新。设计上用了“神经表达技术”,听起来像是让交互更自然,但正文没解释具体怎么实现。智能体功能提到了每日简报和 Gemini Spark,还没说什么时候能用。模型这边出了 Gemini Omni 和 3.5 Flash,参数规模、跑分、价格和发布时间一概没提,我会先打个折,等有实测再判断。

推荐理由:HKR 三项都成立:Google I/O 把 Gemini 的 Omni、3.5 Flash 和智能体打包发布,信息量够硬,也踩在开发者关心的竞品节奏上。我会先打个折——正文没给发布时间、参数和价格,所以重要性停在 84 分,featured 没问题。

AI HOT 精选

Gemini 月活冲到 9 亿,官方把功劳归给发版速度

Gemini 应用月活用户超过 9 亿。官方说增长主要靠发布节奏快,但正文没列出具体是哪些功能、怎么统计的、统计周期多长,只预告会在后续推文里回顾过去一年的重要更新。

推荐理由:Gemini 官方账号自己报出 9 亿月活,这个数字够硬,也够有话题性,所以给了 featured。但正文只提了一句增长来自更快发布节奏,具体哪些功能、怎么统计的、算的是 app 还是含网页端,全都没说。我会先打个折:9 亿可能包含 Google 全家桶的被动触达,不一定是主动使用。这点先别太激动,等后续有拆解再重新评估。

Hacker News 首页

Gemini CLI 将于 2026 年 6 月 18 日停服,全面转向 Antigravity CLI

Google 宣布 Gemini CLI 将在 2026 年 6 月 18 日停止服务,个人免费用户和 Pro/Ultra 订阅用户届时都无法再使用。这个命令行工具去年发布后攒了超过 10 万 GitHub 星标和 6000 个合并请求,但 Google 认为用户现在需要的是多个 AI 代理互相配合干活,而不是单打独斗,所以决定把精力集中到新的 Ant...

推荐理由:Google 开发者博客扔出一个 Gemini CLI 的停用日期,并指向 Antigravity CLI 作为替代。标题本身就是一个硬截止日,对依赖这条命令行的开发者冲击不小,所以 HKR 三项都站得住。不过正文除了日期和迁移目标外,没解释怎么迁、兼容性如何、旧项目会不会断,信息量其实很薄。我会先打个折,把它放在 featured 的低位,因为截止日本身就有新闻性,但细节缺口太大,不值得给更高分。

AI HOT 精选

谷歌发布 Gemini 3.5 系列,先上 Flash 版,主攻智能体和编程

谷歌 AI 在 X 上宣布推出 Gemini 3.5 系列,首发的是 Gemini 3.5 Flash。官方说这个版本重点强化了智能体(让模型进业务流程干活)和编程能力。正文没披露参数量、价格、跑分成绩和上下文窗口大小,所以实际提升有多大、成本划不划算,现在还没法判断。

推荐理由:Gemini 3.5 系列是 Google 的正代更新,Flash 版先出,定位在智能体和编程,这两个方向现在很热。但正文没披露价格、上下文长度和参数量,我会先打个折——信息不全,实际落地成本不好判断。这点先别太激动,等补上关键数字再重新评估。

AI HOT 精选

谷歌搜索 25 年来最大改版:用 Gemini 3.5 Flash 把搜索框变成聊天框

谷歌在 I/O 大会上宣布搜索业务改版,核心是把搜索入口从“敲关键词”改成“直接说完整需求”。底层用新发布的 Gemini 3.5 Flash 模型跑响应,官方说速度是 GPT-5.5 的四倍,但没给具体延迟数据。AI Mode 上线一年后月活过了 10 亿,查询量每季度翻倍,说明用户确实在用。交互上,搜索框会动态变大,支持文字、图片、视频、文件甚至当...

推荐理由:谷歌搜索这次改版不是换个皮肤,而是把 AI 直接塞进搜索框和结果页,交互逻辑都变了。10 亿月活和每季度翻倍的查询量说明用户已经在用脚投票,不是实验室里的 demo。对做搜索、做内容、做 SEO 的人来说,这波改动会直接冲击流量分配和产品设计,所以优先级给到 p1。

The Verge · AI

Gemini 将接入沃尔沃 EX60 的外部摄像头,帮你读懂停车标志

Google 和沃尔沃在 I/O 大会上说,Gemini 会连上还没发布的 EX60 SUV 的外部摄像头,第一个功能是解释那些让人头疼的停车标志。这靠的是沃尔沃车机本来就用了 Google 的 Android Automotive 系统。Google 还提了一嘴,以后可能让 Gemini 回忆路过的路牌之类,但正文没展开说具体还有哪些场景。

推荐理由:H 和 K 都成立:Gemini 连上沃尔沃 EX60 外部摄像头做停车标志解读,是一个具体的多模态上车用例,不是画饼。R 偏弱,因为文章只说了功能存在,没讲怎么处理隐私、误判怎么兜底、会在哪些市场推送,这些信息缺口让冲击力打了折扣。

AI HOT 精选

Gemini 3.5 Flash 发布,跑分超 3.1 Pro,生成速度是其他顶尖模型的 4 倍

Google 在 I/O 后开放了 Gemini 3.5 Flash,产品端和 API 都能用。官方说它在多数基准测试上比 3.1 Pro 强,编程能力提升明显,每秒吐 token 的速度是其他前沿模型的 4 倍。不过帖子没给具体跑分数字和测试条件,这点先别太激动。

推荐理由:Google 在 I/O 后放出了 Gemini 3.5 Flash,产品和 API 都能用。最抢眼的数字是每秒吐 token 的速度是其他前沿模型的 4 倍——我会先打个折,因为正文没披露跟哪些模型比、在什么条件下测的,也没给价格和上下文窗口。这点先别太激动,但速度翻几倍对降低延迟和成本确实有用,所以这条消息值得从业者看一眼。