跳到正文

#产品更新

今日 25 条

5月21日星期四

The Verge · AI

YouTube Shorts 现在能用 AI 把别人的视频改成动画或给你换头

YouTube 给 Shorts 的“混剪”功能加了一个叫“重新想象”的选项,背后用的是 Gemini Omni 模型。你可以直接拿别人发过的短视频,让 AI 把画面风格改成动漫、替换画面里的东西,或者把自己的脸塞进原视频里。创作者可以在上传时决定允不允许别人用 AI 改动自己的内容。正文没提生成一次要多久、有没有水印,也没说免费用户能用几次。

推荐理由:Google 给 YouTube Shorts 的 Remix 加了个 reimagine 模式,用 Gemini Omni 直接改别人的短视频。我会先打个折:这不是新模型发布,是个产品功能更新,所以放在低 featured 档。但它的传播力很强,因为“混剪别人视频”这个动作本身就自带话题,而且创作者能选择关掉,这点在授权上算给了台阶。正文没披露这个功能什么时候全量上线,也没说对视频时长、分辨率的限制,这些缺口让实际影响还得再观察。

The Verge · AI

谷歌搜索的 AI 进化,就是塞进更多广告

谷歌开始在搜索广告里用 Gemini 自动生成产品介绍,还会在部分广告里直接嵌入聊天机器人。文章拿胶囊咖啡机举了个例子,但没提具体覆盖范围和广告价格怎么算。说白了,你搜东西时看到的“赞助产品”描述,以后可能都是 AI 写的,有些广告点进去还能跟机器人聊两句。

推荐理由:Google 开始在 Gemini 的商品搜索结果里塞赞助商品和广告聊天机器人了。我会先打个折:正文完全没提投放范围有多大、怎么收费、效果数据如何,所以这更像一次试探性铺开,而不是大规模产品发布。对从业者来说,值得盯的是它把广告嵌进对话式搜索的路径,但现阶段信息缺口太大,先别太激动。

5月20日星期三

TechCrunch · AI

Stability AI 发了新音频模型,最长能生成六分多钟的歌

Stability AI 推出了 Stable Audio 3.0 系列,一共四个模型。最小的两个(4.59 亿参数)能在设备本地跑,生成两分钟的音乐或音效;中等(14 亿参数)和大杯(27 亿参数)模型则能生成 6 分 20 秒的完整曲子,比 2024 年的 2.0 版长了一倍多。小、中杯模型都开放权重,可以随便用和改。不过正文没提训练数据来源、生成...

推荐理由:我会先打个折:标题的 6 分钟和正文的 2 分钟对不上,正文没解释这个差距,所以别太激动。但端侧能跑出 2 分钟音轨这件事本身挺省钱,对做音频工具的人是个信号。整体算中等偏轻的产品更新,靠标题的钩子和端侧成本点撑到 featured 门槛。

The Verge · AI

AI 内容打标签这事,到了见真章的时候

Google 在 I/O 大会上说,现在能更广地验证 SynthID 给 AI 图片打的水印了;另一边 C2PA 也在推一套叫 Content Credentials 的标准,想给图片、视频、音频都加上来源元数据。说白了,就是两套技术路线在比赛谁能更靠谱地告诉你“这东西是不是 AI 生成的”。但文章没具体说这次 SynthID 的验证范围到底铺到了多大...

推荐理由:这条消息本身有料,但正文没给出完整覆盖范围、落地时间表和实际采用数据,所以我会先打个折。它更像一次中量级的溯源更新,不是那种必须立刻写的重磅发布。

The Verge · AI

如果连 Google 都做不出有用的 AI 智能体,那可能没人能了

Google 在 I/O 2026 上发了好几个 AI 智能体,能帮人搜资料、规划活动、总结邮件和日历。这些智能体可以在后台一直跑,但文章没提什么时候上线、怎么收费,也没给任何实测数据。作者的意思是,Google 在 AI 智能体上折腾了好几年,这次借着 OpenClaw 的热度再推一把,但如果连手握海量用户数据的 Google 都搞不定,那整个行业吹...

推荐理由:H 和 R 都很强,因为文章把 Google 的 agent 当成整个行业能不能成的风向标,而且直接踩中从业者对实用性、平台权力和成本的焦虑。K 给了新信息,但只限于后台运行这一点,正文没披露上线时间、定价和实际评测结果,所以整体还是落在 featured 偏下位置。

TechCrunch · AI

Figma 在协作画布里塞了个 AI 助手,能直接用对话生成和修改设计

Figma 在它的多人协作画布上直接加了一个 AI 助手。你可以用大白话让它生成新设计、改现有设计,或者自动跑一些重复活儿,比如批量出不同版本的设计稿。你还能同时开好几个助手,让它们各干各的。Figma 说这个助手能理解设计语境和元素,因为它背后用的模型是专门针对设计场景调过的。不过正文没披露这个助手具体是用自家模型还是接了别家的 API,也没提生成结...

推荐理由:Figma 把 AI agent 塞进了协作画布,你打字就能让它生成或改设计。我会先打个折:正文只说了能力范围,没提用的是什么模型、成本多少、什么时候上线,所以别太激动。但这件事本身值得关注,因为它意味着设计师的工作流可能要被 agent 插一脚了。

阿里技术 · 公众号

阿里平头哥发布真武 M890 AI 芯片,128 卡超节点服务器已在百炼平台上线

阿里平头哥的真武 M890 AI 芯片首次公开,主打 Agent 场景的算力底座。配套的 128 卡超节点服务器,卡间直连延迟低于 150 纳秒,机架带宽达到 Pb/s 级别。这套硬件已经在阿里云百炼平台跑起来了,支持通义千问、DeepSeek 和 Kimi 等模型。不过正文因为环境验证问题没加载出来,具体的芯片架构、制程、显存规格和实测性能数据暂时看...

推荐理由:HKR三项都踩中了,但得先打个折——消息源是阿里自己的技术文章,没有第三方实测、没提定价、也没说量产规模。所以分数就卡在featured门槛上,当个基础设施产品更新看比较合适。

新智元 · 公众号

摩尔线程 MUSA 生态更新:SDK 对齐 CUDA 12.8,SGLang 主线已合并

摩尔线程放出了自家 GPU 生态 MUSA 的最新进展。SDK 5.1.0 把兼容目标拉到了 CUDA 12.8,覆盖了 761 个驱动和运行时接口,意思是跑 CUDA 代码时能认的指令更多了。推理框架 SGLang 的主线代码已经合并了 MUSA 的支持,硬件支持排期在 2026 年第二季度。另外还提了一个叫 MUSACODE 的工具,能自动把库迁移...

推荐理由:我会先打个折:这还是一家厂商的生态更新,不是整个国产 GPU 阵营的集体突破。但文章把兼容 API 数量、SDK 版本对标和 SGLang 主线合入这几个点都摆出来了,比空谈“替代 CUDA”实在。老黄喝豆汁的梗让标题有了传播力,内文也没写成公关稿,对关注推理部署和算力自主的读者来说值得一看。

机器之心 · 公众号

谷歌 I/O 大会后,搜索框直接变成了 AI 智能体入口

谷歌在 I/O 大会上发布了 Gemini 3.5 Flash,并把 AI 模式直接嵌进了搜索框。公司说现在它的 AI 服务每月要处理超过 3200 万亿个 token,已经有超过 850 万开发者在使用 Gemini。不过这篇文章因为微信平台的环境验证问题,正文内容没能加载出来,所以具体的模型参数、性能对比和实际体验细节都没法确认。

推荐理由:谷歌 I/O 这次把模型更新和搜索入口绑在一起推,AI Mode 直接嵌进搜索框,比普通功能发布重得多。Gemini 3.5 Flash 是新的轻量模型,月 token 消耗 3.2 千万亿说明用量已经很大,850 万开发者这个数字也够扎实。我会先打个折:正文没披露 3.5 Flash 的具体 benchmark 对比和定价,实际性价比还得等实测。但就凭搜索框变智能体这一条,当天必须写。

Latent Space

Google I/O 2026:Gemini 3.5 Flash 发布,百万 token 上下文、四种思考模式,主打编程和干活快

Google 在 I/O 大会上把 Gemini 重新定位成消费级 AI 入口和开发者代理平台。最核心的发布是 Gemini 3.5 Flash,今天就能用,上下文窗口 100 万 token,单次最多输出 6.5 万 token,提供“极简/低/中/高”四档思考深度,并且能在多轮对话里保留思考过程。官方说它比 3.1 Pro 更强,尤其在终端操作、编...

推荐理由:Google I/O 这次不是单点发布,是把模型、视频、agent 和开发工具打包一起推。Gemini 3.5 Flash 的定价和上下文窗口摆在那,对做应用的人有直接参考价值;Omni 的视频理解和 Spark 的后台 agent 思路,跟现在行业里追的 agent 落地、多模态成本是同一根神经。我会先打个折——现场 demo 和实际 API 稳定性之间通常有差距,但信息量够、时间点敏感,放 P1 没问题。

AI HOT 精选

微软内部警告:AI 编程工具让 GitHub 的代码托管生意面临生存危机

微软内部认为,Cursor、Claude Code 这类 AI 编程助手正在改变开发者写代码和协作的方式,大家不再需要频繁把代码传到 GitHub 仓库,这让 GitHub 的托管业务受到根本性冲击。微软已经要求部分团队在 2026 年 6 月底前停用 Claude Code,统一改用自家的 GitHub Copilot CLI,表面理由是统一工具链和...

推荐理由:这条消息的杀伤力在于“内部示警”和“生存级风险”这两个词,把 AI 编程工具对 GitHub 托管业务的威胁摆到了台面上。我会先打个折:目前只有一家媒体爆料,微软和 GitHub 都没公开回应,所以不能当定论看。但信息量够硬——微软一边推 Copilot CLI,一边给 Claude Code 设了停用 deadline,说明内部已经在用行政手段抢开发者入口了。对从业者来说,这比单纯的产品更新更有嚼头:如果 AI 编程工具真的让代码托管变得可有可无,GitHub 的护城河就塌了一大块。正文没披露这个决策覆盖多大规模、是否全球执行,这点先别太激动。整...

AI HOT 精选

通义千问发布 Qwen3.7-Max,主打长时间自主干活和跨平台编程

Qwen 团队推出了 Qwen3.7-Max,一个专为智能体场景设计的闭源模型。它最显眼的能力是能长时间自主执行任务,官方演示了一个连续跑 35 小时、调用上千次工具的内核优化任务。在编程方面,它在 Terminal Bench 2.0 上拿了 69.7 分,超过了 DeepSeek-V4-Pro Max 的 67.9 分;在 SWE-Pro 这类复杂...

推荐理由:Qwen Studio 发了 Qwen3.7,一口气覆盖聊天、图像视频理解、图像生成、文档处理、网页搜索、工具调用和工件生成,摆明要往智能体方向走。我会先打个折:正文没给任何 benchmark、定价、上下文窗口或延迟数据,所以没法判断实际可用性和成本。亮点是工具调用和工件生成这两项,说明模型不只是聊天,而是被设计成能进业务流程干活。这点先别太激动,等看到具体评测和接入方式再说。

AI HOT 精选

Gemini Omni 能拿你的脸和声音做数字分身,以后拍视频不用真人出镜了

Gemini Omni 上线了一个新功能,你可以用自己的长相和声音创建一个数字分身。建好之后,这个分身就能替你出镜生成视频,不用每次都重新上传照片。正文没提这个功能要不要钱、在哪些地区能用、什么时候正式上线,我会先打个折观望。

推荐理由:Gemini Omni 让用户拿自己的形象和声音做数字分身视频,建好之后不用反复传图,这点对做内容的人挺方便。但正文没写价格、哪些地区能用、什么时候上线,所以现在只能当个预告看。我会先打个折:功能听着省事,可落地时间表和成本都不清楚,别太激动。

AI HOT 精选

Gemini 3.5 Flash 发布:价格涨了,但谷歌打算把它塞进所有产品里

谷歌在 I/O 大会上直接发布了 Gemini 3.5 Flash,跳过预览阶段。输入价格涨到每百万 token 1.5 美元,输出 9 美元,分别是上一代 Flash 预览版的 3 倍和 Flash-Lite 的 6 倍,已经快追上自家的 Pro 型号了。涨价不是谷歌一家的事,OpenAI 和 Anthropic 的新模型也都在提价,各家似乎都在试探...

推荐理由:我会先打个折:正文只给了价格和全面铺开的意图,没提能力提升、跑分或上下文窗口,所以没法判断涨得值不值。但涨价幅度本身对开发者是硬信号,值得放进精选。

AI HOT 精选

Gemini 推出个人 AI 代理 Spark 和每日简报,能跨 Gmail、文档、幻灯片自动干活

Gemini 这次加了两个功能。一个是 Gemini Spark,相当于一个常驻的个人 AI 代理,你授权后它可以自己在 Gmail、Google Docs 和 Slides 之间跑流程,官方说笔记本合上也能继续运行——这点先别太激动,正文没披露具体怎么实现、延迟和资源消耗也没提。另一个是 Daily Brief,根据你设定的个人目标,每天给你推定制摘...

推荐理由:Gemini 应用这次加了两个东西:Gemini Spark 可以在你授权后跨 Gmail、Docs、Slides 自动操作,Daily Brief 则给美国 18 岁以上订阅用户推送每日简报。等于从聊天助手往个人代理迈了一步,让模型直接进你的文档和邮件里干活。正文没提延迟、错误率和权限撤回细节,实际稳不稳还得看上线后的反馈。

AI HOT 精选

Claude Code 团队把主力输出格式从 Markdown 换成了 HTML

Claude Code 团队发现让模型直接生成 HTML 页面,比用 Markdown 更能把事说清楚。文章举了四个具体用法:用表格做对比、用 CSS 控制排版样式、用 SVG 画图表、用 JavaScript 加交互操作。他们没说性能数据或成本变化,更像是一篇内部实践分享,告诉你“我们这么用下来效果不错”。

推荐理由:Claude Code 团队把默认输出从 Markdown 切到 HTML,这篇官方博文列出了表格、CSS、SVG 和 JS 交互四种用法,说明 HTML 在展示结构化结果和可交互内容上比纯文本强。对写代码的人有实操参考价值,但不算重大产品发布,放在 featured 档合适。

AI HOT 精选

ChatGPT 图像生成周用量冲到 15 亿次,OpenAI 聊了聊 Images 2.0 带来的新玩法

OpenAI 发推说,现在大家每周在 ChatGPT 里生成超过 15 亿张图片。研究员 kenjihata、产品负责人 adele__li 和主持人 AndrewMayne 一起聊了 Images 2.0 上线后冒出来的新用法和趋势。正文没展开具体是哪些用例,也没给技术细节,就提了个数字和一场对谈。

推荐理由:我会先打个折:正文只给了 15 亿这个总数,没拆地区、模型版本或付费/免费比例,也没说 Images 2.0 具体改了啥。但光这个量级就够说明图像生成已经从尝鲜变成高频刚需,对算力规划和竞品压力都有参考价值。没有新能力或定价信息,所以分数停在 78 不往上拉。

TechCrunch · AI

Gmail 现在能直接语音问收件箱了,Google I/O 2026 上演示了用 Gemini 翻找邮件细节

Google 给 Gmail 的 AI 收件箱加上了语音对话搜索,你可以直接开口让 Gemini 帮你从邮件堆里挖出具体信息。目前正文没披露这个功能会推给哪些用户、支持什么语言、要不要额外付费、响应有多快,也没说背后是用什么检索机制把邮件捞出来的。

推荐理由:我会先打个折:这功能听起来挺方便,开车时动嘴就能查邮件里的航班号或报销金额。但正文只说了“可以语音搜 Gmail”,没交代支持哪些语言、是不是全球推送、要不要额外付费,也没讲清楚 Gemini 到底怎么从邮件里捞出答案——是直接扫全文还是先建索引。这点先别太激动,等有实测再判断到底省不省事。

AI HOT 精选

谷歌把 AI 概览和 AI 模式揉进一个搜索框,现在能传图、传文件、传视频问问题

谷歌上线了一个基于 Gemini 3.5 的新搜索框,把之前的 AI Overviews 和 AI Mode 合并成一个入口。你可以打字、传图片、丢文件或发视频,搜索会跨这些格式一起理解你的问题。支持多轮对话,回答会结合上下文更贴近你。桌面和手机端全球同步上线,正文没披露具体延迟和成本数据。

推荐理由:谷歌搜索这次更新,等于把 AI 对话直接嵌进了搜索框,支持文字、图片、文件、视频混着问,还能多轮追问。底层是 Gemini 3.5,把之前的 AI Overviews 和新的 AI Mode 整合在一起,桌面和移动端都上了。对做搜索、做内容、做 AI 产品的人来说,这意味着谷歌的流量分发逻辑在变,跟 Perplexity 那种 AI 搜索的竞争也更直接。不过原文信息偏薄,没写具体交互细节、覆盖地区有没有限制、实际回答质量怎么样,所以重要性我给 86,先别往 90 以上冲。

The Verge · AI

Google I/O 画了一堆 AI 大饼,但前提是你得把个人数据交出来

Google 在 I/O 2026 上发布了 Gemini Spark(常驻 AI 助手,能帮你张罗活动)、Daily Brief(每日简报)和 Gmail AI 收件箱(根据邮件自动生成待办和回信草稿)。这些功能听起来都挺实用,但核心都是靠大量个人数据喂出来的。文章点出了这个信任问题,不过正文没披露具体的数据处理条款,所以先别急着说它安全还是不安全。

推荐理由:Google 在 I/O 2026 亮出的几个新工具,核心卖点是替你读邮件、替你整理信息,但前提是你得把大量个人数据交出去。正文只说了这些功能依赖个人信息,没写数据怎么处理、存多久、会不会拿去训练模型。我会先打个折:产品方向很明确,就是让 AI 住进你的邮箱和日程里,但隐私和信任那部分目前只有表态,没有细节。这点先别太激动,等 Google 把数据处理规则说清楚再判断值不值得跟进。

FT · 科技

Google 要出智能眼镜,还会在搜索引擎里塞进 AI 代理

Google 准备发布智能眼镜,同时给搜索引擎加上 AI 代理功能。CEO Sundar Pichai 说这些功能靠新的 Gemini 模型驱动,目标是缩小跟 Anthropic 和 OpenAI 的差距。不过这篇付费墙后面的正文没披露具体规格、上市时间和价格,所以眼镜长什么样、卖多少钱、什么时候能买到,现在都还不知道。

推荐理由:我会先打个折:正文没披露参数、时间表和价格,所以没法判断落地有多快。但 Google 把 Gemini agent 塞进搜索,再配上智能眼镜,等于在用户每天用的入口上同时推两个 AI 触点。Pichai 自己说新功能要缩小跟 Anthropic、OpenAI 的差距,这话本身就说明他们承认落后,也在用产品动作追。对从业者来说,看点不是技术多新,而是 Google 怎么用分发优势把 agent 推到普通人面前。这点先别太激动,等具体上线和实测再说。

AI HOT 精选

Claude 操控真实界面的生产实践指南:点击更准、长任务不跑偏、操作可回放

Claude 现在能直接操作真实软件界面了,这篇博客讲的是怎么把它用到生产环境里,而不是只跑个 demo。文章给了四个具体机制:一是提高点击准确率,减少点错按钮的概率;二是可以选“思考努力级别”,在速度和效果之间做取舍;三是在长会话里保持上下文,避免任务跑到一半忘了前面在干嘛;四是把 Claude 的操作录成可重放的演示日志,方便排查和复现。正文没给出...

推荐理由:我会先打个折:这不是官方模型或产品发布,更像一份实战经验总结,所以放在质量教程档位。但它把 Claude 操控真实界面的四个关键机制讲得很清楚——怎么提高点击准头、怎么控制模型思考深度、怎么处理长会话不丢上下文、怎么把操作录下来复现。对正在把 agent 塞进业务流程的团队来说,这些点比 benchmark 数字更有用。

AI HOT 精选

OpenAI 卖算力期货:交钱锁定长期 GPU,正文没写价格和最低消费

OpenAI 上线 Guaranteed Capacity 服务,让客户提前锁定长期算力,避免高峰期排队。官方说法是帮企业在算力紧张时也能跑关键任务。但公告没披露价格、合同年限、最低配额,也没说锁的是哪种 GPU。我会先打个折——这更像给大客户吃定心丸,小团队暂时不用激动。

推荐理由:我会先打个折:正文没给价格、期限和容量配额,所以现在只能知道 OpenAI 开始卖算力预留,但不知道划不划算。H 来自 OpenAI 把算力稀缺变成一种可预订的服务,对 API 用户是个实在的钩子。K 只到产品名和规划机制这一步,缺关键商业细节。R 踩中了生产可靠性和预算规划这两个痛点,所以能进 featured,但信息缺口把分数压在中段。

AI HOT 精选

Google 把 Tensor 芯片的 AI 能力开放给开发者,Pixel 10 手机上的 TPU 现在可以直接跑模型了

Google 发布了 Tensor ML SDK 的公开测试版,开发者现在能把 PyTorch 或 TFLite 模型转换、编译后,直接调用 Pixel 10 系列手机里的 TPU 芯片来跑推理。整个流程通过 LiteRT 这个统一框架完成,不用再分别对接底层硬件驱动。官方还提供了一个模型库,里面有超过 100 个现成的经典模型和生成式 AI 模型,包...

推荐理由:HKR-K 很扎实:文章给出了 Pixel 10 TPU 上的具体工作流和一个 100+ 模型库。H 和 R 也够得上 featured,但这是个测试版开发者 SDK,不是旗舰模型或面向大众的产品发布,所以我会先打个折。

AI HOT 精选

Gemini Omni 发布:能理解物理世界的视频生成模型,面向付费用户开放

Gemini Omni 不只是生成画面,它会判断场景里接下来该发生什么——比如物体掉落、碰撞这类物理规律,同时结合历史、科学和文化知识来构建内容。视频生成功能今天起向全球 Google AI Plus、Pro 和 Ultra 订阅用户开放,可以在 Gemini 应用、Google Flow 和 YouTube Shorts 里用。正文没披露推理的具体技...

推荐理由:我会先打个折:正文只给了发布和接入渠道,没放任何物理推理的测试案例、视频生成的质量对比或具体定价,所以信息密度其实偏薄。但“物理推理+视频生成”这个标签本身够硬,加上直接打通 YouTube Shorts,对关注多模态生成和平台竞争的从业者来说是个明确的信号。基于现有信息,放在 85–94 这个区间偏低的位置是合理的,等有实测数据再往上调。

AI HOT 精选

Gemini Omni:谷歌新模型,先拿视频开刀,号称什么输入都能生成内容

谷歌发了条推文介绍 Gemini Omni,说这个模型能从任意输入生成内容,首发支持视频。正文没披露参数量、定价、上线时间,也没给任何跑分数据。我会先打个折:目前只有一段营销推文和一条线索串,实际能力、成本和延迟全都不清楚。

推荐理由:Google AI 发了一条 Gemini Omni 的预告帖,核心卖点是“从任意输入创造内容”,听着像是要把视频、音频、文本这些全揉进一个生成入口里。我会先打个折:正文没披露参数、没提定价、没给可用时间,也没贴任何基准测试结果,所以现在只能当概念验证看。如果是真的,对做多模态产品的团队来说挺省事,但没见到具体东西之前,这点先别太激动。

TechCrunch · AI

Google 学 Meta 做音频眼镜,在 I/O 2026 上发了款靠语音交互的智能眼镜

Google 在 I/O 大会上宣布和 Warby Parker、Gentle Monster 合作,推出新的“音频眼镜”。这副眼镜没有屏幕,主要靠语音指令来操作 Google 自家的应用和服务,包括调用 Gemini 助手。它会同时支持 Android 和 iOS,设计上有三星参与,预计今年晚些时候上市。正文没披露具体价格、硬件参数和确切发售日期,所...

推荐理由:我会先打个折:正文没给价格、上市时间和硬件参数,所以只能当个信号看,别太激动。但 Google 在 I/O 上亮出这副音频眼镜,摆明了要跟 Meta 抢 AI 穿戴入口,语音调用 Gemini 这条信息本身是实的。对从业者来说,这比单纯发个模型更能说明大厂在把 AI 往硬件里塞的节奏。

AI HOT 精选

谷歌发了 Gemini Omni,一个能把图文视频混着输入、直接出视频的多模态模型

谷歌在推上宣布了 Gemini Omni,说它能吃图像、视频和文本,吐出来的是基于 Gemini 现实世界知识生成的视频。目前只展示了视频生成这一个方向,正文没提模型大小、推理成本、能不能公开用、什么时候上线。我会先打个折:这更像一个预告,不是能立刻上手的东西。

推荐理由:谷歌扔了个 Gemini Omni,能拿图片、视频和文字一起喂进去,直接吐视频出来。我会先打个折:正文没披露模型多大、收不收费、什么时候能用,所以现在只能当个预告看。对跑视频管线的从业者来说,这个输入组合有点意思,但缺了价格和落地时间,暂时没法算账。

AI HOT 精选

Google I/O 发了几个 Gemini 新东西:新设计、智能体功能、Omni 和 3.5 Flash 模型

Google 在 I/O 大会上扔了一串 Gemini 更新。设计上用了“神经表达技术”,听起来像是让交互更自然,但正文没解释具体怎么实现。智能体功能提到了每日简报和 Gemini Spark,还没说什么时候能用。模型这边出了 Gemini Omni 和 3.5 Flash,参数规模、跑分、价格和发布时间一概没提,我会先打个折,等有实测再判断。

推荐理由:HKR 三项都成立:Google I/O 把 Gemini 的 Omni、3.5 Flash 和智能体打包发布,信息量够硬,也踩在开发者关心的竞品节奏上。我会先打个折——正文没给发布时间、参数和价格,所以重要性停在 84 分,featured 没问题。

AI HOT 精选

Gemini 月活冲到 9 亿,官方把功劳归给发版速度

Gemini 应用月活用户超过 9 亿。官方说增长主要靠发布节奏快,但正文没列出具体是哪些功能、怎么统计的、统计周期多长,只预告会在后续推文里回顾过去一年的重要更新。

推荐理由:Gemini 官方账号自己报出 9 亿月活,这个数字够硬,也够有话题性,所以给了 featured。但正文只提了一句增长来自更快发布节奏,具体哪些功能、怎么统计的、算的是 app 还是含网页端,全都没说。我会先打个折:9 亿可能包含 Google 全家桶的被动触达,不一定是主动使用。这点先别太激动,等后续有拆解再重新评估。

Hacker News 首页

Gemini CLI 将于 2026 年 6 月 18 日停服,全面转向 Antigravity CLI

Google 宣布 Gemini CLI 将在 2026 年 6 月 18 日停止服务,个人免费用户和 Pro/Ultra 订阅用户届时都无法再使用。这个命令行工具去年发布后攒了超过 10 万 GitHub 星标和 6000 个合并请求,但 Google 认为用户现在需要的是多个 AI 代理互相配合干活,而不是单打独斗,所以决定把精力集中到新的 Ant...

推荐理由:Google 开发者博客扔出一个 Gemini CLI 的停用日期,并指向 Antigravity CLI 作为替代。标题本身就是一个硬截止日,对依赖这条命令行的开发者冲击不小,所以 HKR 三项都站得住。不过正文除了日期和迁移目标外,没解释怎么迁、兼容性如何、旧项目会不会断,信息量其实很薄。我会先打个折,把它放在 featured 的低位,因为截止日本身就有新闻性,但细节缺口太大,不值得给更高分。

AI HOT 精选

谷歌发布 Gemini 3.5 系列,先上 Flash 版,主攻智能体和编程

谷歌 AI 在 X 上宣布推出 Gemini 3.5 系列,首发的是 Gemini 3.5 Flash。官方说这个版本重点强化了智能体(让模型进业务流程干活)和编程能力。正文没披露参数量、价格、跑分成绩和上下文窗口大小,所以实际提升有多大、成本划不划算,现在还没法判断。

推荐理由:Gemini 3.5 系列是 Google 的正代更新,Flash 版先出,定位在智能体和编程,这两个方向现在很热。但正文没披露价格、上下文长度和参数量,我会先打个折——信息不全,实际落地成本不好判断。这点先别太激动,等补上关键数字再重新评估。

AI HOT 精选

谷歌搜索 25 年来最大改版:用 Gemini 3.5 Flash 把搜索框变成聊天框

谷歌在 I/O 大会上宣布搜索业务改版,核心是把搜索入口从“敲关键词”改成“直接说完整需求”。底层用新发布的 Gemini 3.5 Flash 模型跑响应,官方说速度是 GPT-5.5 的四倍,但没给具体延迟数据。AI Mode 上线一年后月活过了 10 亿,查询量每季度翻倍,说明用户确实在用。交互上,搜索框会动态变大,支持文字、图片、视频、文件甚至当...

推荐理由:谷歌搜索这次改版不是换个皮肤,而是把 AI 直接塞进搜索框和结果页,交互逻辑都变了。10 亿月活和每季度翻倍的查询量说明用户已经在用脚投票,不是实验室里的 demo。对做搜索、做内容、做 SEO 的人来说,这波改动会直接冲击流量分配和产品设计,所以优先级给到 p1。

The Verge · AI

Gemini 将接入沃尔沃 EX60 的外部摄像头,帮你读懂停车标志

Google 和沃尔沃在 I/O 大会上说,Gemini 会连上还没发布的 EX60 SUV 的外部摄像头,第一个功能是解释那些让人头疼的停车标志。这靠的是沃尔沃车机本来就用了 Google 的 Android Automotive 系统。Google 还提了一嘴,以后可能让 Gemini 回忆路过的路牌之类,但正文没展开说具体还有哪些场景。

推荐理由:H 和 K 都成立:Gemini 连上沃尔沃 EX60 外部摄像头做停车标志解读,是一个具体的多模态上车用例,不是画饼。R 偏弱,因为文章只说了功能存在,没讲怎么处理隐私、误判怎么兜底、会在哪些市场推送,这些信息缺口让冲击力打了折扣。

AI HOT 精选

Gemini 3.5 Flash 发布,跑分超 3.1 Pro,生成速度是其他顶尖模型的 4 倍

Google 在 I/O 后开放了 Gemini 3.5 Flash,产品端和 API 都能用。官方说它在多数基准测试上比 3.1 Pro 强,编程能力提升明显,每秒吐 token 的速度是其他前沿模型的 4 倍。不过帖子没给具体跑分数字和测试条件,这点先别太激动。

推荐理由:Google 在 I/O 后放出了 Gemini 3.5 Flash,产品和 API 都能用。最抢眼的数字是每秒吐 token 的速度是其他前沿模型的 4 倍——我会先打个折,因为正文没披露跟哪些模型比、在什么条件下测的,也没给价格和上下文窗口。这点先别太激动,但速度翻几倍对降低延迟和成本确实有用,所以这条消息值得从业者看一眼。

The Verge · AI

Google I/O 2026 一口气发了 13 个 AI 更新,Gemini 3.5 直接成了默认模型

Google 在 I/O 2026 上发布了新模型 Gemini 3.5 Flash,今天起它就是 Gemini 应用和搜索里 AI Mode 的默认模型了。更强的 Gemini 3.5 Pro 下个月才来。文章只提了这俩模型、搜索、Gmail 和智能眼镜 Project Aura 有更新,但没把 13 个发布全列出来,想看完整清单得去 The Ver...

推荐理由:这条消息有 I/O 大会的流量加持,Gemini 3.5 Flash 默认上线的动作也够快,对关注 Google 生态的人来说是个明确的信号。但正文只说了默认切换和 Pro 的时间点,13 项完整清单、跑分、定价这些关键信息都没给,所以重要性先打个折,放在 featured 里而不是直接上首页。

AI HOT 精选

谷歌发布 Gemini 3.5 Flash,智商分涨到 55,速度超 280 tokens/秒,但运行成本贵了 5.5 倍

谷歌把 Gemini Flash 系列更新到了 3.5 版,智商评分从上一代的 46 分提到 55 分,直接超过了 Grok 4.3 和 Claude Sonnet 4.6。进步主要在两方面:一是让模型进业务流程干活(代理任务)更靠谱了,二是知识真实性提升,幻觉明显减少。输出速度超过每秒 280 个 token,在速度和智商之间卡了个好位置。多模态评测...

推荐理由:谷歌发Gemini 3.5 Flash,属于头部实验室的模型迭代,而且有Artificial Analysis的第三方数据撑腰,速度、智能、成本都摆出来了。HKR三项全中,尤其是5.5倍的成本跳涨让这条消息不止于常规发布,值得从业者看一眼。

TechCrunch · AI

Google 把街景塞进 Genie 世界模型,现在能直接生成可交互的街道模拟

Google DeepMind 把 Street View 街景数据接入了自家的世界模型 Project Genie,让它能根据真实街道照片生成可交互的 3D 场景。你可以像玩游戏一样在模拟街道里走动,还能调天气、看极端气候下的样子。官方说这会用在机器人训练、游戏和旅游场景里,但正文没披露模型参数、上线时间,也没给任何评测结果,所以实际效果和成本都还是...

推荐理由:谷歌 DeepMind 把 Street View 塞进 Project Genie,等于让街景从静态照片变成能走进去互动的模拟环境。我会先打个折:正文完全没披露模型大小、推理延迟、上线计划,也没给任何定量评测,所以现在只能当一次技术演示看。但它的钩子很实在——机器人训练可以直接用真实街景做仿真,游戏生成也能拿到现成的地图素材,再加上谷歌手里独一份的街景数据,这个方向本身值得关注。

TechCrunch · AI

谷歌发布 Gemini 3.5 Flash,把下一波 AI 押注在能自己干活的智能体上,而不是聊天机器人

谷歌在 I/O 开发者大会上推出了 Gemini 3.5 Flash,官方说这是他们目前写代码和驱动 AI 智能体(让模型进业务流程干活)最强的模型。它能独立跑通编程流程、管理研究项目,内部测试里甚至从零搭建了一个操作系统。这标志着谷歌的重心从聊天转向了能自主执行复杂任务的智能体。不过,正文没披露这个模型的参数量、上下文窗口和具体定价,所以实际成本和规...

推荐理由:我会先打个折:正文没披露参数量、价格和上下文窗口,所以性能上限和实际成本都还看不清。但 Google 这次把 Gemini 3.5 Flash 直接押在 agent 和从零写软件上,等于说“别只把我当聊天工具,我能进业务流程干活”。对做 agent 和代码生成的人来说,这个方向比单纯刷榜更有看头。不过没给技术细节和定价,现在只能当信号看,别太激动。

The Verge · AI

Google 想用 CodeMender 跟 Anthropic 的 Claude Mythos 抢安全赛道

Google 在 I/O 上把去年 10 月亮相的代码安全工具 CodeMender 的 API 开放给一批专家测试,定位是“能自己发现漏洞并修好”的 AI agent。DeepMind CTO 说目标是帮全球代码库做安全加固。文章拿它跟 Anthropic 突然发布的 Claude Mythos Preview 对比,但正文没披露 CodeMende...

推荐理由:HKR 三项都踩中了,但正文只确认了封闭内测和标记修复机制,开放时间、价格、评测结果全都没披露,所以先放在 featured 这一档。