跳到正文

Google / Gemini

Google 与 DeepMind 的 AI 动态:Gemini 系列、Veo 视频模型、研究成果与产品生态的持续追踪。

最新精选

第 261–280 条 · 共 409 条

5月20日星期三

AI HOT 精选

Google I/O 发了几个 Gemini 新东西:新设计、智能体功能、Omni 和 3.5 Flash 模型

Google 在 I/O 大会上扔了一串 Gemini 更新。设计上用了“神经表达技术”,听起来像是让交互更自然,但正文没解释具体怎么实现。智能体功能提到了每日简报和 Gemini Spark,还没说什么时候能用。模型这边出了 Gemini Omni 和 3.5 Flash,参数规模、跑分、价格和发布时间一概没提,我会先打个折,等有实测再判断。

推荐理由:HKR 三项都成立:Google I/O 把 Gemini 的 Omni、3.5 Flash 和智能体打包发布,信息量够硬,也踩在开发者关心的竞品节奏上。我会先打个折——正文没给发布时间、参数和价格,所以重要性停在 84 分,featured 没问题。

AI HOT 精选

Google 发了 Gemini 3.5,说模型不光能想还能动手干活

Google AI 开发者账号宣布了 Gemini 3.5 模型家族,强调它把推理和执行能力合在一起,目标是让模型直接进业务流程干活。但正文没披露参数量、跑分、价格、上下文窗口和具体上线时间,也没说跟上一代比到底强在哪。这点先别太激动,等有实测数据再看。

推荐理由:H 和 R 都站得住:官方发新模型家族,关注度够高,也会刺激大家去比参数、比价格。但 K 确实不行,整篇公告除了名字什么都没给,没法做技术判断,所以总分拉不到 85 以上。

AI HOT 精选

Gemini 月活冲到 9 亿,官方把功劳归给发版速度

Gemini 应用月活用户超过 9 亿。官方说增长主要靠发布节奏快,但正文没列出具体是哪些功能、怎么统计的、统计周期多长,只预告会在后续推文里回顾过去一年的重要更新。

推荐理由:Gemini 官方账号自己报出 9 亿月活,这个数字够硬,也够有话题性,所以给了 featured。但正文只提了一句增长来自更快发布节奏,具体哪些功能、怎么统计的、算的是 app 还是含网页端,全都没说。我会先打个折:9 亿可能包含 Google 全家桶的被动触达,不一定是主动使用。这点先别太激动,等后续有拆解再重新评估。

AI HOT 精选

Google 把 Gemini 科研助手 ERA 发在 Nature 上,并开放早期测试

Google Research 在《自然》杂志上发表了他们基于 Gemini 的“经验研究助手”(ERA),同时通过 Google Labs 的可信测试者计划开放了早期访问。这个工具想帮研究人员自动完成文献综述、提出假设和设计实验这些耗时的工作。文章主要讲了 ERA 从一篇 Nature 论文走向实际计算发现工具的过程,但正文没披露它在真实科研场景里的...

推荐理由:Google Research 把基于 Gemini 的 ERA 发在了 Nature 上,同时通过 Google Labs 的可信赖测试者计划开放初步试用。我会先打个折:正文没给出具体指标、基准测试设置,也没讲可复现的工作流细节,所以没法判断它到底有多能打。但这件事本身值得关注——它不是在秀一个 demo,而是试图把论文里的研究助手推到真实科研场景里去验证。这点先别太激动,等看到实际使用反馈和量化结果再说。

Hacker News 首页

Gemini CLI 将于 2026 年 6 月 18 日停服,全面转向 Antigravity CLI

Google 宣布 Gemini CLI 将在 2026 年 6 月 18 日停止服务,个人免费用户和 Pro/Ultra 订阅用户届时都无法再使用。这个命令行工具去年发布后攒了超过 10 万 GitHub 星标和 6000 个合并请求,但 Google 认为用户现在需要的是多个 AI 代理互相配合干活,而不是单打独斗,所以决定把精力集中到新的 Ant...

推荐理由:Google 开发者博客扔出一个 Gemini CLI 的停用日期,并指向 Antigravity CLI 作为替代。标题本身就是一个硬截止日,对依赖这条命令行的开发者冲击不小,所以 HKR 三项都站得住。不过正文除了日期和迁移目标外,没解释怎么迁、兼容性如何、旧项目会不会断,信息量其实很薄。我会先打个折,把它放在 featured 的低位,因为截止日本身就有新闻性,但细节缺口太大,不值得给更高分。

AI HOT 精选

谷歌发布 Gemini 3.5 系列,先上 Flash 版,主攻智能体和编程

谷歌 AI 在 X 上宣布推出 Gemini 3.5 系列,首发的是 Gemini 3.5 Flash。官方说这个版本重点强化了智能体(让模型进业务流程干活)和编程能力。正文没披露参数量、价格、跑分成绩和上下文窗口大小,所以实际提升有多大、成本划不划算,现在还没法判断。

推荐理由:Gemini 3.5 系列是 Google 的正代更新,Flash 版先出,定位在智能体和编程,这两个方向现在很热。但正文没披露价格、上下文长度和参数量,我会先打个折——信息不全,实际落地成本不好判断。这点先别太激动,等补上关键数字再重新评估。

AI HOT 精选

谷歌搜索 25 年来最大改版:用 Gemini 3.5 Flash 把搜索框变成聊天框

谷歌在 I/O 大会上宣布搜索业务改版,核心是把搜索入口从“敲关键词”改成“直接说完整需求”。底层用新发布的 Gemini 3.5 Flash 模型跑响应,官方说速度是 GPT-5.5 的四倍,但没给具体延迟数据。AI Mode 上线一年后月活过了 10 亿,查询量每季度翻倍,说明用户确实在用。交互上,搜索框会动态变大,支持文字、图片、视频、文件甚至当...

推荐理由:谷歌搜索这次改版不是换个皮肤,而是把 AI 直接塞进搜索框和结果页,交互逻辑都变了。10 亿月活和每季度翻倍的查询量说明用户已经在用脚投票,不是实验室里的 demo。对做搜索、做内容、做 SEO 的人来说,这波改动会直接冲击流量分配和产品设计,所以优先级给到 p1。

The Verge · AI

Gemini 将接入沃尔沃 EX60 的外部摄像头,帮你读懂停车标志

Google 和沃尔沃在 I/O 大会上说,Gemini 会连上还没发布的 EX60 SUV 的外部摄像头,第一个功能是解释那些让人头疼的停车标志。这靠的是沃尔沃车机本来就用了 Google 的 Android Automotive 系统。Google 还提了一嘴,以后可能让 Gemini 回忆路过的路牌之类,但正文没展开说具体还有哪些场景。

推荐理由:H 和 K 都成立:Gemini 连上沃尔沃 EX60 外部摄像头做停车标志解读,是一个具体的多模态上车用例,不是画饼。R 偏弱,因为文章只说了功能存在,没讲怎么处理隐私、误判怎么兜底、会在哪些市场推送,这些信息缺口让冲击力打了折扣。

AI HOT 精选

Gemini 3.5 Flash 发布,跑分超 3.1 Pro,生成速度是其他顶尖模型的 4 倍

Google 在 I/O 后开放了 Gemini 3.5 Flash,产品端和 API 都能用。官方说它在多数基准测试上比 3.1 Pro 强,编程能力提升明显,每秒吐 token 的速度是其他前沿模型的 4 倍。不过帖子没给具体跑分数字和测试条件,这点先别太激动。

推荐理由:Google 在 I/O 后放出了 Gemini 3.5 Flash,产品和 API 都能用。最抢眼的数字是每秒吐 token 的速度是其他前沿模型的 4 倍——我会先打个折,因为正文没披露跟哪些模型比、在什么条件下测的,也没给价格和上下文窗口。这点先别太激动,但速度翻几倍对降低延迟和成本确实有用,所以这条消息值得从业者看一眼。

The Verge · AI

Google I/O 2026 一口气发了 13 个 AI 更新,Gemini 3.5 直接成了默认模型

Google 在 I/O 2026 上发布了新模型 Gemini 3.5 Flash,今天起它就是 Gemini 应用和搜索里 AI Mode 的默认模型了。更强的 Gemini 3.5 Pro 下个月才来。文章只提了这俩模型、搜索、Gmail 和智能眼镜 Project Aura 有更新,但没把 13 个发布全列出来,想看完整清单得去 The Ver...

推荐理由:这条消息有 I/O 大会的流量加持,Gemini 3.5 Flash 默认上线的动作也够快,对关注 Google 生态的人来说是个明确的信号。但正文只说了默认切换和 Pro 的时间点,13 项完整清单、跑分、定价这些关键信息都没给,所以重要性先打个折,放在 featured 里而不是直接上首页。

AI HOT 精选

谷歌发布 Gemini 3.5 Flash,智商分涨到 55,速度超 280 tokens/秒,但运行成本贵了 5.5 倍

谷歌把 Gemini Flash 系列更新到了 3.5 版,智商评分从上一代的 46 分提到 55 分,直接超过了 Grok 4.3 和 Claude Sonnet 4.6。进步主要在两方面:一是让模型进业务流程干活(代理任务)更靠谱了,二是知识真实性提升,幻觉明显减少。输出速度超过每秒 280 个 token,在速度和智商之间卡了个好位置。多模态评测...

推荐理由:谷歌发Gemini 3.5 Flash,属于头部实验室的模型迭代,而且有Artificial Analysis的第三方数据撑腰,速度、智能、成本都摆出来了。HKR三项全中,尤其是5.5倍的成本跳涨让这条消息不止于常规发布,值得从业者看一眼。

TechCrunch · AI

Google 把街景塞进 Genie 世界模型,现在能直接生成可交互的街道模拟

Google DeepMind 把 Street View 街景数据接入了自家的世界模型 Project Genie,让它能根据真实街道照片生成可交互的 3D 场景。你可以像玩游戏一样在模拟街道里走动,还能调天气、看极端气候下的样子。官方说这会用在机器人训练、游戏和旅游场景里,但正文没披露模型参数、上线时间,也没给任何评测结果,所以实际效果和成本都还是...

推荐理由:谷歌 DeepMind 把 Street View 塞进 Project Genie,等于让街景从静态照片变成能走进去互动的模拟环境。我会先打个折:正文完全没披露模型大小、推理延迟、上线计划,也没给任何定量评测,所以现在只能当一次技术演示看。但它的钩子很实在——机器人训练可以直接用真实街景做仿真,游戏生成也能拿到现成的地图素材,再加上谷歌手里独一份的街景数据,这个方向本身值得关注。

TechCrunch · AI

谷歌发布 Gemini 3.5 Flash,把下一波 AI 押注在能自己干活的智能体上,而不是聊天机器人

谷歌在 I/O 开发者大会上推出了 Gemini 3.5 Flash,官方说这是他们目前写代码和驱动 AI 智能体(让模型进业务流程干活)最强的模型。它能独立跑通编程流程、管理研究项目,内部测试里甚至从零搭建了一个操作系统。这标志着谷歌的重心从聊天转向了能自主执行复杂任务的智能体。不过,正文没披露这个模型的参数量、上下文窗口和具体定价,所以实际成本和规...

推荐理由:我会先打个折:正文没披露参数量、价格和上下文窗口,所以性能上限和实际成本都还看不清。但 Google 这次把 Gemini 3.5 Flash 直接押在 agent 和从零写软件上,等于说“别只把我当聊天工具,我能进业务流程干活”。对做 agent 和代码生成的人来说,这个方向比单纯刷榜更有看头。不过没给技术细节和定价,现在只能当信号看,别太激动。

The Verge · AI

Google 想用 CodeMender 跟 Anthropic 的 Claude Mythos 抢安全赛道

Google 在 I/O 上把去年 10 月亮相的代码安全工具 CodeMender 的 API 开放给一批专家测试,定位是“能自己发现漏洞并修好”的 AI agent。DeepMind CTO 说目标是帮全球代码库做安全加固。文章拿它跟 Anthropic 突然发布的 Claude Mythos Preview 对比,但正文没披露 CodeMende...

推荐理由:HKR 三项都踩中了,但正文只确认了封闭内测和标记修复机制,开放时间、价格、评测结果全都没披露,所以先放在 featured 这一档。

TechCrunch · AI

谷歌搜索不再是那个链接列表了

谷歌在 I/O 大会上把搜索框彻底重做了。以后你输入问题,它不再只给你一排蓝色链接,而是直接展开成对话式回答,甚至能派“信息代理人”去帮你跑腿查资料、生成一个临时小工具。文章没给出具体上线时间,也没提这次改动对网站流量的影响有多大,但可以确定的是,那个靠排序链接来呈现信息的搜索时代结束了。

推荐理由:我会先打个折:正文没给上线时间、流量影响数据,也没说清楚代理具体能干什么,更像一篇观点评论。但 Google 把搜索从链接列表改成对话回答加自主代理,这个方向如果落地,对依赖搜索流量的产品和内容生态是实打实的冲击。标题虽然夸张,但抓住了搜索产品逻辑在转向这个点,所以给了 88 分、p1 级别。

AI HOT 精选

谷歌发布 Gemini 3.5 Flash,专治复杂、跑得久的自动化流程

谷歌在 I/O 大会上掏出了 Gemini 3.5 系列的第一个模型 Flash,定位很明确:让模型进业务流程干活,处理那种步骤多、周期长的任务。在 Terminal-Bench 和 MCP Atlas 这两个考编程和代理能力的测试里,它的分数压过了自家上一代的 3.1 Pro。速度方面,比别家顶尖模型快 4 倍,如果放在谷歌自己的 Antigravi...

推荐理由:谷歌在 I/O 大会上扔了个 Gemini 3.5 Flash,专门给那种要跑很久、步骤很复杂的 agent 工作流用的。我会先打个折:跑分是谷歌自己给的,第三方还没复现,但 Terminal-Bench 上超 3.1 Pro、速度是其他前沿模型 4 倍这些数字,如果属实确实省钱省时间。Antigravity 环境里飙到 12 倍,这点先别太激动,正文没披露那是啥场景、跟谁比。整体看,这是个同日发布的重要模型更新,对做 agent 落地的人有直接参考价值,但还没到改写行业规则的程度。

The Verge · AI

Gmail 要能语音对话了:对着收件箱直接问,它帮你翻邮件找答案

Google 给 Gmail 加了一个叫 Gmail Live 的语音功能,点搜索栏图标就能直接开口问收件箱里的内容。发布会上员工现场演示,问了孩子学校的活动和自己去底特律的行程,Gmail 直接从邮件里抓出了学校展示活动的日期地点和行程信息。正文没披露这个功能什么时候上线、支持哪些语言,也没说离线能不能用。

推荐理由:我会先打个折:正文只给了两个演示例子,没写什么时候上线、要不要付费、背后用的什么模型。所以判断停在 featured 低段。但这件事本身挺直观——Gmail 搜索栏加了个语音入口,你对着它问“底特律的酒店订单”或者“孩子学校活动日期”,它直接回话,不用翻邮件。对每天被邮件淹没的人来说,省事是真的。这点先别太激动,等正式推送再看实际识别率和隐私处理。

The Verge · AI

Google 搜索迎来最大改版,搜索框会主动帮你把问题问得更细

Google 在 I/O 2026 上展示了重新设计的搜索框,底层用 Gemini 3.5 Flash 驱动,把顶部的 AI 摘要和聊天式搜索体验打通了。产品 VP Robby Stein 说,以后你用自然语言提问,基本都能稳定触发 AI 摘要。新搜索框能自动扩展开来承接长问题,还会用 AI 补全你的提问。不过正文没披露具体什么时候推全量,这点先别太激动。

推荐理由:我会先打个折:正文没写上线时间,也没给灰度范围,所以重要性停在 86 分。但这件事本身够硬——Google 把搜索框从关键词匹配改成 Gemini 3.5 Flash 驱动的对话入口,AI Overviews 和 AI Mode 不再各自为战,而是同一个模型在背后调度。对做搜索优化、内容分发和 AI 产品的人来说,这意味着流量路径可能被重新画一遍。这点先别太激动,毕竟没上线日期,但值得现在就盯着。

The Verge · AI

Google I/O 推出 AI 购物通用购物车,让 Gemini 帮你跨店下单

Google 在 I/O 大会上发布了一个“通用购物车”,用户在搜索或跟 Gemini 聊天时就能把不同零售商的商品加进去,最后通过 Google 统一结账。这个购物车还会追踪价格、提示补货、推荐折扣,并提醒你选的商品可能有什么问题。未来会接入 YouTube 和 Gmail,但正文没披露定价、具体上线时间和首批覆盖哪些零售商。

推荐理由:Google 在 I/O 上放了个挺大胆的购物功能:你在 Search 或 Gemini 里看到想买的东西,AI 直接帮你加进购物车,最后通过 Google 结账。正文说未来还会接入 YouTube 和 Gmail,等于把购物触点铺到更多地方。我会先打个折——目前只说了发布,没给上线时间、覆盖商家和退款纠纷怎么处理,这些才是决定它能不能用的关键。但方向很明确,Google 想把 AI 从“帮你搜”推到“帮你花”,信任门槛比普通搜索高得多。

The Verge · AI

Google AI Studio 现在能靠一句话生成安卓原生 App

Google 给 AI Studio 加了个新功能:你输入想法,它直接生成一个能在安卓手机上跑的 App。平台里内嵌了安卓模拟器,写完可以先预览;想真机体验的话,把手机连上电脑就能安装。Google 说后续还会开放测试邀请功能,但目前还没上线。这次首发主要面向个人小工具类应用,不是啥都能做。

推荐理由:Google AI Studio 现在能靠提示词直接吐出可安装的 Android 原生应用,还带模拟器预览和真机安装。初版只覆盖个人工具类应用,不是完整开发环境,所以算中等分量的产品更新,不是 P1。