跳到正文

Google / Gemini

Google 与 DeepMind 的 AI 动态:Gemini 系列、Veo 视频模型、研究成果与产品生态的持续追踪。

最新精选

第 221–240 条 · 共 409 条

5月28日星期四

AI HOT 精选

Google 搜索产品 VP 聊 AI 原生搜索:新模式怎么跑、成本多高、出版商怎么办

Robby Stein 在 Google I/O 上谈了搜索正在从列链接转向直接给答案的 AI 原生模式。AI Mode 会把复杂问题拆成多轮搜索去查,背后跑在 Google 自己的 TPU 上,推理成本不低,但正文没给具体数字。搜索量没降反升,这点他提了但没展开数据。关于答案里引用哪些信息源和链接,有一套选择逻辑,但没细说权重。出版商最关心的流量问题...

推荐理由:这是一篇访谈摘要,不是产品发布,所以我会先打个折。HKR 三个维度都踩中了,但正文没披露具体价格、流量数字或成本数据,判断只能停在“高质量访谈”这个区间。文章把 Google 转向 AI 原生搜索的几个矛盾摆得很清楚:想用多轮对话和 AI Mode 留住用户,又得面对 TPU 成本高和出版商怕被截流的现实。信息够硬,但缺量化验证,所以分数给到 74 是合理的。

5月27日星期三

纽约时报中文网

谷歌怎么从 AI 掉队变成领跑的?

两年前谷歌的 AI 还在建议人吃石头、往披萨上抹胶水,现在它的聊天机器人 Gemini 月活用户已经冲到 9 亿,跟 OpenAI 自报的 ChatGPT 用户数打平。谷歌没把 Gemini 当独立产品养,而是直接塞进 Gmail、地图、Google.com 这些每天被几十亿人用的服务里,连苹果 Siri 未来的底层技术也换成了它,等于 Gemini ...

推荐理由:HKR三项全中。文章用逆袭主线把谷歌从掉队拉到能打的位置,钩子够强;9亿用户、770亿广告收入、Siri合作这些数字和信息量扎实,不是空谈;对从业者来说,模型竞争格局和分发渠道的变动直接关系工作判断,相关性高。整体是产业分析而非模型发布,放在78-84分档合理。

TechCrunch · AI

用户不想被硬塞 AI 搜索,DuckDuckGo 安装量涨了 30%

Google 在 2026 I/O 大会上把传统搜索结果页的蓝色链接换成了 AI 代理,直接替用户做决定。用户反弹很快,DuckDuckGo 的 App 安装量跟着涨了 30%,说明不少人开始找别的搜索入口。正文没披露这个 30% 的绝对基数有多大,所以实际规模还不好说。

推荐理由:HKR 三项都踩中了:30% 的安装涨幅是个具体的用户用脚投票信号,直接挂钩 Google AI Search 改版。不过正文没写清楚这个涨幅是多长时间内的、怎么统计的,所以信息有缺口,我会先打个折,放在 featured 里比较合适。

5月26日星期二

AI HOT 精选

Sundar Pichai 聊 AI 搜索:Google 想把搜索框变成帮你干活的入口

Sundar Pichai 在 Google I/O 后聊了聊公司怎么应对 ChatGPT 的冲击。核心是把 Gemini 模型塞进新的智能搜索框和 Gemini Spark 智能体平台,让搜索从“给你一堆链接”变成“直接帮你启动任务”。他回应了“Google Zero”的担忧——网站从 Google 来的流量可能归零,但没给出具体流量影响数据。另外,...

推荐理由:这篇是 Sundar Pichai 在 I/O 后的访谈,核心就两件事:Gemini 要嵌入搜索框,以及 Spark 这个让模型进业务流程干活的平台。我会先打个折——正文没披露任何模型规模、延迟数据或上线节奏,所以别当产品发布看。但它的价值在于把 Google 对搜索未来的态度摆上台面:AI 直接生成答案会进一步挤压传统网页流量,同时 Spark 又在抢 agent 平台的身位。这点先别太激动,因为没给技术细节,但方向本身对做搜索、做内容和做 agent 的人都有影响。

r/LocalLLaMA

Shard:把 KV 缓存压到原来的十分之一,长上下文推理更省显存

Shard 这套方法能在 Llama-3.1-8B 上把 KV 缓存占的显存砍掉约 90%。具体来说,8K 上下文长度时压缩比约 10 倍,拉到 32K 时能到 11 倍。技术路线分两路:对 Key 矩阵先用 PCA 降维再做 int4 量化,对 Value 矩阵则用 Hadamard 旋转配合向量量化。论文在 NIAH 和 LongBench 两个基...

推荐理由:HKR 三项都站得住:10 倍 KV 缓存压缩是个好钩子,数字和模型、上下文长度、基准测试都列清楚了。信息目前只来自 Reddit 帖子,验证有限,所以分数压在 78–84 这个区间。正文没提压缩方法的具体实现和额外计算开销,这点先别太激动,等有人复现再说。

AI HOT 精选

OpenAI 被曝下月发 GPT-5.6,上下文窗口拉到 150 万 token

开发者在 OpenAI Codex 的后台日志里挖出了一个叫 iris-alpha 的未公开模型,对应 GPT-5.6,可能 6 月发布。最直观的变化是上下文窗口涨到 150 万 token,比现在 GPT-5.5 API 的 105 万多出约 43%。有人在辅助工具 OpenCode 里实测,喂到 90 万 token 还能流畅回话,甚至能处理超过 ...

推荐理由:这条消息来自 Codex 日志泄露,不是官方公告,所以我会先打个折。但 150 万 token 的上下文窗口和 iris-alpha 代号都是实打实的数字,对做 agent 和长文档处理的人有直接参考价值。正文没提发布时间和定价,这点先别太激动。整体属于值得从业者扫一眼的更新,但还没到必须立刻行动的程度。

AI HOT 精选

苹果被曝用定制版 1.2 万亿参数谷歌模型改造 Siri,简单问题仍跑本地

爆料说苹果下一代 Siri 的核心换成了一个定制的谷歌大模型,参数规模 1.2 万亿,比大家猜的 Gemini 3.5 Flash(约 3000 亿参数)大好几倍。复杂任务会交给这个大模型,简单查询还是留在手机上跑。苹果现在最头疼的是日常问题的响应速度,大模型再聪明,回慢了也没人用。另外,下个月 WWDC 可能会官宣 Apple Intelligenc...

推荐理由:这篇就一个 X 上的爆料,给了些架构细节但没附源文件、没提上线时间和功能范围,所以我会先打个折。1.2T 参数这个数字挺具体,但正文没解释是总参数还是激活参数,也没说模型怎么裁出来给手机用。简单查询跑本地、复杂任务走云端这个分工听着合理,不过延迟到底压到多少、在哪些机型上能跑都没交代。这点先别太激动,等有实测或官方确认再往上调。

5月25日星期一

FT · 科技

Meta 和 Google 模型的安全护栏几分钟内就被扒掉了

有软件能让模型回答生物武器和恶意软件的问题,但正文没披露具体是哪些模型、怎么复现、用了什么工具,也没提两家公司有没有应对措施。

推荐理由:标题很炸,但正文信息量偏薄。我会先打个折:它只说了有软件能诱导模型输出危险内容,没披露具体是 Meta 和 Google 的哪款模型,也没给复现步骤或缓解方案。这点先别太激动,因为缺了这些技术细节,从业者看完也不知道自己该查什么、怎么防。不过“几分钟拆护栏”这个事实本身,加上涉及两家大厂,已经足够让做安全的人警觉,所以 featured 没问题,只是离必写还差一口气。

5月24日星期日

新智元 · 公众号

Anthropic 三张底牌全翻:Mythos 1 首次现身,Opus 4.8 被扒出

Anthropic 的新模型和项目被提前曝光了。claude-opus-4.8 的名字出现在 Google Vertex AI 平台上,同时一份 59.8MB 的 Claude Code 源码映射文件泄露,里面 51.2 万行 TypeScript 代码不仅提到了 Sonnet 4.8,还带出了 Mythos 1 的线索。Mythos 1 看起来和 C...

推荐理由:我会先打个折:这是泄露加平台列表,不是 Anthropic 官方发布。正文没披露能力分数、定价、上下文窗口或可复现评测,所以分数卡在 78–84 区间。但 Mythos 1 第一次被挖出来,Opus 4.8 又在 Vertex 上露脸,对关注 Anthropic 路线图的人来说信息量不小,值得放进 featured。

5月23日星期六

The Verge · AI

上手 Gemini Omni:什么都能转什么都能生,我先拿毛绒玩具试了试

作者去年用 Gemini 给儿子的毛绒鹿做过一段度假视频,没给孩子看,但这件事让他反复琢磨“无害的 AI 乐子”和“纯 AI 垃圾”之间的那条线。这次上手 Gemini 的“任意输入、任意输出”新模型,他再次拿那只毛绒鹿做了一段 deepfake 视频,发现生成逼真视频的工具已经好用到几乎不需要技术门槛,而且这个趋势还在加速。正文没披露模型参数量、定价...

推荐理由:这篇值得推,因为 The Verge 上手玩了一个很唬人的 Gemini 新模型,用一张毛绒鹿照片直接生成视频,效果够“野”。但我会先打个折:全文就一个例子,没参数没价格没时间表,属于尝鲜体验不是产品发布。H 和 R 都过关,K 卡在信息太少,所以整体给 featured 但别当硬核技术稿看。

AI HOT 精选

Gemini 月活破 9 亿,新增两个能替你干活的代理功能

Google 说 Gemini 应用月活用户超过 9 亿了。这次更新把 Gemini 从问答工具往主动干活的个人代理方向推了一步。新模型叫 Gemini 3.5 Flash,还换了套叫“Neural Expressive”的设计语言,另外 Gemini Omni 模型能把提示词直接生成视频。重点在两项代理功能:Daily Brief 会给你出个性化每日...

推荐理由:Google 这次更新核心就两件事:一是 Gemini 应用月活冲到 9 亿,盘子确实大;二是推出了 Daily Brief 和 Gemini Spark 两个代理功能,后者可以在用户授权下 24 小时跑任务。我会先打个折,正文没披露代理功能的具体完成率和延迟数据,实际干活靠不靠谱还不知道。但 9 亿这个量级加上“常驻后台的个人代理”定位,对做 agent 产品的团队来说是个明确的信号——大厂开始用自家分发渠道推代理了,竞争门槛在抬高。

AI HOT 精选

谷歌在 I/O 大会甩出一整套 AI 代理开发工具,从写代码到上线调试全包了

谷歌这次发布的不是单个模型,而是一条让 AI 代理(能自主干活的程序)落地的工具链。Antigravity 2.0 是个独立桌面应用,配了命令行工具和 SDK,方便开发者直接在本机跑代理。Google AI Studio 新增 Kotlin 支持,号称能一键生成安卓应用并发布,还出了手机版 App。Gemini API 里加了托管代理服务,部署步骤简化...

推荐理由:HKR 三项都成立:谷歌端出了一套有名字、有组件的代理工具栈,覆盖本地开发、云端托管和浏览器协议。不过目前只有社交媒体的摘要,正文没披露定价、API 细节和实际演示,所以分数卡在 78–84 这个区间。我会先打个折,等看到更完整的文档再往上调。

5月22日星期五

TechCrunch · AI

Google 的 AI 眼镜我们上手试了,离好用就差一口气

Google 在 I/O 大会上给了一小段上手时间,试的是带显示功能的 Android XR 眼镜,不是今年秋天只出声的那款。镜片上能直接叠一层信息,比如天气、步行导航、打车详情和实时翻译,还能用 AI 自己捏小组件。眼镜会同时支持 iPhone 和安卓手机。但正文没提价格、什么时候开卖、续航和具体硬件参数,所以现在只能算工程机阶段,别急着掏钱。

推荐理由:我会先打个折:正文没披露价格、上市时间和续航,所以重要性停在 74 分、放在 featured 低位是合理的。但 TechCrunch 的实际上手测试本身就比通稿有说服力,Gemini 把翻译和导航叠进视野这个机制,是把 AI 从“问一句答一句”推到“你看着世界它帮你理解”的关键一步。对从业者来说,这比又一个聊天机器人更新更值得盯。

MIT Technology Review · AI

Google I/O 暴露了 AI 做科研的两条路:专用工具还在用,但资源正流向通用智能体

Google I/O 上,DeepMind 的 Hassabis 一边用“我们正站在奇点的山脚下”这种大词,一边展示的是 WeatherNext 提前预警飓风救了人命。这正好点出了 AI 做科研的两条路线:一条是像 WeatherNext、AlphaFold 这种专为解决某个科学问题训练的专用工具;另一条是让通用大模型像智能体一样自己搞研究。现在资源明...

推荐理由:我会先打个折:这篇是 MIT Technology Review 的评论,不是一手技术报告,所以细节有限。但它的判断站得住——Google 把科学 AI 的牌子从 AlphaFold 那套单独炫技,换成 Gemini for Science 这个统一入口,还塞进了 AI Co-Scientist 和 AlphaEvolve 两个组件,并且开放申请。对做 AI 应用的人来说,这比发一篇论文实在,因为能摸到产品了。不过别太激动,正文没披露这套东西的算力成本、实际科研产出对比,也没说普通团队用不用得起,所以目前更像一个方向牌,不是落地手册。

AI HOT 精选

Datasette Agent 发布:给数据库配了个能聊能画图的 AI 助手

Simon Willison 把做了三年的 LLM 库和 Datasette 数据库工具终于接上了,发布了 Datasette Agent。你可以直接用对话的方式问数据库里的问题,比如“我最近一次看到鹈鹕是什么时候”,它会自己写 SQL 去查。配合插件还能自动生成图表、用 ChatGPT 画图,或者在沙箱里跑代码。线上演示跑的是 Gemini 3.1 ...

推荐理由:Datasette 给自家工具加了个能聊天的 agent,支持插件画图,还能选 Gemini 3.1 Flash-Lite 或 LM Studio 本地模型。对搞数据的人来说,这比大厂发新模型更实在——它解决的是“我能不能在自己机器上安全地用 AI 查数据”的问题。不过正文没披露本地模型的具体效果和延迟,这点先别太激动。整体看,实用性强但受众偏窄,放在 featured 里合适。

AI HOT 精选

谷歌发布 Kotlin 版和 Android 版 Agent 开发套件 0.1.0,让 AI 能在手机本地跑任务

谷歌把 Agent 开发套件(ADK)带到了 Kotlin 和 Android 上,版本号 0.1.0。Kotlin 版负责后端流程,Android 版则专门为手机端做了优化,能直接调用 Gemini Nano 这类本地模型干活。这套东西的核心是混合调度:你可以让云端大模型当总指挥,把涉及隐私的具体任务(比如查本地文件里的酒店预订)派给手机上的子 Ag...

推荐理由:Google 这次发了两个 ADK:Kotlin 版给后端搭 Agent 工作流,Android 版让 Agent 跑在手机上。版本号 0.1.0 说明还在早期,功能边界和稳定性都别抱太高期待。正文只交代了平台和版本,没给性能数据、实际案例或开发者规模,所以我会先打个折——方向对,但落地效果还得看后续。

5月21日星期四

r/LocalLLaMA

Fireworks 提出“Agent 执行税”:浏览器智能体跑任务时,22.9% 的推理算力都浪费了

Fireworks 在 WebVoyager 上跑了 720 个浏览器智能体任务,发现平均有 22.9% 的推理调用属于无效消耗,他们管这个叫“Agent 执行税”——也就是为了完成任务,模型多做的无用功。具体到各家模型:MiniMax M2.5 每成功完成一个任务的成本比 Gemini 低了 2.3 倍;GLM-5 的任务成功率做到 57.1%;Ki...

推荐理由:HKR 三项都站得住:它把一个跑分现象包装成了可复用的采购指标,有具体数字支撑,而且直接回应了从业者在选型时对隐性成本的焦虑。信源是 Fireworks 自己的博客和 Reddit 讨论,不是第三方独立评测,所以重要性停在 74 分 featured 档,没往上拉。

The Verge · AI

我用谷歌 AI Studio 一个下午“氛围编程”搞出了三个安卓 App,第一个只靠 148 个字的提示词

The Verge 的编辑 Sean Hollister 用谷歌 AI Studio 试了一把“氛围编程”,一个下午生成了三个安卓 App。其中一个 App 他只输入了 148 个字的提示词,大概 10 分钟后就在自己的安卓手机上装好跑起来了。前提是他提前把手机开了 USB 调试模式并连上电脑,剩下的活 AI Studio 全包了。他感叹这速度让他差点...

推荐理由:这不是 Google 官方大发布,而是一篇带实测细节的第一人称体验文,有梗有数字,适合放进精选。

Hacker News 首页

Google 正式宣布 AI 模式搜索结果里会插广告

Google 在 2026 年 5 月的营销大会上确认,AI 模式(AI Mode)的搜索结果里要开始放广告了。他们用 Gemini 模型做了两种新广告形式:一种是对话式发现广告,另一种是突出显示答案的广告,广告里还会带一个独立的 AI 解释器,帮你判断产品靠不靠谱。同时,他们也在扩大 Direct Offers 的试点,让用户能直接在搜索结果里结账或...

推荐理由:这条消息本身够直接:Google 亲口说 AI 模式的搜索结果里要加广告了。对从业者的冲击在于,之前大家还在猜 AI 搜索会不会保持无广告的纯净体验,现在靴子落地了。我会先打个折——正文只给了 78 分和 66 条评论,广告格式、投放机制、上线时间全都没写,所以实际影响有多大还看不清。但光是“确认会加广告”这一点,就足够让做搜索优化和广告投放的人紧张起来,因为流量分配和预算逻辑可能又要重算一遍。这点先别太激动,等具体规则出来再判断力度,但信号本身值得放进精选里。

AI HOT 精选

Google 把设计搭子 Stitch 升级了,现在能读你的代码库直接生成界面

Stitch 这次更新主要干了四件事。一是实时流式出设计稿,你边改它边生成,不用干等。二是能直接导入现有代码库或 Design.md 文件,拿你项目里真实在用的组件来做设计,品牌风格不容易跑偏。三是加了动态界面生成,四是做完的设计可以导出成一个可分享的线上链接,省掉从原型到上线中间一堆部署步骤。工具现在已经全球开放,正文没提收费模式。

推荐理由:我会先打个折:正文没披露模型细节、定价和实际输出质量,所以别急着当生产工具。但 Stitch 这次更新把实时流式构建和代码库导入加进来,等于让 AI 直接读你的代码和设计文档来生成页面,不再是画个样子就完事。对天天在 Figma 和代码编辑器之间切换的团队,这个流程缩短挺实在。全球开放也让更多人能上手试,不过没看到成本或准确率数据,这点先别太激动。