跳到正文

#Google

今日 3 条

5月15日星期五

AI HOT 精选

Arm 和 Google 联手,让手机本地跑音频模型快了 2 倍多

Arm 的新指令集 SME2 把矩阵计算单元直接塞进了 CPU,不用再纠结是忍受 CPU 慢还是外挂专用加速器。Google AI Edge 的 LiteRT 和 XNNPACK 能自动调用这套指令,拿 Stability AI 的音频生成模型 stable-audio-open-small 在 Arm 手机上测试,生成速度提升超过 2 倍,内存占用降...

推荐理由:我会先打个折:这篇只针对一款音频模型在 Arm 设备上的优化,覆盖面不宽。但 2 倍加速和 4 倍内存缩减这两个数字很实在,不是实验室跑分,是直接落到移动端和笔记本上的效果。文章把 SME2 指令集怎么跟 Google AI Edge 的推理管线配合讲得比较清楚,没有堆术语吓人。对正在头疼边缘端延迟和内存成本的团队来说,这是一条能直接抄作业的参考。信息量够上 featured,但别指望它能推广到所有生成式模型。

5月14日星期四

彭博科技

发那科搭上谷歌,股价直接冲上历史新高

工业机器人巨头发那科宣布跟谷歌合作搞“物理 AI”,消息一出股价飙到历史最高点。正文被 Bloomberg 的付费墙挡了,没披露合作具体做什么、股价涨了多少、什么时候落地。从标题看,市场是把这当成真金白银的利好来炒的——毕竟谷歌在 AI 上的技术积累,配上发那科在工厂里的硬件铺货量,想象空间确实大。但正文没给细节,这点先别太激动,等具体方案出来再看是真...

推荐理由:Bloomberg 的消息源靠谱,Fanuc 股价创纪录这个事实本身就够硬,所以 H 和 R 都给了。但我会先打个折:正文没披露合作机制、股价涨幅、产品细节或时间表,K 完全撑不起来。这点先别太激动,等后续有实质内容再说。

AI HOT 精选

AI 替你处理邮件,一个月要花多少钱?

作者拿主流大模型算了一笔账:让 AI 帮你读、写、整理邮件,每月推理成本在 22 到 130 美元之间,中位数 26 美元。如果做成 SaaS 产品,按 75% 毛利率定价,一年大概要收 500 美元,比 Google 企业版贵一倍。想省钱的话,换小模型能把成本压到十分之一甚至二十分之一;更狠的做法是直接在用户自己的 GPU 上跑,边际成本趋近于零。文...

推荐理由:这篇文章没发布新模型或产品,就是一篇成本算账的评论。我会先打个折:它把顶尖模型、小模型和本地部署三条路径的月费摆在一起,22–130 美元对比近零成本,数字直观,对正在掂量 AI 邮件代理是否划算的团队有参考价值。正文没披露测试用的具体模型名和邮件量,所以这些数字只能当量级参考,别直接套进预算表。整体是一篇有用的观点分析,不是重大发布,所以重要性给 73 分。

MIT Technology Review · AI

AI 聊天机器人开始泄露真实手机号,谷歌 Gemini 被曝多次给出私人号码

MIT Technology Review 记录了三起 Gemini 把真人手机号当成客服电话给出去的案例。一位以色列软件工程师收到陌生人 WhatsApp 消息,对方说是 Gemini 给的 PayBox 客服号——但他跟这家公司毫无关系。文章还提到,隐私清理公司 DeleteMe 的数据显示,过去七个月里用户关于生成式 AI 的隐私咨询量涨了 40...

推荐理由:MIT Technology Review 的报道给了具体案例,DeleteMe 的咨询量增长和 ChatGPT 提及比例让问题有了量化支撑,所以 H、K、R 三项都站得住。影响面集中在隐私和产品责任风险,不是模型或平台级的大版本变动,重要性刚好卡在 featured 门槛上。

5月13日星期三

AI HOT 精选

Anthropic 被曝正谈判新一轮融资,投前估值超 9000 亿美元,要筹至少 300 亿

彭博社消息,Anthropic 正在跟投资者初步谈新一轮融资,目标是按 9000 亿美元以上的投前估值,筹至少 300 亿美元。这个数字比它今年 2 月融 G 轮时的 3800 亿投后估值翻了一倍多。交易还没签条款清单,预计最快本月底完成。Anthropic 计划今年晚些时候 IPO,现在急着筹钱主要是为了填算力资源的开销。

推荐理由:这条消息的冲击力全在数字上:投前估值超过 9000 亿美元,还要再融至少 300 亿。我会先打个折,因为正文明确说只是初步谈判,投资方和条款都没披露,月底能不能完成还两说。但即便按传闻看,这个估值已经比 OpenAI 上一轮高出一大截,说明大模型军备竞赛还在加码,算力烧钱没停。对从业者来说,这轮钱到不到位,直接影响 Claude 后续的模型迭代和算力储备,所以关注度不会低。

AI HOT 精选

Google 出了第一款围绕 Gemini 做的笔记本 Googlebook,不再是 Chromebook 那种云优先的路子

Google 发了台叫 Googlebook 的笔记本,系统层面把 Gemini 塞了进去。这次说了三个功能:Magic Pointer 把光标变成一个 AI 入口,点哪都能弹出上下文建议和任务;Create Your Widget 让你用大白话描述需求,自动生成一个能聚合不同信息的桌面小组件;还打通了安卓生态,在电脑上直接调用手机 App 和文件。正...

推荐理由:我会先打个折:正文没披露具体配置、价格、上市时间和实际演示,所以没法往更高分打。但“Googlebook”这个命名和围绕 Gemini Intelligence 的设计,说明 Google 想把 AI 做成笔记本的原生能力,而不是外挂一个助手。三项机制里,Magic Pointer 听起来像用意图预测代替传统光标操作,自然语言生成小组件是把“说人话就能搭界面”搬到桌面,Android 跨设备访问则打通了手机和笔记本的协同。这些点加起来,让这条消息在 AI 从业者眼里有讨论价值,但缺细节也意味着落地效果还得观望。

AI HOT 精选

谷歌在 Android Show 2026 上发了新助理 Android Intelligence,能跨 App 自动干活

谷歌这次推的 Android Intelligence 是一个系统级智能助理,主打跨安卓应用的多步骤自动化任务,比如你让它订咖啡、回消息、填表,它可以自己切 App 完成。Chrome 里的 Gemini 也加了浏览器操作能力,能直接帮你操作网页。另外还有语音笔记转文字功能叫 Rambler,以及可以自定义的生成式 UI 小组件。整场发布没提具体推送时...

推荐理由:这条消息抓人是因为安卓系统级的智能助理,能跨 App 自动操作,不是某个 App 的小修小补。具体放出的功能点挺实在:Chrome 里让 Gemini 直接帮你用浏览器、自动填表、语音转文字,还有可定制的小组件,都是开发者能马上摸到的界面。正文没给技术细节和实际延迟数据,所以效果先打个折。但这件事本身是移动 AI 代理的卡位战,对做工具和分发的团队来说,风向意义大于单点功能。

TechCrunch · AI

Google 和 SpaceX 在谈把数据中心搬上太空

Google 和 SpaceX 正在讨论建轨道数据中心,专门跑 AI 算力。SpaceX 今年晚些时候要搞 1.75 万亿美元的 IPO,需要这个“太空机房”的故事来撑估值。但先别太激动——TechCrunch 自己算过账,把卫星制造和发射成本算进去,现在太空机房的成本比地面贵得多。Google 也没把宝全押在 SpaceX 身上,同时在跟其他火箭公司...

推荐理由:Google 和 SpaceX 在聊把数据中心送上天,专门给 AI 跑推理用。听着像科幻,但确实在谈。我会先打个折:正文没披露成本差多少、什么时候能上、打算铺多大,所以别太激动。它更像一个信号——大厂在认真找地面以外的算力出路,这点值得留意。

AI HOT 精选

Google 用 ADK 搭了一个能跑几周不丢上下文、会自己暂停和恢复的 AI 助手

Google 开发者博客发了一篇教程,用自家的 Agent Development Kit(ADK)搭了一个“新员工入职协调助手”。这个助手能跑好几周:发完欢迎邮件就自己暂停,等员工签完文件再继续,中间还能把装电脑的活派给另一个专门的小助手,最后发一份定制的第一天日程。文章没给具体性能数据,但重点讲了三个让 demo 变生产可用的架构思路:用结构化的持...

推荐理由:Google Developers 这篇教程没发新模型或新平台,但把长时运行智能体的持久化机制讲得很实在:状态机管流程、会话存储保上下文、Webhook 接外部系统。我会先打个折,因为只是工程实践分享,不是重大发布,但对正在落地 agent 的团队来说,这种能跑几天不丢状态的方案比很多 demo 更有用。

TechCrunch · AI

Google 在 Android Show 上发了什么:AI 笔记本、能帮你干活的 Gemini、随口说说的桌面小部件

Google 在 I/O 大会前办了一场 Android Show,把 Gemini 助手塞进了更多地方。新发布的 Googlebooks 笔记本主打 AI 优先,但正文没披露具体配置、价格和上市时间。Gemini 变得更“代理化”,意思是它能跨 App 帮你完成一连串操作,不过实际效果还得看落地。Android 桌面小部件现在支持“vibe codi...

推荐理由:Google 在 I/O 前一口气甩出好几个 Gemini 相关的 Android 更新,我会先打个折:正文没给参数、没标价格、也没说什么时候能用上,所以只能当产品信号看。比较有意思的是 vibe-coded widgets,等于让用户用自然语言描述就能生成桌面小组件,门槛降得很低;Googlebooks 则像是把笔记和 Gemini 的搜索/总结能力缝在一起,能不能打还得看实际体验。整体属于有话题但缺验证的 mid-weight 产品更新。

The Verge · AI

Google 给 Gemini 加了几个新功能,核心是让它能直接操作你的安卓手机

Google 在安卓发布会前搞了个预演,推出了叫 Gemini Intelligence 的东西。简单说,就是把 Gemini 塞进安卓版 Chrome 浏览器里,能帮你自动填表,还能跨 App 执行操作。这离“手机自己用自己”又近了一步。不过正文没提哪些机型能用、什么时候推送、要不要另外付费,这些关键信息都还空着。

推荐理由:H、K、R 三条都成立。Gemini 开始接管 Android 上的 Chrome、自动填充和 app 内操作,不再是纯对话工具。我会先打个折:正文没披露支持设备清单、推送时间和定价,所以只能算产品更新,分数压在 72–77 这个区间。

TechCrunch · AI

Google 给安卓加了能跨 App 干活的 AI,还能用嘴说一个桌面小组件

Google 在安卓发布会上甩出了 Gemini Intelligence 这面新旗号,核心是让 AI 在手机里帮你跨 App 跑腿,比如填表、语音输入、上网查东西。比较有意思的是“vibe-coded widgets”——你直接用自然语言描述想要什么小组件,它就能给你生成出来,不用写代码。不过正文没提这些功能什么时候上线、哪些手机能用、收不收费,也没...

推荐理由:我会先打个折:正文只说了 Gboard 听写和表单填写这两个具体能力,发布时间、设备范围和价格全都没提,所以信息增量有限,不能给太高。但“agentic AI + vibe-coded widgets”这个说法本身挺抓人——一边是让模型进系统流程干活,一边是用自然语言随手生成小组件,对移动端 AI 入口的想象空间有拉动。这点先别太激动,毕竟没落地细节,但作为平台级更新,值得放进 featured 里让从业者扫一眼。

TechCrunch · AI

Google 把 Gemini 塞进 Gboard 语音输入,做听写的小公司要头疼了

Google 开始在 Gboard 键盘里用 Gemini 模型做语音转文字,首批只推给三星 Galaxy 和 Pixel 手机。正文没提支持哪些语言、要不要联网、怎么收费,也没说具体哪天全面推送。对专门做听写工具的创业公司来说,系统自带且模型更强的免费方案一旦铺开,付费墙就很难立住了。

推荐理由:我会先打个折:正文没写支持哪些语言、收不收费、能不能离线用、什么时候铺开,这些关键信息全是空白。能确认的是 Gemini 听写已经进了 Gboard,而且先给三星和 Pixel 用,这对靠听写 API 或 App 吃饭的创业公司不是好消息。Google 把模型塞进输入法,用户不用额外装东西就能用,第三方想靠体验或定价差异化会越来越难。这点先别太激动,毕竟没看到实测延迟和准确率,但方向本身对做语音工具的团队是个明确的挤压信号。

5月12日星期二

Google DeepMind

Google DeepMind 发布 Co-Scientist 多智能体科研系统

Google DeepMind 在 Nature 发表 Co-Scientist 研究,推出基于 Gemini 的多智能体 AI 系统,可迭代生成、辩论和演化复杂科学问题的新假设。

推荐理由:原文披露了多智能体系统的三阶段协作机制与多个实验室的落地案例,可了解 AI 参与科学假设生成的具体路径。

Latent Space

Thinking Machines 发布原生交互模型:2760 亿参数,120 亿激活,实时语音不再靠外挂

Thinking Machines 终于又冒泡了,这次直接扔了个新模型 TML-Interaction-Small。总参数 2760 亿,是个 MoE 架构,实际干活时只激活 120 亿参数。它最狠的地方是把实时语音交互做进了模型骨子里,不再像以前那样给大语言模型外挂语音识别和合成模块。模型能同时听、说、看、想,用 200 毫秒一个的“微对话轮次”连续...

推荐理由:我会先打个折——基准分是 Thinking Machines 自己跑的,还没第三方复现,所以“超过 GPT 和 Gemini”先别太激动。但这条消息值得推,因为它给出了具体架构(276B MoE、12B 激活)、200ms 微轮次这个硬指标,还直接挑战了语音 agent 里常用的 VAD 方案。对正在搭实时语音管线的从业者来说,哪怕只是思路参考也有价值。

彭博科技

AI 芯片公司 Cerebras 把 IPO 规模上调三分之一,想融 48 亿美元

Cerebras 把首次公开募股的融资目标从原来的水平提高了三分之一,最高要融 48 亿美元。这条视频还提到了 Circle 的一季度收入和 Google 研究人员首次用 AI 造出的零日攻击,但正文没披露这两件事的具体细节。

推荐理由:Bloomberg 这条快讯说 Cerebras 把 IPO 盘子加大了三分之一,最高要拿 48 亿美元,对 AI 芯片赛道是个不小的资本信号。不过正文没给定价、估值和时间表,所以我会先打个折,不往 85 分以上推。另外标题里还提了 Circle 一季度收入和 Google AI 生成零日攻击,但正文没展开细节,这两点先别太激动。

AI HOT 精选

Gemini 现在能翻你的 Gmail 和相册,自动拼出一个旅行计划

Gemini App 推出了“个人智能”功能,可以把你的 Gmail、Google Photos、搜索记录和 YouTube 观看历史串起来,直接生成一份定制旅行行程。它省去了你自己翻邮件找酒店、从相册回忆地点的步骤。你随时可以选哪些 App 给它读,也能关掉个性化设置。正文没披露它具体怎么处理隐私数据、会不会把邮件内容喂给模型训练,这点先别太激动。

推荐理由:我会先打个折:正文只说了功能方向,没披露权限粒度、数据范围能不能自己勾选、行程质量怎么评估。亮点是 Google 第一次把四个核心数据源串起来给个人助手用,不再是单点功能。但这点先别太激动——没讲清楚用户能不能关掉某个数据源、数据是本地处理还是上传,也没给任何准确率或用户测试结果。对从业者的刺激在于:如果这套跑通,Google 助手的记忆深度会甩开只能读聊天记录的竞品一截;如果跑不通,就是一次隐私翻车现场。

The Verge · AI

Google 首次拦截了一个用 AI 辅助开发的零日漏洞攻击

Google 威胁情报团队(GTIG)发现并拦下了一个用 AI 帮忙写的零日漏洞。攻击者打算拿它搞一次大规模攻击,绕过某个开源网页系统管理工具的双因素认证,但报告没提具体是哪个工具。漏洞利用脚本里留下了 AI 痕迹,比如一段胡编的 CVSS 评分,还有像教科书一样工整的代码结构,这些都很像大模型训练数据里出来的东西。

推荐理由:这条消息抓人是因为它把 AI 安全从“可能”拉到了“已经发生”。Google 亲自下场说拦住了 AI 开发的零日,目标是绕 2FA,这比泛泛而谈的威胁报告有分量。我会先打个折:正文没披露具体工具名和漏洞细节,没法验证攻击的复杂度,所以分数卡在 78–84 区间是合理的。但光是“AI 造零日”这个事实,就足够让做安全的人多看两眼。

5月11日星期一

AI HOT 精选

OpenRouter 用真实市场需求给模型排座次,DeepSeek V4 Pro 排第一

OpenRouter 搞了个叫 Pareto Code 的排名方法,不看跑分,直接看用户在实际调用中怎么选模型,找出性价比最优的那条线。目前排第一的是 DeepSeek V4 Pro,后面跟着 GPT 5.4 Mini 和 Gemini 3.1 Pro。不过正文没披露具体怎么算分、样本量多大,所以这个排名到底多稳,我会先打个折。

推荐理由:我会先打个折:OpenRouter 只发了一篇帖子,没公布样本量、统计时间窗口和具体定价依据,所以这个排名不能当严谨评测用。但它的价值在于思路——用市场实际调用数据来反映模型性价比,比跑分更贴近真实使用场景。DeepSeek V4 Pro 排第一这点先别太激动,得看后续有没有更透明的数据支撑。整体上,这条信息对正在选模型的开发者有参考意义,但信息缺口明显,够 featured 但上不了更高分。

Computing Life · Share · 鸭哥调研

Google 悄悄关停 Project Mariner,但三家大模型公司其实得出了同一个结论

Google 在 5 月 4 日毫无预告地关掉了去年 I/O 大会上主推的 AI 浏览器代理 Project Mariner。这件事不能简单看成 Google 掉队,因为 Anthropic 和 OpenAI 在同类产品上也撞了墙。核心问题在于,独立浏览器代理(像 Mariner、Operator)一启动就是个全新的、没有 cookie 和浏览记录的会...

推荐理由:这条消息的价值在于把三家公司对浏览器 agent 的悲观判断摆在一起,而不是只报 Google 一家关停。关停日期是新的,但正文没给出官方公告链接,也没披露失败的具体指标,比如任务成功率掉到多少、成本高到什么程度,所以信息强度有折扣。对做 agent 的人来说,知道大厂在这个方向上集体后撤,比看一篇技术方案更有参考意义,但缺少一手数据支撑,只能算一个值得注意的信号。

5月7日星期四

The Verge · AI

谷歌关停网页任务实验 Project Mariner,技术已并入 Gemini Agent

谷歌在 2026 年 5 月 4 日关掉了 Project Mariner,一个能让 AI 在浏览器里自动完成多步骤网页任务的实验项目。它之前最多支持同时跑 10 个任务。关停不是因为技术失败,而是这套能力已经挪到了谷歌正式产品里,比如 Gemini Agent 和 AI Mode。正文没披露具体迁移时间点和用户数据,所以实际落地效果还得看后续产品表现。

推荐理由:HKR 三项都过,但正文能拿到的硬信息就三块:关停时间、最多 10 个并发任务、技术并入了 Gemini Agent。Google 官方信源够硬,所以给 featured 低档,不是重大发布。

5月6日星期三

The Verge · AI

Google 的 AI 搜索摘要开始引用 Reddit 帖子了

Google 更新了 AI 搜索功能,会在摘要里直接展示来自 Reddit、社交媒体和论坛的“第一手观点”预览,把搜索词和相关的网络讨论串起来。官方说这是为了满足越来越多人在搜索时想看到真人建议的需求。不过公告没提这个功能具体什么时候、在哪些地区上线。对搜索团队来说,核心问题是 AI 摘要如何引用和排序这些用户生成内容来源。

推荐理由:我会先打个折,因为正文没写覆盖范围和上线时间,所以重要性停在 76 的产品更新档位是合理的。钩子够强——Google 把 Reddit 这种论坛内容塞进 AI 摘要,搜索的流量分配逻辑可能又要变。新事实是 perspectives 预览机制,但具体怎么触发、哪些讨论会被选中都没说。风险点很实在:UGC 来源的引用和排序机制一旦偏了,小站和原创作者会更难拿到流量。这点先别太激动,等看到实际覆盖数据再调整判断。

新智元 · 公众号

12岁写代码,28岁撑起谷歌20亿业务,他却劝年轻人别卷编程了

Alon Chen 12岁开始写代码,28岁在谷歌管着年收20亿美元的业务。但他现在劝年轻人别再把编程当唯一护城河。他给了两个数字:微软新代码里30%是AI写的,谷歌这个比例也超过25%。他的判断是,以后更稀缺的能力是执行、把问题定义清楚、以及沟通协作,纯写代码的壁垒在变薄。不过正文没披露他具体是在什么场合说的这番话,也没给出这些AI生成代码比例对应的...

推荐理由:这篇不是产品发布或模型评测,更像一篇职业判断类的评论。我会先打个折:它没有披露新模型或新方法,但两个 AI 生成代码占比的数字让它比普通鸡汤更有信息量。正文没给出这些数字的统计口径和验证方式,所以别当精确指标用,但它确实说明大厂内部写代码这件事的构成在变。对从业者来说,这比单纯喊“AI 要取代程序员”更有参考价值,因为它指向的是技能重心的转移,而不是岗位消失。

r/LocalLLaMA

Gemma 4 出了 MTP 草稿模型,解码速度翻倍但输出质量不变

Google 在 Hugging Face 上放了 4 个 Gemma 4 的 MTP 检查点。MTP 的做法是拿一个小号草稿模型一次预测好几个 token,再由主模型并行验证,相当于让模型“先猜后验”,最终解码速度能提一倍,而且输出质量跟原来一模一样。不过 Reddit 原帖被网络策略挡了,正文没披露具体模型尺寸、硬件要求或实测延迟数据。

推荐理由:H、K、R 都站得住:钩子是 2 倍低延迟解码,有检查点和机制说明,不是画饼。它不是旗舰模型发布,属于实用更新,75 分放在 featured 低位合理。

5月5日星期二

r/LocalLLaMA

Heretic 1.3 发布:模型可复现、内置跑分、显存占用更低

Heretic 1.3 这个版本主要干了三件事。第一,它现在能把跑模型时的环境——PyTorch 版本、GPU 型号、驱动、加速库这些——都打包记录下来,别人照着做就能复现结果,不用再猜“为啥我跑出来不一样”。第二,它内置了一套跑分系统,直接用 lm-evaluation-harness 测 MMLU、EQ-Bench、GSM8K 和 HellaSwa...

推荐理由:我会先打个折:正文没给出 VRAM 具体降了多少,这点先别太激动。但 Heretic 这次更新确实踩到了两个实在需求——一是让模型运行环境可复现,把 PyTorch、GPU、驱动版本都记下来,方便排查问题;二是内置了 lm-evaluation-harness 基准测试,不用再自己搭评测流程。项目有 2 万星、1300 万次下载,社区验证度够高。缺憾是 VRAM 优化只提了方向没给数字,所以重要性停在 72 分,放在 featured 里合适。

Hacker News 首页

Google、微软和 xAI 同意把早期 AI 模型交给美国商务部做安全评估

Google、微软和马斯克的 xAI 跟特朗普政府谈好了,会在模型公开发布前,先把早期版本交给美国商务部的一个中心做能力和安全审查。这个中心叫 AI 标准与创新中心,已经测过 40 多个模型,包括一些还没发布的。OpenAI 和 Anthropic 在 2024 年就签过类似的协议。不过正文没披露具体要交哪些模型、审查标准是什么、有没有时间表,也没说如...

推荐理由:标题信息量不小,但正文只给了一个事实:三家同意共享早期模型。谁接收、看哪些模型、怎么审、什么时候开始,正文全都没写。我会先打个折——这件事的后续影响取决于审查机制怎么落地,现在只能按已知事实给到 featured 中段。HKR 三条都踩中了,但信息缺口明显,分数暂时不动。

FT · 科技

Google、xAI 和微软同意让美国政府对新的 AI 模型做国家安全审查

三家大模型公司跟美国政府达成了协议,以后发布新模型前要先过一道国家安全审查。起因是 Anthropic 最新的 Mythos 模型让官方有些紧张。不过这篇报道正文被付费墙挡住了,具体怎么审、审哪些模型、什么时候开始执行,这些关键细节都没披露。

推荐理由:我会先打个折:正文只说了三家同意审查,起因是 Anthropic 的 Mythos 模型引发了担忧,但怎么审、审哪些模型、什么时候开始,全都没写。所以这条消息更像一个政策风向标,而不是一份可操作的合规指南。对从业者来说,知道大厂开始接这种审查就够了,具体影响还得等细节出来再判断。

5月4日星期一

r/LocalLLaMA

Gemma 4 E2B 在 8GB 安卓手机上跑得动,还搭了个本地语音笔记 App

一位 Reddit 用户把 Gemma 4 E2B(2.4GB 模型)塞进 8GB 内存的 OnePlus CE 5 手机里,做了个完全离线的语音笔记应用。流程是:Whisper Small(244MB)先把语音转成文字,Gemma 4 E2B 再负责把文字拆成笔记并打标签。录一段 10 到 15 秒的语音,从转录到出结果总共花 12 到 15 秒。搜...

推荐理由:这是 Reddit 个人项目帖,不是官方发布,但信息量够。作者把 Whisper Small 转写和 Gemma 4 E2B 分类都塞进手机,还搭了检索管道(查询扩展、多路全文搜索、RRF 融合,可选 Gemma 重排,超时 15 秒回退),工程细节比很多官方 demo 实在。我会先打个折:没提功耗、发热和长时间稳定性,12-15 秒延迟对语音笔记算可用但不算快。如果是真的,2.4GB 模型在 8GB 手机上跑通整套流程挺省钱,对想做离线 AI 应用的人有参考价值。

5月2日星期六

量子位 · 公众号

腾讯混元开源 440MB 翻译模型,手机离线跑,自称翻译质量超谷歌

腾讯混元放出了一个叫 Hy-MT1.5-1.8B-1.25bit 的翻译模型,把原本 1.8B 参数的模型压到了 440MB,能在骁龙 888、8GB 内存的安卓手机上离线跑。它支持 33 种语言、1056 个翻译方向。压缩的关键是一种叫 Sherry 1.25 比特量化的技术,做法是每 4 个权重里,3 个用 1 比特存,1 个直接置零。官方说翻译质...

推荐理由:我会先打个折:这是个垂直翻译模型,不是基础模型大更新,所以没到 P1。但亮点很实在——1.8B 模型压到 440MB,靠的是 1.25-bit Sherry 量化,每 4 个参数里 3 个用 1-bit、1 个直接置零,这种压缩方式少见。正文给了骁龙 888、8GB 内存的离线跑分,不是空口说白话。翻译质量超谷歌这点先别太激动,正文没披露具体测试集和对比条件,但如果是真的,端侧翻译的性价比会明显拉高。

5月1日星期五

The Verge · AI

五角大楼跟 OpenAI、Google、Nvidia 签了涉密 AI 合同,但把 Anthropic 排除在外

五角大楼一口气和七家公司签了涉密 AI 使用协议,包括 OpenAI、Google、微软、亚马逊、Nvidia、xAI 和 Reflection。Anthropic 被挡在门外,理由是供应链风险。合同金额、具体要用哪些模型、怎么部署,正文都没披露。之前五角大楼处理机密信息时用过 Anthropic,这次突然不带它玩,原因没说透。

推荐理由:我会先打个折:正文没披露合同金额、模型范围和部署条件,所以重要性停在82。但五角大楼点名7家涉密AI供应商、唯独不带上Anthropic,这个选择本身就很有信息量。国防部给出的理由是供应链风险,等于把安全审查摆到了台面上,对从业者来说,这比一份普通合作公告更值得留意。

TechCrunch · AI

谷歌把 Gemini 助手装进了几百万辆车里

谷歌宣布 Gemini 会逐步替换掉车机里原来的 Google Assistant,首批覆盖的是内置谷歌服务的车型。官方说法是能让车载语音对话更自然、更聪明,但正文没披露具体用了哪个版本的 Gemini 模型、哪些功能会先上、什么时候推完,也没提要不要额外收费。这点先别太激动——目前看更像是一次品牌升级和底层模型切换,实际体验能好多少还得等实车评测。

推荐理由:标题说 Gemini 要上车,规模是“数百万辆”,听着挺唬人。但正文基本就是一句话新闻,没给车型、没给时间、没给功能细节,也没说要不要额外收费。我会先打个折:这事方向对,但落地信息太少,现在激动还太早。对从业者来说,知道 Google 在铺车载渠道就够了,具体怎么打、打不打得赢,还得等后续。

4月30日星期四

Google DeepMind

Google DeepMind 发布 AI co-clinician 医疗研究计划

Google DeepMind 宣布 AI co-clinician 研究计划,探索 AI 智能体在医生临床监督下协助患者诊疗。在 98 个真实初级保健查询的盲评中,该系统 97 例无关键错误,医生更偏好其回答而非主流证据综合工具;在 140 项问诊技能评估中,它在 68 项达到或超过初级保健医生水平,但专家医生在识别危险信号和关键体格检查上整体仍更优。

推荐理由:Google DeepMind 公开 AI co-clinician 研究计划与多模态问诊评测,可了解医疗智能体当前能力边界。

FT · 科技

Google 在 AI 军备竞赛中跑赢对手,科技巨头们计划砸下 7250 亿美元

这篇付费文章只露了个头,正文没披露具体的时间范围和各家花钱的明细。从摘要看,Google 在云计算增速上超过了亚马逊和微软,而 Meta 因为大幅上调资本支出,股价承压。7250 亿美元这个数字是几家巨头 AI 投资计划的总额,但具体怎么算出来的、覆盖几年,文章没给。这点先别太激动,关键细节都锁在付费墙后面。

推荐理由:这篇 FT 报道扔出一个 7250 亿美元的 AI 支出预期,说 Google 跑得比同行快,Alphabet 云业务增速也压过 Amazon 和 Microsoft。我会先打个折——正文没披露这数字怎么拆到各家公司、覆盖哪几年、投在模型还是基础设施上,所以别急着拿它当精确坐标。但即便模糊,这个量级和竞争格局对从业者判断算力成本、云厂商选择和资本热度还是有参考价值。

The Verge · AI

Google 搜索量上季度创历史新高,但没公布具体数字

Alphabet 一季度财报电话会上,CEO Sundar Pichai 说 Google 搜索的查询量达到了“历史最高”,搜索广告收入涨了 19%。他把增长归因于 AI 功能(比如 AI Overviews 那种直接在搜索结果顶部给答案的体验)和 Gemini App 的拉动。另外,YouTube 订阅和 Google One 这类付费服务总订阅数超...

推荐理由:HKR 三项全中:Alphabet 报出搜索查询量历史新高、搜索收入涨 19%、付费订阅破 3.5 亿。但正文没给查询量基数,也没拆 AI Overviews 带来的增量,所以信息有缺口。整体够得上 72–77 分的 featured 档位。

4月29日星期三

新智元 · 公众号

谷歌翻译 20 岁,劈柴哥说它换了四代 AI,现在能直接听懂语气了

劈柴哥发帖庆祝谷歌翻译上线 20 年,月活用户到了 10 亿。他梳理了背后的四代技术:最早是统计机器翻译,2016 年换成神经网络翻译,后来用上 PaLM 2 大模型,2024 年一口气加了 110 种语言。最新的是 Gemini 2.5 Flash 的原生音频翻译,不再先把语音转文字再翻译,而是直接处理声音,能保留原话的语调、停顿和节奏。劈柴哥形容这...

推荐理由:核心事件是谷歌翻译过生日和架构回顾,不是新品发布,但 10 亿月活、110 种语言扩增和原生语音翻译的细节撑得起 featured 档位。我会先打个折,因为正文没给出原生语音功能的具体上线时间或实测数据,这点先别太激动。不过它点到了语音 AI 产品眼下最纠结的问题:级联管线 vs. 原生多模态,所以值得从业者看一眼。

彭博科技

谷歌与美国防部签协议,允许其 AI 用于机密军事工作

谷歌和美国国防部达成了一项协议,让谷歌的 AI 系统能进入机密军事工作流程。五角大楼官员确认了这笔交易,但正文没披露具体用了哪些系统、合同金额有多大,也没说使用上有什么限制。这件事发生在研究人员持续抗议谷歌参与军事项目的背景下,我会先打个折——目前公开信息太少,没法判断这到底是一次性试点还是深度绑定。

推荐理由:这条消息本身够硬:Google 和五角大楼的机密军事 AI 合作被确认了。我会先打个折,因为正文没写具体系统、金额和使用限制,没法判断规模。但 H、K、R 三点都踩中了——冲突感强、事实新、跟从业者的职业伦理直接相关,所以放在 featured 里没问题。

TechCrunch · AI

Anthropic 拒绝五角大楼后,Google 签下新合同扩大军方 AI 使用权限

Anthropic 明确禁止自家 AI 被用于国内大规模监控和自主武器,五角大楼转头就找了 Google。Google 已经和美国国防部签了一份新合同,进一步开放 AI 的使用。不过正文没披露合同金额、具体用到哪些模型,也没说什么时候开始部署。

推荐理由:这条新闻的看点不在合同本身,而在两家公司面对军方订单时截然不同的选择。Anthropic 划了红线,Google 没划,从业者自然会追问:Google 的安全框架到底怎么界定军事用途?正文没披露合同金额、模型范围或部署时间,所以具体影响有多大还不好判断。我会先打个折,但话题性够强,放在 featured 里让读者自己掂量。

4月28日星期二

The Verge · AI

谷歌被曝与五角大楼签了份机密 AI 合同,允许军方“任何合法用途”

The Verge 报道,谷歌和美国国防部签了一份保密协议,允许军方把谷歌的 AI 模型用于“任何合法的政府目的”。合同具体金额、用了哪些模型、部署范围多大,正文都没披露。就在消息曝光不到一天前,谷歌员工刚联名要求 CEO 皮查伊阻止公司 AI 被五角大楼使用。报道还提到,这份合同没给谷歌否决权,也就是说谷歌没法对军方具体怎么用它的模型说“不”。

推荐理由:这条消息的钩子很明确:一家大模型公司悄悄给了军方一张几乎不设限的通行证。我会先打个折,因为合同金额、模型清单和实际部署范围全是空白,没法判断影响到底多大。但“任何合法政府目的”这个表述本身就够有争议,再加上报道出来前不到一天员工还在要求 CEO 阻止合作,时间线很紧凑。对关心 AI 安全与政策的从业者来说,这比一般的合作声明更值得留意。

The Verge · AI

600 多名谷歌员工联名要求皮查伊拒绝将 AI 用于军方机密项目

超过 600 名谷歌员工给 CEO 皮查伊发联名信,要求公司阻止五角大楼把谷歌的 AI 模型用在机密用途上。组织者说签名的人里很多来自 DeepMind,包括 20 多位 principal、director 和 VP 级别的人。信里的核心逻辑是:只要接了机密项目,谷歌就没法保证自己不会间接参与伤害性用途,因为这类工作会在公司不知情或无法叫停的情况下进...

推荐理由:HKR 三项都成立:600 多人联名反对机密军事 AI 使用,DeepMind 和 20 多位中高层卷入,冲突和新鲜度都够。正文没披露 Google 有没有回应,政策也没变,所以保持 featured 中档。

彭博科技

欧盟盯上谷歌在安卓系统里的 AI 控制权,想让第三方 AI 服务也能平等接入

欧盟监管机构提出了一组措施,目标是谷歌对安卓生态里 AI 服务入口的控制。目前公开信息只提到计划让竞品 AI 服务也能进入安卓,但正文没披露具体义务、执行时间表和罚则——彭博的原文被付费墙和反爬机制挡住了,实际细节看不到。

推荐理由:Bloomberg 的信源加上 Google+Android+欧盟反垄断的组合,让这条在 AI 分发层面有分量。但我会先打个折:正文没给出任何执行细节,不知道欧盟这次是动真格还是先放风,所以知识增量有限。从业者真正该盯的是默认助手、搜索入口和 Play 商店的推荐位会不会被强制放开,这点先别太激动。