跳到正文

Google / Gemini

Google 与 DeepMind 的 AI 动态:Gemini 系列、Veo 视频模型、研究成果与产品生态的持续追踪。

最新精选

第 361–380 条 · 共 409 条

4月28日星期二

The Verge · AI

600 多名谷歌员工联名要求皮查伊拒绝将 AI 用于军方机密项目

超过 600 名谷歌员工给 CEO 皮查伊发联名信,要求公司阻止五角大楼把谷歌的 AI 模型用在机密用途上。组织者说签名的人里很多来自 DeepMind,包括 20 多位 principal、director 和 VP 级别的人。信里的核心逻辑是:只要接了机密项目,谷歌就没法保证自己不会间接参与伤害性用途,因为这类工作会在公司不知情或无法叫停的情况下进...

推荐理由:HKR 三项都成立:600 多人联名反对机密军事 AI 使用,DeepMind 和 20 多位中高层卷入,冲突和新鲜度都够。正文没披露 Google 有没有回应,政策也没变,所以保持 featured 中档。

TechCrunch · AI

DeepMind 的 David Silver 拿了 11 亿美元,要做不靠人类数据自己学的 AI

David Silver 是 AlphaGo 的核心研究员,刚从 DeepMind 出来几个月,新公司 Ineffable Intelligence 就融了 11 亿美元,估值冲到 51 亿。标题说目标是“不靠人类数据学习”的 AI,但正文没披露具体用什么方法实现。目前只知道这是一家英国 AI 实验室,其他技术细节、团队规模和产品方向都没说。11 亿这...

推荐理由:这条消息我会先打个折——标题很炸,但正文没给出任何技术机制,所以别太激动。David Silver 的新公司 Ineffable Intelligence 融了 11 亿美元,估值冲到 51 亿,目标是让 AI 不靠人类数据学习。这直接回应了“数据快被榨干”的行业焦虑,也说明顶尖研究员创业的吸金能力。但正文没披露训练方法、验证结果或论文,目前只能当一笔巨额押注来看,离可复现的成果还远。

彭博科技

欧盟盯上谷歌在安卓系统里的 AI 控制权,想让第三方 AI 服务也能平等接入

欧盟监管机构提出了一组措施,目标是谷歌对安卓生态里 AI 服务入口的控制。目前公开信息只提到计划让竞品 AI 服务也能进入安卓,但正文没披露具体义务、执行时间表和罚则——彭博的原文被付费墙和反爬机制挡住了,实际细节看不到。

推荐理由:Bloomberg 的信源加上 Google+Android+欧盟反垄断的组合,让这条在 AI 分发层面有分量。但我会先打个折:正文没给出任何执行细节,不知道欧盟这次是动真格还是先放风,所以知识增量有限。从业者真正该盯的是默认助手、搜索入口和 Play 商店的推荐位会不会被强制放开,这点先别太激动。

彭博科技

数百名 Google 员工联名要求 Pichai 拒绝涉密军事 AI 项目

彭博社报道,一封由数百名 Google AI 研究员签署的联名信递到了 Sundar Pichai 面前,核心诉求是公司不要承接美国国防部涉密级别的 AI 工作。报道只提到了联名信的规模和反对立场,没有披露具体涉及哪些系统、合同金额有多大,也没有 Google 官方的正式回应。

推荐理由:Bloomberg 爆出几百名 Google AI 员工写信给 Pichai,要求别把 AI 系统用在美军机密任务上。我会先打个折:正文只说了信件诉求和参与人数,没披露具体是哪个系统、合同多大、Google 官方怎么回应,所以信息缺口不小。但这事本身够直接——自家研究员公开叫板管理层,而且矛头很具体,不是泛泛反对军事 AI,而是点名“机密工作负载”。对从业者来说,这比一份安全白皮书更有讨论价值,因为它牵扯到公司内部治理、人才去留和国防合同争议。基于这些,重要性给 74、放在 featured 是合理的,等后续有回应或更多细节再调整。

FT · 科技

560 多名 Google 员工联名要求 CEO 阻止公司参与美国军事 AI 项目

超过 560 名 Google 员工给 Sundar Pichai 发了一封公开信,要求公司明确拒绝把 AI 技术用于美国军事用途。信里提到了五角大楼和 Anthropic 之间的冲突,但正文没披露员工的具体诉求、涉及哪些产品或合同金额。

推荐理由:我会先打个折:信里到底要求停用哪些产品、涉及多大合同,正文全都没写,所以没法判断实际业务冲击有多大。但 560 多人集体向 Pichai 施压这件事本身就有冲突感,加上 Pentagon 和 Anthropic 的背景,从业者很难不关心。信息缺口明显,先别太激动,但值得放进精选。

4月27日星期一

Hacker News 首页

Dirac 这个开源编程助手在 TerminalBench 上拿了第一,靠的是省 token 和并行操作

Dirac 是一个专门抠上下文效率的编程助手,刚在 TerminalBench 上跑分拿了第一,用的模型是 Gemini-3-flash-preview。它说自己能把 API 调用成本压到其他同类工具的 20% 到 50%,主要靠三招:用哈希锚点来精准定位代码修改位置、把能并行的操作全并行跑、直接操作抽象语法树而不是整段重写。不过正文没披露 Termi...

推荐理由:HKR 三项都站得住:一个开源编程智能体声称在 TerminalBench 上拿了第一,还给出了具体模型和成本降幅,技术细节也没藏着。不过分数我压到 78,因为目前只有仓库自述,完整榜单分数和复现日志都没放出来,先别太激动。

新智元 · 公众号

奥特曼喊完“红色警戒”五个月,GPT Image 2 在图像竞技场三项登顶,把谷歌甩开一大截

GPT Image 2 上线不到半天就在 Arena 图像榜拿了三个第一。文生图得分 1512,比第二名 Nano Banana 2 高出 241 分,Arena 说这是图像榜有史以来最大分差。盲测胜率 93%,文字渲染能力一口气涨了 316 分。核心变化是模型会“先想再画”:先规划构图、自己检查结果、能联网搜图,还能一次出 8 张风格统一的图。不过正...

推荐理由:GPT Image 2一上线就屠榜,分数和胜率都摆在那,1512分、93%盲测胜率、文字渲染涨316分,这些数字说明它确实把文生图拉到了新高度。我会先打个折:原生思考图像模型听起来很猛,但正文没披露具体架构和成本,这点先别太激动。不过一次生成8张连贯图、能联网搜图再画,对做设计和内容的人很实用。整体是近期多模态产品里最硬的一次更新,值得从业者盯一下。

Hacker News 首页

Chrome 内置 Prompt API:在浏览器里直接跑大模型

Chrome 给开发者提供了一个 Prompt API,让网页可以直接调用浏览器内置的 AI 模型来生成文本,不用把数据发到云端。这个 API 还支持会话管理(保持多轮对话上下文)和结构化输出(让模型按固定格式返回结果,方便程序解析)。文档里没写具体用的是什么模型、上下文窗口多大、收费不收费,也没提什么时候能正式上线。目前看起来还在早期试验阶段,适合想...

推荐理由:Chrome 把 AI 塞进浏览器里,网页调个 API 就能用,这个入口变化挺大。会话管理和结构化输出两份配套文档让方案看起来不是空壳,但正文没提模型规格、上下文窗口多大、要不要付费、什么时候正式上线,所以我会先打个折,放在 featured 里偏低的位置。

4月25日星期六

Computing Life · Share · 鸭哥调研

Anthropic 让自家客户端跑别家模型,反常让步背后在赌什么

Anthropic 在 Claude Cowork 里加了个开关,让你能换成 GPT-5.5、Gemini 3.1 Pro 或 DeepSeek V4 来跑任务。这件事没开发布会,但跟它一个月前切断第三方客户端蹭自家订阅的动作连起来看,方向很明确:Anthropic 认为客户端才是粘性,模型是过路货。更反常的是,走这条路 Anthropic 既收不到订...

推荐理由:我会先打个折:来源非官方,Cowork 用户基数也小,所以没给更高分。但这条消息的钩子很强——让自家产品跑别家模型,还明确不收过路费,数据也不经手,这比单纯发个新功能更值得盯。文章把 AWS、Google、微软在 agent 运行时上的布局串起来,点出了模型层和基础设施层的博弈,对从业者判断生态走向有帮助。

Computing Life · Share · 鸭哥调研

TPU 与 CUDA 的攻防战:Cloud Next 2026 之后的判断

Google 在 Cloud Next 2026 上放了三招:把第八代 TPU 拆成训练用的 8t 和推理用的 8i,8i 内存带宽比 8t 还高,专门对付长上下文推理;推出 TorchTPU,让 PyTorch 代码能直接在 TPU 上跑,不再需要以前那个问题一堆的桥接层;以及给 Anthropic 投了最多 400 亿美元并配 5GW 算力。这三件...

推荐理由:这篇文章把 TPU 和 CUDA 的竞争讲得很清楚,给了 8i 的硬参数和量产时间,也提到了 TorchTPU 这个降低迁移门槛的动作。但正文自己说了缺少独立 benchmark,而且 8i 要 2027 下半年才量产,所以判断 18-24 个月内 TPU 不会取代 NVIDIA。信息有料,但验证还弱,时间也远,所以重要性给到 82,放在 featured 里。

Hacker News 首页

Google 上线 Flow Music,用 Lyria 3 做歌、Veo 生成 MV

Google 悄悄上线了 Flow Music 网页版,目前有歌曲、歌单、空间、视频、项目和 Turntable 六个板块。核心功能是跟一个叫 Producer 的对话式工具聊天做歌,官方说它背后是 Lyria 3 模型,能生成带人声的完整歌曲;AI 音乐视频部分接的是 Veo 模型,可以自己控制角色和画面风格。页面还展示了一些示例曲目和可交互的迷你乐...

推荐理由:我会先打个折:正文没披露价格、地区、模型参数和版权机制,这些关键信息全缺,所以重要性停在 76 不动。但 Google 把 Lyria 3 和 Veo 打包成一个网页端音乐创作入口,6 类入口直接列出来,Producer 能出完整歌曲,这点对从业者来说信号很明确——大厂在认真推 AI 音乐工具,不是 demo。没写版权怎么处理,先别太激动,但上线本身已经够让做音乐 AI 的人盯着看了。

Hacker News 首页

TIPSv2:Google DeepMind 给视觉语言模型换了套预训练配方,零样本分割涨了 14.1 分

Google DeepMind 发了 TIPSv2,一篇 CVPR 2026 论文,改了三处预训练方法,让视觉模型在零样本分割上明显变强。核心发现是:用蒸馏训练出来的小模型,在图像区域和文本的对齐能力上反而超过了大模型老师,原因在于老师模型在预训练时没管那些没被遮住的图像块。于是他们搞了个 iBOT++,把自监督学习的目标从只盯被遮住的块,扩展到所有图...

推荐理由:Google DeepMind 在 CVPR 2026 拿出的 TIPSv2,核心是三处预训练改动。最值得看的是 iBOT++:对遮挡和可见 patch 都加自蒸馏损失,零样本分割直接涨了 14.1 mIoU,同时用 Head-only EMA 把训练参数砍掉 42%。我会先打个折——这还是一次研究发布,不是当天就能用的模型,但可见 token 监督这个方向比堆大教师模型务实,对想省预训练成本的人是个信号。

TechCrunch · AI

Google 计划向 Anthropic 投 400 亿美元,现金加算力

Google 打算先投 100 亿美元现金,把 Anthropic 的估值推到 3500 亿美元;后面还有 300 亿美元,但要看 Anthropic 能不能达到约定的业绩目标。这笔钱不全是现金,相当一部分会折算成云计算资源,也就是给 Anthropic 提供跑模型需要的算力。这个时间点刚好在 Anthropic 小范围放出新模型 Mythos 之后—...

推荐理由:这条消息的冲击力主要来自 400 亿美元的上限和现金+算力的组合,不是单纯的融资数字。我会先打个折:正文没写交易结构、时间表和算力配额,所以实际落地规模和节奏还不清楚。对从业者来说,真正值得盯的是算力绑定——Anthropic 对 Google Cloud 的依赖会不会加深,后续模型训练和推理成本能不能压下来,这点先别太激动,得等更多细节。

FT · 科技

谷歌计划向 Anthropic 投资最高 400 亿美元,钱主要用来买算力

谷歌要给 Anthropic 投一笔钱,上限是 400 亿美元。这笔钱不是单纯的财务投资,核心目的是给 Anthropic 的模型增加计算资源,也就是买更多服务器和芯片来跑模型。这更像是一种算力绑定——Anthropic 拿了钱,但得花在谷歌的云服务或算力上。不过,正文被付费墙挡住了,具体的交易结构、投资时间表、Anthropic 的最新估值,以及算力...

推荐理由:FT 的消息说 Google 计划向 Anthropic 投最多 400 亿美元,用途是增加跑模型需要的算力。我会先打个折——具体怎么投、分几批到账、估值多少、算力从哪来,正文都没写。但光这个数字和算力绑定的方向,就值得从业者盯着看,因为这比单纯财务投资更能锁死合作关系。

彭博科技

谷歌计划向 Anthropic 投资最高 400 亿美元,首笔 100 亿已敲定

谷歌先投 100 亿美元,Anthropic 估值给到 3500 亿美元。后面可能再追加 300 亿,但正文没披露触发条件、时间表和最终持股比例。我会先打个折——重点不是 400 亿这个总数,而是后续那笔钱在什么情况下会进来,以及这个估值到底靠什么撑起来。

推荐理由:P1:HKR 三项全中。Google 可能投 400 亿进 Anthropic,这个数字本身就够抓眼球;Bloomberg 节目里拆出先投 100 亿、估值 3500 亿,后面还能再追 300 亿,信息增量是实的;两家深度绑定对算力和资本格局的影响也够大。没给到 95 分是因为股权、交割时间和追加条件全是空白,正文也没补,总额听着大但实际落地的条款还不清楚,我会先打个折。

4月24日星期五

彭博科技

Google 计划向 Anthropic 投资最多 400 亿美元

Google 先投 100 亿美元进 Anthropic,后面可能再追加 300 亿,总盘子拉到 400 亿。这笔钱会让两家在 AI 上绑得更紧,但正文没披露那 300 亿的触发条件是什么,也没说钱具体怎么花。

推荐理由:这条放 p1 是因为 HKR 三项全中:400 亿的上限本身就是新闻,100 亿加 300 亿的分段结构是新信息,而且会实质影响谷歌和 Anthropic 的联盟关系。后面那 300 亿的触发条件没披露,所以我不给到 95 分以上那档。

4月23日星期四

TechCrunch · AI

Google 要把 AI 概览塞进你的工作 Gmail 里了

Google 在 Cloud Next 大会上宣布,会把类似搜索结果的 AI 概览功能搬到企业版 Gmail 里。你可以用大白话提问,比如问项目进度、发票情况或差旅细节,AI 会直接跨多封邮件抓取信息,生成一段简短的总结,不用你一封封点开看。这个功能默认开启,前提是管理员已经打开了 Gemini for Workspace 和 Workspace In...

推荐理由:Google 要把 AI 自动摘要塞进企业版 Gmail,不是给单封邮件划重点,而是跨多封邮件直接生成总结。这点和普通邮件摘要不一样,更像是在收件箱里加了一层工作流收束。但正文没写什么时候上线、哪些套餐能用、背后模型是什么,所以我会先打个折。HKR 里 K 和 R 都过了,H 偏弱,整体放在 featured 低档就行。

The Verge · AI

Google Meet 的 AI 笔记功能现在也能用在面对面会议上了

Google 把 Gemini 的会议纪要功能从线上视频扩展到了线下面对面开会。你只要在房间里用手机或平板打开 Meet,它就能直接录下现场对话并生成文字稿和摘要。之前这个功能只在安卓测试版里小范围试过,现在正式开放了。另外,就算你用的是 Zoom 或微软 Teams 开会,它也能帮你记笔记,不再只绑在 Meet 自己的通话里。正文没提这个功能对多人说...

推荐理由:一条中等体量的产品更新。H 打在线下加跨平台这个组合拳上,K 落在对 Zoom 和 Teams 的具体支持以及摘要转录能力,R 则指向各家争夺会议记录工作流的暗线。正文没披露定价、铺开节奏和实际转录质量,所以我会先打个折,不把它当成颠覆性发布。

4月22日星期三

量子位 · 公众号

商汤绝影把32B总参、3B激活的模型塞进车机,跑分压过GPT-5.4和Opus 4.6

商汤绝影发布了一个叫Sage的车载端侧多模态模型,总参数32B,但每次推理只激活3B参数。它在PinchBench上拿了94%,比Claude Opus 4.6的93.3%和GPT-5.4的90.5%都高。模型跑在Nvidia OrinX上,首字延迟约0.5秒,单token生成约0.03秒,吞吐80 tok/s。训练用了两个方法:SCOUT省了约60%...

推荐理由:我会先打个折:所有数据都是商汤自报,没有第三方复现,PinchBench 的对比对象和测试条件正文也没细说。但亮点在于它把 3B 激活模型塞进 OrinX,还给出了推理延迟和吞吐,这对车载场景比跑分更有参考价值。后训练省 60% GPU 小时、复杂任务完成率提 20% 这两个数,缺训练规模和消融细节,先别太激动。整体看,信息量够、落地指向明确,但验证链不完整,所以重要性给 79,放在 featured 里提醒大家关注端侧 Agent 的进展和水分。

X · @dotey(宝玉)

Google 把 Gemini Deep Research 拆成两个版本:一个求快求省,一个烧算力出深度报告

Google 把 Gemini Deep Research 拆成了标准版和 Max 版,背后都是 Gemini 3.1 Pro 模型。标准版走速度和成本优先路线,适合嵌在产品里做即问即答;Max 版会反复搜索、推理、打磨报告,官方举的例子是分析师下班前丢一个尽调任务,第二天早上收完整报告。这次最大的变化是支持 MCP,能把 FactSet、S&P、Pi...

推荐理由:这是一次有分量的产品更新:Gemini Deep Research 拆成标准版和 Max 版,在付费 API 里公开预览,标准版偏速度和成本,Max 版给更多算力、反复搜索和推理。HKR 三项都站得住,但官方没公布定价、调用限制和两版实际性能差距,所以分数压在 78-84 这个区间。