跳到正文

Google / Gemini

Google 与 DeepMind 的 AI 动态:Gemini 系列、Veo 视频模型、研究成果与产品生态的持续追踪。

最新精选

第 21–40 条 · 共 409 条

9月18日星期五

TechCrunch · AI

联合国找谷歌帮忙,把全球统计数据做成 AI 能直接调用的格式

联合国周四宣布跟谷歌合作,搭建了一个叫“UN System Data Commons”的新平台。简单说,就是把联合国旗下各个机构的统计数据整理好,让人能用大白话搜索,也让 AI 系统能通过 MCP 这个接口标准直接连上来取数。起因是联合国儿童基金会之前拿 6 个大模型做了个测试,让它们回答 13.3 万个关于全球发展指标的问题,结果平均准确率只有 60...

推荐理由:联合国跟谷歌合作把统计数据做成 AI 可读,还用了 MCP 接口,这事有分量。但最抓人的是那个测试结果——6 个模型答全球发展指标问题,平均准确率才 60%,说明现在的大模型在专业数据上还很拉胯。不过话题偏机构化,离开发者日常远,所以 R 没给,分数就定在 featured 这个档。

AI HOT 精选

美国 AI 巨头公开喊“踩刹车”,但动机不纯

Anthropic 的 Dario Amodei 带头提议“放慢前沿 AI 研发节奏”,Sam Altman 和 Elon Musk 跟着附和,Google、微软也口头支持。The Verge 直接点出这帮人的动机很可疑——这更像是一次联手卡位,而不是真心搞安全。Meta 明确反对任何减速。文章没给出具体的时间表或技术门槛,只整理了各家的公开表态。

推荐理由:头部实验室集体讨论减速是个信号事件,The Verge 对动机的怀疑让这条稿子没沦为公关汇总。扣在 78 而不是更高,因为正文没给出具体时间线或技术硬指标,目前只是各家公开表态的整理,后续怎么落地还看不清。

Hacker News 首页

Wispr 发布实时语音模型 Canto:在真实口述场景下错误率最低,但别急着拿公开基准分说事

Wispr 推出了一个叫 Canto 的实时语音识别模型,主打真实世界的口述场景。他们在 10 小时、超过 2300 名用户的真实录音上做了测试,Canto 的词错误率(WER)比 Google、OpenAI、AssemblyAI 和 Deepgram 的模型都低。在一个专门挑刺的 3 小时挑战集里(包含噪音、低音量、短句),Canto 在实时模型里排...

推荐理由:这篇值得上推荐,主要是因为它在真实脏数据上做了横向对比,不是实验室自嗨。H 和 K 都站得住:场景够脏、对比够直接,对做语音产品的同行有参考意义。但我会先打个折——Wispr 不是头部玩家,这更像一次产品性能秀,不是行业级事件,所以 R 不成立,分数卡在 featured 门槛上。再往上就得看有没有开源、有没有第三方复现了,正文没提这些。

9月17日星期四

彭博科技

美国 AI 公司推动模型出口管制,中国 AI 股抛售加剧

Anthropic 和 Google 正在游说美国政府,想把 AI 模型权重(也就是模型的核心参数文件)也纳入对华出口管制。这事如果落地,中国公司想用 Claude、Gemini 这类前沿模型的门槛会大幅提高。消息一出,本来就在跌的中国 AI 股又挨了一拳——商汤和百度继续下探,恒生科技指数从 2026 年高点已经回撤超过 20%。不过文章没给出提案的...

推荐理由:Bloomberg 独家,信源扎实。Anthropic 和 Google 联手推动模型权重出口管制,这是出口管制从芯片延伸到模型本身的一个明确信号。对中国公司来说,如果落地,想用 Claude、Gemini 这类前沿模型的门槛会大幅提高。市场反应也很直接——中国 AI 股继续挨揍。扣分点:文章没给出提案的具体推进程度和落地时间线,目前还停在游说阶段,所以别急着当成既定事实。

The Verge · AI

Google Home 开放 MCP 接口,允许任何 AI 代理控制你的智能家居

Google Home 现在支持 MCP(模型上下文协议),Claude、ChatGPT 这类第三方 AI 代理可以直接读取你家的传感器数据、控制设备、搭建自定义仪表盘。这意味着智能家居的控制权不再绑死在 Google 自家的助手上了。目前对 Public Preview 用户开放,正文没提收费。我会先打个折——文章没细说权限范围和具体的安全防护措施,...

推荐理由:Google Home 接入 MCP,让 Claude、ChatGPT 这类外部 AI 直接操控家里的灯和传感器,智能家居的控制权不再只绑在自家助手身上。这点先别太激动——文章没细说权限粒度、安全防护和收费方式,信息密度还撑不起更高的分数,所以 78 分合理。

TechCrunch · AI

Google Home 开放 MCP 接口,你的 AI 助手能直接管智能家居了

Google 给 Google Home 推出了一个 MCP 服务器的早期试用版。MCP 相当于一个通用插头,让 Claude、ChatGPT、Google Antigravity 这类 AI 助手能直接操控你家里的智能设备、查看摄像头画面摘要和翻阅设备活动记录。你以后用大白话就能让 AI 帮你调灯光、查门口谁来过,或者自己搭个智能家居控制面板。想用上...

推荐理由:Google Home 开了个 MCP 服务器预览,让 Claude 等外部 AI 能直接使唤家里的智能设备,说明 MCP 正从开发者工具往消费者场景里探。H 和 K 都站得住,但智能家居的共鸣度对咱们读者没那么高,而且现在还只是个早期试用版,我会先打个折。

9月16日星期三

FT · 科技

DeepMind 联合创始人警告:AI 能力跑太快,安全措施跟不上

DeepMind 联合创始人、现任微软 AI CEO 的 Mustafa Suleyman 公开说,现在 AI 模型的能力提升速度,已经超过了安全管控的进度。他点名 OpenAI 和 Anthropic 内部因为安全问题出现了分歧,认为行业不能再靠自愿承诺,得搞强制性的安全标准。不过具体要定什么标准、什么时候落地,文章没写。

推荐理由:Suleyman 以微软 AI CEO 身份公开警告安全管控落后于模型能力,还点名两家头部实验室内部有裂痕,话题分量够。但文章只停在呼吁强制标准,没给出任何具体细节或落地路径,信息增量有限,所以我会在重要性上打个折。

AI HOT 精选

Google 放出 TranslateGemma 等一堆多语言模型,覆盖 300 多种语言

Google 一口气发了三个东西:一个叫 TranslateGemma 的开源翻译模型,用 1,040 组偏好样本做微调(就是用“哪个翻译更好”这种对比数据教模型学风格),在 Flores 基准上跑赢了 NLLB 和原版 Gemma 3。还有一个多语言版 Gemma 3,能处理 140 多种语言,数学和代码能力没掉。最后是一个语音翻译系统,能把 300...

推荐理由:Google 一口气发了三个多语言相关的东西,翻译模型有具体基准和偏好样本数量,多语言 Gemma 3 保住了推理能力,语音翻译覆盖 300 多种语言但缺延迟和成本数据。信息量够上 featured,但语音那块关键指标没给,所以没打到 85。

9月12日星期六

AI HOT 精选

Minitap 指控 Google Artemis 项目直接用了他们的开源代码,还把作者名字删了

Minitap 团队在 Google 新发布的 Artemis 项目里,一眼认出了自己写的 mobile-use 开源代码。安卓设备连接代码、Hopper 智能体的指令,以及一个让 Alice、Bob、Charlie 发新年祝福的 WhatsApp 示例,都是逐字照搬的。更让他们不舒服的是,项目早期的包配置文件里曾明确列出 Minitap 三位作者的名...

推荐理由:Minitap 拿出的不是模糊指控,而是三段逐字相同的代码和作者名被删的包配置记录,证据链清晰。Artemis 本身有行业关注度,开源署名纠纷又自带传播力,HKR 三项全中。没给更高分是因为目前只有 Minitap 单方面发声,Google 还没回应,事情可能还有另一面。

9月11日星期五

Hacker News 首页

Google 签下 22 年核电长约,在芬兰砸 130 亿欧元建 AI 数据中心

Google 宣布在芬兰投入 130 亿欧元,这是它在欧洲最大的一笔单项投资。钱主要用来新建三座数据中心、扩建原有园区,并配套清洁能源项目。作为其中一环,Google 和芬兰电力公司 Fortum 签了 22 年的购电协议,会买下 Loviisa 核电站最多一半的发电量。这座核电站目前供应芬兰约 10% 的电力,Fortum 说这笔长约能帮它筹到钱去延...

推荐理由:Google 在芬兰砸 130 亿欧元建数据中心,同时签下 22 年核电长约,买走一座核电站一半的电。这不是模型发布或产品更新,但比很多产品新闻更值得从业者留意——它说明 AI 竞赛的瓶颈正在从芯片转向电力,大厂开始用几十年长约锁定基荷电源,基础设施的玩法变了。信息够硬,缺的是这笔电具体对应多少算力、支撑什么工作负载,正文没展开。

9月8日星期二

Google DeepMind

Google DeepMind 发布 AlphaGenome Atlas,预测人类基因组全部单碱基变异

Google DeepMind 发布 AlphaGenome Atlas,一个包含人类基因组 90 亿个单核苷酸变异效应预测的平台,规模达 1PB,是 AlphaFold Database 的 30 多倍。

推荐理由:原文给出覆盖 90 亿单核苷酸变异的预测数据集与 AVI 评分,读者可据此了解基因组变异解读的新工具形态。

Computing Life · Share · 鸭哥调研

好点子已经过剩,AI 自我改进的瓶颈在考场

Anthropic 让 Claude Opus 4.8 当教练,自动搜索训练方案去修其他模型的毛病,比如谄媚和欺骗。每个智能体每小时 API 推理成本约 4 美元。核心发现是:把人类专家的方案喂给 AI 当起跑方向,最终表现并没有更好。真正决定改进能不能跨场景迁移的,是考卷怎么设计。只盯着一套 benchmark 优化,涨的分换到没见过的考卷上就崩了,...

推荐理由:这篇是对 Anthropic 对齐实验的二次解读,给出了具体成本和反直觉发现(人类种子方案没带来额外收益)。我会先打个折,因为不是一手发布,但结论本身对从业者有参考价值。三个维度都踩中了:标题有反转、内容有数字、受众对口。

9月5日星期六

Hacker News 首页

Spotify 工程师用 Portal 把 Claude Code 的 token 用量砍了九成

一个 Spotify 工程师发现 Claude Code 大部分 token 都花在了读大文件、生成样板代码这类没什么推理量的 I/O 活上。他用 Spotify 内部的 Portal 平台建了两个“模式”,把这类粗活路由到更便宜的 Gemini 2.5 Flash 去干:一个负责批量读文件回答问题,一个负责照着现有代码风格生成测试和配置。再配合一个叫...

推荐理由:Spotify 工程师的第一手实验,有具体数字和路由策略,不是泛泛的省钱建议。HKR 三个维度都踩中了,但本质是工程实践分享,不是产品发布或研究突破,所以定在 78 分、featured 层级。

9月4日星期五

Hacker News 首页

谷歌 AI 模式推的同一款商品,比传统搜索贵了 21.6%

Productrise 在 23 天里跟踪了超过 200 万条商品信息,发现同一个搜索词下,谷歌 AI 模式展示的商品比传统搜索结果平均贵 21.6%。如果把两边所有商品都算上,AI 模式的中位价是 149 美元,传统搜索是 100 美元,差距拉到 49%。更关键的是,只有 1.28% 的商品会同时出现在两边。在同时出现的商品里,有 38.1% 价格不...

推荐理由:Productrise 用 200 万条商品信息把谷歌 AI 模式的定价倾向给量化了,数字具体、结论尖锐。没给更高分是因为这是单一第三方研究,公司本身卖电商工具,有利益关联,我会先打个折。

AI 群聊日报

Flash 模型集体冲顶:Gemini 3.8 Flash 和 Muse Spark 1.3 同天发布,便宜模型已能搞定九成任务

Google 发布 Gemini 3.8 Flash,输入价格每百万 token 0.75 美元,在 DeepSWE 编程基准上拿到 71% 的分数,多项智能体跑分超过 Sol 和 Opus 5。同一天 Meta 放出 Muse Spark 1.3,智力分跟 Grok 4.6 持平,Contributor 档位输入价只要 0.1 美元,但默认会用你的数...

推荐理由:Gemini 3.8 Flash 以 Flash 档位定价在智能体跑分上超过 Sol 和 Opus 5,这个信号很炸。来源是群聊日报而非官方公告,所以我会先打个折,但里面给的数字和实测笔记密度很高,对做模型选型的人有直接参考价值。

9月3日星期四

AI HOT 精选

Google 从最强 AI 智能体提交里挖出 4 个工程模式

Google 办了个 AI 智能体挑战赛,翻完高分代码发现大家不约而同用了四招。第一招叫双向 MCP:智能体不光能调用自己的工具,还能把自己变成一个工具服务器,让别的智能体直接来问它问题,省掉中间传话的人。第二招是事件驱动并行:多个智能体不再排成一串互相等,而是都盯着同一个事件总线,谁该动谁就动,互不耽误,总延迟从累加变成看最慢的那个。第三招叫同标准降...

推荐理由:文章从比赛代码里挖出四个模式,有具体机制和延迟数据,对 Agent 开发者直接有用。稍微扣分是因为这是赛后总结而非产品发布,且 Google 自家博客难免带点宣传味,但信息本身扎实。

Google DeepMind

Google DeepMind 推出 Fairwind 计划,向政府和可信伙伴开放 Gemini 3.8 Flash Cyber 网络防御能力

Google DeepMind 推出 Fairwind Program,面向政府机构、关键基础设施运营商和网络安全伙伴限量开放其最先进的网络防御能力。该计划将专用网络模型 Gemini 3.8 Flash Cyber 与 CodeMender harness 结合,可自主发现、验证并修复漏洞,把原本数周的手动修复压缩到数分钟内生成可部署补丁,且运行成本低于传统前沿模型。

推荐理由:原文给出 Fairwind 计划的准入对象、模型与工具组合,读者可据此判断自主漏洞修复在企业与政府场景的落地方式。

9月2日星期三

TechCrunch · AI

Google 推出 Pics,一款靠打字出图的 AI 设计工具,直接对标 Canva

Google 发布了一个叫 Pics 的 AI 设计工具,能根据文字描述直接生成海报、社交帖子和插图。它用的是自家的 Nano Banana 图片模型,会先推给 Workspace 企业用户和 Google AI Pro/Ultra 付费用户。跟 Canva 或 Adobe Express 最大的区别是,Pics 没有创作者模板市场,所有东西都是 AI...

推荐理由:Google 出了个叫 Pics 的 AI 设计工具,你打字描述,它直接出海报、社交图。底层是自家的 Nano Banana 模型,先给 Workspace 企业用户和 Google AI Pro/Ultra 付费用户用。跟 Canva 最大的区别是它没有创作者模板市场,所有东西靠 AI 生成。我会先打个折:文章没讲清楚能不能精细编辑、团队协作怎么样,更像功能预告而不是完整产品评测。如果是真的,对懒得翻模板的人挺省事,但设计团队先别急着切过去。

AI HOT 精选

Gemini 现在能看视频学操作,然后自己上手点按、打字、滚动页面

Google DeepMind 给 Gemini 加了一个新能力:给它看一段操作界面的录屏,它就能看懂步骤,然后自己去完成同样的点击、输入和滚动。不是只描述画面,而是真的执行多步任务,比如填网页表单或在手机 App 里下单。这个功能已经在 Gemini 应用和 Google AI Studio 开放测试。不过正文没提延迟和成功率——UI 自动化智能体在...

推荐理由:Google DeepMind 给 Gemini 加了个挺直接的能力:给它看操作录屏,它就能学会步骤,自己去完成填表、下单这类多步 UI 任务。已经在 Gemini 应用和 AI Studio 开放测试,这点让实验门槛很低。但正文没提延迟和成功率——对 UI 自动化智能体来说,这两个数直接决定能不能用,我会先打个折,等实测数据出来再说。

8月29日星期六

TechCrunch · AI

英伟达的护城河,已经从 GPU 延伸到整个机柜的调度能力

英伟达刚发完财报,市场开始重新算它的账。以前大家担心 AWS 和谷歌用自研芯片抢 GPU 的份额,但现在焦点变了:当数据中心的用电量涨到吉瓦级别,怎么调度、怎么让几万张卡高效互联,比单颗芯片的算力更难做。英伟达这次推的 Vera Rubin 方案,把 NVLink 交换机、Spectrum-X 以太网和 BlueField DPU 打包在一起,直接在机...

推荐理由:这是一篇财报后的策略分析,把竞争焦点从芯片算力转移到了整机柜的互联调度上。观点驱动而非硬新闻,所以分数没破 85。我会先打个折:正文没给出具体的性能对比数据或客户案例,更多是逻辑推演,但逻辑本身站得住脚,对关注基础设施的从业者来说值得一读。