跳到正文

#Google

今日 3 条

9月19日星期六

彭博科技

谷歌让 Gemini 自主攻击真实系统,拿下了三个目标

谷歌在一次安全测试里放开了 Gemini 的手脚,让它自主攻击真实系统,结果它成功拿下了三个目标:一个内部应用、一个开源数据库和一个第三方 SaaS 服务。OpenAI、Anthropic 和 Meta 也都公开过类似的测试结果,说明“模型能不能黑进真实基础设施”正在变成一项常规安全指标。文章没披露具体的攻击链条,也没对比各家防御措施,所以我会先把这当...

推荐理由:Gemini 在一次安全测试里自主拿下了三个真实目标,而且 OpenAI、Anthropic 和 Meta 也都公开过类似结果,说明这种测试正在成为安全评估的标配。分数没给到 85 以上,是因为文章没披露具体的攻击链条,也没对比各家防御措施,我会先把这当成一个信号,而不是一个完整的结论。

Google 研究院

Google 开源 MilleMiglia:给中段物流路径规划算法造更真实的测试题

Google 开源了一个叫 MilleMiglia 的工具,专门用来生成中段物流(仓库到分拨中心之间的运输)的测试用例。它不像传统随机生成器那样只扔坐标,而是直接拿真实路网、时间窗口和车辆限制来造场景,这样你测路径规划算法时结果更可信。正文没披露它跟现有基准比具体快多少或准多少,但如果你在搞物流调度优化,这个工具能省掉自己手搓测试数据的时间。

TechCrunch · AI

Google 把 CC 重新定位成家庭 AI 管家,能读邮件、管日历、填表单

Google 这周重新发布了 CC,不再做通用助手,而是专门帮一家人协调杂事。家庭成员可以共享邮箱、日历和待办,AI 会帮着排日程、填学校或活动表单、生成购物清单、规划菜谱。CC 最早在 2025 年推出,这次转向直接跟亚马逊 Alexa 的家庭功能抢用户。目前还在测试,正文没披露具体上线时间和收费方式。

9月18日星期五

FT · 科技

拿了亚马逊80亿、谷歌20亿之后,Anthropic开始建销售团队,安全公司的剧本要改写了

FT这篇评论说得很直白:Anthropic正在从一家安全实验室变成一家普通商业公司。拿了亚马逊80亿美元和谷歌20亿美元的投资后,它现在开始组建销售团队、追企业订单。文章的核心判断是,拿了大钱就得按商业规则玩,安全使命会被稀释。不过正文没给出具体的销售团队规模或营收目标数字,更多是趋势性评论。

Latent Space

AI 圈平静的一天:Claude Code 多线程、Jev 分类器、OpenAI 法律版 Astra

Anthropic 给 Claude Code 加了 Projects 功能,一个对话能同时开好几个云端线程,你走了它还能继续跑。Google 更新了 Gemini 的托管代理,新加的 Credentials API 用占位符把密钥藏起来,不让模型直接看到,号称成本能降 30%。TypeSafe 的 Jev 模型被大家当成快速路由和判断层来用,Clou...

TechCrunch · AI

Google DeepMind 开了个研究所,想把 AGI 的争论摊开来聊

Google 和 DeepMind 的研究员周三搞了个 DeepMind Institute,Shane Legg 当主编,James Manyika 和 Demis Hassabis 做董事。这个所不打算统一口径,而是要把 Google 内部、DeepMind 和全球研究圈对通用人工智能(AGI)的分歧摆到台面上,并且明说随着前沿数据出来,观点会变。...

推荐理由:DeepMind 用研究所的形式介入 AGI 辩论,核心人物直接挂编辑和董事,话题分量够重。但文章只讲了启动和姿态,第一期具体讨论什么、用了哪些数据都没披露,所以分数先打 78,等有实质内容再往上调。

TechCrunch · AI

联合国找谷歌帮忙,把全球统计数据做成 AI 能直接调用的格式

联合国周四宣布跟谷歌合作,搭建了一个叫“UN System Data Commons”的新平台。简单说,就是把联合国旗下各个机构的统计数据整理好,让人能用大白话搜索,也让 AI 系统能通过 MCP 这个接口标准直接连上来取数。起因是联合国儿童基金会之前拿 6 个大模型做了个测试,让它们回答 13.3 万个关于全球发展指标的问题,结果平均准确率只有 60...

推荐理由:联合国跟谷歌合作把统计数据做成 AI 可读,还用了 MCP 接口,这事有分量。但最抓人的是那个测试结果——6 个模型答全球发展指标问题,平均准确率才 60%,说明现在的大模型在专业数据上还很拉胯。不过话题偏机构化,离开发者日常远,所以 R 没给,分数就定在 featured 这个档。

AI HOT 精选

美国 AI 巨头公开喊“踩刹车”,但动机不纯

Anthropic 的 Dario Amodei 带头提议“放慢前沿 AI 研发节奏”,Sam Altman 和 Elon Musk 跟着附和,Google、微软也口头支持。The Verge 直接点出这帮人的动机很可疑——这更像是一次联手卡位,而不是真心搞安全。Meta 明确反对任何减速。文章没给出具体的时间表或技术门槛,只整理了各家的公开表态。

推荐理由:头部实验室集体讨论减速是个信号事件,The Verge 对动机的怀疑让这条稿子没沦为公关汇总。扣在 78 而不是更高,因为正文没给出具体时间线或技术硬指标,目前只是各家公开表态的整理,后续怎么落地还看不清。

Hacker News 首页

Wispr 发布实时语音模型 Canto:在真实口述场景下错误率最低,但别急着拿公开基准分说事

Wispr 推出了一个叫 Canto 的实时语音识别模型,主打真实世界的口述场景。他们在 10 小时、超过 2300 名用户的真实录音上做了测试,Canto 的词错误率(WER)比 Google、OpenAI、AssemblyAI 和 Deepgram 的模型都低。在一个专门挑刺的 3 小时挑战集里(包含噪音、低音量、短句),Canto 在实时模型里排...

推荐理由:这篇值得上推荐,主要是因为它在真实脏数据上做了横向对比,不是实验室自嗨。H 和 K 都站得住:场景够脏、对比够直接,对做语音产品的同行有参考意义。但我会先打个折——Wispr 不是头部玩家,这更像一次产品性能秀,不是行业级事件,所以 R 不成立,分数卡在 featured 门槛上。再往上就得看有没有开源、有没有第三方复现了,正文没提这些。

9月17日星期四

Hacker News 首页

OpenAI 用“不对齐”框架抢跑,想在各国立法前先把规矩定好

OpenAI 发了一套新框架,用来追踪、调查和公开模型“不对齐”——也就是模型行为偏离开发者本意——的情况,同时公布了六个内部案例,全都没影响到真实用户。这件事本质上是公关和治理层面的操作:趁监管机构和外部研究者还没动手,自己先把问题的定义权攥在手里。日本媒体盯着数据捏造这类工程细节,西方媒体更爱聊生存风险。风险在于,一家公司自己定义的框架可能会让不良...

TechCrunch · AI

Google、Nvidia 和 Anthropic 拉上 Emerald AI,想靠“主动省电”给数据中心腾出电网空间

电网软件独角兽 Emerald AI 拉着 Google、Nvidia 和 Anthropic 组了个“AI 能源管理联盟”(AEMA),目标是靠需求响应技术,给新数据中心挤出 100 GW 的电网容量。简单说,就是让数据中心在电网吃紧时主动降功率,把电让出来,这样电网公司才敢批准更多机房接进来。想法挺直接,但文章只开了个头,没写联盟具体怎么运作、什么...

FT · 科技

苹果在AI时代的信任溢价

FT认为苹果在AI竞争中最值钱的护城河不是硬件,而是用户信任。AI要跑得好就得拿个人数据,苹果长期标榜隐私保护,反而比靠广告赚钱的Google和Meta更有优势。文章讲的是商业逻辑,没有披露具体的AI产品更新或市场份额数据。

彭博科技

美国 AI 公司推动模型出口管制,中国 AI 股抛售加剧

Anthropic 和 Google 正在游说美国政府,想把 AI 模型权重(也就是模型的核心参数文件)也纳入对华出口管制。这事如果落地,中国公司想用 Claude、Gemini 这类前沿模型的门槛会大幅提高。消息一出,本来就在跌的中国 AI 股又挨了一拳——商汤和百度继续下探,恒生科技指数从 2026 年高点已经回撤超过 20%。不过文章没给出提案的...

推荐理由:Bloomberg 独家,信源扎实。Anthropic 和 Google 联手推动模型权重出口管制,这是出口管制从芯片延伸到模型本身的一个明确信号。对中国公司来说,如果落地,想用 Claude、Gemini 这类前沿模型的门槛会大幅提高。市场反应也很直接——中国 AI 股继续挨揍。扣分点:文章没给出提案的具体推进程度和落地时间线,目前还停在游说阶段,所以别急着当成既定事实。

Hacker News 首页

macOS 27 Golden Gate 评测:苹果 AI 全面进驻,Intel Mac 彻底淘汰

macOS 27 Golden Gate 是一次风格割裂的更新。一方面,它像当年的 Snow Leopard,修复了上一代 macOS 26 Tahoe 留下的各种设计槽点,底层优化让日常操作更快更稳。另一方面,苹果 AI 功能被强制捆绑,不再提供关闭开关,模型会直接占用你几个 G 的硬盘空间。系统内置的端侧模型叫 AFM 3 Core,是跟 Goog...

The Verge · AI

Google Home 开放 MCP 接口,允许任何 AI 代理控制你的智能家居

Google Home 现在支持 MCP(模型上下文协议),Claude、ChatGPT 这类第三方 AI 代理可以直接读取你家的传感器数据、控制设备、搭建自定义仪表盘。这意味着智能家居的控制权不再绑死在 Google 自家的助手上了。目前对 Public Preview 用户开放,正文没提收费。我会先打个折——文章没细说权限范围和具体的安全防护措施,...

推荐理由:Google Home 接入 MCP,让 Claude、ChatGPT 这类外部 AI 直接操控家里的灯和传感器,智能家居的控制权不再只绑在自家助手身上。这点先别太激动——文章没细说权限粒度、安全防护和收费方式,信息密度还撑不起更高的分数,所以 78 分合理。

TechCrunch · AI

Google Home 开放 MCP 接口,你的 AI 助手能直接管智能家居了

Google 给 Google Home 推出了一个 MCP 服务器的早期试用版。MCP 相当于一个通用插头,让 Claude、ChatGPT、Google Antigravity 这类 AI 助手能直接操控你家里的智能设备、查看摄像头画面摘要和翻阅设备活动记录。你以后用大白话就能让 AI 帮你调灯光、查门口谁来过,或者自己搭个智能家居控制面板。想用上...

推荐理由:Google Home 开了个 MCP 服务器预览,让 Claude 等外部 AI 能直接使唤家里的智能设备,说明 MCP 正从开发者工具往消费者场景里探。H 和 K 都站得住,但智能家居的共鸣度对咱们读者没那么高,而且现在还只是个早期试用版,我会先打个折。

9月16日星期三

NVIDIA 博客

NVIDIA、Google 和 Emerald AI 组了个联盟,想让数据中心像电池一样响应电网

NVIDIA、Google 和一家叫 Emerald AI 的公司成立了一个联盟,核心目标就一个:让 AI 数据中心根据电网负荷动态调整用电量。说白了,现在 AI 训练和推理的用电像抽风一样忽高忽低,传统供电模式根本接不住。联盟想做的事,就是把数据中心变成电网的“柔性参与者”——电网电多了就多算点,电少了就降频或暂停。对做 AI 的人来说,这意味着未来...

Hacker News 首页

Cloudflare 让网站既能被搜索引擎收录,又能挡住 AI 训练爬虫

Cloudflare 在后台加了一个新开关,专门解决一个两难问题:网站想被 Google、Bing 搜到,但不想让 OpenAI、Anthropic 这些公司把内容拿去训练模型。他们把这类既做搜索又做训练的爬虫叫“可问责的混合用途 AI 爬虫”,听起来绕,其实就是承认有些爬虫身兼两职。现在站长可以在控制面板里一键允许搜索用途、拒绝训练用途。功能已经上线...

TechCrunch · AI

AI 墓地:那些没撑下来的项目和创业公司

TechCrunch 整理了一份“AI 墓地”清单,记录那些关停或没达到预期的 AI 项目。最新上榜的是 Relay,一个用 AI 代理自动处理邮件和任务的工具,周一正式关闭。它相当于一个更智能的 Zapier,但 OpenAI、Google 等大厂直接把类似功能塞进自家平台后,这种独立产品就没了生存空间。文章还提到了苹果反复跳票的 Siri AI 和...

AI HOT 精选

Google 放出 TranslateGemma 等一堆多语言模型,覆盖 300 多种语言

Google 一口气发了三个东西:一个叫 TranslateGemma 的开源翻译模型,用 1,040 组偏好样本做微调(就是用“哪个翻译更好”这种对比数据教模型学风格),在 Flores 基准上跑赢了 NLLB 和原版 Gemma 3。还有一个多语言版 Gemma 3,能处理 140 多种语言,数学和代码能力没掉。最后是一个语音翻译系统,能把 300...

推荐理由:Google 一口气发了三个多语言相关的东西,翻译模型有具体基准和偏好样本数量,多语言 Gemma 3 保住了推理能力,语音翻译覆盖 300 多种语言但缺延迟和成本数据。信息量够上 featured,但语音那块关键指标没给,所以没打到 85。

9月15日星期二

TechCrunch · AI

前TikTok高管做了个AI教你怎么摆姿势的App

前TikTok高管推出了一款叫Superpose的相机App,你拍张自拍或照片,AI会分析后生成4种可能的姿势,解决“手不知道放哪”的尴尬。去年Google在Pixel手机上也有类似功能叫Camera Coach,但Superpose只专注教人摆姿势。正文没披露它用的是什么模型、是否免费、以及具体上线日期。

彭博科技

OpenAI、Anthropic、Google 三家联手搞 AI 安全

OpenAI 说正在跟 Anthropic 和 Google 合作推进 AI 安全,但正文没披露具体合作内容,比如是联合做红队测试、统一安全标准,还是共享模型权重。目前只知道三家都表态了,具体怎么分工、有没有实质产出,都还没说。

TechCrunch · AI

iOS 27 让 Siri 终于能用了:换上了 Gemini 模型,能处理复杂指令和屏幕内容

作者升级到 iOS 27 公测版后,Siri 从只能定闹钟变成了每天都会用的助手。这次大改把底层模型换成了 Google 的 Gemini,扔掉了之前那套扩展知识库和不太稳定的 ChatGPT 集成。实际用下来,Siri 能查世界杯赛程、球队阵容和比分了;早期开发者版本有些小毛病,但公测版基本稳定。另外 Siri 换了新图标和过渡动画。文章没提延迟、准...

9月14日星期一

Hacker News 首页

Google 自己用 AI 秒拒的诈骗广告,人工审核却放行了两次

作者在 YouTube 上看到一个伪装成 iOS 系统弹窗的广告,提示“iPhone 存储已满”,诱导用户点击。他举报了两次,Google 都说广告合规。作者把广告截图喂给 Google 自家的 Gemini 模型,几秒内就被判定为违规:模仿系统弹窗、用假按钮、制造恐慌。Google 有现成的 AI 审核能力,却没用在广告审查上。正文没披露 Googl...

9月12日星期六

AI HOT 精选

Minitap 指控 Google Artemis 项目直接用了他们的开源代码,还把作者名字删了

Minitap 团队在 Google 新发布的 Artemis 项目里,一眼认出了自己写的 mobile-use 开源代码。安卓设备连接代码、Hopper 智能体的指令,以及一个让 Alice、Bob、Charlie 发新年祝福的 WhatsApp 示例,都是逐字照搬的。更让他们不舒服的是,项目早期的包配置文件里曾明确列出 Minitap 三位作者的名...

推荐理由:Minitap 拿出的不是模糊指控,而是三段逐字相同的代码和作者名被删的包配置记录,证据链清晰。Artemis 本身有行业关注度,开源署名纠纷又自带传播力,HKR 三项全中。没给更高分是因为目前只有 Minitap 单方面发声,Google 还没回应,事情可能还有另一面。

9月11日星期五

Hacker News 首页

Google Gemini 正式推出 Windows 桌面版

Google 发布了 Gemini 的 Windows 原生桌面应用,用户可以直接从电脑上打开 AI 助手,不用再绕道浏览器。官方博客没有说明这个版本包含哪些功能、是否免费,也没提能不能离线用。如果你习惯把 AI 当桌面工具用,现在多了一个入口,但具体体验好不好还得等上手才知道。

Hacker News 首页

Google 签下 22 年核电长约,在芬兰砸 130 亿欧元建 AI 数据中心

Google 宣布在芬兰投入 130 亿欧元,这是它在欧洲最大的一笔单项投资。钱主要用来新建三座数据中心、扩建原有园区,并配套清洁能源项目。作为其中一环,Google 和芬兰电力公司 Fortum 签了 22 年的购电协议,会买下 Loviisa 核电站最多一半的发电量。这座核电站目前供应芬兰约 10% 的电力,Fortum 说这笔长约能帮它筹到钱去延...

推荐理由:Google 在芬兰砸 130 亿欧元建数据中心,同时签下 22 年核电长约,买走一座核电站一半的电。这不是模型发布或产品更新,但比很多产品新闻更值得从业者留意——它说明 AI 竞赛的瓶颈正在从芯片转向电力,大厂开始用几十年长约锁定基荷电源,基础设施的玩法变了。信息够硬,缺的是这笔电具体对应多少算力、支撑什么工作负载,正文没展开。

9月10日星期四

9月9日星期三

AI HOT 精选

OpenRouter 发了个教程:一行代码换模型,用 Gemini 改图

OpenRouter 发了个教程,教开发者怎么用一行 API 调 Gemini 的图片编辑模型。默认模型叫 Nano Banana 2(就是 google/gemini-3.1-flash-image),你传一张原图和一段文字指令,接口直接返回改好的图。教程给了完整的 Python 和 TypeScript 代码示例:本地文件转 base64 或者传一...

9月8日星期二

TechCrunch · AI

Chrome 改成每两周发一次更新,因为 AI 让漏洞攻击变快了

Google 把 Chrome 的更新周期从 4 周缩短到 2 周,从 Chrome 153 版本开始,覆盖桌面、iOS 和 Android。原因是 AI 驱动的自动化攻击工具和社区提交的漏洞报告越来越多,补丁必须出得更快。正文没披露具体漏洞数量或攻击案例,但逻辑很清楚:攻击者用 AI 批量找漏洞,浏览器就得加速修。对用户来说,以后重启浏览器的频率会更高。

Google DeepMind

Google DeepMind 发布 AlphaGenome Atlas,预测人类基因组全部单碱基变异

Google DeepMind 发布 AlphaGenome Atlas,一个包含人类基因组 90 亿个单核苷酸变异效应预测的平台,规模达 1PB,是 AlphaFold Database 的 30 多倍。

推荐理由:原文给出覆盖 90 亿单核苷酸变异的预测数据集与 AVI 评分,读者可据此了解基因组变异解读的新工具形态。

9月7日星期一

Hacker News 首页

YouTube 有个回退 20 秒的 bug,作者用 ChatGPT 查出来了

作者发现 YouTube 在软刷新(比如切出去再切回来)时会自动回退约 20 秒。他用 ChatGPT 写了一个 Tampermonkey 脚本,hook 住视频跳转事件,再通过 Chrome 的调试端口让大模型直接看调用栈,定位到问题是客户端代码里的时间戳计算有误。Android 版 YouTube 正常,说明 bug 只出在 Web 端。正文没提 ...

9月6日星期日

Hacker News 首页

OKF Agent Memory:把 AI 编程助手的记忆存进 Git 仓库,不用外部数据库

这是一个纯 Go 写的库,给 AI 编程助手加一个能存到 Git 仓库里的长期记忆。它实现了 Google OKF v0.2 规范,内置 BM25 搜索,单次查询不到 300 微秒,还自带一个 MCP 服务器。项目宣称能把 token 消耗砍掉 80%,靠的是渐进式信息展开——先给摘要,需要时再查详情。不过正文没列出具体对接了哪些编程助手,也没给出真实...

9月5日星期六

Hacker News 首页

Spotify 工程师用 Portal 把 Claude Code 的 token 用量砍了九成

一个 Spotify 工程师发现 Claude Code 大部分 token 都花在了读大文件、生成样板代码这类没什么推理量的 I/O 活上。他用 Spotify 内部的 Portal 平台建了两个“模式”,把这类粗活路由到更便宜的 Gemini 2.5 Flash 去干:一个负责批量读文件回答问题,一个负责照着现有代码风格生成测试和配置。再配合一个叫...

推荐理由:Spotify 工程师的第一手实验,有具体数字和路由策略,不是泛泛的省钱建议。HKR 三个维度都踩中了,但本质是工程实践分享,不是产品发布或研究突破,所以定在 78 分、featured 层级。

9月4日星期五

TechCrunch · AI

Gemini Spark 现在能帮你管 Google Photos 了

Google 的个人助手 Gemini Spark 新增了管理 Google Photos 的能力:你可以让它直接修图、整理相册、自动创建共享相册、把演唱会海报照片转成日历事件,还能在 Photos 里跑一些自动化流程。功能会在接下来几周内推送给美国英语用户,需要订阅 Gemini AI Pro 或 Ultra 套餐。正文没透露国际版上线时间。

Hacker News 首页

谷歌 AI 模式推的同一款商品,比传统搜索贵了 21.6%

Productrise 在 23 天里跟踪了超过 200 万条商品信息,发现同一个搜索词下,谷歌 AI 模式展示的商品比传统搜索结果平均贵 21.6%。如果把两边所有商品都算上,AI 模式的中位价是 149 美元,传统搜索是 100 美元,差距拉到 49%。更关键的是,只有 1.28% 的商品会同时出现在两边。在同时出现的商品里,有 38.1% 价格不...

推荐理由:Productrise 用 200 万条商品信息把谷歌 AI 模式的定价倾向给量化了,数字具体、结论尖锐。没给更高分是因为这是单一第三方研究,公司本身卖电商工具,有利益关联,我会先打个折。

FT · 科技

智能眼镜终于要翻身了?Meta卖了100万副,苹果也要入场

FT这篇评论聊的是智能眼镜能不能真正普及。回想Google Glass当年因为造型奇怪、隐私争议大而失败,现在情况变了:Meta的Ray-Ban智能眼镜已经卖了超过100万副,苹果也要进场。关键变化是摄像头变小了、AI语音助手更好用了、镜框也做得更像普通眼镜。隐私和社会接受度仍然是问题。正文没披露具体销量数据或时间线。

AI 群聊日报

Flash 模型集体冲顶:Gemini 3.8 Flash 和 Muse Spark 1.3 同天发布,便宜模型已能搞定九成任务

Google 发布 Gemini 3.8 Flash,输入价格每百万 token 0.75 美元,在 DeepSWE 编程基准上拿到 71% 的分数,多项智能体跑分超过 Sol 和 Opus 5。同一天 Meta 放出 Muse Spark 1.3,智力分跟 Grok 4.6 持平,Contributor 档位输入价只要 0.1 美元,但默认会用你的数...

推荐理由:Gemini 3.8 Flash 以 Flash 档位定价在智能体跑分上超过 Sol 和 Opus 5,这个信号很炸。来源是群聊日报而非官方公告,所以我会先打个折,但里面给的数字和实测笔记密度很高,对做模型选型的人有直接参考价值。

The Verge · AI

Google 给 Gmail、Docs 和 Keep 加了实时语音模式,能直接开口问邮件和笔记了

Google 推出了 Gmail Live、Docs Live 和 Keep Live,相当于给这三个应用装上了语音助手,你可以直接开口让它帮你翻邮件、记东西或查资料。Gmail Live 主要用来从收件箱里捞信息,不用再靠关键词或邮件标题去翻长串对话,比如可以问“我家小孩下次学校活动是几号”。Docs Live 和 Keep Live 具体能做什么正...

9月3日星期四

The Verge · AI

Google 新天气模型分辨率提升5倍,雨雪预报更准了

Google 发布了 WeatherNext 3,一个全球 AI 天气模型,分辨率比上一代高5倍——相当于从模糊的卫星图升级到能看清街道细节。它用实时观测数据训练,重点改进雨雪预报。正文没披露具体准确率提升了多少,也没说什么时候能用上。