跳到正文

Google / Gemini

Google 与 DeepMind 的 AI 动态:Gemini 系列、Veo 视频模型、研究成果与产品生态的持续追踪。

最新精选

第 81–100 条 · 共 409 条

7月31日星期五

Hacker News 首页

谷歌用 Gemini 自动找漏洞、判优先级、修补丁,Chrome 六月修了 300 多个安全 bug,超过前两年总和

谷歌 Chrome 安全团队把 Gemini 和其他模型接进了漏洞发现、分类和修补丁的全流程。六月单月就修了超过 300 个安全漏洞,比 2024 和 2025 两年加起来都多。系统还翻出了一个藏了 13 年的沙箱逃逸漏洞,能让被攻破的渲染进程骗浏览器读取本地文件。从生成补丁到合入代码最快只要 30 分钟。不过正文没披露具体用的是哪个版本的 Gemin...

推荐理由:谷歌官方博客详细讲了 Chrome 安全团队怎么把 Gemini 模型接进漏洞到补丁的全流程,六月单月修了 300 多个洞,超过前两年总和,还揪出一个藏了 13 年的沙箱逃逸。数字和管线描述都具体,不是概念稿。不过正文没披露用的是哪个版本的 Gemini,也没说误报率和人工复核比例,这点先别太激动。整体判断挂在实打实的效率提升和漏洞发现能力上,给 78 分。

AI HOT 精选

Gemini Spark 能直接操作你的 Chrome 浏览器了,帮你填表、预约看房

Google 把 Gemini Spark 接进了 Chrome 的自动浏览功能。你点头同意后,Spark 就能直接在网页上干活,比如预约看房时间、自动填航班信息。正文没提什么时候上线、支持哪些网站,也没说登录和付款环节怎么处理。

推荐理由:Google 把 Gemini Spark 的 agent 能力直接塞进 Chrome,给了预约看房、填航班信息这两个具体例子,并且强调要用户同意才动手,落地思路比纯聊天机器人进了一步。但我会先打个折:正文没提上线时间、没列支持哪些网站,也没说登录和付款环节怎么处理——这些缺口让实际可用性还悬着。如果是真的,对做浏览器自动化的团队是个省钱信号,但先别太激动。

7月29日星期三

Hacker News 首页

TurboFieldfare:让 8GB Mac 跑起 26B 模型,内存只占 2GB

一个用 Swift 和 Metal 写的推理引擎,能在任何 M 系列 Mac 上跑 Gemma 4 26B 模型,内存占用压到 2GB 左右。模型本身 4-bit 量化后还有 14GB 大,常规工具在 8GB 内存的 Mac 上根本跑不动。它的做法是把模型共享层和 KV 缓存留在内存里,每个 token 需要用到的那部分“专家”参数才临时从 SSD 流...

推荐理由:一个开源推理引擎,用 Swift 和 Metal 实现,让 Gemma 4 26B 在 M 系列 Mac 上仅占 2GB 内存就能跑。技术细节交代清楚:4-bit 量化、共享层常驻、专家参数按 token 从 SSD 流式加载。对内存受限的 Mac 用户实用价值很高。不过这是个人项目,正文没给出推理速度和基准测试数据,实际可用性要打个问号,所以分数卡在 78。

AI HOT 精选

算力价格未来可能涨 10 倍以上

Dwarkesh Patel 算了笔账:如果一块 H100 能跑出人类软件工程师的水平,按现在的工程师市场价,这块卡一年租金应该超过 25 万美元,是当前现货价的 15 倍。文章从 Anthropic 年收入可能冲到 1000-1500 亿美元出发,指出实验室的训练算力每年只增长 3 倍,要撑起 10 倍收入增长,要么利润率飙升,要么算力变贵。目前两者...

推荐理由:Dwarkesh 用工程师工资倒推算力定价,给了一个具体的估值锚点,比泛泛聊趋势有用。但这只是一篇个人思考,不是行业事件,所以分数卡在 featured 门槛上。

Hacker News 首页

Linux 内核开始用 AI 写补丁和审代码,Linus 拒绝讨论伦理问题

Drew DeVault 对 Linus Torvalds 力挺 AI 进入内核开发的做法很不满。目前已有超过 1200 个内核提交带上了“Assisted-by”标签,大部分是用大模型辅助写的补丁。新工具 Sashiko 用 Google Gemini 自动生成代码审查意见,这意味着就算你不想用 AI,只要给内核贡献代码,也躲不开跟 AI 打交道。L...

推荐理由:Linus 给内核开发用 AI 定了调,Drew DeVault 这篇反驳是目前最有分量的反对声音之一。1200 个提交和 Sashiko 工具让这事不再是空谈。扣分点在于这只是单篇观点文章,不是社区正式决议,但争论本身已经够有看头了。

The Verge · AI

艺术家们开始集体起诉 AI 公司,部分案件已熬过第一轮驳回动议

插画师、作家和音乐人正在对 Google、Meta、Anthropic 等公司提起版权诉讼。文章追踪了最近的案件进展:一些法院驳回了科技公司要求撤诉的动议,让官司得以继续推进。艺术家们对胜诉的信心比之前高了一些,但对 AI 的整体走向仍然悲观。正文没披露具体的赔偿金额或和解细节。

推荐理由:一篇版权诉讼进展的汇总,亮点在于法院驳回了科技公司撤诉的动议,让案子能继续打。艺术家信心涨了一点,但对 AI 整体走向还是悲观。我会先打个折:正文没给赔偿数字或和解细节,所以只能当趋势信号看,别当深度法律分析。

Hacker News 首页

1132 名前沿 AI 员工联名请求美国政府牵头,为自动化的 AI 研发踩一脚“国际刹车”

来自 OpenAI、Anthropic、Google、Meta 等公司的 1132 名员工签署了一份声明,警告 AI 可能很快就能自己搞 AI 研究了。他们担心这会引发能力爆炸式增长,让人类来不及理解和控制。声明请求美国政府支持一项国际合作,开发能主动给整个前沿领域“降速”的技术和治理工具。签署人包括 OpenAI 首席科学家 Jakub Pachoc...

推荐理由:1132名前沿实验室员工公开要求美国政府开发给AI“降速”的工具,这事本身就说明内部对失控的担忧已经压不住了。声明里提到“AI很快能自己搞AI研究”,如果属实,意味着能力可能突然跳升,人类连反应时间都没有。我会先打个折:声明没给出具体时间表或技术证据,更像是一次集体表态。但签署人包括OpenAI首席科学家,分量不轻,值得从业者认真看一眼。

The Verge · AI

AI 烧钱终于烧到华尔街心疼了

谷歌最新财报显示资本支出又跳涨了一截,盘后股价直接跌了近 5%。市场担心的不是技术不行,而是砸了几千亿美元建数据中心之后,还没看到明确的回报时间表。文章点名谷歌、微软、Meta 都在加码,但谁也没给出盈利路线图。我会把这次下跌看作市场情绪在降温,而不是崩盘信号。

推荐理由:谷歌盘后跌近 5% 不是崩盘,但它是市场第一次用股价表达对 AI 资本开支的不耐烦。文章没给新数据或独家爆料,纯做情绪解读,所以分数没拉满。我会先打个折:这更像降温信号,不是转向信号。

AI HOT 精选

Gemini API 的托管 Agent 默认模型升级到 3.6 Flash,新增环境钩子,还给了免费额度

Google 把 Gemini API 里“托管 Agent”(让模型自己决定调什么工具、按流程干活的托管服务)的默认模型从 2.5 Flash 换成了 3.6 Flash,推理更快、成本更低。同时加了一个叫“环境钩子”的功能,允许开发者在 Agent 调用工具前后插入自定义逻辑,比如做权限检查或记审计日志。另外新开了免费套餐,每月白送 1000 次 ...

推荐理由:Google 把托管 Agent 的默认模型切到 3.6 Flash,推理更快、成本更低,还加了环境钩子让开发者在工具调用前后插逻辑,再开一个每月 1000 次免费套餐。这是 agent 产品化的扎实更新,不是营销噱头。没给更高分是因为目前只是 API 层面的默认升级和功能补全,还没看到大规模验证或生态联动。

7月28日星期二

Hacker News 首页

别让大模型自己报“信心分”,这分数基本没用

Justin Flick 直接给结论:让大模型输出一个 0 到 100 的“信心分”在科学上站不住脚。模型没法可靠地自我评估,连 Anthropic 自己的内省研究都说这种能力很不稳定、看场景。更麻烦的是,“信心”这个词把答案对不对、写得顺不顺、有没有满足用户意图全搅和成一个数了。传统机器学习里,概率分数有校准方法,但大模型把每个 token 的生成概...

推荐理由:作者把大模型信心分拆成正确性、流畅度和意图匹配三个维度,指出它们被硬塞进一个数字里,并引用Anthropic的内省研究来论证模型自我评估不可靠。观点清晰,但这是一篇个人博客,没有新的实验数据,话题偏工程实践,所以分数没给更高。

TechCrunch · AI

你在 Claude 分享的聊天记录和 Artifacts,可能已经被 Google 搜到了

Reddit 用户发现,在 Google 里搜“site:claude.ai/share”能直接翻出一大串 Claude 用户的分享链接,里面有些对话甚至包含健康记录、公司内部文件和孩子的姓名电话。问题出在 Claude 的分享功能上:它生成的链接虽然号称“有链接的人才能看”,但 Anthropic 没在 robots.txt 里禁止搜索引擎抓取这些页...

推荐理由:Anthropic 产品安全事件,用户数据通过 Google 索引被公开访问,TechCrunch 跟进报道并提供了可复现的验证步骤。三个维度都打得很实:隐私泄露的冲击力、技术原因的揭示、对从业者日常操作的直接影响。没给更高分是因为目前仍是单次曝光事件,尚未看到更大规模的数据泄露统计或 Anthropic 的正式回应,影响范围还在确认中。

TechCrunch · AI

微软发布首个网络安全模型 MAI-Cyber-1-Flash 和智能体安全平台 Perception

微软在旧金山一场小型活动上掏出了两样新东西:一个是专门做网络安全的模型 MAI-Cyber-1-Flash,用来在复杂代码库里找那些难发现的漏洞,并驱动自家的 MDASH 漏洞挖掘工具;另一个叫 Perception 的平台,可以派出一组 AI 智能体去自动跑安全流程,比如找 bug 和修 bug。不过正文没披露模型参数量、跑分、定价,也没说 Perc...

推荐理由:微软这次掏出了两样东西:一个叫 MAI-Cyber-1-Flash 的网络安全模型,用来在复杂代码库里挖那些难找的漏洞,还驱动自家的 MDASH 漏洞挖掘工具;另一个是 Perception 平台,能派出一组 AI 智能体自动跑安全流程,比如找 bug 和修 bug。机制上确实有新意,不是换个壳的常规更新。但正文没披露模型参数量、跑分、定价,也没说 Perception 具体怎么跟现有安全工具打通,信息缺口不小,所以知识增量打了折扣。H 和 K 都踩中了,R 偏弱,刚好卡在 featured 门槛上。

7月27日星期一

AI HOT 精选

Google AI 生成的搜索结果摘要,现在覆盖了 43% 的搜索请求

Similarweb 的数据显示,Google 的 AI Overviews(AI 生成的搜索结果摘要)出现率从一年前的 15% 涨到了现在的 43%。这个变化挺快,说明 AI 直接给答案正在变成搜信息的默认入口。Google 还会把用户从 AI Overviews 再引到对话式的 AI Mode 里继续聊。对靠搜索流量吃饭的网站来说,这直接威胁到他们...

推荐理由:Similarweb的监测数据量化了Google搜索的AI化程度:AI Overviews出现率从一年前的15%跳到43%,对依赖搜索流量的网站是实打实的信号。没给更高分是因为这是第三方监测而非Google官方数据,且TechCrunch原文被截断,缺了更多细节。

Hacker News 首页

OpenAI、Anthropic 等 AI 公司上半年在华盛顿的游说开支翻倍,五家合计花了 4820 万美元

联邦披露文件显示,OpenAI、Anthropic、Google、微软和 Meta 在 2026 年上半年总共花了 4820 万美元游说华盛顿,比去年同期多了一倍多。OpenAI 花得最多,1420 万美元;Anthropic 涨得最猛,从去年同期的 220 万跳到 1100 万。这些钱主要砸向 AI 安全、版权、出口管制和能源基建相关的法案。文章没提...

推荐理由:FT 独家拿到了五家头部 AI 公司的游说支出明细,半年总额 4820 万、同比翻倍,Anthropic 更是涨了五倍,这些硬数字配上四个具体的法案方向,把行业在政策端的焦虑量化出来了。给 78 分是因为它属于政策信号而非产品或技术突破,但对从业者判断监管风向很有用。

纽约时报中文网

用几个提示词,就能让 ChatGPT 和 Gemini 说出它们偷偷猜到了你什么

纽约时报的记者用网上流传的提示词测试了 ChatGPT 和 Gemini,结果两个模型都准确推断出了他从未明说的收入水平、健康问题、性格特征和居住社区。Gemini 甚至根据他查过的航班、修车和给生锈桌子刷漆的问题,猜到他住在奥克兰山上的独栋房子里。研究人员指出,这说明 AI 助手能把零散的对话拼成社会经济地位、政治倾向这类高层次的用户画像。文章还附上...

推荐理由:纽约时报记者亲自下场验证,用网上流传的提示词测了 ChatGPT 和 Gemini,结果模型从对话碎片里拼出了收入、健康、性格甚至具体房型,Gemini 还根据航班查询和修车问题锁定了奥克兰山上的独栋住宅。有案例有细节,不是空谈隐私风险。分数没打满是因为这本质上是一次个人实验,不是大规模系统研究,但警示作用够直接。

Computing Life · Share · 鸭哥调研

A2A 协议现实检验:大厂在极小市场里划地盘,还被本地子智能体挤掉了大半空间

Google 推的 A2A 协议,解决的是 Salesforce、SAP 这些大厂之间让各自的 AI 跨公司、长耗时协作的远端委派问题,比如一个 AI 查账查到一半要暂停等人工审批。这个场景真实但极其小众,市场体量跟 MCP 那种让所有开发者给模型接工具的需求没法比。更尴尬的是,在单系统内部,Claude Code、Codex 这些工具里的本地子智能体...

推荐理由:这篇不是新闻,是一篇冷静的行业分析。它没吹 A2A,而是用 Salesforce 查账等具体例子把协议的真实场景和市场规模摊开来看,同时指出在单系统内部它又被 Claude Code 这类工具的本地子智能体方案挤压。信息密度和判断力都在线,但因为是评论而非独家爆料,分数维持 78 不变。

AI HOT 精选

Suno 一口气更新了五个功能:MIDI 导出、更干净的分轨、歌词协作、截图写歌和车载支持

Suno 这次把网页端和移动端一起更新了,主要加了五样东西。最实用的是高级音轨分离和 MIDI 导出,分轨质量比之前好,导出 MIDI 后可以直接拖进宿主软件做混音或重编曲,对正经做歌的人省了不少事。歌词合写加自动保存,适合跟朋友一起攒词,不怕手滑丢稿。截图生成歌曲偏玩票,拍张图就能出歌。Apple CarPlay 和 Android Auto 也上线...

推荐理由:Suno 这次更新不是小修小补,MIDI 导出和高级分轨把生成结果往正经制作流程里推了一步,对用 Suno 做 demo 再进宿主精修的人省事不少。截图生成歌曲更像玩具功能,但核心两项升级有分量。没给更高分是因为 Suno 本身不算基础设施级产品,更新辐射面有限,而且正文没披露分轨质量的具体指标,实际效果得等用户上手验证。

7月26日星期日

Computing Life · Share · 鸭哥调研

一张 AI 搜索页面,为什么同时进了德国法院和监管机构

德国慕尼黑法院在 2026 年 5 月发了一道临时禁令,禁止 Google 的 AI Overview 继续传播虚假陈述,理由是 AI 摘要直接替网页下了结论,这就不再是“提供链接”,而是 Google 自己说的话,得自己负责。紧接着 7 月,德国媒体监管机构 ZAK 也出手了,它不盯着单句对错,而是把同一张搜索页拆成两个动作:生成答案算平台自己的内容...

推荐理由:德国法院对 Google AI Overview 的临时禁令,是 AI 生成搜索答案被追责的早期案例,直接点明“AI 替网页下结论就不再是提供链接”。ZAK 的监管动作则从另一个角度切入,关注搜索结果里原始网页的可见度。两个动作放在一起,给 AI 搜索的合规提供了跨司法辖区的参考。禁令是临时的,正文没披露后续判决,这点先别太激动,但框架本身已经够清晰。

7月24日星期五

TechCrunch · AI

前谷歌安全高管创办 AegisAI,拿 3600 万美元融资,专防 AI 生成的鱼叉钓鱼邮件

AegisAI 由前谷歌安全负责人 Cy Khormaee 和 Ryan Luo 创立,两人曾参与开发谷歌安全浏览和 reCAPTCHA。他们拿了 3600 万美元融资,要解决的是攻击者用 AI 批量生成高度个性化的钓鱼邮件——AI 能瞬间扒出你的同事、项目、差旅行程,写出以假乱真的消息。他们的做法是让 AI 智能体像人一样逐条读邮件,抓那些规则清单会...

推荐理由:前谷歌安全负责人出来创业,拿了 3600 万美元,做 AI 反钓鱼——这三个要素够上 featured。但产品还在早期,正文没给客户数、没第三方评测,效果验证弱,所以分数停在 72。我会先打个折,等有实际部署数据再看。

7月23日星期四

AI HOT 精选

Google Gemini 月活用户冲到 9.5 亿,离十亿俱乐部只差临门一脚

Google 在 2026 年第二季度财报电话会上说,AI 助手 Gemini 的月活用户已经超过 9.5 亿,比去年同期翻了三倍。今年 2 月这个数字还是 7.5 亿。CEO Sundar Pichai 把增长归功于 Daily Brief 这类能自主干活的 agent 功能,以及个性化助手 Gemini Spark。iOS 端过去 12 个月下载量...

推荐理由:Google 财报电话会披露 Gemini 月活冲到 9.5 亿,同比翻三倍,2 月时还是 7.5 亿。Pichai 把增长归因到 Daily Brief 这类 agent 功能和个性化助手 Gemini Spark,iOS 端下载量也有提及但没给具体数。这个体量是 AI 助手进入主流市场的关键信号,不过正文缺了用户行为细节和竞品对比,所以重要性先打 78 分。