跳到正文

Google / Gemini

Google 与 DeepMind 的 AI 动态:Gemini 系列、Veo 视频模型、研究成果与产品生态的持续追踪。

最新精选

第 141–160 条 · 共 409 条

6月24日星期三

Hacker News 首页

Mozilla 提出 PACT 匿名凭证方案,想用“每人限速”替代硬件认证来防爬虫

Mozilla 发了一篇技术博文,正式提出 PACT 匿名凭证方案,核心思路是让网站只验证“这个访客有没有超过访问次数上限”,而不需要知道你是谁、用什么设备。文章直接点名了 Google 已放弃的 Web Environment Integrity 和 Apple 已部署的 Private Access Tokens,认为前者会扼杀浏览器竞争,后者把上...

推荐理由:Mozilla 拿出 PACT 方案,正面硬刚 Google 和 Apple 的路线,技术细节和立场都很明确。不过它目前还只是一篇博文提案,没落地实现,对纯 AI 从业者来说偏 Web 基础设施,所以我会先打个折。

6月21日星期日

TechCrunch · AI

诺奖得主 John Jumper 离开 DeepMind 加入对手 Anthropic

John Jumper 在 Google DeepMind 干了快 9 年后跳槽到 Anthropic。他 2024 年刚因为 AlphaFold(一个能根据基因序列预测蛋白质 3D 结构的模型)拿了诺贝尔化学奖。Jumper 自己说,博士毕业才半年 Hassabis 就敢让他带 AlphaFold 团队,胆子很大。Bloomberg 还提到他是谷歌编...

推荐理由:John Jumper 是 AlphaFold 的核心人物,2024 年刚拿诺贝尔化学奖,现在离开待了快 9 年的 DeepMind 去 Anthropic。这条消息分量很重,但正文没披露他在 Anthropic 具体做什么,所以分数打不了更高——信号强,细节薄。

6月19日星期五

AI HOT 精选

Transformer 共同作者诺姆·沙齐尔宣布加入 OpenAI

诺姆·沙齐尔在 X 上说自己要加入 OpenAI,跟那边的团队一起干活。他管这个决定叫“艰难的决定”,同时说对之前在 Google 的团队和成果特别自豪。帖子没提他去 OpenAI 具体做什么岗位、什么时候入职、负责哪个方向。

推荐理由:沙齐尔是 Transformer 论文的作者之一,他换东家本身就是行业级事件,所以热度和关联度拉满。但原帖信息太薄,连去 OpenAI 干什么都没提,知识增量几乎没有,分数卡在 88 是合理的。

6月18日星期四

AI HOT 精选

Noam Shazeer 离开 Google 加入 OpenAI,谷歌两年前花 27 亿美元把他请回来

Noam Shazeer 已经从 Google 离职,加入了 OpenAI。两年前 Google 花了 27 亿美元把他请回来,现在他又走了。帖子没说他什么时候走的、在 OpenAI 具体做什么,也没提这对 Gemini 团队的实际影响有多大。

推荐理由:Transformer 合著者、27 亿美元回购、再次出走——三条线都踩中了。帖子没说他什么时候走的、在 OpenAI 具体负责什么、对 Gemini 的实际冲击有多大,所以到不了 95 分以上。但这个信号本身已经够强,值得放 featured。

AI HOT 精选

Google 提出三种架构模式,让 A2UI 的声明式原生渲染和 MCP Apps 的 iframe 自定义界面能搭配干活

Google 开发者博客分享了三种把 A2UI 和 MCP Apps 结合起来的架构思路。核心逻辑是:标准组件用 A2UI 的 JSON 描述,交给宿主应用原生渲染,避免视觉割裂和性能损耗;只有复杂自定义逻辑才放进 iframe。模式一让 MCP 服务器直接返回 A2UI 的 JSON 数据,完全绕过 iframe,文章用一个食谱应用演示了两个面板都靠...

推荐理由:Google 官方博客发了一篇 A2UI 和 MCP Apps 的集成指南,给出了三种架构模式,对做 agent 产品的人直接有用。H 和 K 都打中了——方案有实操性,边界清晰;R 没中,因为这不是身份类内容,传播面会窄一些。单源博客,重要性给 72、放 featured 是合理的。

AI HOT 精选

Google 把 Gemini 塞进了一台 99 美元的音箱,想让你跟它聊天而不是下指令

Google Home Speaker 是第一款围绕 Gemini 做的音箱,99.99 美元,现在就能预订,本月发货。它支持说话中途改口、不用反复唤醒就能接着聊,内置了 10 种新声音。我会先打个折:这些听起来像连续对话的能力,其实分两层。基础的多步指令和打断纠错是机器自带的,但真正像人一样自由聊天的 Gemini Live,以及让音箱帮你总结 Ne...

推荐理由:99 美元定价和即日预订是硬信息,Gemini 首次落地音箱也够分量。没给更高分是因为目前只有发布信息,连续对话和 Gemini Live 的自由聊天能力还没经过真实环境验证,正文也没披露具体延迟和端侧模型细节。

AI HOT 精选

谷歌发布 ARD 开放规范,让 AI 智能体跨公司找工具、验身份

谷歌和一批行业伙伴搞了个叫 ARD(Agentic Resource Discovery)的开放规范,专门解决一个实际问题:当你的 AI 智能体需要调用外部工具、技能或别的智能体时,怎么知道该找谁、信得过、连得上。现在各家平台都有自己的小本本,跨公司就抓瞎了。ARD 的思路是,每家公司在自家域名下挂一个公开的“能力目录”,然后由搜索引擎一样的“注册中心...

推荐理由:谷歌推的是一个 agent 互操作规范,有具体机制,不是空谈概念。但这是规范发布,不是产品上线,离真正普及还远,所以分数压在 78。正文没列出具体合作伙伴名字,生态支持力度还不明朗,这点先别太激动。

6月17日星期三

The Verge · AI

Google 时隔六年出新智能音箱,下周开卖,主打能聊天的 Gemini 助手

Google 会在 6 月 24 日开卖一款叫 Google Home Speaker 的新智能音箱,定价 49.99 美元。这是自 2020 年 Nest Audio 之后 Google 第一次发新的音箱产品。它运行的是 Gemini for Home,也就是说你可以跟它连续对话,不用每句都喊一遍“Hey Google”,助手能记住上下文。外观是个裹...

推荐理由:Google 六年来的第一款新音箱,49.99 美元定价配上 Gemini 连续对话,产品更新是实打实的。但智能音箱现在不算热赛道,行业影响力有限,所以 H 和 K 都站得住,R 偏弱,整体停在 featured 72 分这个位置。

Hugging Face 博客

Hugging Face 发布 ARD 发现工具,让 AI 代理能自己搜工具、技能和其他代理

Hugging Face 上线了 Discover Tool,这是 ARD(代理资源发现)规范的一个参考实现。ARD 是一份由微软、谷歌、GoDaddy、Hugging Face 等共同起草的开放草案,解决的是当前代理生态里一个很实际的问题:现在用 MCP 工具、A2A 代理或技能,都得靠人提前写好配置、指定好地址,代理自己不会找。ARD 相当于在它们...

推荐理由:ARD 瞄准的是代理工具发现这个真实痛点,背后有微软、谷歌、Hugging Face 等跨厂商背书,还给了可用的参考实现。没打更高分是因为它目前还是开放草案,不是正式标准,文章也没说清楚谁会跟进落地、生态铺开要多久。

AI HOT 精选

OpenAI 的护城河快干了:市场份额跌破一半,微软考虑换用 DeepSeek,一年亏掉 340 亿美元

Gary Marcus 用三件事说明 OpenAI 的领先优势正在快速消失。第一,市场份额首次跌破 50%,谷歌正在吃掉它的份额,普通用户觉得 ChatGPT 和 Gemini 用起来没区别,纯靠大模型做生意留不住人。第二,微软这个最大金主正在考虑把 Copilot 的后端从 OpenAI 换成 DeepSeek,原因是按用量计费后成本太高——自己最大...

推荐理由:Gary Marcus 用市场份额跌破 50% 和微软考虑换供应商这两件事,论证 OpenAI 的领先优势在快速缩小。文章是评论性质,不是一手报道,而且 Marcus 一向看空 OpenAI,读者需要知道这个立场。但两个信号都是公开可查的事实,对行业判断有参考价值,所以给到 78 分。

6月16日星期二

Google DeepMind

Google DeepMind 发布 AI Control Roadmap,用纵深防御管控内部 AI 智能体

Google DeepMind 发布 AI Control Roadmap,一套用于构建和管理 Google 内部部署的高级 AI 的框架,采用纵深防御思路,在模型对齐之外增加系统级安全层,即便对齐不完美也能提供保障。

推荐理由:Google DeepMind 公开内部 AI Control Roadmap,给出把智能体当作内部威胁来监控与拦截的分层思路。

TechCrunch · AI

ChatGPT 市占率首次跌破 50%,但月活用户仍有 11 亿

ChatGPT 还是全球最常用的 AI 助手,月活用户超过 11 亿,但它的市场份额第一次掉到了 50% 以下。排在后面的 Gemini 有 6.62 亿月活,Claude 有 2.45 亿。正文没披露具体的份额数字、统计方法和时间窗口,所以这个“跌破 50%”到底有多严重,还得等更多细节。

推荐理由:ChatGPT 份额跌破 50% 是个值得标记的节点,月活对比也给了具体参照。但正文没披露统计方法、时间窗口和精确份额,标题比正文重,所以分数先不打更高,等更多细节出来再说。

6月15日星期一

纽约时报中文网

谷歌起诉一个中国诈骗团伙,称其用 Gemini 批量生成假网站骗美国人

谷歌在美国法院起诉了一个叫“局外人企业”的中国网络犯罪团伙,指控他们用 Gemini 做了 131 个软件工具包,批量仿冒谷歌、美国邮政局和 E-ZPass 等网站。今年 5 月短短两周内,这个团伙就向安卓用户发了 250 万条钓鱼短信,链接指向 9000 个假网站。谷歌说这是它第一次和 FBI 以及 AT&T、T-Mobile、Verizon 三家运...

推荐理由:谷歌第一次对 AI 诈骗团伙走法律程序,有实打实的数字和跨境协作,不是空泛警告。但本质还是执法新闻,不是 AI 能力或产品更新,所以分数压在 85 以下。

6月13日星期六

AI HOT 精选

谷歌 Android 安全主管因反对军事 AI 合作辞职,称公司“丧失道德指针”

谷歌 Android 平台安全负责人 René Mayrhofer 因公司向美国国防部提供 AI 技术而辞职。他在告别信里说,管理层绕过内部讨论,悄悄放弃了碳中和目标,并在 2025 年 2 月删除了“不将 AI 用于武器”的承诺。今年 4 月,谷歌与五角大楼签了协议,允许 AI 用于机密军事行动和情报搜集。Mayrhofer 担心这些技术可能被用来针...

推荐理由:谷歌高管辞职,带着内部时间线和具体细节,不是空泛抗议。HKR 三条全中,但本质是人事和政策事件,不是产品发布,所以分数压到 84 以内,定在 82。

6月12日星期五

r/LocalLLaMA

MTP 投机解码实测:助手模型没选对,速度可能白给

一位用户在 llama.cpp 里给 Gemma 4 Heretic 系列模型跑 MTP 投机解码,发现助手模型(draft model)选得好不好,直接决定加速效果是翻倍还是几乎没变化。他拿 26B Q8 模型测试,生成速度从每秒 30 个 token 跳到 62 个;12B Q4 模型更夸张,从 12 涨到 54。但同名 GGUF 文件不一定是同一...

推荐理由:我会先打个折:这是单篇 Reddit 帖子,没有其他来源交叉验证,而且 Gemma 4 的用户群比 Llama/DeepSeek 小。但优点也很明显——有硬核的实测数字,26B Q8 从 30 涨到 62 tok/s,12B Q4 从 12 涨到 54,结论直接可操作。对跑本地模型的人来说,这种“选对助手模型速度翻倍”的信息比泛泛的优化建议有用得多,所以给到 featured。

6月11日星期四

Hacker News 首页

代码行数换了个更好的公关团队

David Curlewis 指出,Google、Anthropic、OpenAI 现在都在吹“AI 写了百分之多少的代码”,这本质上就是当年被嘲笑的代码行数统计,只不过包装得更漂亮。他对比了早年的说法——比如 Copilot 让任务完成速度快了 55%,那是可验证的结果承诺;而现在的“75% 代码由 AI 生成”这类数字,不管产品有没有真的变好,都会...

推荐理由:这篇评论用一句“代码行数找了个更好的公关”就把几家大厂吹的 AI 代码占比拉回现实。它没停留在吐槽,而是拿早年 Copilot 的“任务完成速度快 55%”做对比,说明现在的百分比数字更像公关话术,缺少对产品实际改善的验证。对受够了管理层拿 AI 写代码比例说事的工程师来说,这篇文章说出了他们想说的话。观点文章,所以没给更高分,但切入点和论据都够扎实。

机器之心 · 公众号

谷歌开源 26B 文本扩散 MoE 模型 DiffusionGemma,推理时只激活 3.8B 参数,一次生成 256 个 token

谷歌发了一个实验性的开源模型 DiffusionGemma,用的是 Apache 2.0 协议。它不走自回归模型逐 token 生成的路线,而是一次性起草 256 个 token 的文本块,把解码瓶颈从内存带宽转向了计算本身。在单张 H100 上能跑到每秒 1000+ token,比自回归模型快最多 4 倍。模型总规模 26B,但推理时只激活 3.8B...

推荐理由:谷歌开源了一个 26B 的文本扩散模型,跳过自回归解码,推理只激活 3.8B 参数,单张 H100 跑到每秒 1000+ token。Apache 2.0 协议,有具体的速度对比和机制说明,对做推理优化的人有直接参考价值。不是公关稿,数字和做法都给了,值得放进精选。

量子位 · 公众号

谷歌开源扩散文本模型 DiffusionGemma,生成速度比自回归模型快 4 倍

谷歌把生成图片的扩散模型思路搬到了文字生成上,开源了 DiffusionGemma。它不像传统模型那样一个字一个字往外蹦,而是一次铺开 256 个 token 的“画布”,从噪声开始多轮去噪,整段文字同时浮现。在 H100 上跑到每秒 1000+ token,消费级 RTX 5090 上也有 700+,比同规格自回归模型快了约 4 倍。这个 26B 参...

推荐理由:谷歌悄悄开源 DiffusionGemma,把扩散模型那套一次去噪整段文字的路子用在文本生成上,速度数字很漂亮,比同类模型快约 4 倍。我会先打个折——目前只有速度数据,生成质量、实际任务表现都没披露,这点先别太激动。分数没更高就是因为缺这些关键验证。

The Verge · AI

谷歌拒绝正面回应是否用 YouTube 创作者视频训练音乐 AI Lyria

一群独立音乐人起诉谷歌,指控它用 YouTube 创作者的视频训练音乐生成模型 Lyria。谷歌的回应很滑头:它说用户条款允许这么做,但死活不承认、也不否认到底有没有真的拿去训练。文章没披露 Lyria 的训练数据来源和规模,所以到底用了多少创作者的内容、怎么用的,目前全是问号。

推荐理由:我会先打个折:信息增量确实不大,因为谷歌死活不松口,训练数据到底用了多少、怎么用的全是问号。但这件事值得放出来,不是因为它技术有多硬,而是谷歌这种'你猜我用没用'的回应方式,把 AI 公司和创作者之间的信任问题摆到了台面上。对从业者来说,这比一篇技术报告更能提醒你:现在做模型,数据合规的雷可能比算法问题更先炸。

AI HOT 精选

德国法院裁定:Google 要对 AI 摘要的假话负法律责任

德国一家法院判定,Google 在搜索结果顶部生成的 AI 概览(AI Overviews)里给出的错误回答,算作 Google 自己说的话,公司需要为此承担法律责任。Gary Marcus 认为这个判决影响可能很大,尤其如果其他国家跟进的话。帖子链接到 the-decoder.com 的报道,但原文没披露具体案件细节、原告是谁、以及赔偿金额。

推荐理由:这是第一起法院把 AI 概览幻觉定性为平台自身言论的判决,Gary Marcus 提醒其他国家可能跟进,对 AI 产品责任边界影响很大。分数定在 82 是因为帖子缺案件细节、原告和赔偿信息——方向性信号很强,但还不是完整故事。