# 苹果想把谷歌数万亿参数的 Gemini 模型压缩进 iPhone，给新 Siri 当大脑

> 原标题：Apple 正努力将庞大的 Gemini 模型塞进 iPhone 以驱动新 Siri

- 来源：AI HOT 精选
- 发布时间：2026-05-28T18:30:48.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/29551
- 原文：https://arstechnica.com/ai/2026/05/apple-reportedly-trying-to-distill-googles-multi-trillion-parameter-gemini-ai-to-run-on-iphone

## 摘要

苹果正在尝试用模型蒸馏技术，把谷歌那个参数规模大到数万亿的 Gemini 模型缩小，塞进 iPhone 里本地运行，用来驱动新版 Siri。但 Ars Technica 的报道也泼了盆冷水：因为原始模型实在太大，完全在手机本地跑通的可能性很低，大概率还是得搭配云端处理。正文没披露具体的蒸馏方案、参数目标、延迟要求，也没给出发布时间表。

## 推荐理由

我会先打个折，因为这只是个爆料，不是已发布的产品。文章给了蒸馏方案和“云端大概率必需”的判断，但没披露模型压缩后的具体尺寸、延迟数据或上线时间，所以信息量够上 featured，但别当实锤看。

## 锐评

这条消息的核心矛盾点很直白：苹果想把一个参数规模大到数万亿的模型，通过蒸馏技术缩小到能塞进 iPhone 本地运行。蒸馏通俗讲就是让一个“大老师”模型教一个“小学生”模型，学它的回答风格和知识，从而把体积和算力需求压下来。但 Ars Technica 的报道自己先泼了冷水，因为原始模型实在太大，完全在手机本地跑通的可能性很低，大概率还是得搭配云端处理。

这里缺的关键信息太多了。正文没披露具体的蒸馏方案、目标参数规模、对延迟的要求，也没给出任何发布时间表。没有这些数字，就没法判断这件事离落地有多远。比如，如果目标是 30 亿参数以下、首字延迟低于 100 毫秒，那还算有工程上的讨论价值；如果只是“正在尝试”，那更像早期技术验证。另外，用谷歌的模型来驱动 Siri，后续的授权、隐私和定制化空间也都是未知数。这条新闻值得关注，但现阶段只能当个方向性信号看，别太激动。
