# 苹果 WWDC 要拿 Gemini 蒸馏出的小模型跑在 iPhone 上，复杂问题还是会甩给谷歌云

> 原标题：苹果WWDC将推AI升级：Gemini蒸馏模型本地运行，但技术栈外部依赖显著

- 来源：AI HOT 精选
- 发布时间：2026-05-31T12:12:02.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/30774
- 原文：https://x.com/kimmonismus/status/2061058117304262999

## 摘要

下个月 WWDC 苹果会展示 Siri 和端侧 AI 的升级，核心思路是把谷歌 Gemini 模型“蒸馏”成一个小号版本，直接在 iPhone 芯片上本地跑，主打隐私和省 token 费。但整个技术栈对外依赖很重：本地模型源自 Gemini 蒸馏，手机处理不了的复杂请求会路由到谷歌云，还用了英伟达的机密计算。苹果之前承诺的 Private Cloud ...

## 推荐理由

这条消息我会先打个折，因为目前只有单一信源，正文没披露模型参数量、延迟、成本或合同细节。但它的信息量对从业者来说很实在：苹果在 WWDC 前被曝出用 Gemini 蒸馏模型救急，本地跑小模型保隐私，重活还是得走 Google 云和 Nvidia 机密计算，等于承认自研大模型没跟上。这个技术栈组合本身就说明苹果在端侧 AI 上选择了外部依赖，跟它一贯的全栈控制路线反差很大，所以给了 82 分，放在 featured 位置。

## 锐评

这条消息的核心矛盾在于：苹果一边讲端侧隐私，一边把技术命脉交给谷歌和英伟达。具体来说，Siri 的新大脑是把谷歌 Gemini 模型“蒸馏”成小号版本，直接在 iPhone 芯片上本地运行。蒸馏可以理解为让一个大学问家（大模型）教一个小学生（小模型），只学回答风格和关键知识，体积和算力需求都大幅缩减，所以能塞进手机、省 token 费。但复杂问题手机处理不了，会路由到谷歌云，还用了英伟达的机密计算。苹果之前承诺的 Private Cloud Compute 原计划用自研芯片，现在因为跑不动完整 Gemini 模型，部分转向谷歌云，名字却没改。

正文没披露蒸馏后模型的具体参数量、延迟和准确率损失，也没说哪些请求会触发云端路由、用户是否知情。这些缺口直接决定“本地隐私”的成色。另外，苹果还在找小型端侧 AI 初创公司来加速模型缩减，说明内部工程进度有压力。整体看，这是一次务实的技术妥协，但对外讲隐私故事时，依赖外部技术栈的事实会让说服力打折。
