# 苹果被曝用定制版 1.2 万亿参数谷歌模型改造 Siri，简单问题仍跑本地

> 原标题：苹果据称正使用定制版1.2T参数Google模型重塑下一代Siri

- 来源：AI HOT 精选
- 发布时间：2026-05-25T19:42:58.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/27049
- 原文：https://x.com/kimmonismus/status/2058997271803674991

## 摘要

爆料说苹果下一代 Siri 的核心换成了一个定制的谷歌大模型，参数规模 1.2 万亿，比大家猜的 Gemini 3.5 Flash（约 3000 亿参数）大好几倍。复杂任务会交给这个大模型，简单查询还是留在手机上跑。苹果现在最头疼的是日常问题的响应速度，大模型再聪明，回慢了也没人用。另外，下个月 WWDC 可能会官宣 Apple Intelligenc...

## 推荐理由

这篇就一个 X 上的爆料，给了些架构细节但没附源文件、没提上线时间和功能范围，所以我会先打个折。1.2T 参数这个数字挺具体，但正文没解释是总参数还是激活参数，也没说模型怎么裁出来给手机用。简单查询跑本地、复杂任务走云端这个分工听着合理，不过延迟到底压到多少、在哪些机型上能跑都没交代。这点先别太激动，等有实测或官方确认再往上调。

## 锐评

这条爆料的核心信息是：苹果下一代 Siri 可能不再死守自研模型，而是用了一个定制版谷歌大模型，参数规模 1.2 万亿，比大家猜的 Gemini 3.5 Flash（约 3000 亿参数）大好几倍。复杂任务交给云端大模型，简单查询留在手机上跑，这个分工思路不新鲜，但苹果愿意用外部模型来撑 Siri 的场面，态度转变比参数数字更值得关注。

爆料里苹果最头疼的是日常问题的响应速度——模型再聪明，回慢了也没人用。但正文没披露这个 1.2T 模型的实际延迟、推理成本，也没说定制到底改了哪些地方。没有这些数字，很难判断它是真能落地还是实验室指标。另外，消息来源是社交媒体爆料，不是官方或供应链确认，可信度要打折。

还缺几个关键信息：这个模型是直接调用谷歌 API 还是苹果自己部署？端侧和云端的切换逻辑是什么？下个月 WWDC 如果官宣，看苹果怎么解释隐私和延迟的取舍，才是判断这条爆料含金量的关键。
