# Antigravity SDK 支持本地模型，智能体可以完全断网运行

> 原标题：Antigravity SDK 支持本地模型，可完全离线运行智能体

- 来源：AI HOT 精选
- 发布时间：2026-09-23T17:09:01.108Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/58442
- 原文：https://developers.googleblog.com/introducing-support-for-local-ai-models-in-the-antigravity-sdk

## 摘要

Google 给 Antigravity SDK 加上了本地模型支持，首发适配的是 Gemma 4 26B A4B，通过 LiteRT 在本地跑。智能体现在能完全离线工作，代码和请求都不出本机。官方演示了一个混合模式：用 Gemini 3.8 Flash 在云端当规划器，只花 95 个 token 做任务拆解，本地 Gemma 4 26B 实例负责审计...

## 推荐理由

Google 给 Antigravity SDK 加了本地模型支持，首发适配 Gemma 4 26B，通过 LiteRT 在本地跑。我会先打个折：目前只绑定了 Google 自家的模型，生态还没打开。但亮点在于那个混合模式演示——云端 Gemini 3.8 Flash 只花 95 个 token 做规划，本地模型执行审计，成本数字摆出来了，不是画饼。对需要在设备上跑智能体、又不想把数据送出去的团队，这是个值得动手试试的信号。正文没提跨平台支持和第三方模型接入计划，这点先别太激动。

## 锐评

这条更新对注重数据隐私和成本控制的开发者来说挺实用。Antigravity SDK 现在能直接调用本地的 Gemma 4 26B 模型，通过 LiteRT 运行，代码和请求都不出本机，完全离线也能干活。官方演示了一个混合模式：用云端 Gemini 3.8 Flash 当规划器，只花 95 个 token 做任务拆解，具体的审计和修代码工作全交给本地模型，97.2% 的 token 消耗都在本地完成。这相当于把最敏感、最繁重的活儿留在自己机器上，只把不涉密的规划指令发到云端，既省钱又安全。

不过，想跑起来门槛不低，官方建议显存或统一内存大于 24GB，这意味着普通笔记本基本没戏。另外，正文只提了 Gemma 4 26B 这一个首发模型，对其他本地模型的支持程度、实际推理速度和任务完成质量都没给具体数据。混合模式虽然思路好，但规划器和执行器之间的配合容错率怎么样，遇到复杂任务会不会频繁回滚，这些都没说。我会先打个折，等更多模型适配和实测数据出来再看。
