# SGLang 推理框架完整功能将登陆 Google TPU，由 RadixArk 与 Google Cloud 合作推进

> 原标题：RadixArk 与 Google Cloud 合作，将完整 SGLang 功能引入 TPU

- 来源：AI HOT 精选
- 发布时间：2026-07-30T15:50:35.428Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/47636
- 原文：https://www.lmsys.org/blog/2026-07-30-sglang-google-tpu

## 摘要

SGLang 这个开源推理框架以后能在 Google 的 TPU 上跑了，功能跟 GPU 版对齐。RadixArk 和 Google Cloud 分两步走：现在就可以通过 SGL-JAX 在最新一代 TPU 上跑 Gemma、Qwen、DeepSeek 等模型；今年晚些时候还会推出一个基于 PyTorch 的后端 SGL-torchtpu，让用惯 Py...

## 推荐理由

SGLang 是生产级推理框架，把它全套功能搬到 TPU 上对部署团队有实际价值。文章给了两条具体路径和已支持的模型，信息扎实。没打更高分是因为这属于基础设施层面的合作，影响面集中在工程圈。

## 锐评

这条消息的核心是，开源推理框架 SGLang 正式支持 Google TPU，而且承诺功能跟 GPU 版对齐。RadixArk 和 Google Cloud 分两步走：现在就能通过 SGL-JAX 在最新一代 TPU 上跑 Gemma、Qwen、DeepSeek 等主流模型；今年晚些时候还会推出基于 PyTorch 的后端 SGL-torchtpu，让用惯 PyTorch 的人不用换工具链。Google VP 的原话是消除“迁移税”，意思是你不用为了换硬件重写一套代码。

对团队来说，这多了一个硬件选项，尤其如果 TPU 在特定负载下成本更低，可能挺省钱。但文章没给任何性能或价格对比数字，只说“成本效率高”。另外，Day 0 支持新模型这个承诺听起来很好，实际能不能做到，得看后续新模型发布时的跟进速度。目前信息来自 LMSYS 官方博客，属于项目方自己的公告，没有独立第三方的验证。
