# 摩尔线程把 SGLang 的 MUSA 后端合进了主线，还拉来核心开发者一起聊了聊

> 原标题：国产GPU组了个开源局，把SGLang等核心开发者都摇来了！

- 来源：量子位 · 公众号
- 发布时间：2026-05-14T04:11:00.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/20773
- 原文：https://mp.weixin.qq.com/s?__biz=MzIzNjc1NzUzMw==&mid=2247890725&idx=2&sn=ebd8c3e6d058b71c14c65cb660250393

## 摘要

摩尔线程办了一场 SGLang × MUSA 线下交流会，宣布 MUSA 后端已经并入 SGLang 主分支。截至 5 月 12 日，他们一共提了 47 个 PR，其中 41 个被合并。不过正文因为环境验证问题没能加载出来，具体技术细节和现场讨论内容暂时看不到。

## 推荐理由

我会先打个折：这不是模型发布，也不是平台级大更新，更像推理后端生态的一次实质性进展。但 47 个 PR、41 个合入的数字说明摩尔线程不是挂个名，是真在往 SGLang 主线里交代码。对国内做推理部署的人来说，MUSA 后端进主线意味着以后用 SGLang 时多了一条国产卡的路，这点先别太激动，正文没披露实际性能对比和线上规模，但至少代码层面已经打通了。

## 锐评

这条消息的核心就一句话：国产GPU厂商摩尔线程办了个线下交流会，宣布他们的MUSA后端已经合入SGLang主分支。SGLang是现在大模型推理部署的热门框架，能直接在主分支里跑国产卡，对用摩尔线程硬件的团队来说省了一层适配的麻烦。截至5月12日，他们提了47个PR，合并了41个，这个合并率说明社区对代码质量是认的。

但问题也出在这里——正文因为微信环境验证没加载出来，所有技术细节都是空白。我不知道现场到底跑了什么模型、吞吐量和延迟跟CUDA后端差多少、支持哪些卡、有没有多卡并行的实测数据。这些才是判断这件事含金量的关键。PR数量只能说明提交活跃，不能说明性能到位。

另外，标题里提到Mooncake也来了，但正文同样没展开。Mooncake是月之暗面开源的推理加速项目，如果他们跟摩尔线程有具体合作，那价值会大不少。目前只能先打个折：方向是对的，但缺实测数字和合作细节，别急着下结论。
