# 摩尔线程 MUSA 生态更新：SDK 对齐 CUDA 12.8，SGLang 主线已合并

> 原标题：老黄喝豆汁「破防」背后，国产GPU正在填上CUDA护城河

- 来源：新智元 · 公众号
- 发布时间：2026-05-20T04:27:00.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/25286
- 原文：https://mp.weixin.qq.com/s?__biz=MzI3MTA0MTk1MA==&mid=2652701875&idx=2&sn=b589d3443906bfd388b155a70d9cfcf3

## 摘要

摩尔线程放出了自家 GPU 生态 MUSA 的最新进展。SDK 5.1.0 把兼容目标拉到了 CUDA 12.8，覆盖了 761 个驱动和运行时接口，意思是跑 CUDA 代码时能认的指令更多了。推理框架 SGLang 的主线代码已经合并了 MUSA 的支持，硬件支持排期在 2026 年第二季度。另外还提了一个叫 MUSACODE 的工具，能自动把库迁移...

## 推荐理由

我会先打个折：这还是一家厂商的生态更新，不是整个国产 GPU 阵营的集体突破。但文章把兼容 API 数量、SDK 版本对标和 SGLang 主线合入这几个点都摆出来了，比空谈“替代 CUDA”实在。老黄喝豆汁的梗让标题有了传播力，内文也没写成公关稿，对关注推理部署和算力自主的读者来说值得一看。

## 锐评

这条消息的核心是摩尔线程MUSA SDK 5.1.0把兼容目标定在了CUDA 12.8，覆盖了761个驱动和运行时接口。用人话说，就是现在用CUDA写的代码，在这家国产卡上能直接认的指令更多了，迁移成本会低一些。另外推理框架SGLang的主线代码已经合并了MUSA的支持，硬件排期在2026年Q2，说明生态上在跟开源社区接轨，不是自己闷头搞一套。

但得打个折。原文因为微信环境验证被挡住了，我没法看到具体的性能对比、实际跑分或者延迟数据。兼容接口数量只能说明“能跑”，不能说明“跑得好”。CUDA的护城河不光是API数量，还有编译器优化、算子库深度和多年积累的调试工具链，这些在新闻稿里通常不会提。

还缺几块关键信息：在真实模型（比如Llama 3或类似规模）上的推理吞吐和首token延迟是多少？MUSACODE自动迁移工具的成功率和对复杂算子的支持程度如何？以及最重要的，这些卡现在到底能不能稳定买到、供货周期多长。没这些，光看兼容数字还激动不起来。
