跳到正文
r/LocalLLaMA

MTPLX V1 发布:一个原生 Swift 应用,让 Mac 跑 MLX 模型速度翻倍,Qwen 3.6 27B 从 28 tps 提到 63 tps

MTPLX V1: The Swift App For Running & Creating MLX MTP Models (2x TPS Qwen 3.6 27B)

开发者 YoussofAl 把之前的命令行工具重构成了一个 55MB 的原生 Mac 应用。核心卖点是数学上精确的推测解码:在 Apple Silicon 上跑 Qwen 3.6 27B,生成速度从每秒 28 个 token 直接拉到 63 个,而且不是只支持贪婪解码,任意温度下输出都和普通自回归一模一样。新加的 Forge 功能解决了 v0.1 最大...

推荐理由:本地推理工具,有实打实的 2 倍提速数字,但受众锁死在 Apple Silicon + MLX 用户,太垂直了,共鸣面不够。H 和 K 都踩中了,R 没戏,刚好够上 featured 门槛。分数留在低位,因为本质是工具链优化,不是模型能力或应用层的突破。

读原文 ↗导出 Markdown