# MTPLX V1 发布：一个原生 Swift 应用，让 Mac 跑 MLX 模型速度翻倍，Qwen 3.6 27B 从 28 tps 提到 63 tps

> 原标题：MTPLX V1: The Swift App For Running &amp; Creating MLX MTP Models (2x TPS Qwen 3.6 27B)

- 来源：r/LocalLLaMA
- 发布时间：2026-06-12T02:15:01.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/37704
- 原文：https://www.reddit.com/r/LocalLLaMA/comments/1u3iikl/mtplx_v1_the_swift_app_for_running_creating_mlx/

## 摘要

开发者 YoussofAl 把之前的命令行工具重构成了一个 55MB 的原生 Mac 应用。核心卖点是数学上精确的推测解码：在 Apple Silicon 上跑 Qwen 3.6 27B，生成速度从每秒 28 个 token 直接拉到 63 个，而且不是只支持贪婪解码，任意温度下输出都和普通自回归一模一样。新加的 Forge 功能解决了 v0.1 最大...

## 推荐理由

本地推理工具，有实打实的 2 倍提速数字，但受众锁死在 Apple Silicon + MLX 用户，太垂直了，共鸣面不够。H 和 K 都踩中了，R 没戏，刚好够上 featured 门槛。分数留在低位，因为本质是工具链优化，不是模型能力或应用层的突破。

## 锐评

开发者把之前的命令行工具打包成了原生Mac应用，核心卖点是数学上精确的推测解码，在Apple Silicon上跑Qwen 3.6 27B，生成速度翻了一倍多，从每秒28个token提到63个。新加的Forge功能解决了之前版本最大的痛点：贴一个Hugging Face链接进去，它能自动把模型转成MLX格式并接好MTP头，然后在你自己的机器上实测加速效果。应用里还带了流式聊天界面、实时解码面板、内置AIME 2026基准测试，KV缓存可以存到SSD，重启后会话不丢。

不过这条消息来自Reddit，原文被网络屏蔽了，我们拿到的只是摘要，没法核实具体实现细节和用户反馈。55MB的包体说明引擎是内置的，但没提内存占用和模型加载时间。速度翻倍听起来诱人，但推测解码的效果很依赖草稿模型质量，正文没披露草稿模型是什么、准确率有多少。另外只提了Qwen 3.6 27B这一个模型的数字，其他小模型如Qwen 3.5 9B和Gemma 4的加速比没给，通用性存疑。如果是真的挺省钱，但建议等一手社区实测再上车。
