Qwen 3.6 27B 是本地跑模型的甜点级选择
Qwen 3.6 27B is the sweet spot for local development
Piotr Migdał 在 Macbook Max M5 128GB 上实测了 Qwen 3.6 27B,用 8-bit 量化版跑出每秒 32 个 token,占 42GB 内存。他认为这是第一个能当通用智能用的本地模型。测试里它一次就生成出六边形扫雷的 npm 包,还搭了一个响应式落地页。文章给了完整的 llama.cpp 配置命令,并出于伦理原因...
推荐理由:一篇带真实数字的个人实测,不是通稿。Qwen 3.6 本身热度就高,这篇文章补上了本地部署的实操细节。分数卡在 72 是因为它终究是个人评测,不是官方发布或重大产品更新。