# Qwen3.8-Flash-Next 在 64GB Mac 上跑到 27 tok/s，但模型文件 95.5GB

> 原标题：Qwen3.8-Flash-Next (95.5 GiB) on a 64GB Mac at ~27 tok/s, checkpoint + fork

- 来源：r/LocalLLaMA
- 发布时间：2026-09-18T20:15:10.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/57412
- 原文：https://www.reddit.com/r/LocalLLaMA/comments/1wk14il/qwen38flashnext_955_gib_on_a_64gb_mac_at_27_toks/

## 摘要

Reddit 用户发帖称在 64GB Mac 上跑通 Qwen3.8-Flash-Next，速度约 27 tok/s，但 checkpoint 体积 95.5GB。这个大小对 64GB 内存来说很极限——系统还得留内存给其他进程，实际可用可能不到 60GB，所以大概率用了量化（具体精度没披露）。27 tok/s 对本地推理来说算流畅，能正常对话。不过帖...
