# Qwen3.8-Flash-Next 125B 在 2021 款 M1 Max 上跑到 12-15 tok/s

> 原标题：Qwen3.8-Flash-Next (125B) at 12-15 tok/s on a 2021 32GB M1 Max

- 来源：r/LocalLLaMA
- 发布时间：2026-09-27T17:53:08.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/59266
- 原文：https://www.reddit.com/r/LocalLLaMA/comments/1wrqql8/qwen38flashnext_125b_at_1215_toks_on_a_2021_32gb/

## 摘要

Reddit 用户发帖说，Qwen3.8-Flash-Next 这个 125B 参数的大模型，在 2021 款 32GB 内存的 M1 Max 上跑出了每秒 12-15 个 token 的速度。对消费级硬件来说，这个速度挺亮眼，但帖子正文被 Reddit 屏蔽了，没透露用了什么量化精度、推理框架或优化手段。实际好不好用，还得看精度和上下文长度——这两点...
