# Qwen 明天开源 Qwen3.8-Flash-Next：总参数 125B、激活 6B 的 MoE 多模态模型

> 原标题：Qwen 3.8-Flash-Next releasing tomorrow (125B a6B)

- 来源：Hacker News 首页
- 发布时间：2026-08-25T11:49:43.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/52696
- 原文：https://modelscope.cn/models/Qwen/Qwen3.8-Flash-Next

## 摘要

Qwen 在 ModelScope 上预告了 Qwen3.8-Flash-Next，一个基于下一代 Qwen4 架构的多模态 MoE 模型，总参数 125B，每次推理只激活约 6B 参数。这次提前放出来是为了让社区先看看 Qwen4 的设计思路。明天（2026-08-26 15:00 UTC）正式开源，会同时放出 FP8 版本。正文没披露跑分、推理速度...

## 推荐理由

Qwen 提前放出了 Qwen4 架构的预告，125B 总参、6B 激活的 MoE 设计是实打实的新信息，在国内开源圈关注度很高。扣分是因为明天才正式开源，现在没跑分、没推理速度数据，我会先打个折——等明天 FP8 版本放出来再看实际表现。

## 锐评

Qwen 在 ModelScope 上预告了 Qwen3.8-Flash-Next，明天开源。这是一个基于 Qwen4 架构的多模态 MoE 模型，总参数 125B，每次推理只激活约 6B 参数。如果这个激活比例是真的，意味着推理成本会很低，用消费级显卡也能跑。但正文没披露任何基准测试成绩、推理速度，也没说多模态具体支持哪些输入输出，目前只能看到一张预告图和倒计时。

这次提前放出来，官方说法是让社区先看看 Qwen4 的设计思路。从命名和参数规模看，它更像一个架构验证版，不是拿来直接上生产的模型。我会等模型卡和权重放出来，看看实际跑分和显存占用再判断。如果 6B 激活量能跑出接近同规模密集模型的水平，那确实挺省钱。
