# 通义千问开源 Qwen3.8-Flash，125B 总参数每次只激活 6B，训练成本降到前代的九分之一

> 原标题：Qwen3.8-Flash 开源，Qwen4 架构预览

- 来源：AI HOT 精选
- 发布时间：2026-08-26T15:32:46.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/52932
- 原文：https://x.com/Alibaba_Qwen/status/2092636376990990503

## 摘要

阿里通义放出了 Qwen3.8-Flash 的完整权重，这是个多模态的 MoE 模型，总参数量 125B，但每次推理只激活其中 6B 参数，所以跑起来很轻。训练成本只有 Qwen3.7-Plus 的九分之一，性能还全面反超。生产版 API 定价是输入每百万 token 0.16 美元、输出 0.47 美元，原生支持 262K 上下文，可以拉到 1M。官...

## 推荐理由

阿里通义开源了 Qwen3.8-Flash，一个 125B 总参数但每次只激活 6B 的 MoE 多模态模型，训练成本只有前代 Qwen3.7-Plus 的九分之一，性能还全面反超，API 定价也给了具体数字。这种用极低激活参数换高性能、低成本的路线，对国内做模型选型和成本控制的技术团队很有参考价值，加上 Qwen4 架构预览，信息量够硬，HKR 全中。
