跳到正文
AI HOT 精选

通义千问开源 Qwen3.8-Flash,125B 总参数每次只激活 6B,训练成本降到前代的九分之一

Qwen3.8-Flash 开源,Qwen4 架构预览

阿里通义放出了 Qwen3.8-Flash 的完整权重,这是个多模态的 MoE 模型,总参数量 125B,但每次推理只激活其中 6B 参数,所以跑起来很轻。训练成本只有 Qwen3.7-Plus 的九分之一,性能还全面反超。生产版 API 定价是输入每百万 token 0.16 美元、输出 0.47 美元,原生支持 262K 上下文,可以拉到 1M。官...

推荐理由:阿里通义开源了 Qwen3.8-Flash,一个 125B 总参数但每次只激活 6B 的 MoE 多模态模型,训练成本只有前代 Qwen3.7-Plus 的九分之一,性能还全面反超,API 定价也给了具体数字。这种用极低激活参数换高性能、低成本的路线,对国内做模型选型和成本控制的技术团队很有参考价值,加上 Qwen4 架构预览,信息量够硬,HKR 全中。

读原文 ↗导出 Markdown