# Qwen 放出 Qwen3.6-35B-A3B，35B 总参数只激活 3B，开源可商用

> 原标题：Qwen3.6-35B-A3B released!

- 来源：r/LocalLLaMA
- 发布时间：2026-04-16T13:27:39.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/23
- 原文：https://www.reddit.com/r/LocalLLaMA/comments/1sn3izh/qwen3635ba3b_released/

## 摘要

Qwen 发了个新模型，叫 Qwen3.6-35B-A3B，用的是稀疏 MoE 架构，总参数量 35B，但每次推理只激活其中 3B 参数，跑起来会比较省资源。采用 Apache 2.0 协议，可以商用。官方说法是它在写代码、处理多模态任务上表现不错，还支持“思考”和“不思考”两种模式，能直接塞进业务流程里干活。不过这篇帖子没给出具体的跑分、上下文窗口长...

## 推荐理由

这条帖子是个发布通告，信息量有限但钩子够硬。35B 总量、3B 激活的稀疏 MoE 听着省算力，但正文没放基准和上下文窗口，我会先打个折。Apache 2.0 开源是实锤，对想自己部署的人有吸引力；agentic coding 和多模态推理的说法先别太激动，等实测数据出来再看。

## 锐评

Qwen3.6-35B-A3B 是个稀疏 MoE 模型，总参数量 35B，每次推理只激活其中 3B 参数，意味着对显卡显存和算力的要求会低不少，本地跑起来的门槛可能不高。采用 Apache 2.0 协议，商用友好。官方说它在写代码、多模态理解和推理上表现不错，还支持“思考”和“不思考”两种模式，能直接塞进业务流程里干活。

但这条帖子本身信息量有限。正文没披露任何具体跑分，也没提上下文窗口长度、推理延迟这些关键指标。官方说法里“写代码能力跟激活参数 10 倍大的模型相当”听起来挺强，但没给出对比对象和测试集，说服力要打个折。多模态能力具体到什么程度，是看图说话还是能读文档，也没展开。

想认真评估的话，还得去 Hugging Face 或官方博客翻技术报告，看实际跑分和硬件实测。如果这些数据也缺，那这个模型目前更像一个省资源的候选方案，能不能打还得等社区实测。
