# DeepSeek-V4.1-Flash 在硅基流动上线，552B 参数、1M 上下文，KV 缓存砍到 V4 Flash 的四分之一

> 原标题：DeepSeek-V4.1-Flash 上线 SiliconFlow，552B MoE 支持 1M 上下文

- 来源：AI HOT 精选
- 发布时间：2026-09-10T14:21:06.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/55673
- 原文：https://x.com/SiliconFlowAI/status/2098054160176545821

## 摘要

硅基流动当天就接入了 DeepSeek-V4.1-Flash。这是个 552B 参数的混合专家模型，实际干活时预填充阶段激活约 80 亿参数，解码阶段约 160 亿参数，自带视觉能力，一次能处理 100 万 token 的上下文。最实在的一点是 KV 缓存占用只有 V4 Flash 的四分之一，部署成本会低不少。MIT 许可证，商用也方便。

## 推荐理由

硅基流动当天上线 DeepSeek-V4.1-Flash，KV 缓存降到 V4 Flash 的四分之一，这是个很直接的省钱信号。552B MoE、8B/16B 激活参数、1M 上下文、MIT 许可证这些关键信息都给了，但正文没放基准测试或实际跑分数据，所以分数没往上调，维持在 78。
