# DeepSeek 出了个 V4.1-Flash，用新架构把视觉理解直接做进模型里，KV 缓存砍到原来的 1/4

> 原标题：DeepSeek 发布 V4.1-Flash：新 Causal Encoder-Decoder 架构，带原生视觉理解

- 来源：AI HOT 精选
- 发布时间：2026-09-10T08:16:13.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/55681
- 原文：https://x.com/kimmonismus/status/2097962333767102665

## 摘要

V4.1-Flash 是 DeepSeek 新架构里最小的一个模型，总参数 552B，但干活时输入只激活 8B、输出激活 16B，属于 MoE 的省电模式。它换了一套叫 Causal Encoder-Decoder 的架构，视觉理解不再外挂，而是原生支持。最实在的变化是 KV 缓存：跟上一代比，HBM 占用降到 1/4，SSD 存储降到 1/8，意味着...

## 推荐理由

我会先打个折：正文没给具体 benchmark 和推理延迟数据，所以性能到底怎么样还得等实测。但架构切换这件事本身就够硬——Causal Encoder-Decoder 加原生视觉，KV 缓存直接砍到原来的零头，对实际部署的人比单纯跑分更有吸引力。加上 DeepSeek 的发布自带流量，选它上头条没毛病。
