# DeepSeek 开源 V4.1-Flash：用不对称算力给编程 Agent 省 prefill 成本

> 原标题：DeepSeek 开源 V4.1-Flash：CED 架构降低编码 Agent 的 prefill 开销

- 来源：AI HOT 精选
- 发布时间：2026-09-11T22:01:37.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/56134
- 原文：https://www.baseten.co/blog/deepseek-v41-flash-more-efficient-prefill-for-coding-agents

## 摘要

DeepSeek 放出了 V4.1-Flash 的开放权重，一个 552B 参数的 MoE 模型，用了 Causal Encoder-Decoder 架构，专门为编程 Agent 调过。它把算力拆成两块：prefill 阶段激活 8B 参数，decode 阶段激活 16B，外加 KV 缓存效率也做了优化。跑分上，Terminal Bench 2.1 拿...

## 推荐理由

DeepSeek 开源了 V4.1-Flash，一个 552B 的 MoE，用 CED 架构把 prefill 和 decode 拆开，专门降编程 agent 的延迟。Terminal Bench 2.1 的分数是实打实的，Baseten 的分析也补了部署视角。没给到 85 分以上是因为这是第三方解读，不是官方技术报告，部分细节还得等一手资料验证。
