# DeepSeek 发布 V4 Pro 和 Flash 模型，能在华为昇腾芯片上跑

> 原标题：[AINews] DeepSeek V4 Pro (1.6T-A49B) and Flash (284B-A13B), Base and Instruct — runnable on Huawei Ascend chips

- 来源：Latent Space
- 发布时间：2026-04-25T05:00:48.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/10416
- 原文：https://www.latent.space/p/ainews-deepseek-v4-pro-16t-a49b-and

## 摘要

DeepSeek 终于发了 V4 系列，一共两个型号：V4 Pro 总参数 1.6 万亿，每次激活 490 亿；V4 Flash 总参数 2840 亿，激活 130 亿。两个模型都支持 100 万 token 的上下文，用了新的压缩注意力技术，相比 V3.2，处理长文本时计算量只要 27%，显存占用只要 10%。这次比较特别的是同时发了基础版和指令版，...

## 推荐理由

这条必须写。DeepSeek 这次放出的不只是模型，而是把华为昇腾兼容性摆上台面，等于在 CUDA 依赖上划了一刀。技术报告说 1M token 下只用 V3.2 27% 的算力、10% 的 KV 缓存，省得挺实在。两档参数和 MIT 许可也让落地门槛更低。我会先打个折：正文没提实际推理延迟和昇腾上的吞吐数据，这点先别太激动，但硬件独立性本身已经够重。

## 锐评

DeepSeek 这次 V4 系列最值得关注的点不是跑分，而是它明确支持华为昇腾芯片。技术报告里说，在 100 万 token 的长文本场景下，新架构的算力消耗只有 V3.2 的 27%，显存占用更是降到 10%，这个效率提升相当实在。如果数据没注水，意味着用国产卡跑大模型的门槛又降了一截。

不过要打个折：正文没给出和 Kimi K2.6、GPT-5.4 这些同期模型的直接对比数据，只说“大致同级”。另外，虽然发了基础版和指令版，但推理能力到底怎么样，报告里没展开，得等第三方实测。华为昇腾的供应量目前也只有 H100 的四分之一，实际部署规模还得看产能。
