# DeepSeek V4 Flash 正式版 API 开始公测，只改了后训练，让模型干活的能力分涨了不少

> 原标题：DeepSeek-V4-Flash 正式版 API 上线公测，Agent 能力基准测试远超 V4-Pro 预览版

- 来源：AI HOT 精选
- 发布时间：2026-07-31T06:02:05.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/47817
- 原文：https://www.ithome.com/0/984/116.htm

## 摘要

DeepSeek 今天下午把 V4 Flash 正式版的 API 放出来公测了。模型结构和尺寸跟预览版一样，只是重新做了一遍后训练，但让模型进业务流程干活（Agent）的分数明显上去了。比如 Terminal Bench 2.1 跑到 82.7，DeepSWE 54.4，官方说远超 V4 Pro 预览版。Flash 现在原生支持 Responses A...

## 推荐理由

DeepSeek V4 Flash 正式版公测，Agent 跑分压过 V4 Pro 预览版，属于国产主力模型的一次实打实更新。两个具体分数（Terminal Bench 2.1、DeepSWE）让信号更实在。分数没给更高是因为它毕竟是 Flash 不是 Pro，而且正文没披露后训练具体改了什么、成本多少，这些缺口让判断得先打个折。

## 锐评

这次 V4 Flash 正式版升级，说白了就是模型没换脑子，只重新做了一遍后训练，就让它在“让模型进业务流程干活”的 Agent 测试里分数明显上去了。比如 Terminal Bench 2.1 跑到 82.7，DeepSWE 54.4，官方说远超 V4 Pro 预览版。这至少说明，后训练对 Agent 能力的提升效果很直接，不一定非要堆更大的模型。

但要注意，这些分数目前只有官方自己放出来的基准测试结果，没有第三方复现或更详细的消融实验。而且 V4 Pro 正式版还没发，Flash 到底比 Pro 差多少、强在哪，现在没法直接比。另外，这次升级只动了 API 接口，App 和网页版没变，普通用户暂时感受不到变化。

还缺什么：一是 Flash 和 Pro 正式版在更多实际业务场景里的对比；二是后训练具体改了哪些数据、用了什么方法，正文没披露；三是成本有没有变化，也没提。
