# DeepSeek V4 Flash 公测：Agent 跑分大幅超过 V4 Pro 预览版

> 原标题：DeepSeek-V4-Flash Update

- 来源：Hacker News 首页
- 发布时间：2026-07-31T06:08:36.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/47828
- 原文：https://api-docs.deepseek.com/updates/

## 摘要

DeepSeek 把 V4 Flash 模型开放公测了，API 调用方式不变，模型名改成 deepseek-v4-flash 就行。这次只更新了 Flash，V4 Pro 和 App/Web 端都没动。Flash 的模型结构和尺寸跟之前的预览版一样，只是重新做了一遍后训练。最大的变化是 Agent 能力，官方给的跑分比 V4 Pro 预览版高出一大截：...

## 推荐理由

DeepSeek V4 Flash 开放公测，Agent 跑分压过自家 V4 Pro 预览版，这在国产大模型里算一个值得标记的能力更新。只动后训练不动结构，技术信号很明确。没给 90 分以上是因为它毕竟还是 Flash 这一档，不是满血旗舰，实际业务表现还得等用户反馈。

## 锐评

DeepSeek 把 V4 Flash 模型开放公测，API 调用方式不变，模型名改成 deepseek-v4-flash 就行。这次只更新了 Flash，V4 Pro 和 App/Web 端都没动。Flash 的模型结构和尺寸跟之前的预览版一样，只是重新做了一遍后训练。

最大的变化是 Agent 能力，官方给的跑分比 V4 Pro 预览版高出一大截：Terminal Bench 2.1 拿了 82.7，Cybergym 76.7，DSBench-FullStack 68.7。这些数字说明模型在命令行操作、网络安全和全栈开发这类需要多步执行的任务上进步明显。但要注意，DSBench 是内部测试集，正文没披露题目难度和代表性，第三方还没复现，我会先打个折看。

另外，Flash 原生支持 Responses API 格式，专门适配了 Codex，意味着可以直接接入代码执行环境干活。V4 Pro 只说“很快”发布，没给具体时间，想用更强模型的还得等。
