# DeepSeek V4-Flash 0731 发布：不改模型结构，纯靠训练后优化，把智能体能力拉到接近 GPT-5.6，成本还低了六成

> 原标题：[AINews] not much happened today

- 来源：Latent Space
- 发布时间：2026-08-01T01:38:09.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/48390
- 原文：https://www.latent.space/p/ainews-not-much-happened-today-038

## 摘要

DeepSeek 放出了 V4-Flash 0731 版本，模型大小和结构没变，还是 284B 总参数、13B 活跃参数、100 万上下文窗口。这次更新全靠训练后优化，没有动预训练。最直观的变化是 Terminal-Bench 分数从 56.9 跳到 82.7，其他智能体相关的跑分也全面上涨。API 定价是输入每百万 token 0.14 美元、输出 ...

## 推荐理由

这条消息的核心看点很集中：DeepSeek V4-Flash 0731 没动预训练、没改结构，纯靠后训练把 Terminal-Bench 拉高 25.8 分，其他智能体跑分也全面上涨。对从业者来说，这说明后训练在提升模型实际干活能力上的空间比很多人想的大。定价和开源权重让它在 GPT-5.6 降价后依然有竞争力。不过原文是付费 newsletter 的汇总，不是一手发布公告，标题自己也说'今天没啥大事'，所以分数没给到 85 以上。

## 锐评

这次更新最值得看的是，DeepSeek 没动预训练，只靠训练后优化就让模型在智能体跑分上全面上涨。284B 总参数、13B 活跃参数、100 万上下文窗口都没变，但 Terminal-Bench 从 56.9 跳到 82.7，GDPval-AA v2 Elo 从 1189 涨到 1559，输出 token 用量还降了 12%。Artificial Analysis 把它排在 50 分，只比 GPT-5.6 Luna 的最高 51 分低 1 分，但每次任务成本便宜约 60%。API 定价输入每百万 token 0.14 美元，缓存命中折扣打到 98% 后只要 0.0028 美元，这个折扣力度很激进。

不过正文没写具体用了什么训练后配方，是强化学习、偏好对齐还是别的组合拳，一概没提。权重当天就放出来了，MIT 协议，Unsloth 做了 4-bit 量化版需要约 168GB 显存。没有技术细节，这些跑分提升就只能当现象看，没法判断可复现性。另外 V4-Pro 的 API 和网页版还没更新，官方说还在等正式版，所以这次提升目前只限 Flash 这条线。
