这次 V4 预览版最值得关注的是把 1M 上下文从“能做但很贵”变成了所有官方服务的默认配置,Pro 和 Flash 都不加价。技术上说,他们用 token 压缩加自研 DSA 稀疏注意力把计算和显存成本打了下来,但正文没披露具体压缩率、稀疏度这些关键指标,也没给延迟数据,所以实际体验会不会因为压缩掉细节而打折扣,还得等上手。
DeepSeek 主动拿 V4-Pro 对标 Claude Sonnet 4.5 和 Opus 4.6,内部员工做 Agentic Coding 反馈优于 Sonnet 4.5,但跟 Opus 4.6 开深度思考后还有差距。这种自己亮短板的表述在国内厂商里少见,反而让评测可信度加了一点分。不过这只是内部使用反馈,不是标准化基准测试,样本量和任务类型都没说,我会先打个折。
对开发者来说,API 同时兼容 OpenAI 和 Anthropic 格式,改个 model 参数就能切,旧的接口名还能用三个月,7 月 24 日后停服。Flash 版推理接近 Pro 但知识储备少一些,复杂 Agent 任务有差距,日常够用且更便宜。整体看,这次更新把长上下文从卖点变成了基础设施,但模型在长文档上的实际召回率和幻觉率还没公布,这是接下来要看的关键缺口。