# DeepSeek 多模态模型开始灰度测试，能识别图片里的饮料和杯子

> 原标题：确认！DeepSeek多模态AI已经开测

- 来源：量子位 · 公众号
- 发布时间：2026-04-29T12:44:00.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/12468
- 原文：https://mp.weixin.qq.com/s?__biz=MzIzNjc1NzUzMw==&mid=2247887827&idx=2&sn=6801c43c3dc9126d3e6bc2dd94a372b4

## 摘要

DeepSeek 研究员确认 V4 视觉版已经在灰度测试，官网首页上线了图片识别入口。一张截图显示，模型花了 4 秒识别出一张文字不多的图片里的饮料种类和杯子类型。正文没披露灰度覆盖范围、API 是否开放以及定价，所以能不能用上、花多少钱还不清楚。

## 推荐理由

HKR 三项都站得住：DeepSeek V4 视觉灰度测试是实打实的国内旗舰更新，有截图和 4 秒思考样本。分数维持 80，因为正文没披露开放范围、API 怎么接、价格和跑分，信息缺口不小，先别太激动。

## 锐评

DeepSeek 研究员确认 V4 视觉版已经在灰度测试，官网首页多了图片识别入口。从流出的截图看，模型花了 4 秒识别出一张文字不多的图片里的饮料种类和杯子类型，速度不算快但也不算慢。

这条消息最值得关注的点是 DeepSeek 终于补上了多模态这块短板，之前一直只有纯文本能力。但正文没披露灰度覆盖了哪些用户、API 是否同步开放、以及收费标准，所以现在只能说“有了”，不能说“能用”。

我会先打个折：截图只展示了一个简单场景，复杂图文混排、表格、手写体这些真实世界常见的情况还没验证。另外 4 秒的延迟如果是端到端响应时间，在对话场景里还能接受，但如果要接业务流程干活，这个速度可能还得优化。
