实测通义千问图像模型 3.0:中文长文字不崩、多图融合能打,跟 GPT Image2 有来有回
实测Qwen-Image-3.0:19大场景挑战GPT Image2,中文长文本与多图融合表现亮眼
阿里放出了 Qwen-Image-3.0,一次能塞 4.5k token 的指令,支持 12 种语言和 20 多种字体。作者拿它跑了 19 个场景,包括中文长文本、多语言混排、UI 界面、多图融合和图片编辑。结果文字基本不花,信息也对得上,画质跟 GPT Image2 差不多。国内直接能用,速度不慢,价格也不算贵,但正文没给出具体价格和延迟数字。
推荐理由:作者拿Qwen-Image-3.0跑了19个场景,中文长文本、多语言混排、UI界面、多图融合都测了,文字基本不花,画质跟GPT Image2差不多。对比做得挺实在,不是公关稿。扣分是因为正文没给出具体价格和延迟数字,想算成本的人还得自己去查。