19大场景实测Qwen-Image-3.0,GPT Image2不再是生图的唯一选择了

AI 知识库10小时前发布 AI沃茨
622 0 0
熊猫办公
好久没有图片模型更新了,最近我是真的有点手痒。结果就昨天,Qwen-Image-3.0上线了。支持最高4.5k token输入、12种语言、20多种字体,还有多图融合、图中图和图片编辑。我随便给了个提示语生成一张猫咪全品种科普图鉴图,它给我的图是这样的,

19大场景实测Qwen-Image-3.0,GPT Image2不再是生图的唯一选择了

还有一张这样的,

19大场景实测Qwen-Image-3.0,GPT Image2不再是生图的唯一选择了

这个效果,这个文字稳定性,有点意思啊,有点和Image2齐平的感觉了,那这来都来了,必须得赶个热乎的,从中文文字、多语言组合图、UI设计、多图融合、和图片编辑五个方向来给大家大测特测一波,量大管饱,Here we go!
先从中文文字开始,能测中文字稳定的能力的最好办法就直接把尽可能多的文字内容塞到一张图里,看它能不能把所有的信息一一复现,并且做到文字不崩,比如这张图。

19大场景实测Qwen-Image-3.0,GPT Image2不再是生图的唯一选择了

这个提示语长到我一个页面都没放完,要滑动好几个页面才能容纳所有我想要的文字信息。但Qwen-Image-3.0还真的把它做出来了,所有的信息都在它该在的位置上,还做出了表格。整个图片的质量完成度还是非常高的。除了文字之外,我还希望能通过文生图的功能,在单张图片上实现文字信息与对应图片内容的精准匹配。比如说,我这里制作了一份包含十二道菜的菜谱,我只给了菜名和定价,请Qwen-Image-3.0 给我做出来的图是这样的。

19大场景实测Qwen-Image-3.0,GPT Image2不再是生图的唯一选择了

所有的菜式图片和名字都对应上了,价格也是对的,同时也按照我想要的分类进行了分区,然后整个菜谱的设计也实现了我想要的拼贴质感,每一处文字和标签的设计和整体的风格都很匹配,讲道理做成一个菜单没啥压力。又或者我想把中文文字玩出一点新的花样,让它不那么无聊,能做出好看一点的字体和排版的话,就有了这两张图。

19大场景实测Qwen-Image-3.0,GPT Image2不再是生图的唯一选择了
19大场景实测Qwen-Image-3.0,GPT Image2不再是生图的唯一选择了

一种是偏印刷风格的字体,另外一种就是我们经常会用到的手写毛笔字。这两种字体做出来的效果都不是那种常见的AI直出的感觉,人感会更强一些,搭配上一些元素和排版,整个画面的设计感还是有的。中文测差不多了,那如果我想要在一张图中加入多种语言混合展现,比如说,我想做一张横版的中英文的双语工作日历,Qwen-Image-3.0给我的图是这样的,

19大场景实测Qwen-Image-3.0,GPT Image2不再是生图的唯一选择了

设计有、中文有、对应英文有、文字崩坏没有,而且8月1号就是周六,这个也是对应上的,世界知识也没什么问题。换成更复杂一点的多文字的双语科普图,依旧也是可以的,即使需要介绍的信息如此之多也都能按照条例排版对应清楚,我仔细看了所有的文字都没有出现揉成一团或者模糊错字的情况,准确率还是相当哇塞。

19大场景实测Qwen-Image-3.0,GPT Image2不再是生图的唯一选择了

双语可以的话,就来上个难度,我设计了一款产品,然后让它的说明书中出现6种语言文字,效果是这样的。

19大场景实测Qwen-Image-3.0,GPT Image2不再是生图的唯一选择了

说实话,六种语言同时出现,已经属于很强的文字压力了,Qwen-Image-3.0也都扛住了。说明书的内容都能对应上了,看多这么多字儿我还是想感叹一句,是真的不崩啊,一点糊的感觉都没有,而且一次就成功了这图。接下来到了UI的部分,先来两张系统UI热热身,

19大场景实测Qwen-Image-3.0,GPT Image2不再是生图的唯一选择了
19大场景实测Qwen-Image-3.0,GPT Image2不再是生图的唯一选择了

车载系统界面图和学习APP演示图的整个 UI 看起来都没什么大问题,再看看APP的UI界面,甚至灵动岛都给我画出来了,游戏的页面也很贴合现在手游的审美。

19大场景实测Qwen-Image-3.0,GPT Image2不再是生图的唯一选择了

除了文生图之外,Qwen-Image-3.0也支持多图融合和图片编辑,我也是直接上高强度。比如这里我给了一张模特图和一张6套衣服组合图,

19大场景实测Qwen-Image-3.0,GPT Image2不再是生图的唯一选择了

然后让图中模特穿上第二张图的这套衣服,然后站在一张图中,Qwen-Image-3.0做出来的是这样的,人物对、衣服对、配饰和鞋子都没出差错,站位也是和原图对应上的,一次就能跑出这样的效果还是挺牛的。

19大场景实测Qwen-Image-3.0,GPT Image2不再是生图的唯一选择了

然后,我又给了一张产品图和一张品牌手册,让Qwen-Image-3.0根据这仨图给我做一个产品的主KV,

19大场景实测Qwen-Image-3.0,GPT Image2不再是生图的唯一选择了

给我的图是这样的,是能读取主题色和品牌概念以及logo,做出合适的海报。

19大场景实测Qwen-Image-3.0,GPT Image2不再是生图的唯一选择了

当然,除了这种复杂的图片融合之外,修改改图这类图片编辑操作Qwen-Image-3.0也能做的很好。比如,修改一下海报上的文字啊,都能延续原本字体,(左原图 右改图)

19大场景实测Qwen-Image-3.0,GPT Image2不再是生图的唯一选择了
19大场景实测Qwen-Image-3.0,GPT Image2不再是生图的唯一选择了

清掉玻璃里的路人和拍摄者倒影啊,

19大场景实测Qwen-Image-3.0,GPT Image2不再是生图的唯一选择了
19大场景实测Qwen-Image-3.0,GPT Image2不再是生图的唯一选择了

替换一下产品图哇,

19大场景实测Qwen-Image-3.0,GPT Image2不再是生图的唯一选择了
19大场景实测Qwen-Image-3.0,GPT Image2不再是生图的唯一选择了

把竖版人物海报扩成横版KV啊,也都没什么问题。

19大场景实测Qwen-Image-3.0,GPT Image2不再是生图的唯一选择了

每一个任务其实都做的很好,不会动原图的其他部分,又能把我们想要改掉的地方成功修改,不留痕迹。最后放一张我很喜欢的手冲咖啡手绘分镜图,

19大场景实测Qwen-Image-3.0,GPT Image2不再是生图的唯一选择了

步骤都对,画的也自然,甚至能感受到一些chillchill的感觉,到这其实我觉得在图片质量Qwen-Image-3.0已经能和Image2媲美了,如果碰到中文长文本、多张参考图和精细编辑的任务,我还是挺愿意先让Qwen-Image-3.0跑一跑的,不贵,速度也挺快,处理信息的能力也够强,重要的是在国内打开就能用。能实实在在的感觉到,这把国产图片模型这次又往前走了一大步。现在测完,我脑子里已经又多了好几个想继续打磨的case了。这种手痒的感觉还挺好的。说明我们手里又多了一个能干活的国产图片模型。所以这次我愿意很直接地夸一句。Qwen-Image-3.0,真是不错。

@ 作者 / 卡尔


© 版权声明

相关文章