首页财产ai正文 Qwen-Image-3.0效果炸裂?我反手扔了这9道题 阿里推出AI生图新模子Qwen-Image-3.0,官方称其有诸多上风。经实测,它于细节、内容、常识方面体现有前进,但也存于速率、正确度等问题。 2026-07-24 11:27 ·微信公家号:量子位 文婷 文婷 AI投资人解读· Qwen-Image-3.0撑持10px小字精准衬着,最长撑持4.5k token输入,可天生多种繁杂版面,还有撑持12国语言原生衬着。外网测评中,其图象理解及代码天生体现已经超部门海外模子。 · 有效户反馈它存于速率慢、混合术语、不懂语法等问题。 总结:该模子于功效上有显著晋升,具有必然投资潜力,但于不变性及正确性上还有有待完美,需存眷其后续优化进展,联合市场竞争等因素综合评估投资价值。

千问说它可以帮我拼九宫格了,还有是差别主题的那种。

这两天,阿里推出了一款AI生图新模子——Qwen-Image-3.0。

按官方说法,它不仅能正确天生仿真UI界面,还有能帮教员一键天生排版精巧的期末试卷;设计师也能用它快速输出海报、分镜及网页原型,省去从空缺画布一点点搭框架的时间。

更夸张的是,它还有能于单张图中同时出现9份差别主题的常识图解,并主动完成整洁排布,让信息密度及雅观度同时于线。

此次,Qwen-Image-3.0给本身的要害词只有一个字:实。

不是纯真更都雅,也不是只卷画风、构图、光影。

而是要让AI绘图再也不逗留于“哇,好美丽”的赞叹,而是继承往前走一步:这图能不克不及装下我的所有需求、能不克不及把细节画清晰、能不克不及直接拿去改、拿去用、拿去交差。

官方把这个“实”拆成三层:

第 一层是细节真实:它撑持10px小字精准衬着,笔划笔锋、人物毛孔、发丝、纸张、讲明这种细节都能稳住。

第二层是内容丰实:Qwen-Image-3.0最长撑持4.5k token输入,可以天生报纸、分镜、试卷、PPT这种繁杂版面。

第三层是常识厚实:它撑持12国语言原生衬着,还有能天生网页、游戏、直播等常见UI界面,甚至能联合世界常识做科普海报。

外网也已经经有人上手测了,于这份测评中,Qwen-Image-3.0的图象理解及代码天生体现,已经经跨越了GPT Image 二、Nano Banana 2等海外模子。

听起来很猛。

但图象模子的发布样例,历来有一个老问题,即“官方demo凡是展示的,都是最顺的那一壁。”

真正到了编纂、教诲、电商、设计这些场景里,到底好欠好用,不克不及只看宣传页怎么写,也不克不及只看天生图第 一眼漂不美丽,还有患上上手测。

以是,于收成一片掌声的同时,推上也呈现了不少对于Qwen-Image-3.0的吐槽。

有人说它“速率慢”,有人吐槽它会“混合术语”、“不懂语法”,甚至还有有网友直接指出,官网封面图里的阿拉伯语语法就有问题:

以是此次,咱们缭绕着官方信息提出的“内容丰实”、“细节真实”、“常识厚实”三个标的目的,设计了9道更详细的实测题,把额度测了个精光。

就看它到底能不克不及装、能不克不及稳、能不克不及细、能不克不及懂。

以和最要害的:它能不克不及真的帮咱们干活交差。

0一、先看它细节真不真实,放年夜后会不会露馅

噔噔噔噔,开场就丢王炸:验细节!

先拿最不讲原理、也最轻易露馅的学术论文页开刀。

论文页看着朴素,现实上全是生图模子的雷区:密密麻麻的小字、上下标、希腊字母、分数线、多行公式推导……

远看像论文不算数,放年夜后还有能清清晰楚、不糊不乱,才算真本领。

Qwen-Image-3.0能不克不及扛住呢?

实测一:学术论文公式页

提醒词:

效果以下(历时约莫3分20秒):

排版工致、笔迹清楚,不错不错,扛住了。

出在好奇,于等候Qwen-Image-3.0天生图片的间隙中,我还有用统一套提醒词模版测试了一下ChatGPT Plus版的天生效果,成果以下(历时约1分19秒):

实测二:萌宠与主人的近景肖像

测完了论文,让咱们来看一张治愈感满满的《主人与猫》吧。

提醒词:

成片:

很好,我很满足~

人物皮肤纹理、发丝质感、服装材质、猫咪标配傲娇心情等十足于线,气氛感统统。

就是天生速率慢了点。(历时约一分半)

实测三:念书条记

尽人皆知,天生一张新图是一回事,于原本的图象上做邃密编纂则是另外一回事了。

以是咱们此次要测的是,Qwen-Image-3.0可否于不粉碎原图布局的条件下,模拟高中生记讲堂条记的习气,给鲁迅师长教师的《狂人日志》加之重点条记。

提醒词:

效果以下:

于这个历程中,虽然呈现了一处同音错字“叶”(应该是“页”),但总体来看,它闻名段落抓患上很准,没有魔改原文,讲明也像手写,有真正的人类思索陈迹及红笔条记,与纸张纹理的交融也比力融洽。

最使人赞叹的是,它模仿并揭示出了学生们从“看到‘吃人’一词的不解到阐发出‘虚假’素质”的真实思索历程。

后续于对于话中指堕落误后,Qwen-Image-3.0立刻就改好了。

0二、再看它能不克不及把繁杂需求都装进图里

细节能不克不及画好,只是第 一关。

许多生图模子并不是不会绘图,只是画面里的元素一多,排版就最先掉控。

针对于这一痛点,Qwen-Image-3.0把输入长度拉到了4.5k token。

第二关就让咱们用一道最直不雅的九宫格题来验验它的现实承载能力及横向放开能力吧。

实测四:繁杂的九宫格常识图解

提醒词以下:

效果:

体现不错,过关。

实测五:一张高中数学模仿试卷

接下来,让咱们再测测Qwen-Image-3.0天生模仿试卷的能力:

提醒词:天生一张真实打印感的高中数学模仿试卷,A4竖版,中文排版。顶部包罗黉舍名称、测验名称、姓名及准考据号填写栏。第 一部门为6道选择题,每一题有A、B、C、D四个选项。第二部门为4道填空题。第三部门为3道解答题,此中包罗一道带坐标轴及抛物线示用意的解析几何题,以和一道立体几何题。页面底部留出规范答题区域及横线。试卷应像真实教辅资料,题号持续、版面规整、公式清楚、图文不堆叠。

OMG,翻车的一幕呈现了…….第 一次天生的效果其实不抱负:

我勒个去,怎会云云?

莫非测到一半就要翻车了吗?刺激!

思量到多是由于我没有于提醒词内要求“详细标题问题”及“北京地域”,以是我进一步增补了详细要求,并请Qwen-Image-3.0帮我天生一份有详细标题问题的北京高测验卷。

不外很遗憾,它此次居然直接抛却了生图,但给了我一套尺度的试卷标题问题,并于末端标了然该套试卷的难度系数及标题问题设置的合理性,让我自行排版:

不外亲爱的Qwen-Image-3.0,我怎么可能乖乖就范?!否则还有测你干吗?

在是下一步,情绪不变的我将它给的试题收拾到了文档中,并再次试图哀求它据今生成一套试卷:

很惋惜,均不可功,并且此次它问题更年夜了。

它不只是没法天生一套完备的试卷,它还有于未奉告我的环境下擅自窜改了标题问题挨次,并偷摸吞失了我设计的其他9道标题问题(包括2道选择题、2道填空题、5道解答题):

啥环境……莫非它牛吹年夜了?还有是我的要领出了问题?

我忽然反映过来,会不会不是模子不行,而是我一最先就没用对于它的打开方式?

前两次我都是习气性地让Codex帮我写提醒词,再丢给Qwen-Image-3.0生图。

问题会不会就出于这里,Qwen-Image-3.0实在更吃自家模子天生的提醒词?

既然云云,那就尝尝看吧!来都来了!!!

秉持着毫不容易抛却的精力,我举行了第三次测验考试:先用千问从头天生一套提醒词,再交给Qwen-Image-3.0生图。

还有好,此次乐成了!并且效果不错,很像我高三每一周模仿考的试卷:

这也让我发明,问题不于在模子自己,也不于在提醒词要表达的内容,而于在“适配”。

假如你也想让Qwen-Image-3.0帮你天生一份试卷,那你最 好按这三步去操作(固然假如各人有更好的措施,也接待于评论区别享呀!):

第 一步,先把题库发给千问,让它基在这套题库天生一份适配Qwen-Image-3.0的专用提醒词。(假如手头没有现成题库,也能够直接把出题要求告诉它,让它师长教师成题库。)

第二步,复制千问给出的Markdown提醒词模板;

第三步,把Word题库及这份Markdown提醒词一路发给Qwen-Image-3.0,如许才能天生咱们想要的试卷版面。

这一波三折的,确凿很抓马。

但它也深刻地提示了咱们一件事:用模子,最 好还有是要用对于“钥匙”,别把A模子天生的提醒词,一成不变地搬到B模子里用。

究竟提醒词这工具,也有模子本身的性情。

此次我已经经把踩过的坑连泥带土刨出来给各人看了,愿列位绕着走,别再沾一身灰啦~T T

实测六:一条提醒词,天生完备视觉初稿

这一项重要测的是Qwen-Image-3.0能不克不及帮忙设计师们从0最先完成质量较高的底稿设计。

详细做法是,给它一个真实设计的brief,让它一次性天生“一张发布会海报、一组短视频分镜、一个挪动端勾当页原型”这三类常见的设计底稿,并不雅察它可否将三种差别的视觉使命规整地放进统一张图里,利便设计师参考,而不是一片杂乱。

假如这一项过了,才能申明它真的有能力帮设计师先跑一版,而不是只会天生一张伶仃的美丽图。

如下是Qwen3.7-Plus天生的提醒词(全文测试均基在此版本):

结果展示:

0三、常识厚实:看它的认知可否跟上实际、是否真的懂场景

假如说前两关磨练的是“Qwen-Image-3.0到底能不克不及装、能不克不及稳、能不克不及细”,那末末了一关则磨练的是它“到底能不克不及懂”。

这应该是图象天生最难的部门,由于模子必需要拥有海量的认知、要真的相识实际世界的最新变化及各种法则。

实测七:日文美妆直播间

这是一道集语言、法则及产物常识在一体的综合题。

Qwen-Image-3.0不仅要写对于日文,还有要知道日本直播电商界面里,主播画面、弹幕、商品卡、扣头、下单按钮凡是怎样漫衍,有何特色。

提醒词为:

这题的尺度是不克不及只“有日文”,还有想让认识日本产物的人一眼看已往也不会感觉别扭。

让咱们一路来看看实测效果:

各人感觉咋样?

(注:日元JPY及人平易近币CNY的钱币符号写法基真相同,均为“¥”,只是国际上凡是会加之国度代码加以区别,例如JPY¥或者CNY¥。)

实测八:多语种杭州夏季游览海报

接着,让咱们来设计一张多语种贸易游览海报吧。

咱们需要让中文、英文、日文同时呈现于一张贸易海报物料上,且标题、时间、地址、图片一个都不克不及少,更主要的一点是不克不及有错字,由于只要有一个错字,整张设计稿都将回炉重造了。

提醒词以下:

效果:

太美丽了,我将当即逃离工位出发杭州(bushi)。

实测九:仿一个量子位公家号界面

末了,让咱们来整个活,趁便测试一下Qwen-Image-3.0设计仿真UI界面的能力吧~

这一次,我将唆使Qwen-Image-3.0天生一张“手机端量子位公家号文章页”仿真图。

它绘图时要同时做到三件事:

第 一,像一个手机端真实微信文章页面,有顶部导航、账号信息、标题区、首图及互动按钮

第二,能天然露出量子位的账号信息及科技媒体调性;

第三,还有能把Qwen-Image-3.0这篇实测文章包装成一条充足想点开的推送。

固然,作为整活环节,我还有要偷偷加一个小彩蛋:主编微信动静弹窗,夸我写患上真棒。(doge)

提醒词:

很是期待,让咱们一路来看看效果:

哎呀,看到嘉奖及10w+我好兴奋哈哈哈哈哈(梦里甚么都有,但实际何时能眷顾我一下)。

并且很欣喜的是,它天生的这张图片连手机界面的时间、旌旗灯号、电量等细节都有!

但客不雅来讲吧,它天生的格局及实际里的微信文章页确凿不太同样。

总体觉得像是把小红书、微信公家号、知乎等几个平台的界面气势派头揉于了一路,末了画出来一个有点“混血”的页面。

不外,至少它没有只天生一个泛泛的手机界面。Logo、账号信息、发布时间、转赞评互动区、阅读量数据这些元素都于,择要、小标题等文章基本布局也基本具有。

这申明它对于详细UI场景已经经有了必然理解,只是还有需要像修错字同样,多沟通、多指令、多调几轮。

哦,你问我此次为何不继承调?前面文章里的错字、试卷我都一轮轮改了。

求苍天辨忠奸……不是我不想测,偏偏相反,是我测患上太当真,把额度测光了啊啊啊!!

不外话说回来,假如一个模子仍旧需要用户重复烧额度,才能把图调到想要的样子,也申明它间隔“一把出活”还有有不少改良空间。

各人感兴致的话,接待把本身调好的版本发到评论区哦。

答对于无奖!

0四、“你很精彩,但确凿还有有一些不足之处。”

这9道题测完,信赖各人对于Qwen-Image-3.0的能力已经经有了一个比力直不雅的熟悉。

正如评论区这位俄罗斯网友说的:Qwen-Image-3.0是很精彩,但它确凿还有有一些不足之处。

比拟在以前的Qwen-Image-1.0及2.0,这一代于“细节真实”、“内容丰实”及“常识厚实”三个标的目的上,前进是较着的。

但它间隔“让用户安心拿来干活”,还有有需要补课之处。

有的是速率问题,有的是正确度问题,也有的是繁杂场景里的不变性问题。

好比这位用户于利用Qwen-Image-3.0天生一张西班牙语学术九宫格图时,就碰到了“同音术语混合”、“拼写过错”、“格局不规范”等问题。

但与此同时,她也坦诚地暗示,Qwen-Image-3.0于西班牙语文素质量上的前进让她印象深刻,并向Qwen表达了感激。

这也申明,Qwen-Image-3.0确凿让人冷艳、也确凿已经经能把许多繁杂使命做起来,但要真正做到不变、正确、快速、一把出活,还有患上继承打磨。

究竟,没有人但愿本身于赶着交差时,交上去的是一张带着过错的图片。

但愿Qwen-Image系列后续能连续存眷这些真正的用户反馈,并于下一代模子里把这些坑补上吧。

【本文由投资界互助伙伴微信公家号:量子位授权发布,本平台仅提供信息存储办事。】【免责声明】:本文不组成任何投资建议。市场有危害,投资需审慎。若有任何疑难,请接洽(editor@zero2ipo.com.cn)投资界处置惩罚。

-lehu乐虎88国际