
阿里千问发布Qwen-Image-3.0:能画知识九宫格,还能修古画,这个AI画像样样通?
今天凌晨,阿里千问正式发布了他们最新的图像生成基础模型——Qwen-Image-3.0。
说实话,这个版本的升级比我预期的要大。发布会上阿里打出的核心关键词只有一个字——"实"。
什么意思?就是说这个模型不只追求"好看",而是追求"好用"。

从"准"到"实"的三代进化
回顾一下千问图像模型的进化史:
1.0 版本强调的是"准",能画出你需要的东西;
2.0 版本在此基础上追求"准多齐美真",各方面都比较均衡;
到了 3.0,直接换了个赛道,开始死磕"实用性"。
这个"实"体现在三个维度上:内容丰实、细节真实、知识厚实。
先说内容丰实。Qwen-Image-3.0 支持最大 4.5k token 的超长输入,这是什么概念?它能一次生成一个九宫格的复杂信息图,每个格子都是一张独立的知识图解。
举个例子,官方展示了一张图——九个格里分别包含了隧道安全漫画、空间几何教学、《出师表》文体分析、物理抛体运动、生物寄生虫科普、群论 Sylow 定理、银行内控管理、DNA 结构对比。每个格子都有精确的中英文文字、公式、图表甚至漫画人物。
你让现在的任何其他图像模型来干这个活,估计直接崩溃。

小字渲染,这次真的可以了
做设计的朋友应该深有体会——AI生成图片最让人崩溃的地方,就是文字渲染。
以前让AI做一张海报,画面可能很美,但上面的字基本没法看,不是缺胳膊少腿就是完全乱码。这就导致AI生图在商业场景下一直很难落地。
Qwen-Image-3.0 号称支持 10px小字精准渲染。官方展示了一张学术论文的截图,满屏的公式和LaTeX排版元素,上标、下标、花括号、分数线——全都清清楚楚。
这个能力要是真能稳定复现,那对于做产品海报、影视分镜、漫画制作的人来说,简直是降维打击。
而且它还支持 12 国语言和 20 多款字体原生渲染。做海外市场的朋友应该能懂这个有多实用。

从画张好看的图,到修复古画
让我觉得比较惊艳的一个功能是古画修复。
给模型一张破损或不完整的传统绘画,它能自动修复缺失的部分,同时保持原有的艺术风格和笔触。官方展示的鹰搏图修复效果,不仅补全了缺失部分,还保持了水墨渐变和羽毛质感。
这个能力要是放到文物保护领域,价值不可估量。
另外,Qwen-Image-3.0 在人像摄影的细节上也做了很大提升。毛孔、发丝这些微观细节的还原度,已经逼近摄影级的真实感了。

什么时候能用上?
目前阿里云百炼和千问 AI 平台已经开通了 API 邀测,感兴趣的同学可以去申请试用。Qwen Studio 和千问 APP 也即将上线,到时候可以免费体验。
从整体来看,Qwen-Image-3.0 代表了一个趋势——AI图像生成正在从"娱乐工具"向"生产力工具"转变。
以前我们用AI生图,大多是玩玩而已,生成的头像、壁纸好看就行。但现在,不管是做产品海报、学术配图、还是UI界面设计,AI都已经到了"真的能用"的阶段。
当然,具体效果怎么样,还得等大家亲自上手试了才知道。毕竟宣传片总是最美的,真到了实际场景里,是不是还能保持这个水平,这才是关键。
评论 (0)
暂无评论,来写第一条吧 ✍️