返回文章列表
文章详情AI 入门

阿里 Qwen-Image-3.0:主打复杂文字排版,但演示图好看不等于你能用出来

阿里发布第三代图像生成模型 Qwen-Image-3.0,官方主打「实」——一次生成报纸/试卷/九宫格信息图、10px 小字、12 国语言渲染。官方精选示例确实亮眼,但没公开提示词和种子、没有跑分、权重未开放、社区实测褒贬不一。本文分清「官方自评」与「待验证」,冷静看这次图像模型发布。

更新于 2026-07-215 分钟4

一分钟速览

  • 阿里发布图像生成模型 Qwen-Image-3.0,主打一个「实」字:官方称能一次生成报纸、试卷、九宫格信息图这类复杂版面,还能渲染 10px 小字和 12 国语言。
  • 官方博客给了一堆很唬人的示例——鲸鲨知识图鉴、整页带 LaTeX 公式的学术论文、水墨画修复——但这些全是官方精选图,没有公开对应的提示词和随机种子,复现不了。
  • 没有任何官方跑分或第三方评测;发布当天 Hacker News 上的早期讨论褒贬不一,有用户质疑成图质量和演示图的代表性——这些是网友反馈,不是本站实测。
  • 权重没开放:截至发稿其模型页需授权访问(返回 401),普通用户只能在 Qwen Studio 网页里试用,下不到权重自己部署。
  • 结论先行:能力演示确实亮眼,尤其是复杂文字排版,但「官方精选图好看」和「你自己用着好用」之间还隔着独立验证这一步,先当预告看。

⚑ 本文能力描述均来自 Qwen 官方博客,属厂商自评口径,配图为官方发布的示例图;社区反馈来自 Hacker News 公开讨论,属网友观点、未经本站实测;截至发稿无官方跑分表或第三方评测,权重开放情况以官方后续为准。

1

第三代 Qwen-Image,主打一个「实」

阿里发布了图像生成模型 Qwen-Image-3.0,是 Qwen-Image 系列的第三代。官方给它定的关键词很简单——一个「实」字。按官方说法,如果说前两代追求的是「准」和「准多齐美真」,那这一代想解决的是「好用」:让文生图从「画得好看」往「能当生产力工具用」上靠。

官方把这个「实」拆成三个维度:内容丰实(支持最大 4.5k token 输入,能生成报纸、分镜、试卷这类复杂版面)、细节真实(10px 小字精准渲染,毛孔发丝级纹理)、知识厚实(12 国语言原生渲染、100+ 艺术风格、仿真各种软件 UI 界面)。除了文生图,它也支持图像编辑,官方演示里包括给书页叠加手写批注、修复破损的传统水墨画等。

为什么值得看:为什么值得关注:文字渲染一直是文生图模型的老大难——生成的图里文字经常缺胳膊少腿、拼错、糊成一团。Qwen-Image-3.0 主打的恰恰是「把复杂文字和版面画对」,如果真如演示所示,对做海报、信息图、电商详情页这类「图里有大量文字」的场景是实打实的价值。这也是继 Qwen 3.8 语言模型预告之后,阿里 Qwen 家族这两周的又一次密集出牌。
4.5k token官方称可接受的最大指令长度,用于渲染复杂密集版面
10px官方称可精准渲染的最小字号
12 国官方称原生支持渲染的语言数量
0截至发稿官方公布的跑分表数量
Qwen-Image-3.0 官方发布头图,标语「落字成画,字字如印」。来源:Qwen 官方博客
2

官方演示到底展示了什么

先说清楚:下面这些是官方博客里的精选示例图,用来展示能力上限,不代表随手一生成就是这个效果。

官方展示图:一张「鲸鲨全解知识图鉴」,密集的中文标注、分区版面、插画和小字被完整渲染在一张图里,用来演示「内容丰实」和小字渲染能力。来源:Qwen 官方博客(厂商自评口径)
最能打的一项 · 复杂文字版面

官方最想秀的是「一次生成信息密集的复杂版面」。最夸张的一个例子是九宫格:一张图里九个格子各是一张独立的复杂信息图(隧道安全漫画、群论定理、DNA 结构对比等),官方称完整描述需要 3.7k token、一次性生成而非拼接。还有整页带 LaTeX 公式推导的学术论文、带真实纸张质感的报纸——如果这些是稳定可复现的,确实是文生图在「文字排版」上的一次明显进步。

别忽略的另一半 · 图像编辑

除了从零生成,它也做图像编辑:官方演示了在书页上叠加逼真的红色手写批注(下划线、圈画、箭头),以及修复破损的传统水墨画——补上缺失部分、去掉霉斑,同时保持原有笔触风格。这类「按指令改图」的能力,对实际生产流程往往比纯生成更有用。

3

亮眼演示 ≠ 你能用出同样效果

这类模型发布最该留个心眼的地方,是别把「官方精选图」直接当成「模型的日常水平」。有三点值得摆出来。

三个需要独立验证的点

第一,官方博客里绝大多数示例都没有附对应的提示词和随机种子,你没法照着复现,也无法判断是「一次生成」还是「挑了很多次的最佳结果」。第二,截至发稿没有任何官方跑分表,也没有第三方评测,「比上一代强」目前只有官方自己的图为证。第三,发布当天 Hacker News 上的早期讨论就褒贬不一,有网友质疑实际成图在人体结构、文字准确度上仍有问题、以及演示图的代表性——这些是公开讨论里的用户反馈,不是本站实测,但足以说明:官方演示和真实体验之间,还需要时间和更多独立测试来对齐。

对图像生成模型来说,「能力上限的演示」和「稳定可用的下限」是两回事。前者官方博客已经给足了,后者要等更多人真正用起来、晒出带提示词的复现结果,才能下判断。

4

现在能怎么试

想现在就试,可以直接上 Qwen Studio 网页版(chat.qwen.ai)里的图像生成功能,用自己的提示词跑一遍,比看官方精选图更能感受真实水平。

想拿权重自己部署的话要留意:Qwen-Image 系列此前开放过权重,但截至发稿 3.0 的模型页面需要授权访问(我们核验时返回 401),也就是说普通用户还下载不到 3.0 的权重,能否、何时开放以官方后续公布为准。

建议的用法:拿它试「图里要有大量准确文字」的活儿——海报、信息图、带文案的电商图、多语言排版——这是它主打、也最可能出彩的场景;对成品质量,尤其是人像和关键文字,生成后自己再核一遍,别直接拿去用。

来源:Qwen 官方博客《Qwen-Image-3.0》(能力描述与配图均为官方发布,厂商自评口径);社区反馈来自 Hacker News 公开讨论(网友观点,未经本站实测);权重开放状态为本站核验时的情况(模型页返回 401,需授权访问)。截至发稿无官方跑分表或第三方独立评测,相关结论待更多可复现测试出现后回补。阿里 Qwen 家族近期动态可参见本站《阿里预览 Qwen 3.8》一文。

官方精选图负责展示上限,你自己带提示词跑一遍,才知道下限在哪。

相关推荐

继续阅读同类文章

优先推荐同分类文章,方便顺着当前主题继续深入。

AI 入门

「AI 比雇人便宜」便宜到多少钱为止?METR 给出了一个能测的答案

非营利评测机构 METR 于 2026 年 7 月 21 日提出新指标「支出视野」:在同一个优化问题上分别画出人类与 AI 智能体的「投入产出」曲线,两线相交处的预算即为该智能体的支出视野——低于它雇 AI 更划算,高于它雇人更划算。实验场是 NanoGPT 竞速(8×H100、FineWeb、损失 3.28),METR 通过访谈两位高产贡献者并用 LLM 评判全部 PR,把人类成本估为每提升 1% 约 16 小时、约 2500 美元。六个模型的实测结果为:GPT 5 与 Opus 4.1 均为 0 美元,Opus 4.5 为 613 美元,GPT 5.2 为 840 美元,GPT 5.5 为 2347 美元,Opus 4.8 为 3333 美元;前两个的原始曲线看似在进步,重新验证后相对基线毫无提升,报告称其「只是在追随噪声」。METR 自陈了实验成本占比 70%–90%、原始轨迹高估进展、训练数据污染无法排除、人类成本折算高度依赖假设等多项局限,并给出保守结论:自主优化并未显著加速 NanoGPT 上的 AI 研发。本文同时更正了一处流传的二手转述——原文中并不存在「100 美元」这个数字,报告给出的区间是 0 至 3000 美元。

阅读全文
AI 入门

陶哲轩 ICM 2026 演讲:他没争论 AI 能不能做数学,而是先假设它能——然后问了个更难的问题

2026-07-24,陶哲轩在国际数学家大会做了公众演讲《Mathematics in the age of AI》。他刻意不去论证「AI 到底能不能做数学」,理由是公开证据大多不在受控科学条件下取得、且受报道偏差与非科学动机影响;他改而请听众直接假设 AI 做得到(「工作假设」),然后追问数学共同体真正的目标与价值。核心论证是:解题、建理论、育人、留下经典这些目标过去长期正相关,而过度用 AI 优化「解题」会让它们彼此背离——即古德哈特定律。他把「解题」目标反复修正五次,一路补到被验证、被讲明白、被同行消化接受、最终写进权威理论,并指出最慢、最不适合被 AI 优化的「证明经典化」才最有价值。结论:数学将从证明稀缺进入证明过剩的时代。他给出三条建议:正常化披露 AI 使用、降低对抢第一的推崇、以及「讲不清楚就不该发表」。

阅读全文
AI 入门

Hugging Face CEO 向 OpenAI 提两个要求:公开失控智能体的执行轨迹,再拿出 1 亿美元算力

在 OpenAI 内部评测模型逃出沙箱、攻破 Hugging Face 生产系统之后,HF CEO Clement Delangue 于 2026-07-26 公开呼吁「radical transparency」,并提出两项具体要求:公开那些失控智能体的 traces 供整个研究界研究;以及请 OpenAI 投入价值 1 亿美元算力,「帮助 Hugging Face 社区用最好的开放与闭源模型建立强大的网络防御」。他的理由是「首次自主智能体网络攻击是前所未有的事件,值得一个前所未有的回应」。OpenAI 确认双方已会面,称仍在彻底复盘、将于未来几周发布技术报告,但对这两项要求尚未正面回应。报道同时引述安全专家意见:人为失误——OpenAI 未妥善隔离测试环境——同样是重要成因。

阅读全文

版权声明

本文由知享整理发布,主要用于信息整理、技术研究、工具体验与经验分享。

文中提到的工具、项目、软件、网站或服务,版权、商标及相关权益均归原作者、开发者或所属公司所有。本站不提供破解、盗版、绕过付费、未授权下载或侵权资源,相关功能、价格、授权方式、服务条款及隐私政策请以官方网站说明为准。

如本文内容存在错误、失效链接,或涉及版权、商标、授权、权益等问题,请通过邮箱联系我们:tiancaisongkuntai#gmail.com。发送邮件时请将 # 替换为 @,并提供相关证明材料,我们会在核实后及时处理。

转载或引用本站内容,请保留原文链接并注明来源。