据 动察 Beating 监测,千问发布第三代图像生成模型 Qwen-Image-3.0。新模型最大支持 4.5k Token 输入,重点提升复杂版面、细小文字和知识型图像的生成能力。
它可以用一条长指令生成报纸、试卷、短剧分镜和九宫格信息图。模型能在同一张图里处理多个主题,并同时生成公式、图表、人物和中英文文字。官方展示的一张九宫格包含九类独立内容,描述指令长约 3.7k Token。
文字渲染也进一步加强。千问称,模型可以清晰生成小至 10px 的文字,并处理 LaTeX 公式、上下标、手写批注和报纸密集排版。毛孔、发丝、纸张和绘画纹理等细节也更真实。
Qwen-Image-3.0 原生支持 12 种语言、100 多种艺术风格和多类 UI 界面。官方还展示了联网生成天气图、修复传统绘画和制作专业信息图等用法。相比单纯生成好看的图片,这一代更强调 PPT、教育材料、设计和内容制作等实际场景。
币须知道