Qwen-Image-3.0-Pro 上线千问AI平台,支持复杂图文排版、精细渲染与图像编辑

简介: Qwen-Image-3.0-Pro 现已上线千问AI平台,支持文生图和图像编辑,可处理最高 4.5K Tokens 指令,支持 12 种语言、20 余种字体和约 10 px 小字渲染,适用于复杂图文排版、真实质感、UI 设计和知识信息图等场景。

2026-08-05模型发布

Qwen-Image-3.0-Pro 上线千问AI平台,支持复杂图文排版、精细渲染与图像编辑

一、概览

Qwen-Image-3.0-Pro 现已上线千问AI平台——面向开发者与 AI Agent 的模型服务平台。作为第三代 Qwen-Image 图像生成模型,Qwen-Image-3.0-Pro 同时支持文生图和图像编辑,围绕「内容丰实、细节真实、知识厚实」三个方向升级:可接收最高 4.5K Tokens 的复杂指令,在单张图中组织多层级、多区域内容;支持约 10 px 小字、公式和真实材质渲染;支持 12 种语言、20 余种字体,以及网页、游戏、直播等界面生成。

从报纸、试卷、论文页面和分镜,到人像摄影、产品质感、知识信息图与多语言设计稿,Qwen-Image-3.0-Pro 可将复杂内容组织、精细视觉呈现和图像编辑纳入同一工作流,为内容创作、设计、教育、电商和应用界面生产提供更完整的图像能力。

Qwen-Image-3.0-Pro 发布主视觉

延伸阅读:查看 Qwen-Image-3.0 完整发布文章

二、模型详情

1. Qwen-Image-3.0-Pro:面向复杂视觉内容生产的图像模型

模型名称 / 版本号:Qwen-Image-3.0-Pro(qwen-image-3.0-pro

能力定位:支持文生图和图像编辑,可根据长指令生成包含复杂版面、精细文字、真实细节和专业知识的图像,也可结合参考图完成重绘、增删、批注和视觉信息重组。

2. 核心参数

参数 说明
模型标识 qwen-image-3.0-pro
任务类型 文生图、图生图 / 图像编辑
输入模态 文本、图像;图像编辑支持 1–3 张参考图
输出模态 图像,PNG 格式
指令长度 最高 4.5K Tokens
输出尺寸 总像素范围为 512 × 512 至 2,048 × 2,048;未指定尺寸时可由模型推荐
单次输出 最多生成 6 张图像
文字渲染 支持约 10 px 小字、12 种语言、20 余种字体
提示词增强 prompt_extend 默认开启;支持 direct,文生图还可使用 agent 模式
可控参数 支持反向提示词、随机种子和水印控制
在线体验 已支持
API 调用 已提供 DashScope HTTP API、Python SDK 和 Java SDK 调用方式

模型价格及最新调用限制请查看 Qwen-Image-3.0-Pro 模型详情页

三、模型能力

1. 内容丰实

复杂版面:一张图容纳多层内容

Qwen-Image-3.0-Pro 可在同一张图中安排标题、正文、图表、示意图、公式和注释等不同元素,并保持分区关系和阅读顺序。最高 4.5K Tokens 的指令容量使模型能够处理试卷、报纸、菜单、故事板和演示页等信息密度较高的任务。

在九宫格中组织安全漫画、语文、数学、医学、金融等不同类型的密集内容

画中画与界面纵深

模型支持多层嵌套的画中画内容,可在同一画面中保持设备、应用窗口、对话界面和海报等层级关系。复杂信息不再只依赖平铺布局,也可以沿视觉纵深逐层展开。

多层应用界面与海报内容嵌套生成案例

分镜与连续视觉叙事

对于短剧、广告和脚本可视化任务,模型可在统一画幅中组织多个镜头,保持人物、场景、光线和叙事节奏的连续性,便于从文字脚本快速形成可讨论的故事板。

人物、场景和镜头语言保持连续的电影感故事板

延伸阅读:查看复杂内容与版面生成的完整案例

2. 细节真实

小字、公式与纸张排版

Qwen-Image-3.0-Pro 强化了小字号文字、公式、栏线和纸张版面的稳定呈现,可用于信息图、学术页面、报纸和说明文档等需要同时保证信息密度与可读性的场景。

鲸鲨知识信息图、学术论文页面与报纸版面三组生成案例

人像与材质

模型对皮肤、发丝、织物、光影和景深等微观细节进行更细致的还原,可生成更接近真实摄影的人像与场景,同时保持画面中的招牌文字、花束和背景层次。

逆光人像、发丝、花束与街景材质的综合呈现

图像编辑与手写批注

在图像编辑任务中,Qwen-Image-3.0-Pro 可在保留原始版面与主体结构的基础上,根据指令增加手写批注、重点标记或局部内容,为教材处理、内容审阅和视觉修改提供更直接的编辑方式。

在保持教材版面与地图内容的基础上增加红色手写批注的编辑前后对比

延伸阅读:查看真实细节与图像编辑的完整案例

3. 知识厚实

多语言与多字体

Qwen-Image-3.0-Pro 支持 12 种语言和 20 余种字体,可在不同语言的海报、杂志、宣传页和界面中完成原生文字渲染。发布案例覆盖日语、韩语、西班牙语等语言,适合多地区内容生产和本地化设计。

韩语文字、人物与杂志化版面共同组成的时尚海报

从参考图到知识信息图

模型可结合输入图像与外部知识,将单一主体扩展为包含分类、结构、特征和说明文字的专业信息图。生成过程不仅改变视觉样式,也会重新组织知识结构和版面层级。

由昆虫参考图生成包含分类关系和说明文字的知识信息图的前后对比

联网信息与主题化生成

在接入联网信息后,模型可将天气等实时数据组织为完整视觉页面;也可结合艺术家、作品风格和直播界面知识,生成具有明确主题、人物关系和平台元素的内容。

将杭州天气信息整理为移动端视觉海报

结合艺术家形象、作品元素和互动组件生成的直播界面

延伸阅读:查看多语言、知识与界面生成的完整案例

四、开发接入

1. 通过 DashScope API 调用

Qwen-Image-3.0-Pro 使用 DashScope 多模态生成接口。调用时需传入模型标识 qwen-image-3.0-pro,并在请求头中配置 API Key。以下为精简的文生图示例:

01curl --location 'https://dashscope.aliyuncs.com/api/v1/services/aigc/multimodal-generation/generation' \\

02  --header 'Content-Type: application/json' \\

03  --header "Authorization: Bearer $DASHSCOPE\_API\_KEY" \\

04  --data '{
   

05    "model": "qwen-image-3.0-pro",

06    "input": {
   

07      "messages": \[

08        {
   

09          "role": "user",

10          "content": \[

11            {
   

12              "text": "生成一张竖版城市报刊亭人像摄影:午后逆光,一名年轻女性手捧橙粉色玫瑰,背景招牌写有 Il Messaggero,呈现自然发丝、花瓣和胶片颗粒质感。"

13            }

14          \]

15        }

16      \]

17    },

18    "parameters": {
   

19      "prompt\_extend": true

20    }

21  }'

完整的 API Key 获取方式、请求示例与响应结构可查看 模型 API Reference

2. 文生图与图像编辑

  • 文生图:在 content 中传入文本描述,适合海报、信息图、UI、摄影和分镜等从零生成任务。
  • 图像编辑:在同一条用户消息中传入 1–3 张参考图及编辑指令,可完成局部修改、内容增删、风格调整、批注和多图融合。
  • 复杂指令:长指令可描述版面分区、文字内容、元素位置、材质、光线和镜头关系;prompt_extend 默认开启,可使用 direct 模式,文生图还支持更精细的 agent 模式。

3. 关键调用说明

  • 输出尺寸的总像素范围为 512 × 512 至 2,048 × 2,048;未传入尺寸时,可由模型根据内容推荐。
  • 单次请求最多生成 6 张图像,输出格式为 PNG。
  • 参考图支持公网 URL 或 Base64 输入,格式包括 JPG、JPEG、PNG、BMP、TIFF、WEBP 和 GIF,单张不超过 10 MB。
  • 可通过反向提示词、随机种子和水印参数进一步控制生成结果。
  • 对可读文字、固定版面或参考图编辑要求较高时,建议在提示词中明确文字内容、区域位置、层级关系和需要保留的元素。
  • 更完整的请求参数、图像输入方式和响应结构可查看 图像生成与编辑 API 文档

五、立即体验

Qwen-Image-3.0-Pro:模型详情立即体验API Reference

Qwen-Image-3.0-Pro 现已在千问AI平台开放在线体验与 API 调用,欢迎使用。

相关文章
|
6天前
|
人工智能 API 内存技术
刚刚 DeepSeek V4.1 Flash 开启内测,1 分钟教你用上!
刚刚 DeepSeek 内测群发布了 DeepSeek V4.1 Flash 中间版本内测的消息,这次的模型采用了新的结构,原生支持多模态、能力更强、速度更快、且成本更低。
1750 9
|
10天前
|
人工智能 运维 BI
阿里云千问办公QwenWork深度解析:基于Qwen3.8,六大核心能力重构企业全自动化工作流与计费选型指南
传统AI办公工具大多停留在对话问答、文档摘要、简单文案生成层面,只能完成单点碎片化任务,无法自主拆解复杂业务流程,很难串联多工具、多文档、外部业务系统完成端到端完整工作交付。很多企业在落地AI办公的时候,需要组合多款不同工具,来回切换界面,手动复制粘贴中间结果,智能化改造落地门槛居高不下。千问办公QwenWork是整合多款智能体产品能力打造的一体化企业办公智能体平台,底层基座依托Qwen3.8大模型,打通桌面端Agent、云端Agent、企业协同Agent三种运行形态,不再局限简单问答,接收业务目标之后自主拆解任务步骤,调用各类工具,处理文档、表格、浏览器自动化、数据查询,直接输出可交付的办公
1637 2
|
11天前
|
网络协议 Linux iOS开发
【2026实测】Wireshark下载+安装+汉化+使用教程(图文版,巨详细)
Wireshark 是一款免费开源的网络协议分析工具,可实时捕获、解析并可视化数据包,助你诊断网络故障、分析通信协议(如HTTP、DNS、TCP等)。支持Windows/macOS/Linux,含中文界面,新手入门便捷。(239字)
|
7天前
|
SQL 人工智能 前端开发
QoderWake 1.0 正式发布:从桌面里的 Agent,到工作现场的数字员工
QoderWake v1.0正式发布:企业级数字员工团队平台。支持“一句话建岗”,预置10类特训岗位;Waker常驻钉钉/飞书群,@即响应、自动协作、跨任务记忆;具备定时/事件/API多触发方式与统一任务看板;已沉淀27.6万条记忆、12.3万项技能,助力组织实现人机协同增效。
770 2
|
5天前
|
缓存 测试技术 API
DeepSeek V4.1 Flash 内测接入:改个模型名即可调用(附代码)
DeepSeek V4.1 Flash 内测不用申请,base_url 不变、改个模型名就能调,9/10 到期。本文讲清接入、计费限流与多模态注意点。
769 0
DeepSeek V4.1 Flash 内测接入:改个模型名即可调用(附代码)
|
19天前
|
人工智能 自然语言处理 安全
阿里云千问办公、Qoder Teams、Qoder CN区别与选择指南:模型能力、适用场景与最新活动参考
本文聚焦阿里云2026年推出的三款自研AI办公产品,清晰拆解千问办公、Qoder Teams、Qoder CN的差异化定位与能力边界:千问办公主打职场全场景提效,支持自然语言指令一键完成PPT生成、数据分析等高频办公任务;Qoder Teams面向程序员团队,深度整合AI代码生成、团队协同与企业知识库能力;Qoder CN则专为金融、政务等强合规场景打造,实现数据不出境与VPC私有化部署。文章同步给出分场景选型指南与最新活动定价,帮助不同类型的企业按需组合产品,实现业务岗、研发岗与强合规场景的AI能力全覆盖。
3935 5
阿里云千问办公、Qoder Teams、Qoder CN区别与选择指南:模型能力、适用场景与最新活动参考
|
10天前
|
人工智能 自然语言处理 安全
阿里云AI数智鉴密:AI 生成内容如何拿到一张"防篡改的身份证"
隐形水印 + C2PA签名:让AI生成内容“持证上岗”。
1151 0
|
12天前
|
缓存 数据可视化 开发工具
DeepSeek Harness 怎么更新?dsh 更新完整指南:更新本体(npx、npm、源码)与更新插件两种方式
DeepSeek Harness 的更新分两层:本体更新(npx 自动最新、npm update -g、源码 git pull)与插件更新(插件市场点更新、命令行覆盖安装)。本文按「准备 → 更新本体 → 更新插件 → 更新后检查」四步走,覆盖新手常见疑问。
1403 1
DeepSeek Harness 怎么更新?dsh 更新完整指南:更新本体(npx、npm、源码)与更新插件两种方式

热门文章

最新文章