千问最新图像基座模型,正式发布!

简介: 阿里巴巴发布Qwen-Image-2.0:全球领先的图文多模态模型,支持1K token长文本与2K高分辨率,集图像生成与编辑于一体,在AI Arena评测中生图/编辑分列全球第三、第二。中文文字渲染精准,已开放API邀测及Qwen Chat免费体验。

刚刚,阿里巴巴正式发布新一代图像生成及编辑模型Qwen-Image-2.0。该模型支持1K token的超长文字输入和2K高分辨率,可准确渲染复杂指令。

作为千问大模型的图像生成模型底座,Qwen-Image-2.0集生图和编辑于一体,在AI Arena文生图评测中斩获1029分,位列全球第三。

目前,阿里云百炼上已开通API邀测,开发者也可直接通过Qwen Chat(https://chat.qwen.ai/)免费体验新模型。

集图像生成与编辑于一体

Qwen-Image-2.0在Qwen-Image和Qwen-Image-Edit两大模型基础上全新升级,首次将图像生成和编辑统一到一个模型中去,以更轻量的模型架构,实现了生图和改图性能的大幅提升。

根据提供图片(图左)

生成一个九宫格带不同拍照姿势的组图(图右)

性能方面,在AI Arena评测中,Qwen-Image-2.0在图像生成中得分1029,位列第三;在图片编辑中得分1034,仅次于Nano Banana Pro。

输入提示词大幅拓展,可实现复杂任务

Qwen-Image-2.0将输入提示词扩展到1K token,可详尽描述任务,实现更专业的文字渲染,轻松拿捏专业PPT、高级海报、多格漫画等复杂图片。

比如以小楷字体几近完全渲染《兰亭集序》数百字的全文配图,以自然语言生成论文格式配图的复杂PPT等,根据超市环境生成现实风格的超市商品海报等。

文字渲染更优,生图应用场景更丰富

基于模型架构与性能的全新升级,Qwen-Image-2.0生图质感尤为细腻,小至老人皱纹的褶皱,大到浩然宇宙,模型生成的人物、自然、建筑等常用图片都极其逼真。

其中,在中文汉字渲染方面,Qwen-Image-2.0表现极为突出,不但可以以多种字体准确渲染汉字,而且写得又多又准,效果比 Nano Banana Pro更优。

同时,用户也可上传数张图片进行编辑,生成诸如九宫格多手势自拍、全景式人物图像拆解、多种创意风格造型,以及诗词配图等。

根据提供图片(图左)

生成全景式人物概念拆解(图右)

根据提供图片(图左1)

稳定生成不同创意风格图片(图左起2、3、4)

基于全新的Qwen-Image-2.0模型,用户还可与AI协同创作出更丰富、更实用的图片。

比如一句话生成杭州两日旅游攻略图,写实风格的商品海报,极为逼真的绿色丛林,4x6的多格漫画组图,儿童绘本图等。

/ END /



来源  |  阿里云公众号

相关文章
阿里发布 Qwen-Image-2.0,实测复杂插画生成,手绘细节还原度很高!
阿里千问Qwen-Image-2.0刚发布即实测!我们用其生成视频封面,精准还原“手绘风格+颜色编码+精细布局”。提示词含标题、图标、配色与排版要求,效果惊艳。现可通过chat.qwen.ai免费体验!
|
25天前
|
缓存 人工智能 API
阿里云Qwen3.8‑Flash 大模型解析:百万上下文MoE、多模态能力、API实战与企业落地指南
2026年,通义千问正式推出Qwen3.8‑Flash多模态大模型,作为Qwen3.8系列面向高效推理打造的旗舰版本,该模型采用稀疏混合专家MoE架构,把长上下文处理、多模态理解、工具调用能力融为一体,原生支持最高100万Token上下文窗口,能够完整读取超长业务文档、完整代码仓库、长时间会议视频,一次性完成信息解析、摘要、推理与生成任务。
566 4
|
7月前
|
人工智能 自然语言处理 前端开发
借助 AI Coding 快速打造 AI Agent 系统
本项目构建了基于LangGraph的购物场景生成AI Agent,通过Agent Skills模块化技能、Planner智能规划及A2A+MCP标准化协议,实现从自然语言一键生成结构化场景、智能匹配商品并对接会场搭建。借助AI Coding工具,数天内完成低代码到高扩展架构的跃迁,显著提升运营效率与系统可靠性。
借助 AI Coding 快速打造 AI Agent 系统
|
6月前
|
人工智能 自然语言处理 文字识别
阿里云AI产品免费试用:7000万Tokens+30款产品零成本体验!
阿里云推出“AI免费试用”活动:新用户享7000万Tokens、100张图+50秒视频生成额度,覆盖通义千问Qwen3、万相2.6等30+款AI产品。零门槛开通即用,支持Agent搭建、代码生成、NLP/视觉智能等全场景实践,助开发者低成本启航AI应用开发。
2558 7
|
7月前
|
存储 人工智能 Docker
OpenClaw进化指南:阿里云+Windows本地部署+EvoMap自进化配置,让AI Agent学会自我成长
2026年是AI智能体的爆发元年,OpenClaw(原Clawdbot/Moltbot)凭借开源可控、全场景适配的特性成为现象级AI工具,但多数用户仍停留在“手动配置技能、重复调试问题”的初级阶段,殊不知通过EvoMap这个GitHub神器,能让OpenClaw实现**协议约束下的自主进化**——像人类一样复刻优质技能、自主优化能力,甚至形成独有的“数字人格”。
2427 8
|
9月前
|
机器学习/深度学习 人工智能 自然语言处理
Z-Image:冲击体验上限的下一代图像生成模型
通义实验室推出全新文生图模型Z-Image,以6B参数实现“快、稳、轻、准”突破。Turbo版本仅需8步亚秒级生成,支持16GB显存设备,中英双语理解与文字渲染尤为出色,真实感和美学表现媲美国际顶尖模型,被誉为“最值得关注的开源生图模型之一”。
5883 9
|
11月前
|
测试技术
哪里不对改哪里!全能图像编辑模型Qwen-Image-Edit来啦
Qwen-Image-Edit基于20B Qwen-Image模型,融合视觉语义与外观控制,支持中英文文字精准编辑、风格迁移、IP创作等多重功能,具备SOTA性能,助力低门槛、高精度图像编辑。
4565 23
|
6月前
|
人工智能 运维 监控
你的 AI Agent 真的在受控运行吗?
以 OpenClaw 为案例,从行业威胁态势与运行时防护的固有局限出发,系统拆解 AI Agent 可观测体系的设计方法论:通过 Session 审计日志、应用日志与 OpenTelemetry 遥测三条数据管道,构建行为审计、威胁检测、成本管控与运维观测的完整闭环。
你的 AI Agent 真的在受控运行吗?
|
7月前
|
人工智能 自然语言处理 搜索推荐
适时性智能 AI:AI 建站的协作式共创新模式
适时性智能AI是一种以动态引导、即时响应、渐进优化为核心的新型交互理念,摒弃“一次性完美交付”,转为“协作伙伴”,在用户需求从模糊到清晰的过程中提供精准支持,显著降低建站门槛,提升共创效率与个性化水平。
355 4

热门文章

最新文章