国产之光!阿里千问上线 Image3:4500长Token输入!

简介: 阿里Qwen-Image-3.0悄然发布,主打“实用主义”:支持4.5K token超长输入、12国语言原生渲染、10px小字精准呈现,可一次性生成九宫格知识图解、多层嵌套UI、古画修复等高难度交付级图像,真正迈向生产力工具。(239字)

昨天,阿里千问把 Image3 悄悄放出来了。

没有铺天盖地的预热。如果不是我刚好刷到官网,大概率就错过了。

图片

我没先研究参数,也没先拿一张“美女+氛围感”去夸它好看。那种题现在谁都能交卷。我更想看的是:一张图里既要很多人、又要文字;既要人物稳定、又要连续叙事;既要多语言、又要让字体各归各位。

所以老金我直接出了 5 道偏“交付题”的题目:五人剧海报、同一人九宫格、三语出版页、微电网实验页、多语言街景。

如果你也在做短剧海报、角色设定、科普长图、品牌内容,下面 5 条提示词可以直接拿走。

它们不是万能咒语,重点是把“要什么、放哪里、哪些东西不能变、哪些地方必须验收”说具体。

第一张:重做一遍《长安雨霁》,五人群像终于亮起来了

第一题我把难度放在“亮而不空”上:五个人同框,既要主次清楚,又要每个人有脸、有道具、有身份;再塞进片名和竖版海报排版。重点不是人多,而是每个人都有清晰的视觉身份。

【画面规格】
只要高亮版,不要任何暗色雨夜氛围。生成 2:3 竖版、院线级古风悬疑短剧原创概念海报,片名“长安雨霁”。五位均为虚构成年人,不用真实演员、真实影视 IP、品牌或 Logo。

【光线与场景】
场景是雨后初晴的明亮下午,不是傍晚、不是阴天、不是黑夜。天空为大面积珍珠白与浅青蓝,阳光从云后照亮古城门和所有人物面部;湿润石板路反射明亮金色日光,远处灯笼仅作暖金点缀。整体高调曝光、清透、干净、金青配色、空气感强,画面 80% 为明亮中高亮度。人物脸、衣服、城门都必须清晰明亮。

【五人群像与构图】
五位精致成年俊男美女群像必须大面积清楚可见:中央男性“沈砚”27 岁,清俊自信,墨蓝锦袍、玉色腰带,手持折起的密函;左上女性“阿绫”26 岁,黑色高马尾、青绿色轻甲披风,利落侧身;右上男性“陆峤”32 岁,挺拔、浅银灰轻甲、温和坚毅;左下女性“苏晚”28 岁,象牙白长衣,手捧透明琉璃灯;右下女性“顾夫人”40 岁,朱砂红外袍,手持展开竹简。

人物皮肤干净、发丝真实、五官有区分、服装材质精致,五人之间有自然呼应,不遮脸不撞脸,手指正常。构图像高端群像剧海报:人物占画面 70%,城门只作明亮景深背景,顶部留清晰文字区。

【图内文字】
只用简体中文:顶部“老金实验室|Qwen-Image-3.0 人物群像实测”;最大标题“长安雨霁”;副标题“雨停之后,答案才开始出现”;角色小字“沈砚|抄写官”“阿绫|夜行司探员”“陆峤|守城校尉”“苏晚|灯铺掌柜”“顾夫人|旧案证人”;右下角米白圆角纸签、深蓝细边,两行“老金实验室”“Qwen-Image-3.0 实测|第 1 题”。

【负面约束】
禁止英文、拼音、乱码、二维码、水印、深蓝黑底、暗灰雾、阴森光、暴雨夜景、黑压压背景、人物脸部大面积阴影、赛博元素、现代元素、重复人物、畸形手和文字遮脸。

Image

五个人、各自的衣服、道具、站位和海报信息都留在了一张图里,中央主角也有明确的视觉重心。这才是我想看的:它开始能接住“画一张成品”的任务,而不是只接住“画一个漂亮人物”的任务。

第二张:九宫格里,还是不是同一张脸

角色图最怕什么?第一张很漂亮,第二张就像换了演员。于是我把“身份一致性”拆成 9 个镜头:同一张脸、同一套衣服、不同表情和视角。

【画面规格】
生成 1:1 方形人物摄影联系表,3 行 × 3 列,共 9 格。整体是奶油白影棚背景、柔和侧前方自然光、日系杂志试镜卡质感;格与格之间留窄白边,不要把九格做成九个不同模特。

【固定人物身份证】
人物为虚构成年女性“林澈”:深栗色自然卷长发、轻薄空气刘海、鹅蛋脸、偏圆的深棕眼睛、自然鼻梁、豆沙色唇、右耳一枚小珍珠耳钉、白色细肩带针织背心。脸型、五官比例、发色、刘海、肤色、耳钉、服装和光线在九格中必须完全连续;不使用任何真实人物脸部。

【九格镜头脚本】
第一行:正面微笑;45 度回眸;闭眼、双手轻放胸前。
第二行:托腮望向左侧;侧身回看镜头;低头轻扶发梢。
第三行:安静望向远处;侧脸整理右耳珍珠耳钉;双手轻握发梢、正视镜头。
动作可以变化,但必须让读者一眼判断是同一个“林澈”,而不是同款妆发。

【图中文字】
顶部主标题:“同一张脸,九种镜头语言”
标题下小字:“身份一致性实测|不要把九张照片画成九个人”
右上角标识:“老金实验室|Qwen-Image-3.0 实测|第 2 题”
底部一句:“虚构成年角色|仅用于人物一致性测试”

【负面约束】
禁止明显换脸、禁止换衣服、禁止改变发长与刘海、禁止滤镜忽冷忽暖、禁止手部畸形、禁止多余文字或水印。

Image

这张我看重的不是“9 个动作”。是林澈的刘海、脸型、耳钉、衣服和光线基本没有飘,哪怕有一格是侧脸,也还能认出来。

对做虚构角色设定、短剧预热图、漫画角色卡的人来说,这比单张大头照实用得多。图中的林澈是为这次测试设定的虚构成年角色。

第三张:三种语言挤进一页,排版还能不能呼吸

很多生图模型的“会写字”,本质上是会在空白处摆一行大标题。真正的排版题,是让中文、英文、西班牙文三套文字系统共处一页,还要有图、数据卡和阅读顺序。

【画面规格】
生成 3:4 竖版高端环境科普杂志内页,主题“城市树木如何给街道降温”。采用严格 12 列栅格,米白纸张、墨绿与暖黄配色、留白充足;视觉上必须像可阅读的出版页,而不是一张满字宣传海报。

【排版系统】
页首为大标题和一行导语;中部是街道横剖面插图:左侧红砖建筑,中部一棵大树,右侧公交站与候车人;下部有半圆温度仪表和四张数据卡。
正文严格分为三列:
左列是中文摘要,中文宋体/明朝体气质;
中列标题“English brief”,英文衬线字体;
右列标题“Resumen en español”,西班牙文现代无衬线体。
三列各在自己的网格内,不要互相串行,不要把英文直接伪装成中文。

【必须出现的信息】
主标题:“树荫不是装饰,是一台城市降温机”
温度仪表清晰写:“树荫下 31℃”与“无树荫 42℃”
剖面标注包括:“透水铺装”“遮挡直射”“蒸腾散热”“可停留的阴影”
底部数据卡依次为:“树冠覆盖”“地表反射”“步行停留”“雨水下渗”
右上角:“老金实验室|Qwen-Image-3.0 实测|第 3 题”
正文长段落可用占位排版感,但标题、温度、卡片标题必须清晰可读。

【负面约束】
禁止把三种语言混成乱码,禁止让图示压住正文,禁止密集装饰,禁止把杂志页画成 PPT,禁止凭空增加品牌 Logo。

Image

成图里,三种语言各占一列,树、街道、公交站和温度表也没有把正文彻底挤死。它已经懂得“内容不是越多越好,要有位置关系”。

这类图最有价值的地方,是先把标题层级、插图位置和信息密度定下来。原来靠文字描述半天的版式方向,现在一张图就能让团队对齐。

第四张:一页微电网实验图,公式、曲线和表格都要对上

前三题主要在压文字、人物和版式。第四题我换成工程信息图:不仅要画光伏、电池、负载,还要让功率流向、公式、曲线和 8 个时间节点在同一页里对得上。

【任务】
生成一张 16:9 横版、大学工程实验室墙报风格的中文“微电网功率平衡实验页”。它是一页信息密度极高但可阅读的学术工程说明页,不是海报。顶部标题逐字写“午后两小时:一套微电网怎样不掉电”;副标题写“用一张图看懂光伏、储能、负载与功率缺口”。右上角米白圆角纸签、深海军蓝细边,逐字两行“老金实验室”“Qwen-Image-3.0 实测|第 4 题”。

【严格布局】
左栏 25% 为“实验对象”,中栏 50% 为“功率流主图”,右栏 25% 为“公式与结论”;底部贯穿全宽的时间序列表格。左栏画三个实物等距小模型:屋顶光伏板、灰色电池柜、小型咖啡机与照明负载;每个有中文标签“光伏阵列”“磷酸铁锂储能”“楼宇负载”。

中栏画母线、双向变流器和四条彩色功率箭头,箭头标签准确写“光伏输出”“电池放电”“负载消耗”“并网补偿”;箭头方向不能错误。

【公式与结论】
右栏白底公式卡必须准确分四行显示:
“P负载 = P光伏 + P电池 + P电网”
“E(t) = E₀ + ∫ P电池(t) dt”
“SOC = E当前 / E额定 × 100%”
“当 SOC < 20% 时,优先削减非关键负载”
另有“实验结论”框写“先守住照明与通信,再谈舒适负载”。

【时间表与数据】
底部从 13:00 到 15:00 画 8 列等宽时间表:表头“13:00”“13:15”“13:30”“13:45”“14:00”“14:15”“14:30”“15:00”。三行数据标题为“光伏功率”“负载功率”“电池SOC”;光伏依次“3.2kW、3.6kW、3.8kW、3.4kW、2.9kW、2.1kW、1.4kW、0.8kW”;负载依次“2.6kW、2.8kW、3.1kW、3.7kW、4.0kW、3.8kW、3.3kW、2.9kW”;SOC 依次“68%、70%、72%、69%、61%、53%、44%、35%”。
在表格上方加一条曲线,蓝线代表光伏、橙线代表负载、绿线代表 SOC,附图例。采用象牙白、深蓝、信号橙、低饱和绿色,工程绘图清晰,微小文字清楚。

【负面约束】
禁止英文、乱码、伪代码、真实企业 Logo、二维码、水印、错误数学符号、错误单位和拥挤重叠。

Image

这张图真正考的是“关系别错”。

你能看到光伏、电池、负载和公共电网之间的方向;右边的功率平衡式、底部曲线和 13:00—15:00 的表格也都挂在同一张工程页上。

这类提示词的用处,不在于替代工程计算,而在于把团队开会时分散在口头、表格和 PPT 里的关系,先做成一张能共同校对的视觉草图。

第五张:让文字真的长在街景里

最后我故意没做一张白底信息图,而是把多语言、多字体扔进真实街景。因为真正难的不是把几行字写出来,而是让它们分别像木匾、霓虹、海报、玻璃窗贴和花卡上的字。

【画面规格】
生成 16:9 横版写实摄影风雪后北京胡同街景。青砖与红墙被薄雪覆盖,路面有湿润倒影,暖色灯笼照亮两个相邻店铺;中景是一对穿长大衣的成年男女,前景可见自行车和小雪人。整体明亮、温暖、生活化,不要赛博朋克,不要商业广场。

【左店:字体与印刷工作室】
深蓝木匾金色书法:“雪后字铺”
橱窗竖排中文宋体:“字体|纸张|装帧”
一张英文衬线海报:“Letters hold a little weather.”
门口黑板:“欢迎进来,慢慢读”

【右店:花艺与多语言贺卡店】
黑底花瓣立体字:“花语贺意”
玻璃暖白霓虹:“文字会开花”
法文花卡:“La neige garde nos mots.”
日文小卡:“ことばの花束”
西班牙文立牌:“Palabras en flor”
花环中央小牌:“多语种排版实验”

【署名与排版要求】
雪人前的小黑板必须写:“老金实验室|Qwen-Image-3.0 实测|第 5 题”
不同语言分别匹配不同字体和材质:书法在木匾、宋体在竖幅、英文在纸海报、霓虹字在玻璃、花卡文字在纸张上。文字不能漂浮在空气里,不能彼此串行或遮挡人物。

【负面约束】
禁止所有招牌使用同一种字体,禁止错别字密集堆叠,禁止移除雪人、禁止把胡同改成现代商场、禁止出现无法辨识的大面积乱码。

【图 5|老金自测:雪后字铺多语言多字体】

Image

这一张是我最满意的。它知道:木匾该是书法,橱窗竖幅该更克制,霓虹有发光感,花卡应该细小轻一点。文字不再只是压在图上的一层贴纸。

如果你在做门店海报、活动主视觉、节日内容,这类写法很值得存一下:先列出文字的落点和材质,再规定语言和字体气质。不要只写“图上有中英日韩文”,那等于把排版权交给随机数。

官网再补 5 组:不重复老金 1—5,专挑另一条能力线

前面 5 张“老金实验室”图,已经把群像、角色一致性、连续故事、多语种版式和街景文字测了一遍。官网这 5 组我刻意换了方向:图像编辑、古画修复、仿真界面、研究配图、实时信息图。

为了让你能直接理解每张图在测什么,下面的提示词是我根据官网公开案例任务整理出的复现写法;每一条都紧贴对应的官方图,不和老金实测混用。

官网案例一:在真实书页上做“老师批注”

基于输入的一页中文小说书页照片进行编辑。保持原有纸张纹理、印刷字体、页码、版心、地图和书脊完全不变。在正文上方加入自然的红色手写标题“游历路线图:行旅艰辛与信念支撑”;对关键句做红色下划线、波浪线、圈画和箭头批注,手写评语包括“誓友践诺”“人物精神:重诺守信”“总领下文艰难处境”“信义可贵”“路线梳理”。在下半页中国旅行路线图上,用红笔箭头标出行进方向,圈出关键地点;批注要像认真做语文阅读笔记的真实手写字,保留笔压、停顿、轻微不规则和纸张透视,不要覆盖原有印刷内容。

ImageImage

它不是重画一张读书笔记,而是在原来的纸张、地图和印刷字上做增量编辑。对教辅、课程内容和知识博主来说,这条能力线特别实在:一张普通资料页,直接就能变成讲解页。

官网案例二:把破损古画补回原来的气韵

基于输入的传统水墨立轴古画进行修复。保留原作竖幅构图、题字、印章位置、纸本底色、墨色层次和原有笔触。去除画面中的霉斑、虫蛀孔、白色剥落、横向裂痕和纸张破损;补全柳枝、飞鹰、枯枝与留白区域中缺失的笔墨。修复部分必须延续原作水墨渐变、干湿笔变化和宣纸渗化质感,不增加现代元素,不改变原作的构图和时代气息。

ImageImage

这组和前面的“从文字生图”完全是两件事。它考的是看懂已有画面,再顺着同一套笔墨继续画下去。老画修复、档案整理、文博内容二创,终于有了一个可以聊的方向。

官网案例三:一句话生成可用的仿真开发界面

生成一张 16:9 横版桌面端 Python IDE 界面截图,深色主题、真实开发环境质感。
顶部菜单包含 File、Edit、View、Navigate、Code、Refactor、Run、Tools、VCS、Help;左侧是 ml_project 项目树,包含 src、features、models、utils、notebooks 等目录。
中央打开 feature_engineering.py,展示 pandas、numpy、sklearn 导入,包含 load_data、impute_features、scale_features 等函数;底部打开 Python Console,显示数据加载、缺失值填补、标准化和训练集/测试集 shape 日志。
代码配色、行号、文件标签、警告提示、终端文本与窗口层级都要符合真实 IDE 的视觉逻辑。

Image

官网在文章里把它归到“仿真 UI”能力。这个方向跟做海报完全不同,它更适合把产品故事、教程步骤、技术方案放进一张一眼能看懂的工作界面里。

官网案例四:一张昆虫照片,扩成研究级图版

以输入的豆娘微距照片为主体,生成一张深色学术研究图版。保留原始昆虫姿态、叶片和主体细节。左侧排版分类学信息、属种名称、形态诊断、分布与栖息地文字;在昆虫身体上用细线标注复眼、胸部条纹、翅膀、腹部等结构。右侧制作 4 个圆形局部放大视图,分别展示头部、胸部、翅脉和尾部;加入毫米比例尺、雌雄色带对照和图版编号。整体是自然史博物馆或科研期刊图版风格,文字、标线、比例尺和原始照片保持清晰有序。

ImageImage

这组最能说明“世界知识”不是一句空话:一张自然照片,被组织成分类、形态、局部放大和比例尺都有位置的研究图。做科普、教育、展览的朋友,应该很容易想到怎么接进自己的素材库。

官网案例五:把当天信息变成一张天气游览导览

生成一张 9:16 竖版“杭州天气与游览指南”,日期为 2026 年 7 月 21 日,整体为淡青蓝水墨旅游导览风。顶部大标题“杭州天气与游览指南”,中央天气卡突出“26℃~34℃”“小到中雨”,并加入气温曲线、东南风、相对湿度、紫外线等信息。中部以四张卡片推荐西湖、灵隐寺、清河坊街、西溪湿地;底部给出 08:00、11:00、14:00、17:00 的一日游览路线,并用雨具、薄外套等图标呈现出行建议。信息层级清楚、文字与水墨场景结合自然,整张图像一份可直接阅读的旅行天气导览。

Image

这张很有意思:它不是单纯画一个江南场景,而是把日期、天气、路线、景点和出行建议揉成一份当天能读的导览。复杂视觉任务的终点,就是这种“信息已经被组织好”的成品感。

上述 5 组的图片与案例说明均来自 Qwen-Image-3.0 官方博客。

我最后的判断

这一轮测下来,我觉得 Image3 的进步不只是“画面更精致”。

它开始能把复杂提示词拆成几个互相配合的部分:谁在画面里、谁拿什么、文字落在哪、故事往哪走、什么东西绝对不能变。以前很多时候,你是在向模型许愿;现在更像把一份要求不算低的视觉 Brief 递过去,等它给你一张完整的方案。

这两件事差很多。

前者是抽卡,后者才有机会进入工作流。

不过我还是那句话:你交代得越具体,它越像个能帮你起稿的设计同事;把交付物、信息层级和画面关系写出来,它就能更快进入你的创作流程。


谢谢你读我的文章。
如果觉得不错,随手点个赞、在看、转发三连吧🙂
如果想第一时间收到推送,也可以给我个星标⭐~谢谢你看我的文章。

开源知识库(交流群,开源集合都看这):
https://tffyvtlai4.feishu.cn/wiki/OhQ8wqntFihcI1kWVDlcNdpznFf

相关文章
|
2天前
|
人工智能 JSON 安全
|
2天前
|
云安全 人工智能 安全
|
4天前
|
人工智能
Qwen3.8抢先体验!正式版即将发布并开源!
千问Qwen3.8即将开源,参数达2.4T,进化速度以“天”计,实力媲美Fable 5。预览版Qwen3.8-Max已上线阿里Token Plan等平台,限时优惠:日间Credits低至1折,夜间更优,个人/团队版月付仅35元起!
561 21
|
3天前
|
人工智能 自然语言处理 数据挖掘
Qwen3.8-Max 预览版全解析:2.4 万亿参数旗舰模型,Token Plan 限时优惠指南
Qwen3.8-Max-Preview是通义千问Qwen3系列旗舰MoE大模型,参数达2.4万亿,综合推理能力居行业第一梯队。支持思考/快速双模式,擅长大模型五大高难场景。现于阿里云百炼Token Plan、Qoder及QoderWork上线体验,个人版低至39元/月。在阿里云百炼官网:https://t.aliyun.com/U/fPVHqY 免费领取千万Tokens
459 1
Qwen3.8-Max 预览版全解析:2.4 万亿参数旗舰模型,Token Plan 限时优惠指南
|
2天前
|
人工智能 测试技术 语音技术
Qwen-Audio-3.0-TTS 正式发布!AI 语音从 “能说话” 升级到 “会带情绪表达”
阿里云发布Qwen-Audio-3.0-TTS语音合成大模型,支持细粒度标签控制(如[gasp][angry])、freestyle自由风格、16种语言及20种方言,声学鲁棒性强。含Flash(首包延时300ms)和Plus(全球榜单冠军)双版本,已在百炼平台开放调用。在阿里云百炼官网:https://t.aliyun.com/U/fPVHqY 免费领取千万Tokens
493 0
|
9天前
|
缓存 UED 开发者
Codex109天重置23次,明天还要再送一次
Codex近109天完成23次额度重置,7月14日将迎来第24次。Tibo高频响应用户反馈:优化GPT-5.6高消耗问题、补发失效福利、调整重置时间——形成“反馈→回应→修复→补偿”正向闭环,彰显以用户为中心的产品哲学。(239字)
844 12
|
2天前
|
人工智能 自然语言处理 数据挖掘
最新版通义千问(Qwen3.8-Max-Preview)功能介绍
2026年,通义千问正式推出全新旗舰级大模型 **Qwen3.8-Max-Preview 预览版**,作为首款突破万亿参数规格的新一代基座模型,该模型总参数量达到**2.4万亿**,采用全新迭代的MoE混合专家架构,综合推理性能、长文本处理、多模态理解、复杂任务规划能力全面超越前代Qwen3.7-Max版本,整体实力跻身全球第一梯队,可对标海外顶级旗舰模型,是当前面向复杂工程开发、多智能体协同、超长文档解析、专业办公自动化场景的最优国产基座模型。
606 0
|
13天前
|
存储 人工智能 JSON
Qwen 本地部署搭配 ComfyUI 生成 AI 漫剧完整实操指南(小白零基础可落地,零成本无限生成+角色一致性天花板)
2026全网最优本地漫剧流水线:零成本、离线运行、角色统一、低配(8G显卡)可跑。融合Qwen本地大模型+ComfyUI双引擎,实现剧本生成→分镜绘图→动态成片全自动,隐私安全、无审核限流,新手30分钟上手,日更无忧。(239字)