Nano Banana 2.1 九种实战用法:从多图一致性到"养图",附完整提示词

简介: JeecgBoot AI专题研究 把 Nano Banana 2.1 用到实处:九个场景、提示词模板与选型建议![Nano Banana 2.1 九种实战用法](https://oscimg.oschina.net/oscnet/up4d3e83dbda26d53ea8f864a94c9e7eb

JeecgBoot AI专题研究 | 把 Nano Banana 2.1 用到实处:九个场景、提示词模板与选型建议


Nano Banana 2.1 九种实战用法

写在前面:Flash 的价格,Pro 的能力

2026 年 10 月 6 日,Google 发布了 Nano Banana 2.1。名字只多了个小数点,底座却换成了 Gemini 3.6 Flash,思路也很明确:把以前只有 Pro 级模型才稳得住的能力——多参考图一致性、复杂局部编辑、文字海报——下放到 Flash 的成本和速度上。

先把几个关键参数放在一起:

项目 规格
底层模型 Gemini 3.6 Flash
分辨率 1K / 2K / 4K
极端宽高比 1:4、4:1、1:8、8:1
参考图上限 14 张(最多 4 个角色 + 10 个物体)
官方 API 单价 1K 约 $0.0336,2K 约 $0.0504,4K 约 $0.0756

价格大约是前代的一半,这是它最实在的卖点。

但也别急着"全面切换"。从独立评测和 Arena 社区数据来看,它和 OpenAI 的 GPT Image 2.5(尤其是高质量的 Sunburst 版本)各有长处,更像是一对互补的选手。本文按场景拆成九种用法,每种都给出可直接复制的提示词和使用边界,最后再讲怎么选。

说明:文中示例图是按对应提示词生成的参考效果,用来直观展示提示词的结构和写法,实际效果以你在 Gemini 中跑出来的为准。

用法一:多参考图一致性,让角色不再"换脸"

画连载漫画、做品牌 IP、拉故事板,最怕的就是同一个角色跑几轮之后五官、发型、衣服全变样,后期一张张修。

Nano Banana 2.1 在这方面进步很大。它最多能吃进 14 张参考图,Google 内部的"多角色一致性"评测拿到了 1106 分,超过了自家前代和 Pro 版本。实际用法是:把角色设定图、三视图、服装细节一起喂进去,然后让它在同一场景下出不同动作、表情和构图。

A young woman with short auburn hair, wearing a denim jacket and olive cargo pants. Keep her face, hairstyle, and outfit exactly the same as in the reference images. Show her walking through a rainy city street at night, holding a folded umbrella.

这条提示词的骨架只有一句话:"保持 XX 完全不变,只改变 YY。" 前半句锁住身份,后半句给出新情境。

和 GPT Image 2.5 比,Nano Banana 2.1 的优势在"多角色、多物体、大批量"这个维度——便宜、快、能并发;GPT Image 2.5 则在单张图的角色高保真上更强。漫画分镜、系列 IP 图这类要出几十上百张的活,前者的性价比明显更高。

用法二:中英双语文字海报

这一代的文字渲染是肉眼可见的提升。Google 内部"信息图设计"评测拿到 1048 分,"信息图事实性"为 0.521——后者意味着它不仅能把字摆对地方,还能借助知识把内容写对。

下面这条咖啡馆秋季菜单海报的提示词,写法值得直接套用:

A portrait poster for a neighborhood café's autumn menu launch. Warm illustrated style with a steaming ceramic cup, cinnamon sticks and scattered maple leaves on a deep burgundy background. Render this headline exactly once, in large cream serif lettering across the top: "Autumn Menu". Directly below it, in smaller cream lettering: "Menú de otoño". Along the bottom edge, in small clean sans-serif: "From October 10". Keep all text crisp and evenly spaced, with generous margins. No other text, no logos, no watermarks.

双语文字海报参考效果

拆开看,它做对了四件事:

  1. 每段文字都用引号原样写出;
  2. 每段文字都指定了位置、字号和字体风格;
  3. 用 exactly once 防止标题被重复渲染;
  4. 结尾 No other text 堵住了模型"自由发挥"乱加字的口子。

用法三:科普信息图

信息图是 Nano Banana 2.1 很适合的场景,教育内容、科普账号、课程讲义都用得上。

A clean educational infographic titled "How a seed becomes a tree", landscape orientation, white background. Show five stages connected by curved arrows: seed in soil, germination, seedling, young sapling, mature oak tree. Label each stage with one short phrase in dark green sans-serif text. Under the oak, add a small labeled detail of an acorn. Flat illustration, soft greens and browns, plenty of white space, every label large enough to read at a glance.

科普信息图参考效果

写信息图提示词的要点是先定结构、再定标签:几个阶段、用什么连接、每个标签多长、什么颜色,越具体越稳。

需要提醒的是,小字、长段落、复杂字体和精密排版仍然是它的弱项,这方面 GPT Image 2.5 的 Sunburst 版本更可靠。当信息图里的实体和关系一多,比如要画一张人物关系网,它就容易把关系连错、标注写乱。所以:日常信息图、社媒海报、讲义配图放心用;品牌包装、高精度印刷海报,还是交给更重的模型。

用法四:超宽横幅与全景图

1:4、4:1、1:8、8:1 这些极端比例都能直接出图,是 Nano Banana 2.1 的一大亮点。下面是一条 8:1 网站横幅的提示词:

An 8:1 website banner for a handmade ceramics studio. A long wooden shelf runs the full width of the frame, holding a row of glazed bowls, vases and mugs in sage, sand and speckled white. Soft morning light falls across the shelf from a window at the far end. Place the text "Made by hand, fired with care" in thin charcoal serif lettering on the plain wall above the center of the shelf. Calm, minimal, photographic.

超宽横幅参考效果(21:9 版本)

适用的地方很多:

  • 网站 banner、电商首页轮播图
  • 视频封面、社交媒体长图
  • 全景场景概念图

以往的模型画极端比例时,常见"中间饱满、两边崩坏"——两侧要么重复、要么拉伸变形。写这类提示词时,可以像上面那样安排一个贯穿全宽的主体(一整排货架),让模型有理由把画面两端填满,而不是只在中间堆元素。

用法五:只换一个物体

很多时候我们并不想重画整张图,只想"把花瓶换成玻璃瓶"。以前得进 Photoshop 慢慢抠,现在一句话就行。Nano Banana 2.1 支持蒙版编辑和涂鸦编辑,Google 内部这项评测得分 1049,表现相当稳定。

Replace the white ceramic vase on the dining table with a small glass bottle holding a single sprig of eucalyptus. Keep the table, the chairs, the window behind them, the lighting and the camera angle exactly as they are. Match the new bottle's shadow and reflections to the existing light.

注意最后一句:让新物体的阴影和反光匹配现有光源。不写这句,换上去的东西很容易像"贴"上去的。

用法六:换装但保住身份

Change only this character's outfit to a yellow raincoat, dark green rubber boots and a striped scarf. Keep the face, hairstyle, expression, body shape and the background unchanged. Turn the character slightly toward the camera with one hand raised in a wave, so the new pose differs clearly from the original.

这里多了一个技巧:明确要求新姿势和原图有明显区别。如果只说换衣服,模型有时会输出一张几乎和原图一样的图,只把颜色改了改。

用法七:涂鸦圈选,指哪改哪

有些位置用文字很难描述清楚,那就直接在图上画个红圈:

Inside the area circled in red, add a tall potted fiddle-leaf fig in a woven basket. Match the plant's lighting and shadow to the rest of the room. Remove the red circle and leave everything outside it unchanged.

别忘了 Remove the red circle,否则红圈可能会被当成画面的一部分保留下来。

用法五到七其实是同一个公式:

只改 A,保持 B、C、D 完全不变。

模型最怕的是你只说"换个花瓶",结果它把整张图都动了。把"保持不变"的部分逐项写出来,成功率会高很多。

但也要清楚边界:在长链路、多轮次的精细编辑上,GPT Image 2.5 的细节保留和迭代稳定性仍然更好。社区也反馈过 Nano Banana 2.1 连续编辑多轮后会出现噪点、偏色。所以它更适合"一次或少数几轮"就能搞定的局部修改,遇到要来回抠十几遍的活,每次都从原图出发会更安全。

用法八:产品摄影与多图融合

做电商和广告的同学重点看这一节。核心观点就一个:别再堆关键词了,用完整的句子把场景讲清楚。

单图产品摄影:

A high-resolution, studio-lit product photograph of a speckled cream ceramic pour-over coffee dripper standing on a pale travertine block. Soft window light from the left casts a long, gentle shadow to the right; the background is a warm sand-coloured plaster wall. The camera angle is a slightly elevated 30-degree shot that shows the spiral ridges inside the cone. Ultra-realistic, with sharp focus on the glaze speckles.

产品摄影参考效果

一条合格的产品摄影提示词,至少要回答五个问题:光从哪来、影子往哪投、背景什么材质和颜色、机位多高多少度、焦点落在哪。

多图融合——把第一张图的产品和第二张图的 logo 合在一起:

Take the speckled ceramic coffee dripper from the first image. Add the circular KILN & CO logo from the second image to the front of the dripper as a small stamp pressed into the clay, in dark brown underglaze, following the curve of the cone. Ensure the dripper's shape, glaze speckles, the travertine block, the lighting and the background remain completely unchanged.

这里的细节是 logo 的"呈现方式":不是贴一个平面图标,而是"压印在陶土上、用深棕色釉下彩、顺着锥面弧度"。描述越贴近真实工艺,合成出来越不像 P 上去的。

这个用法对电商很实用:同一款产品出不同 SKU 变体、做品牌定制展示,都不用重新拍。

用法九:多轮对话,把一张图"养"出来

最后一个用法很适合不想一次写几百字提示词的人:先出一张基础图,再一轮轮加细节,模型会记住上下文。

第一轮,基础图:

A cozy reading corner in a sunlit apartment: a mustard yellow armchair, a tall brass floor lamp, a low stack of books on the floor and a large window with sheer curtains. Morning light, warm and soft, photographic, 4:5 frame.

多轮迭代的基础图

第二轮,换季节:

Keep the room, the furniture and the camera angle exactly the same. Change the view through the window to a snowy winter street, and add a knitted gray blanket draped over the arm of the chair.

第三轮,加细节:

Keep everything from the previous image. Add a steaming mug of hot chocolate on the stack of books and a small string of warm fairy lights along the top of the window frame. Switch the lamp on so it glows softly.

每一轮都以"保持……不变"开头,只追加一两处改动。这样比一次性写一大段提示词更容易控制,也更容易定位是哪一步出了问题。结合前面提到的连续编辑劣化问题,建议控制在三轮以内,每轮都保存一份。

怎么选:Nano Banana 2.1 还是 GPT Image 2.5

两种模型的定位对比

场景 优先选择
大批量日常出图,成本敏感 Nano Banana 2.1
多角色、多产品一致性 Nano Banana 2.1
信息图、教育图、需要事实性的内容 Nano Banana 2.1
超宽幅、全景图 Nano Banana 2.1
快速多轮对话迭代 Nano Banana 2.1
在 Gemini 生态内免费或低成本使用 Nano Banana 2.1
极高精度文字、小字、复杂排版 GPT Image 2.5(Sunburst)
高保真人像、人脸一致性 GPT Image 2.5(Sunburst)
长链路精细编辑 GPT Image 2.5(Sunburst)
最终商业交付、预算充足 GPT Image 2.5(Sunburst)

一句话:日常、快速、多参考,用 Nano Banana 2.1;最终交付级的文字和复杂编辑,用 GPT Image 2.5。

如果你在做带图片生成的业务系统,比如在低代码平台里搭商品管理、营销物料这类应用,也可以把两者组合起来:批量初稿和变体走 Nano Banana 2.1,人工挑出来的少量终稿再交给 GPT Image 2.5 精修。成本能压下来,质量也有保障。

提示词速查清单

  1. 用完整句子描述场景,少用关键词堆砌;
  2. 文字内容放进引号,同时写清位置、字体和大小,结尾加一句"不要其他文字";
  3. 编辑时逐项写出不变的部分:只改 A,保持 B、C、D 完全不变;
  4. 新加的物体要求匹配光影,否则容易有贴图感;
  5. 文字多、布局复杂时,用 2K / 4K 分辨率,并把 Thinking 调到 medium 或 high;
  6. 善用多轮对话,但控制轮数、每轮存档。

总结

Nano Banana 2.1 的价值不在于某一项指标碾压对手,而在于它把接近 Pro 级别的一致性、编辑能力和文字海报能力,带到了 Flash 级别的价格和速度上。对内容创作者、电商运营、设计师和老师来说,这意味着以前要用更贵的模型才做得出来的图,现在可以更便宜、更快地批量做。

它当然不是万能的。最高精度的文字排版、最严格的人像保真、最长链路的多轮编辑,GPT Image 2.5 依然更稳。把两者看成"效率型"和"精工型"的分工,按场景搭配使用,才是最划算的做法。


本文为 JeecgBoot AI 专题研究系列文章。

目录
相关文章
|
19天前
|
人工智能 JSON API
全网刷屏的 Jev 模型正式开放!一手实战测评 + 保姆级教程
全网爆火的 Jev 模型是什么?有什么用?怎么使用?怎么接入 AI 编程工具?效果真的好么?傻子可懂的 Jev 保姆级实战教程 + 项目实战测评来啦
8783 25
|
17天前
|
人工智能 并行计算 PyTorch
秋叶 ComfyUI 2026 整合包 v3.2 完整部署教程:Python 3.13 + Torch 2.13 全栈升级
秋叶aaaki ComfyUI 2026年8月整合包v3.2正式发布!全面升级Python 3.13.11、PyTorch 2.13.0+cu130及ComfyUI v0.30.2,原生支持MiniMax H3、Wan 2.2、Qwen-Image-2.1等2026主流音视频/图像模型,解压即用,无需环境配置。
3344 15
|
17天前
|
人工智能 测试技术 API
最近全网爆火的 Jev 到底是什么?适合干什么、怎么用,一篇讲透!
Jev是TypeSafe AI推出的“系统一模型”,不生成文本,专做毫秒级结构化决策:Choice(多选)、Score(打分)、Noul(是非概率)。响应快193倍、成本低444倍,适合工单路由、内容审核、测试定级等高频判断场景。
2194 4
最近全网爆火的 Jev 到底是什么?适合干什么、怎么用,一篇讲透!
|
11天前
|
人工智能 Linux 开发者
【2026国内使用】Codex安装过程一篇讲透(Win/Mac/Linux全支持)
Codex是OpenAI推出的AI编程智能体,可读取本地项目、理解需求并自动修改代码。支持桌面GUI、命令行(CLI)及VS Code/Cursor插件三种形态,覆盖可视化操作、终端高效开发与编辑器无缝集成场景,助开发者用自然语言驱动编码全流程。(239字)
【2026国内使用】Codex安装过程一篇讲透(Win/Mac/Linux全支持)
|
17天前
|
云安全 人工智能 安全
|
3天前
|
人工智能 JSON 自然语言处理
2026 年 Jev 决策模型深度拆解:原理解读、实战测评与保姆级落地教程
有一款特殊AI模型在开发者圈子刷屏,它摒弃传统大模型擅长的对话聊天能力,专注做高速结构化决策,它就是TypeSafe AI推出的Jev模型。该模型由ChatGPT共同发明人Diogo Almeida主导研发,定位为**System One Model(系统一模型)**,对标人类大脑快速直觉判断的思维模式,在响应延迟、调用成本、结构化输出稳定性上相比传统生成式大模型有着巨大差异。本文会完整拆解Jev底层原理、三大核心原语能力、适用业务场景,同时提供可直接运行的curl、Python代码示例,并且结合多组实测数据,客观分析模型优势与能力边界,帮助普通开发者和AI应用从业者快速上手落地。
363 1
|
6天前
|
人工智能 Linux Windows
千问办公(QwenWork)官网入口:其实有2个,一个是网页端千问办公,一个是介绍指南页面
千问办公(QwenWork)是阿里云推出的AI智能办公平台,支持网页端直接使用及Windows/Mac/Linux客户端下载。提供PPT生成、财报分析、网页搭建等AI功能,个人版免费,企业版198元/席/月。详情见官网qwenwork.cn或阿里云产品页。
803 0
千问办公(QwenWork)官网入口:其实有2个,一个是网页端千问办公,一个是介绍指南页面

热门文章

最新文章