最佳的 Nano Banana Pro 提示词并非一串“魔法”关键词,而是一份结构清晰的创意简报,它向模型明确说明了图像的目的、主题、场景、构图、光线、风格、具体文本、限制条件以及输出格式。 请将不可更改的细节放在首位,以积极的方式描述预期结果,并逐一调整变量。.
截至2026年7月20日,, 谷歌的图像生成文档 将 Nano Banana Pro 识别为 双子座 3 Pro 图像, ,API 模型 ID 为 gemini-3-pro-image. 谷歌将其定位于专业内容生成和复杂指令处理,而 Nano Banana 2 则是速度更快的通用型选项。这一区别很重要,因为提示词指南不应将所有 Nano Banana 模型都视为同一产品。.
想在阅读时运用这种结构吗?请打开 Nano Banana Pro 图像工作区在 GlobalGPT 上, ,粘贴下面的可复用公式,并在基于浏览器的流程中逐一调整。作为一款一体化AI平台,Global GPT还提供了诸如 GPT 图片 2,, 和 旅途中, 研究和写作 Perplexity、ChatGPT 5.6、Gemini 3 Pro 和 Claude Opus 4.8.
简答:可重复使用的 Nano Banana Pro 提示公式
目标 + 主题 + 动作 + 环境 + 构图 + 光影与色彩 + 视觉处理 + 具体文案 + 必须遵守的限制条件 + 输出设置。. 并非每张图片都需要填写所有字段。请使用那些会影响结果的字段,消除矛盾之处,并通过微调来延续对话,而不是在每次生成后都重写整个提示语。.
本指南涵盖的内容
- 当前 Nano Banana 模型的名称和限制
- 可重用的提示结构
- 一种循序渐进的写作方法
- 主要视觉风格的生成示例
- 图片编辑提示
- 参考图像与一致性
- 应对负面提示的更好方法
- 真正实用的高级控制功能
- 十二条可直接使用的提示语
- 常见故障的排除
- 常见问题
2026年的Nano Banana Pro:当前机型名称、优势与局限
Nano Banana Pro 提示词是针对谷歌 Gemini 3 Pro 图像模型的自然语言指令。它可用于请求生成新图像、描述对一张或多张给定图像的编辑,或继续多轮视觉工作流。 最有效的提示词应明确定义预期用途以及元素之间的关系,而不仅仅是一堆视觉形容词。.
| Google 产品名称 | API 模型 ID | 最符合谷歌当前的指导方针 |
|---|---|---|
| Nano Banana 2 Lite | gemini-3.1-flash-lite-image | 快速、注重成本效益的大规模图像处理;1K级输出,且高级参考工作流较少 |
| 纳米香蕉 2 | gemini-3.1-flash-image | 在质量、速度、延迟和成本之间实现了通用的平衡 |
| 纳米香蕉 Pro | gemini-3-pro-image | 专业素材、复杂的指导要求、品牌一致性、本地化以及精准的创意控制 |
| 纳米香蕉 | gemini-2.5-flash-image | 旧版模型;谷歌建议将较新的工作流迁移至 Nano Banana 2 系列 |
就 Nano Banana Pro 而言,谷歌在文档中明确指出,其支持的 API 工作流中包含 1K、2K 和 4K 分辨率输出、文本转图像生成、文本与图像编辑、多轮优化,以及最多 14 张参考图像。 参考图像的保真度仍受特定类别的限制,因此上传更多图像并不能保证每个面部、物体、徽标或风格都能得到同等程度的保留。.
- 无法保证图片数量完全准确。. 该模型可能不会每次都按照请求生成精确数量的输出。.
- 文本渲染功能虽强,但并非万无一失。. 谷歌建议先确定最终措辞,然后再根据该确切文本请求图片。.
- 编辑工作最好采用对话式的方式进行。. 在保持前一张图片上下文的基础上,每次只要求进行一项受控的更改。.
- 所有生成的图像均包含 SynthID。. 这是谷歌已记录的输出行为之一。.
- 不同型号的输入参数各不相同。. 例如,视频输入功能在 Gemini 3.1 闪存镜像的文档中有说明,但并非作为 Nano Banana Pro 的通用功能。.
如果你还在快速版和专业版之间犹豫不决,那么这个 Nano Banana 2 与 Nano Banana Pro 对比 在您花时间调整提示词之前,先说明一下其中的实际权衡。.
披露: GlobalGPT 发布了本指南,并提供了一个独立的多模型图像工作区。GlobalGPT 并非 Google,也不作为 Gemini 的官方服务提供。其界面、模型可用性、积分、限制、安全控制及输出结果可能与 Google 的应用程序和 API 有所不同。.
适用于各种使用场景的 Nano Banana Pro 提示结构
请将以下结构视为一份检查清单,而非必须严格遵循的固定公式。一张简单的肖像照可能只需六个要素;而包含文字设计和品牌元素的宣传视觉素材则可能需要全部十个要素。.
| 提示字段 | 应说明哪些内容 | 示例片段 |
|---|---|---|
| 1. 目标 | 图片将用于何处,以及它应传达什么信息 | “为一家可持续旅游公司设计一个高端的首页主视觉” |
| 2. 主题 | 主要人物、物体、产品或场景 | “一位身穿锈红色夹克的独行徒步者” |
| 3. 行动 | 发生了什么 | “在高山湖畔驻足” |
| 4. 环境 | 地点、时间、天气、背景和氛围 | “暮色中的群山,水面飘着薄雾” |
| 5. 构成 | 构图、视角、镜头语言和主体位置 | “宽屏16:9构图,视平线视角,主体位于画面左侧三分之一处” |
| 6. 照明与色彩 | 光线方向、对比度、色温和色彩方案 | “柔和清冷的环境光,搭配温暖的轮廓光” |
| 7. 视觉处理 | 媒介、时代、质感、写实主义或设计体系简体中文(大陆) | “编辑风格的户外摄影,自然的质感,克制的调色” |
| 8. 原文 | 必须出现的词语,包括大写形式和位置 | “标题:‘GO FARTHER’,采用紧凑的白色无衬线字体” |
| 9. 约束条件 | 必须保持不变或必须在视觉上真实的细节 | “保持夹克颜色和背包设计的一致性” |
| 10. 输出设置 | 在支持的情况下,包括宽高比、分辨率和变体数量 | “16:9,4K,最后一张照片” |
为[目的/受众]制作[素材类型]。 主题:[人物或事物,特征描述]。 动作:[正在发生的事情]。 环境:[地点、时间、天气、背景]。 构图:[镜头类型、角度、镜头语言、画面布局]。 光影与色彩:[光线方向、柔和度、对比度、色调]。 视觉处理:[媒介、风格、质感、写实程度]。 具体文案:[文案内容],采用[字体与排版位置]。 必须保留:[品牌标识、产品、标志、几何形状或其他限制条件]。 输出规格:[宽高比、图像尺寸、变体要求]。.
如何一步步撰写高质量的Nano Banana Pro提示语
1. 先从工作出发,而不是从风格出发
“在电影海报、产品广告和旅游缩略图中,”电影感”的含义各不相同。在描述视觉风格之前,请先明确素材的用途、受众以及需要传达的信息。上下文信息有助于模型选择实用的布局,而不是生成一张虽然美观但无法使用的图片。.
2. 明确主题及空间关系
请指明主体、其显著特征、其动作,以及它与其他元素之间的相对位置。“银色盒子旁的一只红鞋”比“一个时尚的产品场景”更清晰。当多个物体都重要时,请描述它们位于左侧、右侧、前景、背景的位置,以及重叠、距离和比例。.
3. 先确定构图,再添加装饰细节
在添加修饰性词语之前,先确定构图、视角、主体位置和留白。广角镜头、微距镜头、低角度、俯视构图或居中产品特写,比“杰作”或“获奖作品”这类泛泛之词更能切实改变最终效果。当摄影术语能描述出具体的视觉决策时,它们才真正有用。.
4. 用可观察的术语描述光、颜色和材质
将“惊人的光线”替换为光线的方向和质感:来自镜头左侧的柔和窗光、正午的强烈阳光、温暖的逆光、柔和的摄影棚主光,或是冷调的环境补光。材质方面也采用同样的处理方式:哑光陶瓷、拉丝铝、半透明玻璃、粗麻布,或是湿漉漉的沥青。.
5. 将精确文本与提示词的其余部分区分开来
先写好最终文案,用引号括起来,保留大写格式,并注明其位置。在要求制作内容密集的海报之前,先确认文本的层级结构是否简洁。如果拼写有误,请保留现有设计,并在后续修改中仅修正文本内容。.
6. 每回合优化一个变量
谷歌目前的指导建议采用对话式迭代。与其替换一个基本成功的提示词,不如这样说:“保持主题、构图、服装、背景和字体不变。只需让主光更暖和、更柔和一些。”这能明确编辑边界,并使故障更易于诊断。.
7. 在增加复杂性之前,先测试简短版本
从关键场景入手,仅在输出结果不明确时才添加细节。提示语越长并不一定越好。风格冲突、多机位视角以及重复使用的形容词都会削弱指令的优先级。.
弱: “一只猫,美丽、品质极佳、具有电影感,堪称杰作。”
更强: “一只栩栩如生的橙色英国短毛猫幼崽,正坐在一张浅色大理石台面上,旁边放着一只素白的杯子;镜头为与猫眼平齐的中景,左侧透入柔和的晨光,采用浅景深拍摄,毛发质感自然,背景为冷灰色。”

按视觉目标分类的高质量 Nano Banana Pro 提示词示例
电影风格的剪辑场景
为一本高端考古杂志创作一张电影风格的专题摄影作品。一位女探险家背对镜头,伫立在一座古老砂岩神庙的入口处,凝视着阳光洒满的殿堂。画面采用对称的门框构图,35毫米镜头眼平视角,人物全身置于画面下三分之一处居中。 温暖的金色光芒透过门洞倾泻而入,空气中飘浮着细微的尘埃,阴影深邃却清晰可辨,石材呈现风化质感,色彩调校采用内敛的大地色调。画面比例为4:3,无标题或标志。.

风格化的动漫动作场面
创作一帧手绘动漫动作画面。一位留着银色短发的年轻女子,在雨后充满未来感的东京购物街上,径直朝镜头奔来。 动态的低角度广角镜头,强烈的透视压缩效果,头发和衬衫随着她的步伐飘动。粉彩般的青色和粉色招牌在湿漉漉的人行道上倒映;线条简洁利落,采用平面赛璐璐渲染,局部带有柔和光晕,背景充满活力且清晰可辨。确保双手解剖结构清晰。采用4:3构图,画面中不得出现可辨识的品牌名称。.

带有精确字样的产品图片
为一款即将上市的护肤品创作一张低调奢华的产品照片。一块圆润的象牙色洁面皂部分浸没在浅浅的清澈水中。在洁面皂正面以大写几何无衬线字体压印“AURA”一词一次。 采用四分之三特写构图,产品从左上角向右下角倾斜,背后的大窗户透入柔和的漫射自然光,画面中呈现细腻的涟漪和逼真的湿润倒影,产品表面呈现哑光陶瓷质感,色调以淡鼠尾草绿和暖奶油色为主。采用方形构图,画面中无其他文字、无包装、无其他产品。.

带有受控文本的信息图
为初次养盆栽的业主设计一张简洁的竖版信息图。顶部标题为:“更聪明的浇水法”。其下方展示三个大小相等的插图区域,分别标注为“检查”、“浇水”和“排水”。每个区域包含一个简单图标和一行简短正文: “检查表层土壤”、“将根团浸泡”和“倒空托盘”。采用温暖的米白色背景、森林绿标题、赤陶色点缀,确保高可读性,留白充足,采用平面矢量插画风格,构图比例为4:5。请勿添加任何其他文字。.
如需更多关于输出结果的具体指导,请参阅针对 使用 Nano Banana Pro 创建 4K 图像.
如何向 Nano Banana Pro 发出图像编辑指令
编辑提示需要明确两个边界:哪些内容需要修改,哪些内容需要保持不变。根据可见特征和位置确定目标对象,然后列出必须保持不变的构图、身份、产品几何形状、光照和背景元素。.
添加或替换一个对象
对提供的客厅照片进行编辑。仅将正中央的蓝色布艺沙发替换为一款宽度相同、位置相同的复古棕色切斯特菲尔德皮质沙发。需保持房间原有的透视效果、窗边光线、接触阴影及反射效果。墙壁、地毯、茶几、植物、拍摄角度、裁剪范围以及其他所有物体均保持不变。.
保护某人或某产品
请以提供的肖像照作为身份参考。 需保持人物的面部轮廓、眼色、发型、肤色、年龄及中性表情的一致性。仅将背景调整为光线柔和的现代图书馆,服装改为纯白衬衫外搭炭灰色西装外套。保留原有的头部角度和肩膀位置。呈现自然的摄影质感,采用3:4比例的人像构图。.
在不复制不需要的内容的情况下应用样式
请以图片1为主体和构图依据。图片2仅作为参考,用于借鉴其柔和的水粉画质感、以海军蓝和赭石色为主的有限色调,以及柔和不规则的笔触边缘。请勿复制图片2中的任何人物、物体、文字或版式。请保留图片1中人物的姿势和比例。.
完整的工作流程详见 如何使用文本提示编辑图片. 开发人员还可以关注 Nano Banana Pro API 指南 有关请求和集成步骤。.
如何使用参考图片并提高一致性
参考图片在每张图片都明确标注了用途时最为有用。请根据用途(如人物形象、产品、标志、姿势、构图或风格)对它们进行标注,并说明哪些特征可以借鉴。不要假设模特知道图片2是角色参考还是色彩参考。.
- 请选择一张背景干净、主体清晰可见的主要参考图。.
- 请用文字列出不可变的特征:脸型、发型、服装颜色、标志的几何形状、材质或比例。.
- 为每张额外图片分配一个角色。.
- 在更改角度、姿态或设置之前,先生成第一个已批准的视图。.
- 将已批准的输出结果输入到后续环节,以保持连续性。.
- 每轮更改一个主要变量,并重申哪些变量必须保持不变。.
谷歌的 API 文档规定,对于 Gemini 三图像工作流,最多可使用 14 张参考图像,但这只是上限,并非建议上传 14 张相互竞争的参考图像。参考图像数量较少且更清晰时,通常更容易理解指令优先级。对于实际操作流程,请参考本指南来 确保角色在不同场景中的形象保持一致.
负面提示:描述期望的状态,而非词汇黑名单
谷歌的 官方提示指南 建议采用语义否定提示法:用积极的方式描述目标场景,而不是依赖以逗号分隔的黑名单。“一条空荡荡、人迹罕至、路面干净的街道”为模型提供了目标;而“没有汽车、没有行人、没有杂物、没有标识”则主要罗列了“没有”的事物。.
| 弱排除 | 更扎实的教学 |
|---|---|
| “不杂乱” | “一张简朴的书桌,上面只有笔记本电脑、笔记本和一支笔,每个物品周围都留有明显的留白空间” |
| “无模糊” | “主体和产品标签都清晰锐利;背景则呈现出柔和的光学渐变效果” |
| “不允许有额外人员” | “画面中只有一个人独自伫立;背景空无一人” |
| “没有坏牌” | “双手以放松自然的姿势完全展露,每只手的五根手指清晰分开” |
| “无文本错误” | “仅显示一次确切的标题‘OPEN LATE’,不包含其他任何文字或字母” |
当排除条款明确界定实际边界时(例如“不得添加其他文本”或“不得更改徽标”),它们仍然有其存在的必要。关键在于将这一边界与对所需结果的清晰积极描述相结合。.
无需使用虚假参数即可改进提示的高级控制方法
仅在镜头切换时使用摄影术语
构图类型、视角和主体位置通常比堆砌镜头参数更可靠。当拍摄目标明确为“眼平中景人像,背景压缩”时,就采用这种构图。只有在理解了该焦距所暗示的透视效果时,才应添加焦距参考。.
将宽高比和分辨率视为输出设置
请将宽高比和分辨率放在提示词的末尾,或在界面/API中进行配置。Google 文档中针对 Gemini 3 Pro Image 提供了 1K、2K 和 4K 的规格。在 API 中,image-size 的值应使用大写字母 1K, 2K, 或 4K; ;小写形式将被拒绝。第三方界面中可用的控件可能有所不同。.
将复杂的场景分解为有序的操作步骤
对于包含多个元素的场景,请按清晰的顺序说明背景、主要对象、辅助对象以及最终文本。数字伪权重语法并非 Nano Banana Pro 文档中记载的参数;请改用清晰的指令顺序和可见的约束条件。.
将创意方向与必须遵守的限制区分开来
创意指导可以灵活调整;但品牌形象、文案、产品造型和品牌标识则未必如此。将这些要求归入“必须保留”一栏。在编辑过程中,请在每次关键的后续工作中重复列出这些不变的要素。.
12条可直接使用的Nano Banana Pro提示语
这些示例特意设计得足够具体,既实用又便于调整。请根据您的项目替换主题、文案、颜色、比例和限制条件。.
1. 编辑部肖像
为一本设计杂志创作一幅专题人像。一位四十出头的陶瓷艺术家站在明亮的工作室里的工作台旁,深色亚麻围裙上沾着陶土粉,神情沉静而直率。 半身眼平构图,85毫米人像透视,柔和的北向窗光从镜头左侧射入,阴影细节柔和,暖中性色调,皮肤和织物质感逼真。4:5比例,无文字。.
2. 电商产品展示图
制作一张高品质的电商产品照片,展示一款哑光钴蓝色保温瓶直立于浅色石灰岩底座上。采用四分之三正面视角,画面居中构图,左上角有柔和的漫射主光,右侧边缘有狭窄的轮廓光,接触阴影符合物理规律,圆柱体几何形状准确,背景为干净的浅灰色摄影棚背景。 水瓶上不得出现任何品牌标识。正方形图像,2K分辨率。.
3. 食品宣传活动
为一家社区面包店设计一张夏季宣传图片。一张白瓷盘上放着一款质朴的柠檬挞,摆放在阳光洒落的户外餐桌上,其中切下了一块,露出内馅。 采用俯视四分之三视角,画面中点缀着斑驳的树叶阴影,饼皮质感酥脆,自然散落的面包屑,色调以淡黄色和鼠尾草绿为主,右上角预留了充足的空白空间以便后续添加文案。比例为3:2,写实风格,无文字。.
4. 旅游海报(附原文)
设计一张受世纪中叶丝网印刷风格启发的竖版旅行海报。一列简化的沿海列车沿着赭色悬崖蜿蜒前行,下方是深蓝色的海洋。顶部的大标题为:“RIDE THE COAST”。底部的小字为:“7月18日,星期六”。 请严格使用上述文字,不得添加其他内容。采用扁平的几何形状,略带不完美的油墨质感,配以奶油色边框,以及海军蓝、珊瑚色、赭石色和海蓝色调。比例为2:3。.
5. 应用入门插图
为一款预算管理应用设计一幅亲切的引导插图。画面中,一个人正在整洁的桌面上将三枚大硬币分别放入标有标签的罐子里。采用简单的圆润3D造型、质感柔和的材质、易于辨识的色彩对比,点缀青绿色和暖杏色,采用微妙的等角视角,背景为干净的米白色,顶部留有清晰的空白区域用于放置界面文案。 插图内不得出现任何文字或数字。比例为4:5。.
6. 奇幻环境
为游戏概念图打造一个电影般的奇幻场景。一座狭窄的石桥横跨云雾缭绕的深渊,通向一座凿建在黑山之中的风化观测站。沿途点缀着微小的灯笼,突显出场景的宏大尺度。 从略微高处的俯视角度拍摄的全景镜头,观测站后方的云层中透出暴风雨的光芒,采用冷色调的板岩色系,点缀着微小的琥珀色灯光,岩石和雾气呈现逼真效果,画面中无人,无文字。21:9。.
7. 儿童图书插画
描绘一幅儿童故事场景。一场细雨中,一只系着绿色围巾的小红狐与一只紧张的蓝鸟共撑一把伞。它们站在一个水洼旁,水洼中倒映着面包店温暖的橱窗。 柔和的水彩与彩色铅笔质感,圆润友好的造型,生动的面部表情,低视角构图,淡雅的蓝灰色雨幕中点缀着温暖的金色光斑。3:2横幅构图,无文字。.
8. 建筑可视化
为一座位于林间斜坡上的紧凑型木质与玻璃结构小屋创建逼真的外观可视化效果。需保留可信的建筑细节:可见的地基、雨水槽、窗框以及安全的楼梯入口。 画面为黄昏初降时的眼平三quarter视角,室内灯光温暖,雨后地面湿润,雪松外墙板,深色金属屋顶,本地蕨类植物,采用自然透镜透视效果,画面中无人物或车辆。16:9,4K。.
9. 数据信息图
制作一张标题确切为“A WEEK OF BETTER SLEEP”的方形信息图。展示七行简单的水平行,分别标注为MON、TUE、WED、THU、FRI、SAT、SUN。每行包含一个月亮图标和一个简洁的进度条;不要添加任何数值说明。 深海军蓝背景,浅蓝色进度条,一个暖黄色点缀,易于辨认的大写无衬线字体标签,间距均衡,扁平矢量设计。请勿添加任何其他文字。.
10. 角色转变
根据提供的角色参考图,绘制一张清晰的角色四面图,包含正面、左侧面、背面和三四分之三侧面视图。 所有视角中均需保持人物面部特征一致,包括短卷黑发、圆形红框眼镜、芥末黄夹克、藏青色长裤、白色运动鞋、身体比例及年龄。采用中性站姿,比例一致,柔和均匀的摄影棚灯光,浅灰色背景,无任何标签或额外配饰。宽屏16:9。.
11. 参考文献中的产品组合
请将图片1作为鞋子的精确参考,图片2作为场景参考。将图片1中的鞋子放置在图片2的石阶上,并确保与石阶的透视效果、傍晚的光线、色温、接触阴影以及表面反射相匹配。 保留鞋子的轮廓、材质、缝线、鞋底花纹以及标志的几何形状。请勿复制图片1中的任何其他物体。保持图片2的裁剪范围。.
12. 受控后续编辑
请保持已批准图片中的主体、面部、姿势、服装、拍摄角度、裁剪、背景、字体设计和产品摆放位置不变。仅调整光线:将冷调的顶灯替换为来自镜头左侧的柔和暖色窗光,并从右侧添加一缕微妙的中性补光。保持真实的肤色及所有原有色彩。提交一张修改后的图片。.
Nano Banana Pro 提示故障排除
| 问题 | 可能原因 | 接下来写什么 |
|---|---|---|
| 忽略了一个重要因素 | 提示中包含过多相互冲突的指令,或者该元素的位置不明确 | 删除装饰性细节,明确该元素的位置和比例,并重新生成更简洁的构图 |
| 图片中的文字有拼写错误 | 该段文字内容繁杂、含义模糊,或与场景描述混杂在一起 | 保留设计,仅替换文本,引用最终措辞,并禁止添加额外内容 |
| 一个角色的性格在不同场景中发生了变化 | 未重新表述身份特征,也未重复使用已获批准的图片 | 附上已获批准的参考资料,列出不可更改的特征,仅修改姿势或场景设置 |
| 该模型返回的项数不正确 | 精确计数仍然是一个有据可查的局限性 | 简化场景,明确列出各项元素及其位置,然后在后续工作中编辑额外内容 |
| 一次编辑会改变整张图片 | 变化的界限并不明确 | 请为目标对象命名,并重述所有必须保持不变的主要元素 |
| 结果看起来很普通 | 该提示词使用了宽泛的风格标签,但未提供可见的艺术指导 | 加入主题、构图、光线方向、色彩方案、材质以及一个独特的视觉创意 |
| 4K 未被返回 | 所选模型或接口未公开该输出,或者 API 设置格式不正确 | 确认 Gemini 3 Pro 镜像,分别设置支持的镜像尺寸,并使用大写字母 4K 在 API 中 |
| 引用之间相互冲突 | 太多图像的角色存在重叠 | 移除弱引用,并将剩余的图像标记为“身份”、“对象”、“姿势”、“布局”或“风格” |
如果您对界面设计尚不熟悉,但对提示语设计已有了解,建议从 Nano Banana Pro 新手指南 等您能够生成和编辑基本图像后,再回到这个结构中。.
关于 Nano Banana Pro 提示词的常见问题
Nano Banana Pro 目前的官方名称是什么?
截至2026年7月20日,谷歌将该产品命名为Nano Banana Pro 双子座 3 Pro 图像; 其 API 模型 ID 为 gemini-3-pro-image. Nano Banana 2 是独立的 Gemini 3.1 闪存镜像型号,因此其名称和性能说明不可互换。.
一个 Nano Banana Pro 提示词应该有多长?
并没有什么神奇的字符数限制。先明确任务、主题、构图、光线、风格、具体文本以及限制条件,然后去除重复和冲突的内容。一个重点突出的简短提示,要比包含相互冲突的风格或观点的冗长提示更有效。仅在输出结果存在歧义时才添加细节。.
Nano Banana Pro 支持负面提示词吗?
您可以列出排除项,但谷歌建议以积极的方式描述期望的效果。请写“一条空荡荡的街道上只有一个人”,而不是列出黑名单。必要时使用明确的限制条件——例如“不得出现其他文字”或“不要更改徽标”——并将其与所需的视觉效果相结合。.
Nano Banana Pro 能否准确渲染图片中的文字?
它可以渲染出清晰可读的艺术化文本,但无法保证拼写和版式正确。请先确定最终文案,准确引用原文,并明确大写规则、层级关系和位置。如果某一行有误,请保留设计,仅要求对文本部分进行修正。请对生成的每个单词进行校对。.
如何确保一个角色在多张图片中保持一致?
使用一个干净的身份参考,列出面部、发型、服装和比例等必须保持不变的特征,并在后续迭代中复用已获批准的输出结果。按角色对其他参考进行标注,并每次只更改一个主要变量——姿势、摄像机角度或场景。对每个结果进行视觉检查。.
Nano Banana Pro 最多可以使用多少张参考图片?
Google 为 Gemini 3 图像工作流记录了最多 14 张参考图像,并按对象、角色和风格类别设定了高保真度的下限。14 张是上限,并非理想方案。应使用最少且最清晰的参考图像,为每张图像分配具体作用,并剔除相互冲突的图像。.
Nano Banana Pro 能生成 4K 图像吗?
是的。Google 文档中记载了 Gemini 3 Pro Image 的 1K、2K 和 4K 输出规格。在 API 中,请使用大写的图像尺寸值,例如 4K. 用户界面和第三方界面可能显示不同的控件或默认值,因此决定导出结果的是其可见设置——而非仅凭提示信息。.
在谷歌和GlobalGPT中,相同的提示词会产生相同的结果吗?
不。虽然参数会被传递,但模型版本、接口默认值、引用处理、安全控制和分辨率选项都可能影响结果。GlobalGPT 是一个独立项目,并非 Google 的官方产品,因此请将其控制项与 Google 的 API 文档进行对比,而不是直接假设两者等同。.
最终提示清单
- 提示中是否说明了该资源的用途和受众?
- 主要对象是否通过其显著的视觉特征进行了描述?
- 动作、环境和空间关系是否明确无误?
- 构图中是否明确了镜头类型、视角和位置?
- “光”、“色调”、“材质”和“媒介”是否用可视化的术语进行了描述?
- 引用的原文是否与场景描述分开展示?
- 必须保留的细节和允许修改的内容是否划分得十分明确?
- 所选接口或 API 是否支持宽高比和分辨率?
- 能否删除任何重复的形容词、风格不一致的地方或虚假参数?
- 下一次优化是否仅限于一项受控变更?
最可靠的 Nano Banana Pro 工作流程非常简单:撰写清晰的创意简报,生成有力的基础图像,检查实际发生了哪些变化,并通过对话式交流对结果进行优化。精准性源于有用的约束和严谨的迭代——而非秘密关键词或绝对承诺。.




