AI 图像模型

如何使用 Nano Banana:Gemini 图像生成与编辑实用指南

学习如何在 Gemini、Google AI Studio 和 Gemini API 中使用 Nano Banana 进行图像生成与编辑,包含工作流、模型选择、提示词模板、编辑示例、安全检查和 API 建议。

Nano Banana Team发布于 2026年9月15日
如何使用 Nano Banana:Gemini 图像生成与编辑实用指南

把 Nano Banana 当作编辑循环来用,效果最好:简报、生成、修改、检查、导出。

如果你想学习如何使用 Nano Banana,先从一个小的思维转变开始。

Nano Banana 不只是一个“输入一句漂亮描述,然后希望模型猜中你想法”的文生图玩具。它是 Google Gemini 图像生成与编辑模型家族;多数高质量结果都来自一个简单循环:说明任务,保护必须不变的细节,生成图像,再用更窄的后续指令修改。

这很重要,因为大多数 Nano Banana 失败并不神秘。产品 logo 变了。人脸漂移了。背景编辑顺手改掉了主体。文字看起来差一点但不能用。图片很漂亮,但没法发布。

解决办法不是写更长的提示词,而是写更有用的简报。

这篇指南会说明如何在 Gemini 应用、Google AI Studio 和 Gemini API 中使用 Nano Banana。内容包括实际工作流、模型选择、提示词结构、图像编辑、参考图、API 用法、示例、故障排查、安全检查,以及发布 AI 生成图像前应该做的最终检查。

快速答案:如何使用 Nano Banana

使用 Nano Banana:

  1. 打开 Gemini 做日常图像生成,打开 Google AI Studio 测试提示词,或使用 Gemini API 构建产品流程。
  2. 选择合适的图像模型:Nano Banana 2 用于通用工作,Nano Banana Pro 用于要求更高的最终素材,Nano Banana 2 Lite 用于成本更低的大批量草稿。
  3. 写一个提示词,说明用途、主体、风格、参考图、输出格式和约束。
  4. 如果要编辑现有图片,上传图片,并明确说明什么要改、什么必须保持不变。
  5. 生成一个结果,检查它,再用有针对性的后续提示词修改。
  6. 发布前检查身份、产品细节、文字、logo、瑕疵、权利,以及是否需要标注为 AI 生成。

从选择入口到检查最终图像的五步 Nano Banana 工作流

好的 Nano Banana 工作流不是一次完美提示词,而是生成、窄范围编辑和最终检查的短循环。

最短的可用公式是:

为 [用途] 创建一张 [图像类型]。
主体是 [主要主体]。
使用 [参考图] 保留 [具体细节]。
只改变 [你想改变的内容]。
输出:[宽高比、风格、构图、文字规则]。
避免 [会毁掉这张图的失败情况]。

例如:

为一篇关于 AI 图像编辑的文章创建一张 16:9 博客封面图。
主体是一张整洁的桌面,笔记本电脑上显示编辑前后对比。
使用上传的产品图保留产品形状、颜色和 logo 位置。
只把背景改成明亮的影棚环境。
风格:干净的科技编辑风,真实光线,图中不要有文字。
避免 logo 扭曲、UI 文字不可读、出现多余产品和赛博朋克效果。

这已经比下面这种提示词好很多:

做一张很酷的 AI 图像编辑封面。

什么是 Nano Banana?

Nano Banana 是 Google 对 Gemini 原生图像生成与图像编辑模型的昵称。实际使用中,它可以根据文本创建图片,用自然语言编辑现有图片,组合文本和图像输入,并通过对话持续迭代。

截至 2026 年 9 月 15 日,Google 的 Gemini API 文档列出了几个 Nano Banana 图像模型:

模型昵称 官方模型名称 最适合用途
Nano Banana 2 Lite gemini-3.1-flash-lite-image 成本更低的草稿、高批量生成、快速探索
Nano Banana 2 gemini-3.1-flash-image 通用图像生成与编辑
Nano Banana Pro gemini-3-pro-image 最终素材、产品视觉、广告、图解和文字敏感工作
Nano Banana gemini-2.5-flash-image 尚未迁移的旧工作流

这些名字容易让人混淆,因为很多人说“Nano Banana”时指的是整个图像模型家族。如果你使用 Gemini 应用,可能看不到原始 API 模型名称。如果你使用 Google AI Studio 或 API,模型选择就更重要。

简单规则:

日常图像工作用 Nano Banana 2。结果要发布、用于营销或依赖精确细节时用 Nano Banana Pro。速度和成本比最终精修更重要时用 Nano Banana 2 Lite。

可以在哪里使用 Nano Banana?

常见入口有三个。

入口 最适合 使用体验
Gemini 应用 随手创作和快速编辑 和 Gemini 聊天、上传图片、要求修改
Google AI Studio 提示词测试和模型对比 选择模型、测试提示词、编码前检查输出
Gemini API 应用、自动化、批处理、开发者产品 发送文本和图像输入,接收生成的图像数据

如果你正在学习,先从 Gemini 应用或 AI Studio 开始。如果你要构建可重复的流程,在知道哪些提示词和模型有效后再迁移到 API。

在没有测试创意流程前,不要从代码开始。API 代码不会修好模糊提示词,只会让模糊提示词运行得更快。

应该选择哪个 Nano Banana 模型?

对比 2 Lite、2、Pro 和旧模型的 Nano Banana 模型选择器

按任务风险选择模型:便宜地起草,用平衡模型迭代,用 Pro 完成重要素材。

模型选择应该跟随任务风险。

用 Nano Banana 2 Lite 做草稿和批量任务

Nano Banana 2 Lite 是经济型选择。需要很多粗方向、测试提示词形状,或图像不是最终素材时使用它。

适合用途:

  • 生成粗略视觉方向
  • 尝试 10 到 30 个缩略图想法
  • 起草博客插图概念
  • 低风险内部 mockup
  • 成本敏感的批量探索

不要只因为便宜就使用最便宜的模型。如果图像包含产品标签、品牌细节、人物或重要文字,可以先便宜测试,但最终用更强的模型收尾。

用 Nano Banana 2 做日常工作

Nano Banana 2 是大多数人的默认起点。它适合图像生成、编辑、提示词迭代、博客图、社交概念和日常创意工作,在质量与速度之间比较平衡。

适合用途:

  • 博客封面
  • 社交媒体视觉
  • 创意方向
  • 背景替换
  • 产品概念
  • 轻量图解
  • 参考图实验

如果你不知道从哪里开始,就从这里开始。

用 Nano Banana Pro 做最终素材

当错误会变贵时,Nano Banana Pro 是更好的选择。

使用它来做:

  • 产品图片
  • 广告
  • 落地页 hero 图
  • 品牌活动
  • 最终客户交付素材
  • 带短文字的图像
  • 视觉清晰度重要的图解
  • 对现有图片的高信任编辑

即使用 Pro,也不要跳过检查。更好的模型能减少错误,但不能替代人工检查。

为旧版 Nano Banana 工作流规划迁移

旧的 gemini-2.5-flash-image 模型仍出现在官方文档中,但 Google 将它描述为旧版 Nano Banana 模型,并建议新工作迁移到更新的图像模型。如果你围绕旧模型构建了工作流,在继续依赖它之前,检查当前 Google AI for Developers 文档和迁移说明。

新项目应基于当前 Gemini 3 图像模型,除非你有明确的兼容性理由。

Nano Banana 提示词公式

大多数差提示词失败,是因为它们把六种不同任务混在一句模糊话里。更好的提示词会把它们分开。

展示可靠 Nano Banana 提示词六个部分的图解

强提示词会分清任务、主体、参考图、编辑目标、输出格式和约束。

使用这个结构:

用途:[图像会用在哪里,以及它应该完成什么]
主体:[主要人物、产品、物体、场景或界面]
参考图:[每张上传图应该如何使用]
编辑目标:[如果是编辑,什么应该改变]
输出:[宽高比、构图、风格、尺寸、文字规则]
约束:[什么必须保持不变,什么要避免]

下面是一个完整提示词:

用途:为一篇关于 AI 产品摄影的博客文章创建 hero 图。
主体:一个护肤品瓶子放在干净的浴室台面上,有柔和晨光。
参考图:使用上传的产品图保留瓶身形状、瓶盖颜色、标签位置和 logo 位置。
编辑目标:只把背景从杂乱房间改成极简白色石材台面。
输出:16:9 横图,真实编辑风产品摄影,不添加文字。
约束:保持产品比例、标签布局和 logo 不变。避免多余瓶子、拼写错误文字、包装扭曲、塑料感反光和不真实阴影。

重要词是“保留”“只改变”和“避免”。

Nano Banana 可以从宽泛提示词生成很惊艳的图,但生产工作依赖约束。如果你在意 logo,就写出来。如果脸必须保持一致,就写出来。如果背景是唯一应该改变的内容,就写出来。

如何用 Nano Banana 生成新图像

生成新图像时,你不需要写小说。你需要清楚定义视觉任务。

先说明:

  • 图像用于什么
  • 应该看见什么
  • 风格和氛围
  • 宽高比
  • 是否应该出现文字
  • 要避免什么

示例:

创建一张关于 AI 图像编辑的 16:9 编辑风博客封面。
展示一张设计师桌面,笔记本电脑上显示简单的图片编辑前后对比。
风格:干净的现代科技编辑风,真实光线,温暖中性色桌面,细微蓝绿色点缀。
右侧留出干净留白给标题。
不要包含 logo、可读品牌名、人脸、机器人或图中任何文字。

这个提示词给 Nano Banana 足够方向,同时不会过载。

如果第一张结果接近目标,用窄范围修改:

保持相同构图和桌面。让光线更明亮,移除左侧多余的平板电脑。保持笔记本电脑位置不变。

如果结果完全错了,重写原始简报。不要一直要求模型修补一个你并不想要的方向。

如何用 Nano Banana 编辑现有图片

图像编辑是 Nano Banana 真正有用的地方。诀窍是让编辑目标足够窄。

弱编辑提示词:

让这张产品照更好看。

更好:

只把背景改成干净的白色影棚。
保持产品形状、颜色、标签、logo 位置、阴影方向和相机角度不变。
不要添加文字、多余产品、手、反光或装饰道具。

用于人像:

保留人物的脸、发型、年龄感、表情、服装和身体比例。
只把背景改成有自然日光的明亮家庭办公室。
保持皮肤纹理自然。避免塑料感皮肤、五官改变、多余手指和眼镜扭曲。

用于 UI 截图:

使用这张截图作为布局参考。
创建同一界面的更干净营销 mockup。
保持侧边栏、图表区和卡片布局在相同位置。
不要生成详细假文字,只使用简单块和短标签。
避免多余按钮、扭曲浏览器边框和不可读小字。

编辑越小,越容易判断是否成功。先改背景,再改光线,再裁剪,最后精修。

如何使用参考图

参考图不是魔法。你需要告诉 Nano Banana 参考图应该扮演什么角色。

一张上传图可以表示很多事:

  • 保留身份
  • 保留产品形状
  • 复制光线
  • 复制色彩方案
  • 作为构图参考
  • 作为纹理参考
  • 只替换或编辑其中一部分

要明确说明。

使用图片 1 作为产品身份参考:保留瓶身形状、标签位置、瓶盖颜色和正面角度。
使用图片 2 只作为光线风格参考:匹配柔和晨光和白色台面,但不要复制其中物体。
使用图片 3 只作为构图参考:产品居中,上方留负空间。

上传多张参考图时,这一点尤其重要。如果你不分配角色,模型可能把它们混在一起,生成一张好看但不符合任务的图。

做产品图时,身份通常比风格更重要。做 moodboard 时,风格通常比具体物体更重要。做 UI 图时,布局通常比小字更重要。

在提示词里说清楚这个优先级。

如何迭代而不丢掉已经成功的部分

Nano Banana 是对话式的,所以要用对话方式使用它。

糟糕迭代:

再试一次,让它更好。

好的迭代:

保持相同产品、相机角度和背景。让图像更明亮,减少橙色色偏,并移除瓶子下方多余反光。

使用这个修改结构:

保留 [成功的部分]。
只改变 [一两个具体问题]。
避免 [上一张结果中的失败点]。

示例:

保持同一张人像和服装。只把背景从办公室改成户外咖啡馆。避免改变脸或发型。
保持相同构图。让笔记本电脑屏幕更简单,并移除假文字。使用干净块状元素而不是可读标签。
保持产品居中且完整可见。让阴影更柔和、更真实。不要改变标签。

不要在一个后续提示里改变所有东西。如果你同时要求新背景、新光线、新裁切、新风格和新物体位置,那就不再是编辑,而是在重新生成。

可直接复制的提示词模板

博客封面

为一篇关于 [主题] 的文章创建一张 16:9 博客封面图。
展示 [主要视觉场景]。
风格:[编辑风、干净 SaaS、真实产品摄影、手绘图解等]。
在 [左/右/上方] 留出标题负空间。
除非特别要求,不要包含文字、logo、水印或人脸。
避免泛泛的 AI 大脑图、不可读 UI 文字和视觉杂乱。

产品背景替换

编辑上传的产品图。
只把背景改成 [新背景]。
保持产品形状、颜色、材质、logo、标签位置、相机角度和阴影方向不变。
输出:[宽高比]。
避免多余产品、假标签、包装扭曲、比例改变和不真实反光。

人像背景编辑

编辑上传的人像。
保留人物的脸、发型、年龄感、表情、服装和身体比例。
只把背景改成 [新场景]。
光线应自然,并与主体匹配。
避免身份漂移、塑料感皮肤、服装改变、多余手和眼镜扭曲。

社交媒体图片

为 [平台] 创建一张 [1:1 / 4:5 / 9:16] 图片。
图片应该传达 [一个清晰想法]。
主体:[人物、产品、物体、场景]。
风格:[创作者风、编辑风、干净产品风、俏皮插画]。
保持构图简单,手机上易读。
避免小字、杂乱、假品牌标识和繁忙背景。

图解或信息图

创建一张解释 [概念] 的干净教育图解。
使用 [数量] 个带标签部分:[标签]。
使用简单形状和大号可读标签。
风格:浅色编辑风信息图,不要品牌 logo。
避免长段落、小字、假数据和装饰杂乱。

对于重要文字的图解,我仍然更喜欢确定性的 SVG 或设计工具。图像模型在进步,但精确文字仍然是最先需要检查的内容之一。

如何在 Gemini API 中使用 Nano Banana

如果你在构建应用,应该使用 Gemini API,而不是从 Gemini 应用手动下载图片。

概念很简单:

  1. 创建 Gemini API client。
  2. 选择支持图像的模型。
  3. 发送文本提示词,可选地带上图像输入。
  4. 请求图像输出。
  5. 保存返回的图像字节。
  6. 保存提示词、模型名称、输入参考图和输出元数据,保证可重复。

Google 当前 Python SDK 示例使用 client.interactions.createresponse_format 请求图像输出。简化版本如下:

from google import genai
import base64

client = genai.Client()

interaction = client.interactions.create(
    model="gemini-3.1-flash-image",
    input="Create a clean 16:9 blog cover about AI image editing. No text.",
    response_format={
        "type": "image",
        "aspect_ratio": "16:9",
        "image_size": "2K",
    },
)

if interaction.output_image:
    image_bytes = base64.b64decode(interaction.output_image.data)
    with open("nano-banana-cover.png", "wb") as f:
        f.write(image_bytes)

把它当成概念模式,而不是固定不变的代码片段。SDK 名称、辅助方法和模型可用性可能会改变,所以生产实现前要检查当前 Gemini API 文档。

生产工作流应记录:

  • 提示词
  • 模型名称
  • 日期和时间
  • 输入图像 ID
  • 输出文件路径
  • 宽高比
  • 安全或政策拦截
  • 用户可见的修订历史
  • 成本和延迟

图像生成是概率性的。日志决定了这是一次实验,还是一个可以调试的工作流。

Nano Banana 擅长什么

当你给它一个明确视觉任务时,Nano Banana 最强。

适合场景:

  • 博客和文章图片
  • 产品概念照片
  • 背景替换
  • 社交媒体视觉
  • Moodboard
  • 营销 mockup
  • UI 概念图
  • 简单图解
  • 带明确保留指令的角色或人像编辑
  • AI 艺术 refinement
  • 内部创意探索

当你需要快速从想法走到图片,而不想打开完整设计工具链时,它尤其有用。

甜点区不是“什么都做”。而是“为这个具体用途做出这张具体可用的图片”。

需要小心什么

有些任务仍然需要额外谨慎。

图像里的文字

短标签可能能用。长段落、法律文案、产品声明和精确字体仍然有风险。

重要文字最好先生成无文字视觉,再用确定性的编辑器添加文案。

使用:

为标题留出干净负空间。不要在图像中渲染标题。

Logo 和产品标签

AI 模型可能扭曲 logo、移动标签或发明多余品牌标记。如果 logo 很重要,要明确要求保留,并以全尺寸检查结果。

人脸和身份

处理人像时,每次编辑都重复保留身份的指令。检查脸型、眼神方向、头发、年龄感、皮肤纹理、手和服装。

真实人物、品牌和权利

不要上传或转换你无权使用的图片。谨慎处理名人、私人个体、儿童、商标、受版权保护角色和客户机密素材。

AI 编辑可以让图片视觉上更适合发布,同时也可能让它在法律或伦理上更有风险。

误导性编辑

如果 AI 编辑图像可能让观众误解真实人物、产品、地点或事件,要清楚标注,或者不要使用。Google 也在其 AI 图像生态中使用 SynthID 和水印方法,但水印不能替代诚实的发布语境。

实用检查清单

发布 Nano Banana 图片前,检查:

  • 主体是否仍然匹配目标人物、产品或物体?
  • 模型是否改变了任何 logo、标签、包装或界面细节?
  • 所有可见文字是否准确、可读?
  • 手、脸、阴影、反光和边缘是否可信?
  • 最终图像是否符合请求的宽高比?
  • 裁切是否适合目标平台?
  • 文件大小是否适合网页?
  • 你是否拥有源图和最终用途的权利?
  • 是否应该披露图片为 AI 生成或 AI 编辑?
  • 观众是否可能把图像误解为真实照片?

如果图像用于电商,把产品检查两遍。改变产品的漂亮图片,是糟糕的产品图片。

如果图像用于新闻、健康、金融、法律、政治或公众人物,提高检查标准。高信任语境中的合成视觉需要更多谨慎。

常见 Nano Banana 错误

错误 1:先写风格,后想用途

弱:

电影感,漂亮,高级,超真实。

更好:

为 SaaS 落地页创建一张 16:9 hero 图,展示明亮工作空间中笔记本电脑上的平静分析仪表盘。

风格有帮助,但用途领先。

错误 2:不说明什么必须保持不变

如果编辑产品、人像或 UI,提示词应该包含保留规则。否则模型可能会通过改变你最需要保留的东西来“改进”图片。

错误 3:一次要求太多编辑

先改背景,再改光线,再裁切,再改细节。

一次受控改变胜过五个模糊改变。

错误 4:相信图像文字

不要假设生成的文字正确。放大检查。对于广告、产品标签、法律声明、图表和 UI,精度重要时手动添加最终文字。

错误 5:每个草稿都用 Pro

如果你需要探索,先从更便宜的模型开始。用 Nano Banana 2 Lite 或 Nano Banana 2 生成大方向,再用 Nano Banana Pro 做最终处理。

错误 6:跳过权利审查

放大、编辑、换风格或重新生成图片,不会神奇地清除权利问题。原始输入仍然重要。

示例工作流

工作流 1:博客封面

  1. 用白话写下文章核心想法。
  2. 要求生成一张无文字的 16:9 编辑风图片。
  3. 生成三到六个方向。
  4. 选择一个。
  5. 用后续提示词调整光线、裁切和杂乱元素。
  6. 如有需要,稍后在 CMS 或设计工具里添加标题文字。

提示词:

为一篇关于学习使用 Nano Banana 的文章创建一张 16:9 编辑风博客封面。
展示笔记本电脑上的干净 AI 图像工作流:提示词面板、图像预览和检查清单。
风格:明亮现代科技编辑风,真实桌面,柔和日光,低饱和蓝色和琥珀色点缀。
不要文字、不要 logo、不要人物、不要机器人、不要水印。

工作流 2:产品照片清理

  1. 上传产品照片。
  2. 要求只改变背景。
  3. 强力保留产品身份。
  4. 检查标签、颜色、比例和阴影。
  5. 只有与原图对比后再导出。

提示词:

编辑这张产品照片。
只把背景改成干净白色影棚表面,并带柔和自然阴影。
保持产品形状、颜色、标签、logo 位置、相机角度和大小不变。
避免多余标签、包装改变、不真实反光和文字扭曲。

工作流 3:社交媒体创意

  1. 先定义平台比例。
  2. 每张图只表达一个想法。
  3. 考虑手机端可读性。
  4. 避免图中小字。

提示词:

创建一张关于 AI 图像编辑的 4:5 竖版社交图片。
在手机屏幕上展示简单的照片编辑前后对比,背景是干净桌面。
风格:明亮创作者风,真实但精致。
保持构图简单,手机上易读。
不要包含可读文字、logo 或水印。

工作流 4:API 驱动的图像功能

  1. 在 AI Studio 中原型测试提示词。
  2. 根据成本、质量和延迟选择模型。
  3. 构建启用图像输出的 API 调用。
  4. 保存输入和输出元数据。
  5. 为面向公众的素材加入人工检查。
  6. 为被拦截或失败的生成添加 fallback 行为。

很多团队在这里出错。他们先写代码,然后才发现创意工作流不稳定。先测试图像行为,再围绕它构建界面。

FAQ

Nano Banana 是什么?

Nano Banana 是 Google 对 Gemini 原生图像生成和编辑模型的昵称。它可以根据文本创建图像、编辑上传图像、组合文本与图像输入,并支持对话式修改。

如何使用 Nano Banana?

用 Gemini 应用做快速图像生成和编辑,用 Google AI Studio 测试提示词,或用 Gemini API 构建开发者工作流。提示词要定义用途、主体、参考图、编辑目标、输出格式和约束。

Nano Banana 免费吗?

可用性、免费访问和限制取决于产品入口、账号、地区和当前 Google 定价。在围绕某个免费额度构建工作流前,检查 Gemini 应用、Google AI Studio 和 Gemini API 的实时定价页面。

最好的 Nano Banana 模型是什么?

对大多数用户来说,Nano Banana 2 是最佳起点。Nano Banana Pro 更适合最终产品、营销和文字敏感图像。Nano Banana 2 Lite 更适合成本更低的草稿和高批量探索。

Nano Banana 可以编辑现有图片吗?

可以。上传图片,然后准确说明要改变什么、保留什么。使用“只改变背景”和“保持产品形状、标签、颜色和 logo 不变”这样的短语。

Nano Banana 可以生成带文字的图片吗?

可以生成包含文字的图像,而且新的 Gemini 图像模型比旧系统更擅长这一点。但你仍然应该检查所有文字。对于重要标题、法律文案、logo、标签和 UI 文字,在设计工具中添加最终文字更稳。

可以用 Nano Banana 做商业图片吗?

商业使用取决于 Google 产品条款、你的账号、你的输入图片和最终用例。你仍然需要拥有上传图片的权利,以及安全使用生成结果的理由。

Nano Banana 会添加水印吗?

Google 的公开材料描述了其 Gemini 图像生态中的 AI 生成图像 SynthID 和水印方法。具体用户可见行为可能取决于产品入口和发布阶段,所以请检查你正在使用工具的当前 Gemini 文档。

最好的 Nano Banana 提示词是什么?

最好的提示词不是魔法句子。使用结构化简报:用途、主体、参考图、编辑目标、输出格式和约束。素材越重要,就越具体说明什么不能改变。

应该使用 Gemini 应用、AI Studio 还是 API?

快速个人创作用 Gemini 应用,测试提示词和比较模型用 AI Studio,需要自动化、可重复、日志记录或产品功能时用 API。

最终结论

使用 Nano Banana 的最佳方式,是把它当作视觉编辑器,而不是老虎机。

从任务开始。命名主体。告诉每张参考图它的角色。一次只做一个改变。保留重要细节。然后像真正要发布的人一样检查结果,而不是像被第一张漂亮草稿打动的人那样检查。

这个工作流比输入“让它电影感一点”慢。

但它也是“看起来有意思的图片”和“真正能用的图片”之间的区别。

已检查来源

本文基于 2026 年 9 月 15 日检查的公开产品信息:

Nano Banana 工作室

用一套适合快速草稿和精修成片的流程,创建、编辑并比较 AI 图像。

探索 AI 工作室