今天谷歌又发新东西了,这次不是聊天模型,是图像模型 Nano Banana 2.1。
看到消息的时候我第一反应是"又迭代了"。但认真看了下更新点,发现这次升级对普通人的价值比想象中大,因为它的三个重点全是奔着"改图"去的,不是奔着"从零画图"。
大多数人用 AI 生图的痛点其实不是画不出来,是画出来了但不满意,想改又不知道怎么改。这次更新恰好就在解决这个问题。我把官方更新点拆开讲一遍,再给你几条我平时在用的指令模板,直接抄就能用。
01 这次到底更新了什么
Nano Banana 2.1 是谷歌图像生成与编辑模型的升级版本,上一代叫 Nano Banana 2(模型代号 Gemini 3.1 Flash Image),今年早些时候发布,当时就已经把 Pro 级的画质塞进了 Flash 级的速度里,成本比 Nano Banana Pro 降了四成左右。
这次的 2.1 官方说法是"全方位提升",但重点点名了三块:
一是视觉设计能力。做海报、封面、电商图这类有明确设计诉求的场景,出图的设计感更强了,不再是一眼 AI 图的塑料质感。
二是蒙版编辑。这个是我认为最实用的。你可以圈出图片的一小块区域单独改,别的地方不动。以前想给照片里的人物换个背景,或者把桌上的杯子换成花瓶,AI 经常会把整张图重画一遍,人脸都变了。蒙版编辑就是让 AI 只动你圈的那块。
三是主体一致性。上一代已经能做到 5 个角色保持特征一致,这一代继续加强。对做连续内容的人很关键:你给账号画了个 IP 形象,第二张图它不能变脸。
02 为什么说改图比生图更重要
这里说下我的判断:图像模型卷到今天,“从零生成"的能力早就溢出了,真正的门槛在"精确修改”。
你回想一下自己用 AI 生图的流程:写一段提示词,出四张图,挑一张最不烂的,然后想"要是左边那个字能改一下就好了"。改不动,就再抽卡。抽十次能有一次接近预期就不错了。
蒙版编辑和主体一致性这两个能力,本质是把"抽卡"变成"施工"。你先拿到一张 80 分的图,然后一块一块地修到 95 分,而不是指望一次抽卡直接出 95 分。这是工作流的差别,不是参数的差别。
做自媒体的应该体会最深:封面图的文字、logo、人物表情,每次都要微调。以前靠 PS,现在可以全部用指令完成。
03 六条可以直接抄的指令
下面这六条是我整理的指令模板,覆盖最高频的几个修图场景。用的时候把方括号里的内容换成你自己的信息就行。
① 换背景(保人物)
把这张照片的背景换成[办公室/海边/纯白影棚],保持人物的位置、姿势、 光线方向和面部特征完全不变,新背景的光影要与人物原光线匹配。关键在后半句。"光线方向"和"光影匹配"这两个词要写,否则人物和背景会有明显的"贴上去"感。
② 局部替换(蒙版思路)
只修改图片中[左下角的杯子],把它换成[一束花],图片其余部分 包括人物的姿态、表情、服装和背景全部保持原样,不要重新生成整张图。"不要重新生成整张图"这句很重要,要明确告诉模型你的意图是局部编辑。
③ 文字修改
把图片中的文字[旧文案]替换为[新文案],字体、字号、颜色、位置 与原文字保持一致,中文渲染要清晰无错字。文字渲染曾经是所有图像模型的死穴,中文尤其惨。从 Nano Banana 2 开始中文渲染大幅改善,2.1 继续强化,现在改封面标题的错别字基本可靠了。
④ 保持角色一致出系列图
参考这张图中的角色形象,生成同一角色的新场景图:角色在[咖啡馆用电脑], 保持发型、五官、服装风格与参考图完全一致,画风统一。做 IP 形象、条漫、系列封面的核心指令。一次只锁定一个角色,成功率最高。
⑤ 提升画质
将这张图片提升为高清版本,增强细节和纹理,修正噪点和模糊, 保持原始构图、色彩风格和所有内容不变,不要添加或删除任何元素。老照片修复、截图变清晰、表情包变高清,都用这条。
⑥ 风格转换
把这张照片转换为[吉卜力风格/赛博朋克风格/水彩画风格], 保留原图的构图和主体内容,人物的辨识度要保留,能一眼认出是同一个人。"能一眼认出是同一个人"是个很好用的约束,比"保持一致"效果更稳定。
04 免费入口在哪
普通用户直接打开 Gemini 应用就能用,Nano Banana 2 上线时谷歌已经把原来 Pro 专属的能力开放给了免费用户,包括联网搜索生成实时信息的图、可读文字的渲染这些。2.1 今天上线后逐步替换默认模型。
开发者走 Google AI Studio 或 Gemini API,模型 ID 用 gemini-3.1-flash-image 系列(不是 nano-banana-2,这个命名错位已经坑过不少人),价格大约是 Nano Banana Pro 的一半。
国内用户没法直接访问的话,可以在 ai345 的 AI 工具导航里搜"图像生成",分类里整理了目前能用的各类 AI 绘图和修图工具,按场景挑很方便:https://www.ai345.info/?ref=csdn
05 一点冷静的判断
最后泼点冷水。
这次更新值得用,但别指望它改变什么格局。图像模型现在的竞争已经进入"细节打磨期",每次升级的体感差异越来越小,就像手机摄像头的年度迭代。你要是已经在用 Nano Banana 2,2.1 是顺手升级;你要是还没把 AI 修图用起来,现在入场正是好时候,因为工具已经便宜、快速、够好了。
真正的分水岭不在工具,在工作流。同样一个模型,有人拿来抽卡玩,有人搭出"生图、蒙版修改、文字替换"的标准化流程,一天能出五十张可用素材。指令模板只是起点,关键是把上面这些套路固化成你自己的流程。
参考资料
- IT之家:谷歌 AI 图像模型 Nano Banana 2.1 发布
https://finance.sina.com.cn/tech/digi/2026-10-07/doc-iniukaaq6305860.shtml - 澎湃新闻:谷歌 Nano Banana 2 向免费用户开放
https://www.thepaper.cn/newsDetail_forward_32668145 - Nano Banana 2 全网最全攻略(人人都是产品经理)
https://www.woshipm.com/ai/6345935.html - ai345.info:AI 工具导航
https://www.ai345.info/?ref=csdn