谷歌发布 Nano Banana 2.1:局部编辑与主体一致性升级
谷歌10月7日发布 Nano Banana 2.1,在视觉设计、蒙版编辑和主体一致性三方面升级,并已覆盖 Gemini 应用、谷歌广告等平台。对需要批量出图、做系列角色或品牌素材的运营者和创作者,这次更新可能降低局部修改与形象统一的成本。
发生了什么
10月7日,谷歌正式发布 Nano Banana 2.1,这是其 AI 图像生成与编辑模型的升级版本。谷歌表示,新版在视觉设计、基于蒙版的图像编辑以及主体一致性几方面的进步尤为突出。
今年早些时候,谷歌已推出 Nano Banana 2,也被称为 Gemini 3.1 Flash Image。该版本在具备谷歌 Flash 系列模型高速特性的同时,实现了与 Nano Banana Pro 同级别的出图质量,并把现实世界知识库、文字渲染效果优化、角色与物体一致性表现等原本属于 Pro 版本的功能下放至这款定位更低的模型。
此次 Nano Banana 2.1 主要在三个方向做出改进:生成构图效果更佳、完成度更高的视觉素材;更精准地选中并修改现有图像的局部区域;以及在编辑操作或批量生成多张关联图片时,更好地保留画面主体的样貌与特征。
关键事实
- Nano Banana 2.1 现已逐步部署上线,覆盖 Gemini 应用、谷歌搜索的 AI 模式、Google AI Studio、Google Flow、Stitch、谷歌广告以及 Gemini 企业平台。
- 面向开发者,模型 ID 为 gemini‑nano‑banana‑2.1,支持文本、图片、音频以及视频输入,可输出 1K、2K 以及 4K 分辨率的图像。
- 谷歌表示,改进后的主体一致性可以保证同一个人物或者物体在多次生成结果当中保持样貌统一。
- 目前 OpenAI 的 ChatGPT Images 2.5 依旧是全球领先的图像生成编辑模型,在持续微调图片时更擅长保留上一轮修改成果,不会改动没有编辑的区域,也不会随着反复迭代让原图画质变差。
- 微软 AI 的 MAI‑Image‑2.6 模型于今年 8 月发布,排在 OpenAI 之后。
我们的分析
这次更新把重点放在蒙版编辑和主体一致性,可能意味着谷歌正在补齐图像编辑体验中的关键短板。原文提到,OpenAI 的 ChatGPT Images 2.5 在全球领先,尤其在持续微调时不会改动未编辑区域、不会让画质变差。Nano Banana 2.1 强调“无需重新生成整张画面”和“保留主体样貌”,方向与其接近,但能否达到同样体验仍需实际使用验证。
对内容创作者和品牌运营者来说,主体一致性一直是个实用痛点。此前 Nano Banana 2 已把角色与物体一致性从 Pro 版本下放,2.1 再次强化,意味着生成同一人物、同一产品在多次结果中的样貌统一度可能更高。这对连载式角色、商品图、活动海报等系列素材尤其重要。
覆盖谷歌广告和 Gemini 企业平台,也意味着企业团队可能直接在广告素材流程里使用这些能力。不过,原文同时指出 ChatGPT Images 2.5 仍领先,因此这次更新更像是在缩短差距,而不是改变整体竞争格局。
对运营者意味着什么
- 如果你已经在用 Gemini 应用或 Google AI Studio,可以先拿同一角色或同一产品做批量生成测试,观察多次出图能否保持样貌一致,再决定是否用于系列素材生产。
- 用蒙版编辑处理已有视觉素材的局部问题,比如只替换背景元素、修改文字或产品细节,避免整张重绘,可以更快输出适配不同平台的版本。
- 按投放渠道选择 1K、2K、4K 输出分辨率,避免大幅缩放后画质不足;也可以把该模型接入谷歌广告素材测试,看是否能减少人工修图环节。
- 团队如果经常对一张图反复微调,仍可保留 OpenAI ChatGPT Images 2.5 作为对照工具,用其验证“不改动未编辑区域”的效果,并把谷歌模型用于批量生成与局部修改场景。
信息来源:谷歌 AI 图像模型 Nano Banana 2.1 发布,提升视觉设计、蒙版编辑、主体一致性 — IT之家(2026-10-07)
编辑说明:本文由 NoobClaw 编辑部借助 AI 基于上述公开报道整理与分析,事实以原文为准;分析部分为编辑部观点。发现错误请联系我们更正。
