谷歌近日正式推出 Nano Banana 2.1,这款最新的图像生成与编辑模型在视觉设计、基于蒙版的编辑以及主体一致性方面实现了显著跃升。

今年二月,谷歌曾发布支持最高 4K 分辨率的 Nano Banana 2.0。此次迭代的 2.1 版本在多项核心指标上进一步超越前代。官方指出,新版本重点优化了视觉质感、蒙版编辑体验及主体保持能力。

核心功能亮点

根据 Gemini 开发者网站披露的信息,Nano Banana 2.1 的主要更新包括:

  • 全分辨率画质提升:在 1K(默认)、2K 和 4K 输出下,视觉质量与真实感均得到全面增强;
  • 修复宽幅伪影:解决了 2K 和 4K 分辨率下,宽幅及全景比例(如 1:4、4:1、1:8、8:1)出现的平铺伪影问题;
  • 文本与布局优化:提升了文本渲染精度及信息图表布局的准确性;
  • 多图像融合能力:支持最多参考 14 张图像进行融合,确保最多 4 个人物的一致性以及最多 10 个物体的保真度;
  • 搜索内容定位:结合 Google 网页搜索和图片搜索技术,实现更精准的内容定位(Grounding);
  • 可配置思考层级:提供最低、中等(默认)及最高三种“思考”层级供用户选择。

谷歌表示,Nano Banana 2.1 旨在成为 Nano Banana Pro 更具效率的替代方案。目前,该模型正逐步向 Gemini App、AI Mode、Google AI Studio、Google Flow、Stitch by Google、Google Ads 以及 Gemini Enterprise Platform 等多个谷歌服务平台推送。