谷歌10月6日宣布推出图像生成与编辑模型 Nano Banana 2.1,并从当天起在 Gemini 应用、AI Mode、Google AI Studio、Google Flow、Stitch by Google、Google Ads 及 Gemini Enterprise Platform 等多项服务中陆续推送。据 Android Authority 报道,谷歌称新版本在视觉设计、基于蒙版的编辑和主体一致性三个方面均有改进。
谷歌通过社交平台公布了这一更新。上一版本 Nano Banana 2.0 于今年2月发布,当时使模型能够生成最高 4K 分辨率的图像。
Gemini 开发者网站给出了更具体的技术说明。Nano Banana 2.1 在 1K、2K 和 4K 输出分辨率下提升了画面质量与真实感,默认输出为 1K;修复了 2K 和 4K 分辨率下宽幅与全景画幅(1:4、4:1、1:8、8:1)的拼接伪影;增强了文字渲染和信息图排版的准确度。模型支持多图融合,最多可引用 14 张参考图,其中可维持最多 4 个角色的形象一致性和最多 10 个物体的还原度。它还可借助 Google 网页搜索与图片搜索进行接地,并提供可配置的思考等级,分为最低、中等(默认)和最高三档。
谷歌把 Nano Banana 2.1 定位为 Nano Banana Pro 更高效的对应版本。
上述能力与推送范围来自谷歌的社交帖文与 Gemini 开发者网站,报道未提及该版本是否向所有地区的用户同步开放。