2026-10-06 Google 正式推出 Nano Banana 2.1,并在 Gemini API 更新日志中标记 GA,模型 ID gemini-nano-banana-2.1,基于 Gemini 3.6 Flash,同步上线 Gemini App、AI Studio、Search AI Mode、Flow、Stitch、Google Ads 与 Gemini Enterprise Agent Platform。定价页显示图像输出 $30/百万 token(旧版 $60),1K/2K 单张 $0.0336/$0.0504,比 Nano Banana 2 便宜约一半;模型卡人类盲评文生图 Elo 1050,高于 Nano Banana 2 的 990 和 Pro 的 935。旧模型 gemini-3.1-flash-image 已标记弃用(暂未公布下线日期)。此前我们报道过它在 Flow 中静默上线,现已官方确认。
核心要点速览
- ✓单张价格:1K $0.0336(旧 $0.067,-50%)、2K $0.0504(旧 $0.101,-50%)、4K $0.113(旧 $0.151,-25%);Batch 再打五折至 $0.0168/1K(定价页)
- ✓但文本侧变贵:输入 $1.50/百万 token(旧 $0.50),文本+思考输出 $7.50(旧 $3),长 prompt、多参考图任务需重新核算成本
- ✓盲评 Elo(模型卡):文生图总体偏好 1050 vs NB2 990 vs Pro 935;多角色一致性 1106 vs 978 vs 1011;信息图事实性 0.521 vs 0.179 vs 0.265
- ✓能力规格:最多 14 张参考图(4 个角色 + 10 个物体)、修复 1:8/8:1 超宽比 2K/4K 拼接伪影、Google 网页+图片搜索 grounding、思考档位 minimal/medium/high
- ✓迁移:
gemini-3.1-flash-image已弃用(暂无下线日期);API 输入上限 131,072 token,不支持 function calling / structured outputs / 缓存(模型文档)
开发者 3 秒速决决策指标
把技术选型换算成你的开发预算
40 款主流编程套餐横向比价,支持输入/输出 Token 真实账单模拟
相关资源与官方项目出处
免代理直达深度技术解析与实战评估
核心背景与行业痛点
图像生成已经成了 Agent、电商和广告流程里的高频调用,开发者最在意三件事:单张成本、多轮编辑时角色是否一致、图里的文字能不能用。Nano Banana 2(gemini-3.1-flash-image)速度快,但 2K/4K 超宽比会出现拼接伪影,信息图事实错误也多。此前社区发现 2.1 已在 Flow 里静默上线;10 月 6 日 Google 正式发布,并在 Gemini API 更新日志中直接标记 GA。
架构亮点与底层机制
根据模型卡,2.1 基于 Gemini 3.6 Flash,原生多模态,支持文本、图像、视频、PDF 输入,输出图像和文本。主要升级:1K/2K/4K 三档分辨率(默认 1K),修复 1:4、4:1、1:8、8:1 在 2K/4K 下的拼接伪影;多图融合最多 14 张参考图(4 个角色 + 10 个物体);支持 Google 网页与图片搜索 grounding;思考档位分 minimal、medium(默认)、high 三级。
权威 Benchmark 与实测跑分对比
模型卡给出人类盲评 Elo(思考模式):文生图总体偏好 1050,Nano Banana 2 为 990,Nano Banana Pro 为 935;通用编辑 1026,后两者为 938/939;多角色一致性 1106,后两者为 978/1011;信息图事实性 0.521,后两者为 0.179/0.265。以上都是 Google 自测,暂无第三方复现。
开发者实战落地与开箱指南
把模型名改为 gemini-nano-banana-2.1 即可,旧 ID 已弃用,暂未公布下线日期。定价:图像输出 $30/百万 token,1K/2K/4K 单张 $0.0336/$0.0504/$0.113,Batch 再打五折;但文本输入涨到 $1.50、文本输出涨到 $7.50。该模型不支持 function calling、structured outputs 和缓存,Agent 编排需要在外层完成。详见模型文档。
即刻查看该技术对应模型与主流工具的实测差异,或一键测算团队 API 调用与 $20/月套餐盈亏平衡点。
讨论与评论
0登录后即可参与深度讨论
与广大 AI 开发者、工程师交流评测心得与前沿洞察