模型

Google: Nano Banana 2 (Gemini 3.1 Flash Image)

仅 API 可商用
Google · 商业闭源 · 未公开 · 上下文 128K
能做什么
图像生成聊天问答内容创作
部署门槛
待补充
上下文
128K
token 窗口
参数
未公开

01基础参数

参数规模
未公开
上下文窗口
128K
输入模态
image / text
可生成
image / text
模型系列
开源许可
商业闭源
主要语言
multi

02MoE 架构说明

MoE 混合专家 总参 未公开 · 激活
部署门槛按「激活参数」计算,不等同于总参数量——这是 MoE 模型更易部署的关键。

03部署门槛详情

硬件等级 待补充

04Benchmark 评测

待补充

05适用场景

✓ 适用
高吞吐量、低成本的图像生成与编辑工作流、需要角色/物体一致性的叙事与分镜创作、营销素材、信息图、产品设计原型的快速制作
✗ 不适用
需要最高保真度与最大事实准确性的专业级任务(建议Nano Banana Pro)、本地私有化部署场景(仅云端API)、对图像生成成本极度敏感的超大规模免费应用(可考虑Nano Banana 2 Lite)

06部署与限制

⚙ 本地部署建议
该模型为闭源云端API服务,无法进行本地部署。开发者需通过Google Gemini API、Vertex AI或OpenRouter等第三方平台调用。
⚠ 已知限制
架构细节、参数量、训练数据及渲染模型等核心技术信息未公开。4K输出能力在发布初期为预览状态,GA后1K和2K输出已正式可用。部分API参数(如imageSize)在实际调用中可能存在行为差异。

07详细介绍

Google Gemini 3.1 Flash Image(俗称 Nano Banana 2) 是Google于2026年2月27日推出的新一代图像生成与编辑模型。它基于Gemini 3 Flash的MoE(混合专家)Transformer架构构建,定位介于高速低成本的“Flash”系列与最高质量的“Pro”系列之间,旨在以Flash级的生成速度和成本实现接近Pro级的视觉质量与推理能力。

该模型原生支持多模态输入(文本+图像)与多模态输出(文本+图像),具备精准的文本渲染能力、多语言支持、以及最多5个角色和14个对象在跨图像生成中的一致性保持能力。它还支持实时联网搜索(Web Grounding),可根据最新网络信息生成更准确、更贴合上下文的图像。模型输出分辨率最高可达4K,并内置SynthID数字水印与C2PA内容凭证,确保生成内容的可追溯性。Gemini 3.1 Flash Image已通过Gemini API、Vertex AI及OpenRouter等平台向开发者开放,并集成于Google Gemini应用、搜索及视频编辑工具Flow中。

OpenRouter Provider 比价

共 2 家 provider(2026-06-30 采集),按输入价升序:

Provider输入(USD/1M)输出(USD/1M)量化上下文
Google0.53.0unknown131072
Google AI Studio0.53.0unknown65536

代表价(满血最低):Google 输入 0.5 / 输出 3.0 USD/1M。各 provider 价格一致,无降本空间。

08官方资源

09同类模型