模型

Google: Nano Banana Pro (Gemini 3 Pro Image)

仅 API 可商用
Google · 商业闭源 · 未公开 / 激活 未公开 · 上下文 64K
能做什么
图像生成聊天问答多模态理解
部署门槛
待补充
上下文
64K
token 窗口
参数
未公开
MoE · 激活 未公开

01基础参数

参数规模
未公开
上下文窗口
64K
输入模态
image / text
可生成
image / text
模型系列
开源许可
商业闭源
主要语言
multi

02MoE 架构说明

MoE 混合专家 总参 未公开 · 激活 未公开
部署门槛按「激活参数」计算,不等同于总参数量——这是 MoE 模型更易部署的关键。

03部署门槛详情

硬件等级 待补充

04Benchmark 评测

待补充

05适用场景

✓ 适用
高保真图像生成与精细编辑工作流、图文协同的复杂视觉内容创作、多角色/多场景一致的视觉叙事项目
✗ 不适用
完全离线本地部署(闭源仅 API)、极低延迟/极低成本的简单图像生成、纯文本深度推理(应使用 Gemini 3 Pro)、商用注意 SynthID/C2PA 水印(待验证,以官方信息为准)

06部署与限制

⚙ 本地部署建议
该模型为闭源云端 API 服务,无法进行本地部署。开发者需通过 Google Gemini API、Vertex AI 或 OpenRouter 等第三方平台调用。建议根据项目需求选择 2K 或 4K 输出以平衡成本与质量。
⚠ 已知限制
作为闭源商业模型,使用成本较高且依赖 Google 云服务。模型知识截止于 2025 年 1 月;虽支持搜索 grounding 获取实时信息,但生成内容的准确性与时效性仍受外部数据源影响。商用须注意 SynthID/C2PA 水印(以官方信息为准)。

07详细介绍

Google Gemini 3 Pro Image(官方代号 Nano Banana Pro)是 Google DeepMind 于 2025 年 11 月推出的旗舰级图像生成与编辑模型。它基于 Gemini 3 Pro 的多模态推理架构构建,将大语言模型的强大理解能力与高保真视觉合成技术深度融合,标志着 AI 图像生成从“随机创作”向“可控的工业化生产”迈进。

该模型的核心优势在于其“先理解、再表达”的工作流:它能深入解析复杂的文本提示,并可调用 Google 搜索获取实时信息(如天气、股票数据)来增强生成内容的相关性与准确性。在输出质量上,它支持原生 2K 乃至 4K 分辨率,并在行业内率先实现了可靠的多语言文字渲染。此外,其强大的角色一致性能力可同时在多张图像中保持多达 5 个人物的特征连贯,配合对多达 14 张参考图像的融合能力,使其成为专业设计师、内容创作者和营销人员在概念设计、广告物料、信息图表等领域的强大生产力工具。

OpenRouter Provider 比价

共 2 家 provider(2026-06-30 采集),按输入价升序:

Provider输入(USD/1M)输出(USD/1M)量化上下文
Google2.012.0unknown65536
Google AI Studio2.012.0unknown131072

代表价(满血最低):Google 输入 2.0 / 输出 12.0 USD/1M。各 provider 价格一致,无降本空间。

08官方资源

09同类模型