模型

Google: Gemini 3.5 Flash

仅 API 可商用
Google · 商业闭源 · 未公开 · 上下文 1024K
能做什么
Agent工作流编程开发逻辑推理长文档分析多模态理解
部署门槛
待补充
上下文
1024K
token 窗口
参数
未公开

01基础参数

参数规模
未公开
上下文窗口
1024K
输入模态
audio / file / image / text / video
可生成
text
模型系列
开源许可
商业闭源
主要语言
multi

02部署门槛详情

硬件等级 待补充

03Benchmark 评测

待补充

04适用场景

✓ 适用
AI智能体开发与复杂工作流自动化、高要求的代码生成与多文件重构任务、需要快速响应的流式对话与实时应用、多模态长文档分析与理解
✗ 不适用
对原始知识库和纯抽象推理要求极高的场景(如ARC-AGI-2)、需要本地离线部署的环境、对成本极度敏感且任务简单的轻量级应用(相比更廉价模型)

05部署与限制

⚙ 本地部署建议
Gemini 3.5 Flash为闭源API模型,不提供本地部署。需通过Google AI Studio、Vertex AI或Gemini API等云端服务调用。生产环境部署时,建议在网关层做好队列机制和重试策略,以应对高并发。
⚠ 已知限制
闭源模型,无法本地部署或私有化定制。在ARC-AGI-2等纯抽象推理基准上表现落后于Gemini 3.1 Pro。输出限制为65,536 tokens。知识截止于2026年1月。

06详细介绍

Gemini 3.5 Flash 是 Google 于 2026 年 5 月 19 日在 Google I/O 大会上发布的 Gemini 3.5 系列首款模型。它打破了以往“先旗舰后轻量”的发布惯例,率先上线并直接成为 Gemini App 与 Google 搜索 AI 模式的默认模型。该模型主打“前沿智能与行动能力”的结合,专注于为 AI 智能体、代码生成和复杂工作流提供高性能支持。其核心优势在于平衡了顶尖的推理能力与极高的输出速度(据称可达同类模型的 4 倍),同时在多项智能体和编码基准测试中超越了前代旗舰模型 Gemini 3.1 Pro。

Gemini 3.5 Flash 支持高达 1M token 的输入上下文和 65,536 token 的输出,并能处理文本、图像、音频、视频及 PDF 等多种输入模态。它引入了“动态思考”(Dynamic Thinking)机制,允许模型根据任务复杂度自动调整计算投入,用户也可通过 thinking_level 参数在速度与质量间进行细粒度权衡。该模型尤其适用于长周期智能体任务、多文件代码编写、终端自动化以及多模态文档分析等场景。然而,作为一款闭源 API 模型,它无法进行本地部署,且在部分纯抽象推理基准上的表现仍不及更大型的旗舰模型。

OpenRouter Provider 比价

共 2 家 provider(2026-06-30 采集),按输入价升序:

Provider输入(USD/1M)输出(USD/1M)量化上下文
Google1.59.0unknown1048576
Google AI Studio1.59.0unknown1048576

代表价(满血最低):Google 输入 1.5 / 输出 9.0 USD/1M。各 provider 价格一致,无降本空间。

07官方资源

08同类模型