Gemini 3.5 Flash 是 Google 于 2026 年 5 月 19 日在 Google I/O 大会上发布的 Gemini 3.5 系列首款模型。它打破了以往“先旗舰后轻量”的发布惯例,率先上线并直接成为 Gemini App 与 Google 搜索 AI 模式的默认模型。该模型主打“前沿智能与行动能力”的结合,专注于为 AI 智能体、代码生成和复杂工作流提供高性能支持。其核心优势在于平衡了顶尖的推理能力与极高的输出速度(据称可达同类模型的 4 倍),同时在多项智能体和编码基准测试中超越了前代旗舰模型 Gemini 3.1 Pro。
Gemini 3.5 Flash 支持高达 1M token 的输入上下文和 65,536 token 的输出,并能处理文本、图像、音频、视频及 PDF 等多种输入模态。它引入了“动态思考”(Dynamic Thinking)机制,允许模型根据任务复杂度自动调整计算投入,用户也可通过 thinking_level 参数在速度与质量间进行细粒度权衡。该模型尤其适用于长周期智能体任务、多文件代码编写、终端自动化以及多模态文档分析等场景。然而,作为一款闭源 API 模型,它无法进行本地部署,且在部分纯抽象推理基准上的表现仍不及更大型的旗舰模型。
OpenRouter Provider 比价
共 2 家 provider(2026-06-30 采集),按输入价升序:
| Provider | 输入(USD/1M) | 输出(USD/1M) | 量化 | 上下文 |
|---|---|---|---|---|
| 1.5 | 9.0 | unknown | 1048576 | |
| Google AI Studio | 1.5 | 9.0 | unknown | 1048576 |
代表价(满血最低):Google 输入 1.5 / 输出 9.0 USD/1M。各 provider 价格一致,无降本空间。