模型

Google: Gemini 3.1 Flash Lite

仅 API 可商用
Google · 商业闭源 · — · 上下文 1024K
能做什么
聊天问答智能客服知识问答多模态理解
部署门槛
待补充
上下文
1024K
token 窗口
参数

01基础参数

参数规模
上下文窗口
1024K
输入模态
audio / file / image / text / video
可生成
text
模型系列
开源许可
商业闭源
主要语言
multi

02部署门槛详情

硬件等级 待补充

03Benchmark 评测

待补充

04适用场景

✓ 适用
大规模轻量级Agent工作流、数据提取与内容分类、翻译与转写任务、路由和任务分发
✗ 不适用
复杂多步推理、高难度创意编程、需要深度推理的数学问题

05部署与限制

⚙ 本地部署建议
本模型为闭源云端API模型,不支持本地部署。通过Google AI Studio、Vertex AI或Cloudflare等平台调用,无需本地硬件。
⚠ 已知限制
仅支持文本输出,不支持图像生成。虽基于Gemini 3 Pro,但为了极致的性价比和低延迟,在复杂推理和创造性任务上能力弱于同系列的Flash和Pro版本。知识截止于2025年1月。

06详细介绍

来源:OpenRouter API(scraper 采集,2026-06-30)

Gemini 3.1 Flash Lite 是 Google 于 2026 年 5 月 7 日正式发布的 Gemini 3 系列中最轻量、最高性价比的模型,专注于为大规模生产环境提供极致低延迟和高吞吐量的服务。该模型基于 Gemini 3 Pro 架构优化,原生支持多模态输入(文本、图片、音频、视频和 PDF),上下文窗口高达 1024K(约 100 万 token),并支持输出最长 64K token 的文本结果。其定价仅为输入 $0.25/百万 token、输出 $1.50/百万 token,大幅降低了大规模 API 调用的成本门槛。

该模型的核心亮点在于提供了从 minimal 到 high 四档可配置的思考强度(Thinking Levels),允许开发者在延迟、成本和推理质量之间进行精细权衡。它尤其适合处理翻译、内容分类、数据提取、音频转写等高频重复性任务,也可作为智能路由层,将复杂请求分流给更高级的模型处理。然而,由于其追求极致的性价比,在处理复杂的多步推理、高难度编程或创意性任务时,能力会弱于同系列的 Flash 和 Pro 版本,且不支持图像生成。

OpenRouter Provider 比价

共 2 家 provider(2026-06-30 采集),按输入价升序:

Provider输入(USD/1M)输出(USD/1M)量化上下文
Google0.251.5unknown1048576
Google AI Studio0.251.5unknown1048576

代表价(满血最低):Google 输入 0.25 / 输出 1.5 USD/1M。各 provider 价格一致,无降本空间。

07官方资源

08同类模型