来源:OpenRouter API(scraper 采集,2026-06-30)
Google DeepMind于2026年4月发布的Gemma 4 26B A4B IT是一款旗舰级开源多模态模型。它采用混合专家(MoE)架构,总参数量为25.2B,但推理时仅激活约3.8B参数,这一设计使其在提供接近大型模型性能的同时,推理速度接近4B级模型。
该模型专为消费级GPU和工作站设计,支持高达256K的上下文窗口,并原生支持函数调用,非常适合构建复杂的智能体工作流。其多模态能力覆盖文本、图像和视频理解(通过处理帧序列),并支持超过140种语言。凭借Apache 2.0许可证,该模型对商业应用和本地部署非常友好,开发者可通过GGUF等量化格式在自有硬件上运行。
OpenRouter Provider 比价
共 10 家 provider(2026-06-30 采集),按输入价升序:
| Provider | 输入(USD/1M) | 输出(USD/1M) | 量化 | 上下文 |
|---|---|---|---|---|
| DekaLLM | 0.06 | 0.33 | bf16 | 262144 |
| DeepInfra | 0.07 | 0.34 | fp8 | 262144 |
| Cloudflare | 0.1 | 0.3 | unknown | 256K |
| SiliconFlow | 0.12 | 0.4 | fp8 | 262144 |
| Novita | 0.13 | 0.4 | bf16 | 262144 |
| Parasail | 0.13 | 0.4 | bf16 | 262144 |
| NextBit | 0.13 | 0.4 | bf16 | 262144 |
| Wafer | 0.13 | 0.4 | fp8 | 262144 |
| 0.15 | 0.6 | unknown | 262144 | |
| Venice | 0.1625 | 0.5 | bf16 | 256K |
代表价(满血最低):DekaLLM 输入 0.06 / 输出 0.33 USD/1M。按 provider 选择可进一步降本。