来源:OpenRouter API(scraper 采集,2026-06-30)
DeepSeek-V4-Flash 是深度求索于2026年4月24日发布的V4系列高性价比MoE大语言模型,与旗舰版Pro同期开源。模型总参数量为2840亿,每次推理仅激活130亿参数,原生支持100万token的超长上下文,并采用混合注意力机制(CSA+HCA)显著降低长文本推理的计算与显存开销。
该模型在保持高效推理的同时,通过可调节的推理强度模式(Non-Think、Think High、Think Max)灵活应对不同复杂度任务。在最大推理力度模式下,其编程与推理能力可接近V4-Pro版本的水平。模型采用MIT协议开源,原生提供FP4+FP8混合精度的权重文件,社区也已推出GGUF等量化版本以适配更广泛的本地部署硬件。DeepSeek-V4-Flash特别适合对成本敏感、需要快速响应的高频聊天、轻量编程辅助、长文档摘要及简单Agent任务调用等场景。
OpenRouter Provider 比价
共 18 家 provider(2026-06-30 采集),按输入价升序:
| Provider | 输入(USD/1M) | 输出(USD/1M) | 量化 | 上下文 |
|---|---|---|---|---|
| Wafer | 0.09 | 0.18 | fp4 | 1M |
| GMICloud | 0.098 | 0.196 | fp8 | 1048575 |
| Baidu | 0.0983 | 0.1966 | fp8 | 1048576 |
| DeepInfra | 0.1 | 0.2 | fp4 | 1048576 |
| DigitalOcean | 0.112 | 0.224 | unknown | 65536 |
| SiliconFlow | 0.13 | 0.28 | fp8 | 1048576 |
| StreamLake | 0.13188 | 0.26376 | fp8 | 1024K |
| Alibaba | 0.134 | 0.268 | unknown | 1M |
| Venice | 0.138 | 0.275 | unknown | 1M |
| Morph | 0.139 | 0.278 | unknown | 1048576 |
| Parasail | 0.14 | 0.28 | fp8 | 1048576 |
| AtlasCloud | 0.14 | 0.28 | fp8 | 1048576 |
| AkashML | 0.14 | 0.28 | fp8 | 1048576 |
| Fireworks | 0.14 | 0.28 | unknown | 1048576 |
| Novita | 0.14 | 0.28 | fp8 | 1048576 |
| WandB | 0.14 | 0.28 | fp8 | 1048576 |
| Cloudflare | 0.14 | 0.28 | unknown | 384K |
| DeepSeek | 0.14 | 0.28 | unknown | 1048576 |
代表价(满血最低):DigitalOcean 输入 0.112 / 输出 0.224 USD/1M。按 provider 选择可进一步降本。