DeepSeek-V3 是由深度求索公司于2024年12月发布的开源MoE(混合专家)大语言模型。它拥有671B总参数量,但每个token仅激活37B参数,在实现强劲性能的同时保持了计算效率。模型采用创新的无辅助损失负载均衡策略和Multi-Token Prediction训练目标,并在14.8万亿高质量token上完成预训练,其训练成本仅约557万美元。
该模型在代码、数学和中文理解方面表现尤为突出,性能比肩世界顶尖闭源模型。其支持的128K长上下文窗口使其非常适合长文档分析和复杂逻辑推理任务。后续更新的 DeepSeek-V3.1-Terminus 版本进一步优化了Agent能力和语言一致性。模型采用宽松的MIT开源协议,支持商业使用,可通过SGLang、vLLM等框架在配备多卡的强劲硬件上部署。
OpenRouter Provider 比价
共 3 家 provider(2026-06-30 采集),按输入价升序:
| Provider | 输入(USD/1M) | 输出(USD/1M) | 量化 | 上下文 |
|---|---|---|---|---|
| StreamLake | 0.2002 | 0.8001 | unknown | 128K |
| DeepInfra | 0.32 | 0.89 | fp4 | 163840 |
| Novita | 0.4 | 1.3 | fp8 | 64K |
代表价(满血最低):StreamLake 输入 0.2002 / 输出 0.8001 USD/1M。按 provider 选择可进一步降本。