模型

DeepSeek: DeepSeek V3 0324

仅 API 开源 可商用
DeepSeek · MIT · 671B / 激活 37B · 上下文 160K
能做什么
编程开发逻辑推理数学推理长文档分析Agent工作流
部署门槛
多卡
≥ 16GB
上下文
160K
token 窗口
参数
671B
MoE · 激活 37B

01基础参数

参数规模
671B
上下文窗口
160K
输入模态
text
可生成
text
模型系列
开源许可
MIT
主要语言
zh

02MoE 架构说明

MoE 混合专家 总参 671B · 激活 37B
部署门槛按「激活参数」计算,不等同于总参数量——这是 MoE 模型更易部署的关键。

03部署门槛详情

硬件等级 多卡 · 最低显存 16GB

04Benchmark 评测

待补充

05适用场景

✓ 适用
编程与代码补全、复杂推理任务、长上下文文档处理
✗ 不适用
纯 CPU 本地运行、实时低延迟边缘推理、多模态图像/视频理解

06部署与限制

⚙ 本地部署建议
本地部署需多卡 GPU 集群,FP8 精度下约需 320GB 显存。消费级单卡无法直接运行,建议使用 vLLM、SGLang 等推理框架配合多卡并行或云端 API。量化版本(如 4-bit)可大幅降低显存需求,但仍需 80GB 以上内存/显存。
⚠ 已知限制
仅支持文本输入输出,无多模态能力;本地部署硬件门槛极高,需专业多卡环境;超长上下文(128K+)场景下推理成本与延迟显著增加;部分复杂推理任务仍不及专用推理模型(如 DeepSeek-R1)。

07详细介绍

来源:OpenRouter API(scraper 采集,2026-06-30)

DeepSeek-V3-0324 是深度求索(DeepSeek)于 2025 年 3 月 24 日发布的开源大语言模型,属于 DeepSeek-V3 系列的重要权重更新版本。该模型采用混合专家(MoE)架构,总参数量达 6710 亿,但通过稀疏激活机制每次仅调用约 370 亿参数,在保持强大性能的同时显著降低推理成本。相比前代版本,V3-0324 在推理能力、前端开发、代码生成和中文写作等方面均有明显提升,多项基准测试成绩逼近甚至超越部分闭源商业模型。 该模型以 MIT 协议开源,权重可在 HuggingFace 下载,支持自由商用和本地部署。其适用场景涵盖软件开发辅助、复杂数学推理、长文档分析、智能体构建等,但本地运行对硬件要求极高,需多卡 GPU 集群支持,普通开发者更推荐通过 API 调用。

OpenRouter Provider 比价

共 5 家 provider(2026-06-30 采集),按输入价升序:

Provider输入(USD/1M)输出(USD/1M)量化上下文
DeepInfra0.20.77fp4163840
AtlasCloud0.2160.88fp8131072
SiliconFlow0.251.0fp8163840
Novita0.271.12fp8163840
GMICloud0.291.14fp8163840

代表价(满血最低):DeepInfra 输入 0.2 / 输出 0.77 USD/1M(量化版,另有满血版见上表)。按 provider 选择可进一步降本。

08官方资源

09同类模型