模型

DeepSeek-V3 (硅基流动)

仅 API 开源 可商用
硅基流动 · MIT · 671B / 激活 37B · 上下文 64K
能做什么
长文档分析编程开发逻辑推理知识问答Agent工作流
部署门槛
多卡
≥ 多卡部署,单卡约80GB
API 价格
¥1 /百万
输入/标准档 · 全站比价 →
上下文
64K
token 窗口
参数
671B
MoE · 激活 37B

01基础参数

参数规模
671B
上下文窗口
64K
输入模态
text
可生成
text
模型系列
开源许可
MIT
主要语言
multi

02MoE 架构说明

MoE 混合专家 总参 671B · 激活 37B
部署门槛按「激活参数」计算,不等同于总参数量——这是 MoE 模型更易部署的关键。

03部署门槛详情

硬件等级 多卡 · 最低显存 多卡部署,单卡约80GB

04Benchmark 评测

待补充

05适用场景

✓ 适用
长文档分析与RAG应用、复杂编程任务与代码生成、需要高性价比的推理与逻辑任务、Agent工作流与工具调用场景
✗ 不适用
实时性要求极高的轻量级对话、资源受限的边缘设备部署、纯视觉或语音的多模态任务

06部署与限制

⚙ 本地部署建议
模型为671B MoE架构,推荐使用FP8量化以平衡性能与显存,需多卡(如8×H800/A100)部署。建议使用vLLM、SGLang等推理框架实现Tensor Parallelism。硬件门槛极高,推荐云端部署或使用SiliconFlow等MaaS平台。
⚠ 已知限制
模型规模庞大,本地部署成本极高。部分平台版本上下文长度存在差异,需注意选择。模型本身不支持图像输入。

07详细介绍

DeepSeek-V3(硅基流动版) 是深度求索(DeepSeek)于2024年12月发布的开源大语言模型,由硅基流动(SiliconFlow)平台提供托管与推理服务。该模型采用混合专家(MoE)架构,总参数量达671B,但每次推理仅激活37B参数,在保持强劲性能的同时显著降低了计算开销。模型采用MIT许可证,完全开源,支持128K(开源版)-164K(部分平台)上下文窗口,能够处理长文档分析与复杂代码库等场景。

该模型在编程、推理和多语言理解方面表现卓越,在MMLU、HumanEval、AIME等多项权威基准上达到甚至超越顶尖闭源模型水平。硅基流动通过与华为昇腾云服务深度合作,在国内率先实现基于国产芯片的DeepSeek-V3高效推理服务,提供Serverless API、按需部署等多种调用方式。该模型特别适用于长文档分析、RAG应用、复杂编程任务和智能体工作流等场景,是追求高性能与成本平衡的理想开源选择。

08官方资源

09API 定价 全站比价 →

标准 输入 1 / 输出 2 CNY/百万token · 新用户额度
预算估算器
CNY ≈ 可输入 百万 token

10同类模型