DeepSeek-R1 是深度求索公司于2025年1月发布的首代开源推理大模型,专注于增强复杂问题的逻辑推理能力。模型采用MoE架构,总参数量671B,每次激活37B参数,支持128K上下文长度。其核心突破在于后训练阶段大规模应用强化学习技术(基于DeepSeek-V3-Base),并在引入少量冷启动数据后,解决了早期R1-Zero版本可读性差、语言混杂等问题,最终在数学、代码和自然语言推理等任务上达到比肩OpenAI o1正式版的水平。
该模型核心能力集中于需要深度思考的领域,如高难度数学题(AIME 2024评测)和代码竞赛任务(Codeforces评分),适合作为复杂问题的解决引擎。同时,官方利用DeepSeek-R1的输出数据蒸馏了多个小模型(基于Qwen和Llama系列,从1.5B到70B),其中32B和70B版本在多项基准上超越OpenAI o1-mini,为资源有限的环境提供了选择。模型采用MIT许可协议,完全开源且支持商业用途,官方也明确允许利用其输出进行模型蒸馏。需注意,其完整的671B版本对部署硬件要求极高,推荐使用多卡并行方案,或根据实际需求选用其蒸馏小模型。
OpenRouter Provider 比价
共 2 家 provider(2026-06-30 采集),按输入价升序:
| Provider | 输入(USD/1M) | 输出(USD/1M) | 量化 | 上下文 |
|---|---|---|---|---|
| Novita | 0.7 | 2.5 | fp8 | 64K |
| Azure | 1.485 | 5.94 | unknown | 163840 |
代表价(满血最低):Azure 输入 1.485 / 输出 5.94 USD/1M。按 provider 选择可进一步降本。