来源:OpenRouter API(scraper 采集,2026-06-30)
DeepSeek-R1-Distill-Llama-70B 是 DeepSeek 于 2025 年 1 月发布的开源推理大模型。它并非从零训练,而是通过知识蒸馏技术,从强大的 DeepSeek-R1 教师模型中提炼推理能力,并迁移至 Llama 3.3 70B Instruct 基础模型上。这种“蒸馏”策略使其在保持 700 亿参数规模的同时,专注于强化数学、代码和逻辑推理等核心能力。模型采用宽松的 MIT 许可证,支持免费商业使用。
凭借强大的推理性能和 128K 的长上下文窗口,该模型特别适合需要深度思考的复杂任务场景,如高等数学解题、代码生成、金融量化分析及学术研究等。同时,作为开源模型,它支持企业进行私有化本地部署,能有效满足金融、政务等领域对数据隐私和合规性的严格要求。不过,用户也需注意其原生不支持中文、不支持函数调用等局限性,并根据硬件条件(推荐高端显卡配合量化技术)合理规划部署方案。
OpenRouter Provider 比价
共 1 家 provider(2026-06-30 采集),按输入价升序:
| Provider | 输入(USD/1M) | 输出(USD/1M) | 量化 | 上下文 |
|---|---|---|---|---|
| Novita | 0.8 | 0.8 | bf16 | 8192 |
代表价(满血最低):Novita 输入 0.8 / 输出 0.8 USD/1M。按 provider 选择可进一步降本。