Qwen2.5-72B-Instruct 是阿里云通义千问团队于2024年9月发布的稠密架构大语言模型,拥有727亿参数,支持高达128K的上下文长度,并覆盖29种以上语言。该模型在Qwen2基础上显著增强了代码与数学推理能力,同时在指令遵循、结构化数据理解(如表格)和JSON等结构化输出方面也有大幅提升。
该模型适合需要复杂推理、长文本分析和多语言对话的场景,尤其在编程开发、数学解题、长文档分析以及Agent工作流中表现出色。模型采用Apache-2.0许可,支持商业应用(需注意月活用户超1亿时需另行授权)。部署方面,由于模型规模较大,建议使用多卡环境,可借助FP4量化将显存需求压缩至约42GB以降低门槛。
OpenRouter Provider 比价
共 2 家 provider(2026-06-30 采集),按输入价升序:
| Provider | 输入(USD/1M) | 输出(USD/1M) | 量化 | 上下文 |
|---|---|---|---|---|
| DeepInfra | 0.36 | 0.4 | fp8 | 32768 |
| Novita | 0.38 | 0.4 | bf16 | 32K |
代表价(满血最低):Novita 输入 0.38 / 输出 0.4 USD/1M。按 provider 选择可进一步降本。