Qwen2.5-7B-Instruct 是阿里云通义千问团队于2024年10月发布的指令微调大语言模型,参数量为76.1亿,拥有128K上下文长度,支持生成最多8192个tokens。模型采用因果语言模型架构,结合RoPE位置编码、SwiGLU前馈网络和RMSNorm,并支持29种以上语言,包括中文、英语、法语、西班牙语等。
该模型在编码、数学推理、指令遵循和长文本生成方面相比前代有显著提升,同时对结构化数据(如表格)和结构化输出(尤其是JSON格式)的理解与生成能力也得到增强。适合用于多语言对话系统、轻量级编程辅助、长文档分析以及需要RAG(检索增强生成) 的场景。模型采用Apache-2.0许可,支持商业应用。得益于其规模适中,通过量化部署(如Q4_K_M)最低只需约4.6GB显存,可在单张消费级显卡甚至部分边缘设备上流畅运行。
OpenRouter Provider 比价
共 2 家 provider(2026-06-30 采集),按输入价升序:
| Provider | 输入(USD/1M) | 输出(USD/1M) | 量化 | 上下文 |
|---|---|---|---|---|
| Phala | 0.04 | 0.1 | unknown | 32768 |
| Together | 0.3 | 0.3 | fp8 | 32768 |
代表价(满血最低):Phala 输入 0.04 / 输出 0.1 USD/1M。按 provider 选择可进一步降本。