Qwen2.5-3B-Instruct 是阿里云通义千问团队于 2024 年 9 月推出的轻量级开源语言模型,参数量为 30 亿,采用 Apache-2.0 许可。它是 Qwen2.5 系列中专为资源受限环境(如移动端、边缘设备)设计的模型,在编码、数学和指令遵循能力上相比前代 Qwen2 均有显著提升。模型支持 29 种以上语言,包括中文、英文等,上下文长度支持 128K 个 token,并可生成长达 8K 的文本内容。
该模型非常适合在显存或算力有限的环境中进行本地部署。通过 4-bit 量化(如 GGUF 格式),模型大小可压缩至约 1.9GB,甚至可在 4GB 共享显存的集成显卡上流畅运行。它适用于基础聊天问答、代码生成与补全、轻量级推理等任务。由于其参数量较小,在需要极高推理精度或处理超长、复杂文档的专业场景下,其表现可能会受到一定限制。