模型

Mistral: Ministral 3 3B 2512

仅本地 开源 可商用
— · Apache-2.0 · 3B · 上下文 131K
能做什么
聊天问答编程开发多模态理解内容创作
部署门槛
消费级 8-12G
≥ 4GB
上下文
131K
token 窗口
参数
3B

01基础参数

参数规模
3B
上下文窗口
131K
输入模态
text / image
可生成
text
模型系列
开源许可
Apache-2.0
主要语言
multi

02部署门槛详情

硬件等级 消费级 8-12G · 最低显存 4GB

03Benchmark 评测

待补充

04适用场景

✓ 适用
边缘端及低资源设备部署、实时图像描述与文档分析、多语言对话与代码生成辅助、函数调用驱动的轻量级Agent任务
✗ 不适用
需顶级推理深度的复杂逻辑问题、大规模高并发生产级API服务

05部署与限制

⚙ 本地部署建议
推荐使用FP8或GGUF量化格式部署,可适配8GB显存环境,最低量化后可在低于8GB内存或显存下运行。支持llama.cpp、vLLM、Ollama等主流推理框架,并已验证与vLLM 0.14.1+版本兼容。
⚠ 已知限制
作为紧凑型边缘模型,在需要海量知识或复杂推理的极限任务上可能不及大型模型。其0.4B视觉编码器主要支持基础图像分析,不具备高精度视觉定位或复杂场景理解能力。

06详细介绍

Ministral-3-3B-Instruct-2512 是 Mistral AI 于 2025 年底推出的 Ministral 3 系列中参数规模最小的指令微调模型。该模型采用密集解码器架构,由一个 34 亿参数的语言模型和一个 4 亿参数的视觉编码器组成,总参数量为 38 亿,支持高达 256K 的长上下文窗口。

模型专为边缘端和低资源设备设计,具备原生多模态理解能力,能同时处理文本与图像输入。它支持包括中文、英文、法语、阿拉伯语在内的数十种语言,并原生支持函数调用与 JSON 格式输出,适合构建轻量级智能助手、实时图像理解、数据提取和多语言对话等应用。该模型基于 Apache 2.0 许可证开源,允许商业使用,推荐通过量化部署以在显存受限的环境中获得最佳性能。

07官方资源

08真实评测

Ministral-3B-2512 评测:3B 多模态边缘,256K+视觉,但能力有限

09同类模型