模型

Mistral: Ministral 3 8B 2512

仅本地 开源 可商用
— · Apache-2.0 · 8B · 上下文 262K
能做什么
聊天问答编程开发逻辑推理多模态理解长文档分析
部署门槛
消费级 8-12G
≥ 8GB
上下文
262K
token 窗口
参数
8B

01基础参数

参数规模
8B
上下文窗口
262K
输入模态
text / image
可生成
text
模型系列
开源许可
Apache-2.0
主要语言
multi

02部署门槛详情

硬件等级 消费级 8-12G · 最低显存 8GB

03Benchmark 评测

待补充

04适用场景

✓ 适用
本地AI助手部署、长文档分析与理解、带图像输入的智能客服、边缘设备多模态应用
✗ 不适用
超大规模集群训练、纯CPU推理场景、极高精度数学证明

05部署与限制

⚙ 本地部署建议
推荐使用GGUF量化格式部署。BF16精度约需24GB显存,FP8量化约需12GB,Q4_K_M量化可低至8GB以下。支持llama.cpp、Ollama、vLLM等框架,适合RTX 4090/5090等消费级显卡及Jetson边缘设备。
⚠ 已知限制
推理模型变体(Reasoning)上下文长度为128K,低于Instruct版的256K/262K。对超高分辨率或多图交错场景需注意输入限制。虽支持视觉,但图像理解能力弱于专用大参数量VLM。

06详细介绍

Ministral 3 8B 是 Mistral AI 于 2025 年 12 月发布的 Ministral 3 系列中的平衡型多模态模型,专为边缘部署与高效推理设计。其核心架构由约 8.4B 参数的语言模型与 0.4B 参数的视觉编码器组成,支持 262K 超长上下文窗口,并覆盖数十种语言。该模型在 MMLU、MATH、代码生成等基准测试中均达到同参数量级领先水平,同时原生支持函数调用、结构化输出及多模态图像理解。

该模型提供 Base、Instruct 与 Reasoning 三种变体:Instruct 版本适用于日常对话与智能客服;Reasoning 版本专攻复杂数学推理与编程任务。得益于 Apache 2.0 开源协议与广泛的量化格式支持(GGUF/FP8/BF16),开发者可在 RTX 消费级显卡、Jetson 边缘设备或云端灵活部署,量化后显存需求可低至 8GB。无论是构建本地 AI 助手、长文档分析工具,还是具备视觉能力的 Agent 工作流,Ministral 3 8B 都能在有限算力下提供强劲且可控的多模态 AI 能力。

07官方资源

08真实评测

Ministral-8B-2512 评测:8B 多模态+262K,但学术/中文待证

09同类模型