MiniMax M3 是 MiniMax 于 2026年6月发布的新一代原生多模态开源大模型。它采用混合专家(MoE)架构,总参数量约428B,激活参数约23B。其核心创新在于自研的 MiniMax 稀疏注意力(MSA)架构,能够在支持高达 100万 token 超长上下文的同时,显著提升推理效率。作为从训练第一步就进行多模态混合训练的模型,M3 在文本、图像和视频之间实现了深层的语义融合,而非后期拼接的“外挂式”多模态能力。该模型采用 MIT 开源协议,允许商业使用,并已在 Hugging Face 和 ModelScope 平台开源权重。
M3 的核心能力聚焦于前沿编程(Coding)、智能体(Agentic)工作流与长上下文处理,在 SWE-Bench Pro、BrowseComp 等国际权威评测中达到领先水平。它支持图像与视频输入,并能执行电脑桌面操作等复杂任务。凭借其强大的长上下文与多模态理解能力,M3 适用于长视频解析、复杂代码仓库的深度处理、企业级文档分析以及自动化智能体工作流等场景。模型同时提供“思考”与“非思考”两种推理模式,可根据任务需求在深度推理与低延迟响应间灵活切换。目前,vLLM 与 SGLang 等主流推理引擎均已提供对 M3 的专用部署支持。
OpenRouter Provider 比价
共 6 家 provider(2026-06-30 采集),按输入价升序:
| Provider | 输入(USD/1M) | 输出(USD/1M) | 量化 | 上下文 |
|---|---|---|---|---|
| Minimax | 0.3 | 1.2 | fp8 | 524288 |
| Novita | 0.3 | 1.2 | fp8 | 1M |
| AtlasCloud | 0.3 | 1.2 | fp8 | 524300 |
| Together | 0.3 | 1.2 | unknown | 524288 |
| Parasail | 0.3 | 1.2 | fp8 | 1048576 |
| Morph | 0.6 | 2.4 | unknown | 256K |
代表价(满血最低):Together 输入 0.3 / 输出 1.2 USD/1M。按 provider 选择可进一步降本。