模型

MiniMax: MiniMax-01

仅 API 开源 可商用
— · MIT / MiniMax Model License Agreement · 456B / 激活 45.9B · 上下文 1000192
能做什么
逻辑推理长文档分析多模态理解编程开发数学推理
部署门槛
多卡
≥ 170GB
上下文
1000192
token 窗口
参数
456B
MoE · 激活 45.9B

01基础参数

参数规模
456B
上下文窗口
1000192
输入模态
image / text
可生成
text
模型系列
开源许可
MIT / MiniMax Model License Agreement
主要语言
zh

02MoE 架构说明

MoE 混合专家 总参 456B · 激活 45.9B
部署门槛按「激活参数」计算,不等同于总参数量——这是 MoE 模型更易部署的关键。

03部署门槛详情

硬件等级 多卡 · 最低显存 170GB

04Benchmark 评测

待补充

05适用场景

✓ 适用
超长文本处理与检索、多模态文档理解、需要持续长记忆的 AI Agent 应用
✗ 不适用
低显存单卡本地部署、对实时延迟要求极高的边缘场景、纯轻量级嵌入式设备

06部署与限制

⚙ 本地部署建议
该模型总参数量达 456B,本地部署需多卡(建议 8×H800 或同等级别)并配合张量并行与专家并行策略。官方未公布单卡最低显存门槛,普通消费级 GPU 无法承载。若资源有限,建议优先使用 MiniMax 官方 API 或云端推理服务。
⚠ 已知限制
纯 Lightning Attention 在「大海捞针」等检索任务上表现不足,因此模型采用 7:1 的 Lightning/Softmax 混合比例来弥补;456B 总参数量对本地硬件要求极高,个人开发者难以直接部署;视觉模型 MiniMax-VL-01 虽支持动态分辨率,但在部分细粒度视觉理解任务上仍与专用视觉模型存在差距。

07详细介绍

来源:OpenRouter API(scraper 采集,2026-06-30)

MiniMax-01 是 MiniMax 于 2025 年 1 月 15 日开源发布的旗舰模型系列,包含纯文本模型 MiniMax-Text-01 与视觉语言模型 MiniMax-VL-01。该系列首次在大规模上实现了 Lightning Attention(线性注意力)机制,并与传统 Softmax Attention 及 MoE(混合专家)架构深度融合,在保持顶尖基准性能的同时,将上下文窗口扩展至训练 100 万 tokens、推理 400 万 tokens,是当时业界最长的开源模型之一。 模型总参数量达 4560 亿,采用 32 个专家、Top-2 路由的 MoE 设计,每 token 仅激活约 459 亿参数,兼顾了容量与推理效率。其文本模型在 MMLU、MATH、HumanEval 等学术基准上表现与 GPT-4o、Claude 3.5 Sonnet 等顶尖闭源模型相当,而在长上下文场景下的性能衰减显著更优。视觉模型 MiniMax-VL-01 则基于 ViT-MLP-LLM 框架构建,支持动态分辨率图像输入,适用于文档理解、UI 截图分析等多模态任务。整体定位面向需要超长上下文记忆、复杂推理与多模态理解的 AI Agent 与企业级应用。

OpenRouter Provider 比价

共 1 家 provider(2026-06-30 采集),按输入价升序:

Provider输入(USD/1M)输出(USD/1M)量化上下文
Minimax0.21.1unknown1000192

代表价(满血最低):Minimax 输入 0.2 / 输出 1.1 USD/1M。按 provider 选择可进一步降本。

08官方资源

09同类模型