NVIDIA Nemotron-3-Nano-30B-A3B 是英伟达于 2025 年 12 月开源的混合专家(MoE)大语言模型。它采用创新的 Mamba-2 与 Transformer 混合架构,总参数量为 30B,但每次前向传播仅激活约 3.5B 参数,在保证高性能的同时大幅提升了推理效率。模型经过 25 万亿 token 的预训练,并支持高达 100 万 token 的超长上下文窗口。
该模型设计为统一的推理与非推理任务模型,能够通过思维链(CoT)提升复杂问题的解答质量。它在数学推理(AIME25 得分 89.1%)和编程任务(LiveCodeBench 得分 68.3%)上表现优异,同时具备强大的 Agent 能力和工具调用能力。模型基于 NVIDIA Open Model License 开源,允许商业使用。需要注意的是,其原生语言支持不包括中文,主要面向英语及部分欧洲语言和日语用户。