模型

OpenAI: GPT-4.1 Mini

仅 API 可商用
OpenAI · 商业闭源 · — · 上下文 1047576
能做什么
编程开发逻辑推理长文档分析多模态理解OCR识别
部署门槛
中端 16-24G
≥ 16GB
上下文
1047576
token 窗口
参数

01基础参数

参数规模
上下文窗口
1047576
输入模态
file / image / text
可生成
text
模型系列
开源许可
商业闭源
主要语言
multi

02MoE 架构说明

MoE 混合专家 总参 · 激活
部署门槛按「激活参数」计算,不等同于总参数量——这是 MoE 模型更易部署的关键。

03部署门槛详情

硬件等级 中端 16-24G · 最低显存 16GB

04Benchmark 评测

待补充

05适用场景

✓ 适用
高吞吐量生产环境任务、代码辅助与软件开发、长文档理解与处理、需要平衡性能与成本的 API 调用场景
✗ 不适用
需要本地部署或离线运行的项目、对超低延迟有极致要求的实时交互(可选用 GPT-4.1 nano)、音频或视频原生输入处理(仅支持图像和文本输入)

06部署与限制

⚙ 本地部署建议
该模型为闭源 API 模型,不支持本地部署。通过 OpenAI API、Azure OpenAI 或第三方网关调用,推荐用于云原生应用集成。如需较低显存运行量化版本,第三方社区估算 4-bit 量化可在 16GB 显存显卡上运行。
⚠ 已知限制
仅通过 API 提供,不在 ChatGPT 界面中直接可用。不支持音频和视频输入。知识截止日期为 2024 年 6 月。参数量和具体架构细节未公开,第三方估算仅供参考。

07详细介绍

来源:OpenRouter API(scraper 采集,2026-06-30)

GPT-4.1 Mini 是 OpenAI 于 2025 年 4 月 15 日发布的轻量级多模态模型,属于 GPT-4.1 系列的中坚力量。该模型采用混合专家(MoE)架构与分组查询注意力(GQA)设计,在保持接近 GPT-4o 智能水平的同时,将延迟降低近一半、成本降低 83%。其最突出的特点是拥有 104 万 tokens 的超大上下文窗口,是 GPT-4o 的 8 倍,可一次性处理完整的代码库、数天的对话历史或整部文学作品。

该模型原生支持文本与图像多模态输入,在代码生成、指令遵循和长文本理解方面表现优异。在 SWE-bench Verified 编码评测中,GPT-4.1 系列(含 mini)得分 54.6%,较 GPT-4o 提升 21.4 个百分点;在指令遵循基准 MultiChallenge 上,GPT-4.1 mini 得分 35.8%,显著优于 GPT-4o 的 27.8%。API 定价为输入 $0.40/百万 tokens、输出 $1.60/百万 tokens,并提供 75% 的提示缓存折扣,是高性价比的大规模生产级应用理想选择。

OpenRouter Provider 比价

共 2 家 provider(2026-06-30 采集),按输入价升序:

Provider输入(USD/1M)输出(USD/1M)量化上下文
OpenAI0.41.6unknown1047576
Azure0.41.6unknown1047576

代表价(满血最低):OpenAI 输入 0.4 / 输出 1.6 USD/1M。各 provider 价格一致,无降本空间。

08官方资源

09同类模型