模型

Qwen3.7-Max 评测:国产闭源旗舰,不可本地部署

查看模型详情 →
结论:不推荐
优点
  • ✓ 编程 / Agent 国产第一梯队:SWE-Verified 80.4(与 Claude Opus 4.6 / DeepSeek-V4-Pro-Max 持平)、GPQA Diamond 92.4、Terminal-Bench 2.0 69.7(官方技术报告)
  • ✓ 多语言强:WMT24++ 85.8、MAXIFE 89.2,覆盖 50+ 语言(官方技术报告)
  • ✓ API 成本优势:输入 $1.25 / 百万 token,约为 GPT-5.6 的 1/28(社区评测)
  • ✓ 阿里云百炼 / PAI 可用性高,国内网络原生支持、合规优势明显(官方)
缺点
  • ✗ 闭源不可本地:阿里云官方确认权重不公开,仅百炼 / PAI API(阿里云开发者社区 2026-05-27 答复)
  • ✗ 1.2T 总参 MoE,即使未来开源门槛也极高(参考同族 Qwen3.5-397B FP16 约 794GB),属数据中心级
  • ✗ API 按量计费,长期成本由阿里云单方面决定,不可控
  • ✗ 同生态已有 Qwen3.5-397B-A17B(Apache-2.0 开源)替代,能力差距在可接受范围
适合场景:已通过阿里云百炼 / PAI 接入的企业级中文应用、需官方 SLA 保障的金融 / 政务云端合规场景、高难度 Agent / 编程任务(API 调用,非本地部署)

本文基于公开资料综述(Kimi / DeepSeek 2 家 AI 采集交叉;智谱因训练数据过时误判”模型不存在”已剔除,2026-07-20),非实机测试。

① 公开证据综合

Qwen3.7-Max 是阿里云 2026-05-20 发布的闭源旗舰,定位”面向智能体时代的新一代旗舰模型”,1.2T 总参 MoE(官方技术报告 / 阿里云开发者社区)。

编程与 Agent 国产领先:SWE-Verified 80.4(与 Claude Opus 4.6 80.8、DeepSeek-V4-Pro-Max 80.6 持平)、Terminal-Bench 2.0 69.7(超越两者)、GPQA Diamond 92.4(超 Claude Opus 4.6 91.3)、MCP-Atlas 76.4。Artificial Analysis Intelligence Index v4.0 以 56.6 分位列全球第五、国产第一(官方)。其”35 小时全自主内核优化(1158 次工具调用,10 倍加速)“演示被视为长周期 Agent 执行能力的标杆。

多语言:WMT24++ 85.8、MAXIFE 89.2,覆盖 50+ 语言。

② 与同类模型横评

③ 本地部署建议与 verdict

能不能本地跑?不能。 阿里云官方明确 Qwen3.7-Max 闭源、权重不公开,仅百炼 / PAI API(阿里云开发者社区 2026-05-27 答复)。即使未来开源,1.2T MoE 按同族 Qwen3.5-397B(FP16 约 794GB)推算也是数据中心级,消费级完全不可行。

Verdict:not-recommend(不推荐本地)。 Qwen3.7-Max 能力是国产第一梯队、API 性价比高,但作为闭源模型根本不可本地部署。追求本地的用户应选同族 Qwen3.5-397B-A17B(开源 Apache-2.0)或 DeepSeek-V4-Pro / GLM-5.2;可接受云端 API 且需国产旗舰能力的企业,Qwen3.7-Max 的百炼 / PAI 服务值得考虑——但这已超出”本地部署”范畴。