本文基于公开资料综述(Kimi / DeepSeek 2 家 AI 采集交叉;智谱因训练数据过时误判”模型不存在”已剔除,2026-07-20),非实机测试。
① 公开证据综合
Qwen3.7-Max 是阿里云 2026-05-20 发布的闭源旗舰,定位”面向智能体时代的新一代旗舰模型”,1.2T 总参 MoE(官方技术报告 / 阿里云开发者社区)。
编程与 Agent 国产领先:SWE-Verified 80.4(与 Claude Opus 4.6 80.8、DeepSeek-V4-Pro-Max 80.6 持平)、Terminal-Bench 2.0 69.7(超越两者)、GPQA Diamond 92.4(超 Claude Opus 4.6 91.3)、MCP-Atlas 76.4。Artificial Analysis Intelligence Index v4.0 以 56.6 分位列全球第五、国产第一(官方)。其”35 小时全自主内核优化(1158 次工具调用,10 倍加速)“演示被视为长周期 Agent 执行能力的标杆。
多语言:WMT24++ 85.8、MAXIFE 89.2,覆盖 50+ 语言。
② 与同类模型横评
- vs Claude Opus 4.8 / GPT-5.5:同属闭源云端旗舰阵营,Qwen 中文 / 多语言原生优化更强、API 便宜得多($1.25 vs $5+),但编程 SWE-Bench Pro 略低
- vs DeepSeek-V4-Pro / GLM-5.2:DS / GLM 开源可本地,Qwen 闭源不可本地——本地场景选开源
- vs Qwen3.5-397B-A17B(同族开源):能力有代际差距,但开源可本地
③ 本地部署建议与 verdict
能不能本地跑?不能。 阿里云官方明确 Qwen3.7-Max 闭源、权重不公开,仅百炼 / PAI API(阿里云开发者社区 2026-05-27 答复)。即使未来开源,1.2T MoE 按同族 Qwen3.5-397B(FP16 约 794GB)推算也是数据中心级,消费级完全不可行。
Verdict:not-recommend(不推荐本地)。 Qwen3.7-Max 能力是国产第一梯队、API 性价比高,但作为闭源模型根本不可本地部署。追求本地的用户应选同族 Qwen3.5-397B-A17B(开源 Apache-2.0)或 DeepSeek-V4-Pro / GLM-5.2;可接受云端 API 且需国产旗舰能力的企业,Qwen3.7-Max 的百炼 / PAI 服务值得考虑——但这已超出”本地部署”范畴。