模型

Qwen: Qwen3.7 Plus

仅 API 可商用
阿里通义千问 · 商业闭源 · — · 上下文 1M
能做什么
聊天问答编程开发逻辑推理多模态理解长文档分析
部署门槛
待补充
上下文
1M
token 窗口
参数

01基础参数

参数规模
上下文窗口
1M
输入模态
image / text
可生成
text
模型系列
开源许可
商业闭源
主要语言
multi

02部署门槛详情

硬件等级 待补充

03Benchmark 评测

待补充

04适用场景

✓ 适用
构建多模态智能体与GUI自动化、视觉编程与从设计稿到代码的端到端生成、图文视频协同分析与内容创作、处理大规模文档或代码库的长上下文任务
✗ 不适用
需要完全离线的本地部署、对纯文本推理精度要求达到极致且需微调的专业场景

05部署与限制

⚙ 本地部署建议
该模型为闭源API服务,不提供本地部署。用户需通过阿里云百炼平台调用,成本约为同系列旗舰Max模型的1/5至1/6,输入与输出分别按每百万tokens计费。
⚠ 已知限制
为API-only闭源模型,无法下载权重或本地部署。面向追求成本效益的通用场景,在纯文本推理连贯性上略逊于同系列旗舰文本模型Max。

06详细介绍

来源:OpenRouter API(scraper 采集,2026-06-30)

Qwen3.7-Plus 是阿里云通义千问于2026年6月发布的多模态智能体模型,定位为兼顾性能与成本的全能型基础模型。它基于Qwen3.7强大的文本能力,将视觉理解与语言推理统一为一个「混合智能体」基座,不仅能看懂图片和视频,还能基于视觉信息进行推理、调用工具、编写代码,并在图形界面(GUI)和命令行(CLI)环境中自主完成任务,实现了“看、想、写、做、验”的端到端闭环。模型采用MoE(混合专家)架构,单轮推理仅激活约170亿参数,支持高达100万tokens的超长上下文窗口,并可处理最高1600万像素的图片和长达2小时的视频输入。

该模型的核心优势在于其强大的多模态智能体能力。它在Vision Arena全球视觉模型榜单中位列全球前五、中国第一,并在ScreenSpot Pro(GUI定位)、BabyVision(视觉推理)等多项基准测试中得分超越GPT-5.4和Gemini 3.1 Pro等模型。在实际应用中,它能稳定运行超过11小时,独立完成包含需求生成、编码、部署、测试在内的完整App研发流程,或根据参考图一键复刻专业桌面软件。同时,其输入和输出价格仅为同系列旗舰文本模型Qwen3.7-Max的约1/6,综合成本优势显著。

该模型通过阿里云百炼平台提供API服务,为闭源模型,不支持本地部署。它适用于构建多模态智能体、视觉编程、GUI自动化、长文档分析与内容创作等场景。

OpenRouter Provider 比价

共 1 家 provider(2026-06-30 采集),按输入价升序:

Provider输入(USD/1M)输出(USD/1M)量化上下文
Alibaba0.321.28unknown1M

代表价(满血最低):Alibaba 输入 0.32 / 输出 1.28 USD/1M。按 provider 选择可进一步降本。

07官方资源

08同类模型