模型

Qwen: Qwen3 235B A22B

仅 API 开源 可商用
阿里通义千问 · Apache-2.0 · 235B / 激活 22B · 上下文 128K
能做什么
逻辑推理数学推理编程开发内容创作Agent工作流
部署门槛
多卡
≥ 720GB
上下文
128K
token 窗口
参数
235B
MoE · 激活 22B

01基础参数

参数规模
235B
上下文窗口
128K
输入模态
text
可生成
text
模型系列
开源许可
Apache-2.0
主要语言
zh

02MoE 架构说明

MoE 混合专家 总参 235B · 激活 22B
部署门槛按「激活参数」计算,不等同于总参数量——这是 MoE 模型更易部署的关键。

03部署门槛详情

硬件等级 多卡 · 最低显存 720GB

04Benchmark 评测

待补充

05适用场景

✓ 适用
需要顶级推理能力的复杂任务、大规模代码库分析与生成、多语言复杂场景应用、Agent与工具调用集成
✗ 不适用
资源受限的边缘设备部署、对延迟要求极高的实时交互、个人开发者本地单卡推理

06部署与限制

⚙ 本地部署建议
模型体积约475GB,建议使用多卡部署,最低需720GB总显存(如8×96GB配置);推荐使用vLLM或Transformers框架,可选用FP8、AWQ等量化版本降低显存占用。
⚠ 已知限制
部署门槛较高,需多卡GPU集群支持;原生上下文32K,长文本需YaRN扩展;作为文本模型不支持原生多模态输入。

07详细介绍

来源:OpenRouter API(scraper 采集,2026-06-30)

Qwen3-235B-A22B 是阿里云通义千问团队于 2025 年 4 月 29 日发布的 Qwen3 系列旗舰模型。模型采用混合专家(MoE)架构,总参数量 2350 亿,每次推理仅激活约 220 亿参数。模型包含 94 层 Transformer 结构,采用分组查询注意力(GQA)机制(64 个查询头、4 个键值头),设有 128 个专家,每次推理激活其中 8 个。它支持独特的思考模式(适合复杂逻辑推理、数学、编程)与非思考模式(适合高效通用对话)无缝切换。模型原生支持 32K 上下文,通过 YaRN 技术可扩展至 128K;后续 2507 版本进一步增强了对 256K 长上下文的理解能力。模型采用 Apache 2.0 许可证,支持免费商用。

该模型在编程、数学、通用能力等多项基准测试中表现优异,可对标 DeepSeek-R1、OpenAI o1 等业界顶尖模型。它覆盖 100+ 语言和方言,具备强大的多语言指令遵循与翻译能力。适用于需要顶级推理能力的复杂任务、大规模代码库分析与生成、多语言复杂场景应用,以及 Agent 与工具调用集成等场景。由于模型规模庞大(约 475GB),本地部署门槛较高,推荐使用多卡 GPU 集群(最低 720GB 总显存),或选用 FP8、AWQ 等量化版本以降低资源消耗。

OpenRouter Provider 比价

共 1 家 provider(2026-06-30 采集),按输入价升序:

Provider输入(USD/1M)输出(USD/1M)量化上下文
Alibaba0.4551.82unknown131072

代表价(满血最低):Alibaba 输入 0.455 / 输出 1.82 USD/1M。按 provider 选择可进一步降本。

08官方资源

09同类模型