模型

Cohere: North Mini Code (free)

仅 API 开源 可商用
— · Apache-2.0 · 30B / 激活 3B · 上下文 256K
能做什么
编程开发自主编程Agent工作流逻辑推理内容创作
部署门槛
高端 24G+
≥ 18-20GB
上下文
256K
token 窗口
参数
30B
MoE · 激活 3B

01基础参数

参数规模
30B
上下文窗口
256K
输入模态
text
可生成
text
模型系列
开源许可
Apache-2.0
主要语言
en

02MoE 架构说明

MoE 混合专家 总参 30B · 激活 3B
部署门槛按「激活参数」计算,不等同于总参数量——这是 MoE 模型更易部署的关键。

03部署门槛详情

硬件等级 高端 24G+ · 最低显存 18-20GB

04Benchmark 评测

待补充

05适用场景

✓ 适用
本地部署的智能体编程任务、终端操作自动化与Shell工具驱动、代码生成与算法推理、在OpenCode等脚手架中进行仓库级代码修改
✗ 不适用
中文对话或中文内容创作、多模态理解任务

06部署与限制

⚙ 本地部署建议
推荐使用W4A16量化版本(约18-20GB显存)在单张H100或类似高端GPU上部署。支持通过vLLM、SGLang等框架启动兼容OpenAI的API服务,也可使用Transformers库直接加载。硬件门槛较高(high),需要24GB以上显存级别的GPU。
⚠ 已知限制
主要为英文优化,中文能力未知。模型定位为编程智能体,非通用聊天模型。在部分基准测试(如SWE-Bench Verified)上表现不及Qwen3等竞品,整体表现参差不齐。

07详细介绍

来源:OpenRouter API(scraper 采集,2026-06-30)

Cohere North Mini Code 是 Cohere 推出的首个开源编程模型,也是 North 系列的首款作品,专为智能体编程(Agentic Coding)场景设计。它采用稀疏混合专家(MoE)架构,总参数量达 300 亿,但每次推理仅激活 30 亿参数,在保持强劲性能的同时大幅降低了计算开销。该模型于 2026 年 6 月发布,采用 Apache 2.0 许可证,支持 256K 的上下文窗口,开发者可以自由下载权重进行本地部署或二次开发。

该模型专为多步骤、工具调用的编程工作流优化,在终端操作、代码生成及智能体协作等任务上表现出色,实测输出吞吐量可达同类竞品的 2.8 倍。它能够与 OpenCode、SWE-Agent 等主流智能体框架无缝配合,胜任仓库级代码修改、Shell 工具驱动等复杂任务。量化后的模型(W4A16)仅需约 18-20GB 显存即可在单张高端 GPU(如 H100)上流畅运行,非常适合希望自托管、掌控数据安全的开发者与企业。

OpenRouter Provider 比价

共 1 家 provider(2026-06-30 采集),按输入价升序:

Provider输入(USD/1M)输出(USD/1M)量化上下文
Cohere0.00.0unknown256K

代表价(满血最低):Cohere 输入 0.0 / 输出 0.0 USD/1M。按 provider 选择可进一步降本。

08官方资源

09同类模型