学部署 · 看评测
全部知识库 → Liquid-LFM-1.2B 推荐
1.2B · 1GB
1.2B 端侧王,<1GB 内存
Phi-4-mini 推荐
3.8B · 4GB
3.8B 小钢炮,数学代码降维打击
Qwen2.5-7B-Instruct 推荐
7.61B · 4.6GB
中文本地主力,7B 数学代码领先
Qwen3-30B-A3B 推荐
30.5B · 16.9GB(NVFP4 量化)
MoE 本地性价比王,30B/激活 3B
Nemotron-Nano-12B-VL 推荐
12B · 12GB
文档 OCR 专精,多模态本地
Llama-3.1-8B 谨慎
8B · 8GB
本地入门经典,但许可/知识/对话有短板
DeepSeek-V4-Flash 谨慎
284B · 284GB
开源性价比王,但本地仍需 142GB
GLM-5.2 谨慎
753B · 560GB
开源代码 SOTA,但本地门槛顶级
热门模型
多维度精选当期主力旗舰
最新发布本地部署热门
开源可本地国产之光
国内厂商性价比榜
标准档输入价 / 每百万 token最便宜 TOP 5
02 Qwen2.5-7B-Instruct $0.04
03 Microsoft: Phi 4 $0.07
04 Gemini 2.0 Flash $0.1
05 GLM-4 ¥0.1
生态 · 工具与厂商
本地部署生态精选 Chroma 开源
向量库 · Chroma
开源向量数据库(RAG 检索)
★ RAG 知识库的轻量向量库
LM Studio 免费
运行时 · LM Studio
桌面 GUI 运行模型(Mac/Win)
★ 小白友好的桌面图形界面
ComfyUI 开源
框架 · ComfyOrg
图像生成节点工作流
★ SD/FLUX 图像生成的专业工作流
Ollama 开源
运行时 · Ollama
本地一键运行大模型,最简单的方式
★ 本地部署首选,一行命令跑模型
FastGPT 开源
平台 · Labring
知识库问答平台
★ 国产知识库平台,中文友好
llama.cpp 开源
运行时 · Georgi Gerganov
C++ 推理底座,CPU/量化
★ CPU/低端设备/量化的核心
n8n 开源
工作流 · n8n
工作流自动化,接 AI
★ 把 AI 接入业务流程的自动化工具
Open WebUI 开源
平台 · open-webui
Ollama 的网页界面
★ 给 Ollama 套个类 ChatGPT 网页
Dify 开源
平台 · Dify
应用编排 / RAG / Agent 平台
★ 搭知识库/智能体的首选平台
vLLM 开源
运行时 · UC Berkeley
高吞吐推理引擎(PagedAttention)
★ 生产级高并发部署