模型

Llama 3.2 1B

仅本地 开源 可商用
Meta · Llama 3.2 · Llama 3.2 Community License · 1B · 上下文 128K
能做什么
聊天问答知识问答逻辑推理长文档分析内容创作
部署门槛
CPU 可跑
≥ 2GB
上下文
128K
token 窗口
参数
1B
Llama 3.2

01基础参数

参数规模
1B
上下文窗口
128K
输入模态
text
可生成
text
模型系列
Llama 3.2
开源许可
Llama 3.2 Community License
主要语言
multi

02推荐部署方案

推荐 Q4_K_M ollama

03部署门槛详情

硬件等级 CPU 可跑 · 最低显存 2GB

04Benchmark 评测

待补充

05适用场景

✓ 适用
移动端、物联网 (IoT) 等资源受限的边缘设备部署、个人信息管理与多语言知识检索任务、本地化、低延迟的对话与文本重写应用
✗ 不适用
对复杂推理、数学或代码生成精度要求较高的专业任务、需要视觉理解或大容量知识记忆的多模态场景

06部署与限制

⚙ 本地部署建议
模型可在纯 CPU 环境下运行,最低 8GB 系统内存即可。GPU 部署推荐量化后使用,BF16 精度下最低约需 2GB 显存。可通过 llama.cpp 或 Ollama 等框架轻松部署,适合在树莓派、Jetson 等设备上运行。
⚠ 已知限制
受限于 10 亿参数量,在 MMLU、GSM8K 等复杂基准测试上得分显著低于 3B、8B 等更大模型。官方虽仅保证 8 种语言支持质量,但模型训练数据覆盖了更广的语言集合。

07详细介绍

Llama 3.2 1B 极轻量,纯 CPU 即可运行,适合边缘设备与入门。

08官方资源

09真实评测

Llama-3.2-1B 评测:1B 极致轻量,但数学/工具弱

10同类模型