Llama 3.2 1B 极轻量,纯 CPU 即可运行,适合边缘设备与入门。
Llama 3.2 1B
仅本地 开源 可商用
Meta · Llama 3.2 · Llama 3.2 Community License · 1B · 上下文 128K
能做什么
聊天问答知识问答逻辑推理长文档分析内容创作
01基础参数
- 参数规模
- 1B
- 上下文窗口
- 128K
- 输入模态
- text
- 可生成
- text
- 模型系列
- Llama 3.2
- 开源许可
- Llama 3.2 Community License
- 主要语言
- multi
02推荐部署方案
推荐 Q4_K_M ollama
03部署门槛详情
硬件等级 CPU 可跑 · 最低显存 2GB
04Benchmark 评测
待补充
05适用场景
✓ 适用
移动端、物联网 (IoT) 等资源受限的边缘设备部署、个人信息管理与多语言知识检索任务、本地化、低延迟的对话与文本重写应用
✗ 不适用
对复杂推理、数学或代码生成精度要求较高的专业任务、需要视觉理解或大容量知识记忆的多模态场景
06部署与限制
⚙ 本地部署建议
模型可在纯 CPU 环境下运行,最低 8GB 系统内存即可。GPU 部署推荐量化后使用,BF16 精度下最低约需 2GB 显存。可通过 llama.cpp 或 Ollama 等框架轻松部署,适合在树莓派、Jetson 等设备上运行。
⚠ 已知限制
受限于 10 亿参数量,在 MMLU、GSM8K 等复杂基准测试上得分显著低于 3B、8B 等更大模型。官方虽仅保证 8 种语言支持质量,但模型训练数据覆盖了更广的语言集合。