模型

Sao10K: Llama 3 8B Lunaris

仅本地 开源 可商用
— · llama3 · 8B · 上下文 8K
能做什么
聊天问答内容创作逻辑推理Agent工作流
部署门槛
消费级 8-12G
≥ 8GB
上下文
8K
token 窗口
参数
8B

01基础参数

参数规模
8B
上下文窗口
8K
输入模态
text
可生成
text
模型系列
开源许可
llama3
主要语言
en

02部署门槛详情

硬件等级 消费级 8-12G · 最低显存 8GB

03Benchmark 评测

待补充

04适用场景

✓ 适用
创意角色扮演、叙事与故事生成、一般知识问答、轻量级 Agent 任务
✗ 不适用
复杂数学推理、长文档分析、高精度代码生成

05部署与限制

⚙ 本地部署建议
推荐使用 Llama-3-Instruct 对话模板,温度设为 1.4,min_p 设为 0.1。作为 8B 参数模型,可在 8GB 显存环境下通过 Q4_K_M 等量化方式本地部署,适合低配硬件。
⚠ 已知限制
上下文窗口为 8K,不擅长超长文本处理。在严格的逻辑推理和数学基准测试(如 MATH、GPQA)上得分较低,复杂推理能力有限。

06详细介绍

Sao10K/L3-8B-Lunaris-v1 是一款基于 Meta-Llama-3-8B-Instruct 的模型融合(Model Merge)版本,由开发者 Sao10K 于 2024 年 8 月发布。该模型通过 ties 融合策略,结合了多款专注于角色扮演、叙事和通用知识的 Llama-3 微调变体,旨在在创意生成与逻辑推理之间取得更好的平衡。开发者称该模型是其此前作品 Stheno v3.2 的全面改进版,在社区评价中被认为在 8B 参数规模下拥有出色的创意叙事能力和角色扮演体验。

Lunaris 在创意写作和角色扮演场景中表现突出,同时也具备了一定的通用知识问答和指令遵循能力。它支持 8K 上下文长度,适合中等长度的对话与故事创作。需要注意的是,该模型在复杂的数学推理(MATH 基准约 8.46%)和科学问答(GPQA 基准约 6.82%)等需要深度逻辑分析的任务上能力有限,更侧重于发挥其在创意生成方面的优势。

07官方资源

08同类模型