模型

Claude Fable 5 评测:能力天花板,但闭源+贵+政策风险

查看模型详情 →
结论:不推荐
优点
  • ✓ 软件工程能力公开模型最强:SWE-bench Verified 95.0%(领先 Opus 4.8 88.6%、GPT-5.5 88.7%),SWE-bench Pro 80.3%(官方技术报告)
  • ✓ 1M token 上下文 + 128K 单次输出,长时程 agentic 与代码库级任务(Anthropic Platform 文档)
  • ✓ 多模态输入(文本/图像/文件)+ 视觉推理(官方 System Card)
  • ✓ safety classifier 架构:高风险查询 fallback 到 Opus 4.8,兼顾安全与可用(Anthropic 官方)
  • ✓ Claude Code / Claude.ai / API 多端生态成熟
缺点
  • ✗ 闭源专有,权重未公开,**根本无法本地部署**(搜索未找到开源权重/HF 下载)
  • ✗ API 定价 $10/$50 每百万 token,是 Opus 4.8 的 2 倍、Sonnet 5 的 5 倍,性价比极低(Anthropic 定价页)
  • ✗ 强制 30 天数据保留,不支持零数据保留协议,敏感场景合规受限(Anthropic 文档)
  • ✗ 2026-06 曾因美国政府出口管制全球暂停访问 19 天,政策稳定性存疑(Anthropic 公告)
适合场景:预算充足、需当前公开最强软件工程能力的企业级 API 调用、长上下文代码库重构、跨文件迁移等长时程 agentic 任务(Claude Code / API)、可接受云端 30 天保留的知识工作与研究

本文基于公开资料综述(智谱 / Kimi / DeepSeek 3 家 AI 采集交叉,2026-07-21),非实机测试。

① 公开证据综合

Claude Fable 5 是 Anthropic 2026-06-09 发布的旗舰,定位「Mythos-class」(高于传统 Opus 层级),底层权重与受限访问的 Claude Mythos 5 相同,区别是 Fable 5 附加更严格的安全分类器——检测到网络安全/生化等高风险查询时自动 fallback 到 Opus 4.8(官方技术报告)。

软件工程是其绝对强项:SWE-bench Verified 95.0%(当前公开可用模型最高,领先 Opus 4.8 88.6%、GPT-5.5 88.7%);SWE-bench Pro 80.3%(GPT-5.5 仅 58.6%、Gemini 3.1 Pro 54.2%)。HLE 53.3%(比次优高 7 个百分点)、GDPval-AA 1760-1932 Elo(官方 / llm-stats / Artificial Analysis)。

但定价与政策是硬伤:API $10/$50 每百万 token(Opus 4.8 的 2 倍、Sonnet 5 的 5 倍);强制 30 天数据保留,不支持零保留;2026-06-12 因美国出口管制全球暂停访问,7-01 才恢复(断供 19 天)。

② 与同类模型横评

③ 本地部署建议与 verdict

能不能本地跑?根本不能。 搜索未找到任何 Fable 5 开源权重 / HuggingFace 页 / 本地部署指南,所有访问路径指向云端 API(Kimi 交叉确认)。权重未释出,本地部署技术上不可行。

Verdict:not-recommend(不推荐本地)。 Fable 5 能力确处 2026 公开模型第一梯队,但「本地部署」对其根本不成立——闭源云端模型。即使只论 API,$10/$50 是 Opus 4.8 的 2 倍,而 SWE-bench Pro 优势仅在极端难度任务显著;叠加 30 天强制保留 + 政策断供风险。绝大多数用户应选 Opus 4.8 或开源的 GLM-5.2 / Kimi-K2.6。Fable 5 更适合作为「能力天花板参考」而非日常生产主力。