模型

Anthropic: Claude Opus 4.8

仅 API 可商用
Anthropic · 商业闭源 · 未公开 · 上下文 1M
能做什么
编程开发Agent工作流逻辑推理长文档分析数学推理
部署门槛
待补充
上下文
1M
token 窗口
参数
未公开

01基础参数

参数规模
未公开
上下文窗口
1M
输入模态
file / image / text
可生成
text
模型系列
开源许可
商业闭源
主要语言
multi

02部署门槛详情

硬件等级 待补充

03Benchmark 评测

待补充

04适用场景

✓ 适用
需要高可靠性判断的代理式编码与软件工程任务、跨多天、多会话的长期项目与知识工作、对准确性和诚实度要求极高的企业级决策支持、复杂多工具编排与高自主性工作流
✗ 不适用
对延迟极度敏感、需极速响应的实时交互场景、纯本地离线部署(模型仅通过 API 提供)、预算有限、token 消耗量极大的轻量级应用

05部署与限制

⚙ 本地部署建议
Claude Opus 4.8 为闭源 API 模型,不支持本地部署。可通过 Claude API、Amazon Bedrock、Google Cloud Vertex AI 等平台调用,标准定价为 $5/百万输入 token、$25/百万输出 token。Fast mode 定价为 $10/百万输入、$50/百万输出。提示缓存可节省最高 90% 成本,批处理可节省 50%。
⚠ 已知限制
输出模态仅限文本,不支持图像等多模态生成。在 Terminal-Bench 2.1 上(74.6%)低于 GPT-5.5(78.2%)。对指令精确度要求较高,模糊需求可能得不到主动补全。Microsoft Foundry 上上下文窗口限制为 200K。

06详细介绍

来源:OpenRouter API(scraper 采集,2026-06-30)

Claude Opus 4.8 是 Anthropic 于 2026 年 5 月 28 日发布的旗舰级大语言模型。作为 Opus 4 系列的最强成员,它在 Opus 4.7 基础上进一步强化了代码生成、代理推理与诚实性。模型默认支持 100 万 token 的上下文窗口,最大可输出 128K token,在 Claude API、Amazon Bedrock 和 Google Cloud Vertex AI 上均默认提供。核心创新包括 effort 参数(允许多档调节推理投入)和自适应思考机制,使模型能根据请求自主决定推理深度。Fast mode 预览版可将输出速度提升至 2.5 倍,且定价较前代 Fast 模式大幅降低。

Opus 4.8 专为复杂推理、长程智能体编码和高自主性工作设计。在 SWE-Bench Pro 上取得 69.2% 的成绩,较 Opus 4.7 提升 4.9 个百分点;在计算机使用与浏览器代理测试 Online-Mind2Web 上达到 84%。模型在诚实性与判断力方面有显著提升——主动标注不确定性、减少无依据结论、在复杂多步骤任务中具备主动提问和自我纠错能力。定价与 Opus 4.7 持平,标准模式 $5/百万输入 token、$25/百万输出 token。适用于企业级软件工程、金融分析、法律审查、深度研究等对可靠性和准确性要求极高的场景。

OpenRouter Provider 比价

共 3 家 provider(2026-06-30 采集),按输入价升序:

Provider输入(USD/1M)输出(USD/1M)量化上下文
Google5.025.0unknown1M
Anthropic5.025.0unknown1M
Amazon Bedrock5.025.0unknown1M

代表价(满血最低):Google 输入 5.0 / 输出 25.0 USD/1M。各 provider 价格一致,无降本空间。

07官方资源

08真实评测

Claude Opus 4.8 评测:能力第一梯队,但闭源不可本地部署

09同类模型