模型

Anthropic: Claude Opus 4.8 (Fast)

仅 API 可商用
Anthropic · 商业闭源 · — · 上下文 1M
能做什么
Agent工作流编程开发逻辑推理多模态理解长文档分析
部署门槛
待补充
上下文
1M
token 窗口
参数

01基础参数

参数规模
上下文窗口
1M
输入模态
file / image / text
可生成
text
模型系列
开源许可
商业闭源
主要语言
en

02部署门槛详情

硬件等级 待补充

03Benchmark 评测

待补充

04适用场景

✓ 适用
需要快速响应的智能体编程与代码生成、长上下文复杂任务处理、实时交互式应用、企业级高负载工作流
✗ 不适用
中文为主的内容生成场景、需要本地部署的私有化场景

05部署与限制

⚙ 本地部署建议
该模型为闭源模型,仅可通过 Anthropic API、Amazon Bedrock、Google Vertex AI 及 Microsoft Foundry 等云平台调用,无法进行本地部署。
⚠ 已知限制
专为英文优化,中文能力未公开披露。快速模式目前为研究预览版,需申请访问权限且不保证生产级SLA。模型架构与参数量未公开。

06详细介绍

来源:OpenRouter API(scraper 采集,2026-06-30)

Claude Opus 4.8 (Fast) 是 Anthropic 于 2026 年 5 月 28 日推出的旗舰级大语言模型 Claude Opus 4.8 的高吞吐量版本。该模型与标准版 Opus 4.8 具备完全相同的智能水平与能力,但通过快速模式(Fast Mode)实现了约 2.5 倍的输出速度提升。快速模式的定价为输入 $10/百万tokens、输出 $50/百万tokens,虽然为标准版的两倍,但相比上一代 Opus 4.7 的快速模式便宜了约三倍。它支持高达 100万 token 的超长上下文窗口和 128K 的最大输出长度,并支持文本与图像多模态输入。

该模型专为复杂的智能体编码和企业级工作而设计,在 SWE-Bench Pro 智能体编码基准测试中获得 69.2% 的得分,同时在浏览器智能体基准 Online-Mind2Web 上达到 84% 的成绩。它深度适配 Claude Code 等开发环境,可结合新推出的“动态工作流”功能协调数百个子智能体完成代码库级的大规模迁移任务。此外,模型引入了“投入控制”机制,允许开发者在交互式 Copilot、值班告警等延迟敏感场景下启用快速模式以获得极致响应速度;而在批处理等非实时任务中则可选择标准模式或更经济的 Batch API。该模型目前仅能通过 Anthropic API 及 AWS、Google Cloud、Microsoft Foundry 等主流云平台调用,无法进行本地部署。

OpenRouter Provider 比价

共 1 家 provider(2026-06-30 采集),按输入价升序:

Provider输入(USD/1M)输出(USD/1M)量化上下文
Anthropic10.050.0unknown1M

代表价(满血最低):Anthropic 输入 10.0 / 输出 50.0 USD/1M。按 provider 选择可进一步降本。

07官方资源

08同类模型