Anthropic Claude 定价
Anthropic 官方一方 Claude API 的价格快照,用于理解输入、输出、缓存、Batch 与附加能力如何分别计费。
快照核对时间:2026 年 5 月 9 日。 官方价格可能继续变化,使用前请访问下方官方来源复核;GGPU平台实际可用模型和最终费用记录以当前控制台与账号配置为准。
范围仅包括 Anthropic 自家提供的 Claude API / Claude 官方计费信息,不包含 AWS Bedrock、Google Vertex AI、Microsoft Foundry 等第三方渠道价格。
如何使用这份价格表
官方来源
- Claude API 详细定价页:https://platform.claude.com/docs/zh-CN/about-claude/pricing
- Claude 官网定价总览:https://www.anthropic.com/pricing
模型价格表
下表单位均为 USD / 100 万 Token(MTok)。
Prompt Caching 缓存定价
Prompt Caching 相对于基础输入价格使用以下倍率:
补充说明:
- 缓存写入在内容首次写入缓存时计费。
- 缓存读取在后续命中缓存时计费。
- 这些倍率可以与其他价格修饰规则叠加,例如 Batch API 折扣和数据驻留加价。
Batch API 定价
Anthropic 官方说明:Batch API 对输入和输出 Token 都提供 50% 折扣。
其他一方计费规则
长上下文
- Anthropic 官方说明,
Claude Mythos Preview、Claude Opus 4.7、Claude Opus 4.6、Claude Sonnet 4.6支持 100 万 Token 上下文窗口,并按标准单价计费。 - 官方同时说明,Prompt Caching 和 Batch API 折扣在完整上下文窗口内仍然可用。
数据驻留
- 对于
Claude Opus 4.7、Claude Opus 4.6及更新模型,当通过inference_geo指定 US-only inference 时,所有 Token 价格项都会乘以 1.1x。 - 默认的全局路由仍按标准价格计费。
- 这条规则只针对 Anthropic 一方 Claude API。
Fast mode 快速模式
Claude Opus 4.6的 Fast mode 按标准价格的 6 倍计费。- 官方给出的 Fast mode 价格如下:
补充说明:
- Prompt Caching 倍率会叠加在 Fast mode 价格之上。
- 数据驻留倍率也会叠加在 Fast mode 价格之上。
- Fast mode 不适用于 Batch API。
Tool use 与 Web search 定价
- Tool use 请求本身仍按模型输入 / 输出 Token 计费。
- Anthropic 官方说明,服务端工具可能会有额外按使用量计费。
- 其中 Web search 的官方价格是 $10 / 1,000 次搜索,另加生成内容对应的标准 Token 费用。
Claude-hosted agents 定价
- Claude-hosted agents 按两个维度计费:
- 模型 Token 消耗
- 会话运行时长
- 运行时单价为 $0.08 / 小时。
- 如果在 hosted agent 会话内触发 Web search,同样按 $10 / 1,000 次搜索计费。
本文范围说明
- 本文只整理 Anthropic 官方一方 明确公开的调用定价。
- 不包含账期、付款方式、合同方案或第三方渠道价格。