本页面提供 Anthropic 模型和功能的详细定价信息。所有价格均以美元计。
如需获取最新定价信息,请访问 claude.com/pricing。
下表显示了所有 Claude 模型的定价:
| 模型 | 基础输入令牌 | 5 分钟缓存写入 | 1 小时缓存写入 | 缓存命中与刷新 | 输出令牌 |
|---|---|---|---|---|---|
| Claude Fable 5 | $10 / MTok | $12.50 / MTok | $20 / MTok | $1 / MTok | $50 / MTok |
| Claude Mythos 5(限量供应) | $10 / MTok | $12.50 / MTok | $20 / MTok | $1 / MTok | $50 / MTok |
| Claude Opus 5 | $5 / MTok | $6.25 / MTok | $10 / MTok | $0.50 / MTok | $25 / MTok |
| Claude Opus 4.8 | $5 / MTok | $6.25 / MTok | $10 / MTok | $0.50 / MTok | $25 / MTok |
| Claude Opus 4.7 | $5 / MTok | $6.25 / MTok | $10 / MTok | $0.50 / MTok | $25 / MTok |
| Claude Opus 4.6 | $5 / MTok | $6.25 / MTok | $10 / MTok | $0.50 / MTok | $25 / MTok |
| Claude Opus 4.5 | $5 / MTok | $6.25 / MTok | $10 / MTok | $0.50 / MTok | $25 / MTok |
| Claude Opus 4.1(已停用,Bedrock 和 Google Cloud 除外) | $15 / MTok | $18.75 / MTok | $30 / MTok | $1.50 / MTok | $75 / MTok |
| Claude Opus 4(已停用,Google Cloud 除外) | $15 / MTok | $18.75 / MTok | $30 / MTok | $1.50 / MTok | $75 / MTok |
| Claude Sonnet 5 | $2 / MTok | $2.50 / MTok | $4 / MTok | $0.20 / MTok | $10 / MTok |
| Claude Sonnet 4.6 | $3 / MTok | $3.75 / MTok | $6 / MTok | $0.30 / MTok | $15 / MTok |
| Claude Sonnet 4.5 | $3 / MTok | $3.75 / MTok | $6 / MTok | $0.30 / MTok | $15 / MTok |
| Claude Sonnet 4(已停用,Bedrock 和 Google Cloud 除外) | $3 / MTok | $3.75 / MTok | $6 / MTok | $0.30 / MTok | $15 / MTok |
| Claude Haiku 4.5 | $1 / MTok | $1.25 / MTok | $2 / MTok | $0.10 / MTok | $5 / MTok |
| Claude Haiku 3.5(已停用,Bedrock 和 Google Cloud 除外) | $0.80 / MTok | $1 / MTok | $1.60 / MTok | $0.08 / MTok | $4 / MTok |
有关 Claude Platform on AWS 的定价,请参阅 Claude Platform on AWS 定价。
本节介绍由合作伙伴运营的云平台,在这些平台上由云提供商向您开具账单。对于由 Anthropic 运营并通过应用市场计费的云平台,请参阅 Claude Platform on AWS 定价和 Claude in Microsoft Foundry 定价。
Claude 模型可在 Amazon Bedrock 和 Google Cloud 上使用。如需官方定价,请访问:
Claude Platform on AWS 通过 AWS Marketplace 使用 "Claude Consumption Units"(Claude 消费单位),即 CCU 进行计费。Anthropic 按标准的每模型、每功能费率以美元计算您的令牌使用量,应用任何协商的折扣,然后按每 CCU $0.01 的比率将结果转换为 CCU,并每小时向 AWS Marketplace 报告 CCU 数量。您的 AWS 账单将显示单个 CCU 行项目。
| 概念 | 详情 |
|---|---|
| 计费单位 | Claude Consumption Unit (CCU) |
| CCU 价格 | 每 CCU $0.01(固定;折扣在令牌到 CCU 的转换环节应用,而非应用于 CCU 价格) |
| 转换 | 令牌使用量按标准的每模型、每功能费率以美元计价(与 Claude API 定价相同),然后按每 CCU $0.01 转换为 CCU |
| 计费周期 | 每小时向 AWS Marketplace 计量;按月开具发票 |
| 付款模式 | 仅限后付费(欠款结算);无预付费额度 |
| 折扣 | 以减少计量的 CCU 数量的方式应用 |
| 税费 | 税前计量;AWS Marketplace 处理税费 |
| 成本可见性 | 在 Claude Console 中查看实时明细(通过 AWS Console 访问);AWS Cost Explorer 显示汇总的 CCU |
对于 Claude 4.6 及更高版本模型,使用 inference_geo: "us" 会应用 1.1 倍的定价乘数。inference_geo: "global"(默认)使用标准定价。详情请参阅数据驻留。
当您在 AWS Console 的 Claude Platform on AWS 服务页面上注册时,AWS Console 会查找与您的账户关联的任何私有报价,并提示您在 AWS Marketplace 中接受该报价。如需了解私有报价条款,请联系您的 Anthropic 客户代表。
Claude in Microsoft Foundry 通过 Azure Marketplace 使用 Claude Consumption Units (CCU) 进行计费。Anthropic 按标准的每模型、每功能费率以美元计算您的令牌使用量,应用任何协商的折扣,然后按每 CCU $0.01 的比率将结果转换为 CCU,并每小时向 Azure Marketplace 报告 CCU 数量。您的 Azure 账单将显示单个 CCU 行项目。
| 概念 | 详情 |
|---|---|
| 计费单位 | Claude Consumption Unit (CCU) |
| CCU 价格 | 每 CCU $0.01(固定;折扣在令牌到 CCU 的转换环节应用,而非应用于 CCU 价格) |
| 转换 | 令牌使用量按标准的每模型、每功能费率以美元计价(与 Claude API 定价相同),然后按每 CCU $0.01 转换为 CCU |
| 计费周期 | 每小时向 Azure Marketplace 计量;按月开具发票 |
| 付款模式 | 仅限后付费(欠款结算);无预付费额度 |
| 折扣 | 以减少计量的 CCU 数量的方式应用 |
| 税费 | 税前计量;Azure Marketplace 处理税费 |
| 成本可见性 | Azure Cost Management 显示汇总的 CCU |
托管在 Azure 上的部署可以使用 US Data Zone Standard 部署类型,该类型将推理限定在美国境内。这等同于 Claude API 上的 inference_geo: "us",并应用相同的 1.1 倍定价乘数。详情请参阅数据驻留。
"Prompt caching"(提示缓存)通过在多次 API 调用之间重用先前处理过的提示部分来降低成本和延迟。API 无需在每次请求时重新处理相同的大型系统提示、文档或对话历史,而是以标准输入价格的一小部分从缓存中读取。
启用提示缓存有两种方式:
cache_control 字段。系统会随着对话的增长自动管理缓存断点。对于大多数用例,这是推荐的起点。cache_control,以精细控制具体缓存哪些内容。提示缓存相对于基础输入令牌费率使用以下定价乘数:
| 缓存操作 | 乘数 | 持续时间 |
|---|---|---|
| 5 分钟缓存写入 | 基础输入价格的 1.25 倍 | 缓存有效期 5 分钟 |
| 1 小时缓存写入 | 基础输入价格的 2 倍 | 缓存有效期 1 小时 |
| 缓存读取(命中) | 基础输入价格的 0.1 倍 | 与前一次写入的持续时间相同 |
缓存写入令牌在内容首次存储时计费。缓存读取令牌在后续请求检索缓存内容时计费。一次缓存命中的成本为标准输入价格的 10%,这意味着对于 5 分钟持续时间(1.25 倍写入),缓存在一次缓存读取后即可回本;对于 1 小时持续时间(2 倍写入),则在两次缓存读取后回本。
这些乘数可与其他定价修正因子叠加,包括 Batch API 折扣和数据驻留。
有关实现细节、支持的模型和代码示例,请参阅提示缓存。
对于 Claude 4.6 及更高版本模型,通过 inference_geo 参数指定仅限美国的推理会对所有令牌定价类别(包括输入令牌、输出令牌、缓存写入和缓存读取)应用 1.1 倍的乘数。全球路由(默认)使用标准定价。
这适用于 Claude API(第一方)和 Claude Platform on AWS。在 Claude in Microsoft Foundry 上,相同的 1.1 倍乘数适用于使用 US Data Zone Standard 部署类型的部署(请参阅推理地理位置)。合作伙伴运营的平台(Bedrock 和 Google Cloud)有独立的区域定价。详情请参阅 Bedrock 和 Google Cloud。更早的模型不支持 inference_geo 参数,始终使用标准定价;在这些模型上包含该参数的请求将返回 400 错误。
如需了解更多信息,请参阅数据驻留。
快速模式目前处于研究预览阶段,以高级定价为 Claude Opus 5 和 Claude Opus 4.8 提供显著更快的输出。快速模式定价适用于整个上下文窗口,包括超过 20 万输入令牌的请求。快速模式仅在 Claude API(第一方)上可用;在 Claude Platform on AWS 或合作伙伴运营的云平台上不可用。
| 模型 | 输入 | 输出 |
|---|---|---|
| Claude Opus 5 / Claude Opus 4.8 | $10 / MTok | $50 / MTok |
快速模式在 Claude Opus 4.7 上不可用(带有 speed: "fast" 的请求会返回错误),在 Claude Opus 4.6 上也不可用(请求以标准速度运行并按标准费率计费)。请参阅快速模式。
快速模式定价可与其他定价修正因子叠加:
快速模式不可与 Batch API 一起使用。
如需了解更多信息,请参阅快速模式。
Batch API 允许异步处理大量请求,输入和输出令牌均享受 50% 的折扣。
| 模型 | 批量输入 | 批量输出 |
|---|---|---|
| Claude Fable 5 | $5 / MTok | $25 / MTok |
| Claude Mythos 5(限量供应) | $5 / MTok | $25 / MTok |
| Claude Opus 5 | $2.50 / MTok | $12.50 / MTok |
| Claude Opus 4.8 | $2.50 / MTok | $12.50 / MTok |
| Claude Opus 4.7 | $2.50 / MTok | $12.50 / MTok |
| Claude Opus 4.6 | $2.50 / MTok | $12.50 / MTok |
| Claude Opus 4.5 | $2.50 / MTok | $12.50 / MTok |
| Claude Opus 4.1(已停用,Bedrock 和 Google Cloud 除外) | $7.50 / MTok | $37.50 / MTok |
| Claude Opus 4(已停用,Google Cloud 除外) | $7.50 / MTok | $37.50 / MTok |
| Claude Sonnet 5 | $1 / MTok | $5 / MTok |
| Claude Sonnet 4.6 | $1.50 / MTok | $7.50 / MTok |
| Claude Sonnet 4.5 | $1.50 / MTok | $7.50 / MTok |
| Claude Sonnet 4(已停用,Bedrock 和 Google Cloud 除外) | $1.50 / MTok | $7.50 / MTok |
| Claude Haiku 4.5 | $0.50 / MTok | $2.50 / MTok |
| Claude Haiku 3.5(已停用,Bedrock 和 Google Cloud 除外) | $0.40 / MTok | $2 / MTok |
有关批处理的更多信息,请参阅批处理。
Claude 4.6 及更高版本模型以及 Claude Mythos Preview 以标准定价提供完整的 100 万令牌上下文窗口。(一个 90 万令牌的请求与一个 9 千令牌的请求按相同的每令牌费率计费。)提示缓存和批处理折扣在整个上下文窗口范围内按标准费率应用。
工具使用请求的定价基于以下因素:
tools 参数中的令牌)客户端工具的定价与任何其他 Claude API 请求相同,而服务器端工具可能会根据其具体使用情况产生额外费用。
工具使用产生的额外令牌来自:
tools 参数(工具名称、描述和模式)tool_use 内容块tool_result 内容块当您使用 tools 时,API 还会自动为模型包含一个启用工具使用的特殊系统提示。每个模型所需的工具使用令牌数量列于下表中(不包括前面列出的额外令牌)。请注意,该表假设至少提供了 1 个工具。如果未提供 tools,则工具选择为 none 时使用 0 个额外的系统提示令牌。
| 模型 | 工具选择 | 工具使用系统提示令牌数 |
|---|---|---|
| Claude Opus 5 | auto、noneany、tool | 286 个令牌 406 个令牌 |
| Claude Opus 4.8 | auto、noneany、tool | 290 个令牌 410 个令牌 |
| Claude Opus 4.7 | auto、noneany、tool | 675 个令牌 804 个令牌 |
| Claude Opus 4.6 | auto、noneany、tool | 497 个令牌 589 个令牌 |
| Claude Opus 4.5 | auto、noneany、tool | 496 个令牌 588 个令牌 |
| Claude Opus 4.1(已停用,Bedrock 和 Google Cloud 除外) | auto、noneany、tool | 313 个令牌 315 个令牌 |
| Claude Opus 4(已停用,Google Cloud 除外) | auto、noneany、tool | 313 个令牌 315 个令牌 |
| Claude Sonnet 5 | auto、noneany、tool | 354 个令牌 474 个令牌 |
| Claude Sonnet 4.6 | auto、noneany、tool | 497 个令牌 589 个令牌 |
| Claude Sonnet 4.5 | auto、noneany、tool | 496 个令牌 588 个令牌 |
| Claude Sonnet 4(已停用,Bedrock 和 Google Cloud 除外) | auto、noneany、tool | 313 个令牌 315 个令牌 |
| Claude Haiku 4.5 | auto、noneany、tool | 496 个令牌 588 个令牌 |
| Claude Haiku 3.5(已停用,Bedrock 和 Google Cloud 除外) | auto、noneany、tool | 264 个令牌 355 个令牌 |
这些令牌数量会加到您的正常输入和输出令牌中,以计算请求的总费用。
有关当前各模型的价格,请参阅模型定价部分。
有关工具使用实现和最佳实践的更多信息,请参阅工具使用。
bash 工具定义会为您的请求添加以下输入令牌。这是在每个模型的工具使用系统提示之外的额外消耗,后者在存在任何工具时都会生效。
| 模型 | 额外输入令牌 |
|---|---|
| Claude Opus 5、Claude Opus 4.8 和 Claude Opus 4.7 | 325 个令牌 |
| Claude Opus 4.6、Claude Sonnet 4.6 及更早版本 | 244 个令牌 |
以下内容会消耗额外的令牌:
有关完整的定价详情,请参阅工具使用定价。
代码执行与网络搜索或网络获取一起使用时是免费的。 当您的 API 请求中包含 web_search_20260209(或更高版本)或 web_fetch_20260209(或更高版本)时,除了标准的输入和输出令牌费用外,代码执行工具调用不会产生额外费用。
在不使用这些工具的情况下,代码执行按执行时间计费,与令牌使用量分开跟踪:
代码执行使用量会在响应中跟踪:
{
"usage": {
"input_tokens": 105,
"output_tokens": 239,
"server_tool_use": {
"code_execution_requests": 1
}
}
}文本编辑器工具采用与 Claude 使用的其他工具相同的定价结构。它遵循基于您所使用的 Claude 模型的标准输入和输出 "token"(令牌)定价。
除基础令牌外,文本编辑器工具还需要以下额外的输入令牌:
| 工具 | 额外输入令牌 |
|---|---|
text_editor_20250429(Claude 4.x) | 700 个令牌 |
有关完整的定价详情,请参阅工具使用定价。
网络搜索的使用费用在令牌使用费用之外单独收取:
{
"usage": {
"input_tokens": 105,
"output_tokens": 6039,
"cache_read_input_tokens": 7123,
"cache_creation_input_tokens": 7345,
"server_tool_use": {
"web_search_requests": 1
}
}
}网络搜索在 Claude API 上的价格为每 1,000 次搜索 10 美元,另加搜索生成内容的标准令牌费用。在整个对话过程中检索到的网络搜索结果均计为输入令牌,包括单轮对话中执行的搜索迭代以及后续对话轮次中的结果。
每次网络搜索计为一次使用,无论返回多少条结果。如果在网络搜索过程中发生错误,该次网络搜索将不会计费。
Web fetch(网页抓取)的使用除标准令牌费用外不产生额外费用:
{
"usage": {
"input_tokens": 25039,
"output_tokens": 931,
"cache_read_input_tokens": 0,
"cache_creation_input_tokens": 0,
"server_tool_use": {
"web_fetch_requests": 1
}
}
}Web fetch 工具在 Claude API 上可用,且无需额外付费。您只需为成为对话上下文一部分的抓取内容支付标准令牌费用。
为防止意外抓取会消耗过多令牌的大型内容,请使用 max_content_tokens 参数,根据您的使用场景和预算考量设置适当的限制。
典型内容的令牌使用量示例:
计算机使用遵循标准的工具使用定价。使用计算机使用工具时:
系统提示开销: 计算机使用测试版会向系统提示添加 466–499 个令牌
计算机使用工具令牌使用量:
| 模型 | 每个工具定义的输入令牌数 |
|---|---|
| Claude 4.x 模型 | 735 个令牌 |
额外的令牌消耗:
Claude Managed Agents 按两个维度计费:令牌和会话运行时长。
Claude Managed Agents 会话消耗的所有令牌均按模型定价中显示的费率计费。提示缓存乘数同样适用。会话内触发的网络搜索按标准的每 1,000 次搜索 $10 计费。在 Claude Platform on AWS 上,会话令牌和运行时长费用按标准比率转换为 Claude Consumption Units。当智能体的 model.speed 设置为 "fast" 时,将应用快速模式高级定价。
数据驻留乘数同样适用:当智能体的 model.inference_geo 固定为 "us" 时,运行该智能体的会话所消耗的令牌将按标准费率的 1.1 倍计费,与 Messages API 上仅限美国推理所应用的乘数相同。
以下 Messages API 修正因子不适用于 Claude Managed Agents 会话:
| 修正因子 | 不适用的原因 |
|---|---|
| Batch API 折扣 | 会话是有状态且交互式的。没有批处理模式。 |
| 云平台定价 | 在合作伙伴运营的云平台上不可用。 |
| SKU | 费率 | 计量方式 |
|---|---|---|
| 会话运行时长 | 每会话小时 $0.08 | running 状态持续时长 |
运行时长精确到毫秒计量,且仅在会话状态为 running 时累计。处于 idle(等待您的下一条消息或工具确认)、rescheduling 或 terminated 状态的时间不计入运行时长。
一个使用 Claude Opus 5 的一小时编码会话,消耗 50,000 个输入令牌和 15,000 个输出令牌:
| 行项目 | 计算 | 成本 |
|---|---|---|
| 输入令牌 | 50,000 × $5 / 1,000,000 | $0.25 |
| 输出令牌 | 15,000 × $25 / 1,000,000 | $0.375 |
| 会话运行时长 | 1.0 小时 × $0.08 | $0.08 |
| 总计 | $0.705 |
如果提示缓存处于活动状态,且 40,000 个输入令牌为缓存读取:
| 行项目 | 计算 | 成本 |
|---|---|---|
| 未缓存的输入令牌 | 10,000 × $5 / 1,000,000 | $0.05 |
| 缓存读取令牌 | 40,000 × $5 × 0.1 / 1,000,000 | $0.02 |
| 输出令牌 | 15,000 × $25 / 1,000,000 | $0.375 |
| 会话运行时长 | 1.0 小时 × $0.08 | $0.08 |
| 总计 | $0.525 |
有关此计算的详细演练,请参阅客户支持智能体指南。
使用 Claude 构建智能体时:
速率限制因使用层级而异,并影响您可以发出的请求数量:
有关详细的速率限制信息,请参阅速率限制。
如需超出 Scale 层级的限制或定制定价方案,请联系销售团队。
高用量用户可能可以获得批量折扣。这些折扣根据具体情况逐一协商。
对于有特定需求的企业客户:
请通过 [email protected] 或 Claude Console 联系销售团队,讨论企业定价选项。
令牌使用量如何计算?
令牌是模型处理的文本片段。粗略估算,1 个令牌大约相当于 4 个字符或 0.75 个英文单词。确切数量因语言和内容类型而异。
是否有免费层级或试用?
新用户会获得少量免费额度用于测试 API。如需了解企业评估的延长试用信息,请联系销售。
折扣如何叠加?
Batch API 和提示缓存折扣可以组合使用。例如,同时使用这两项功能与标准 API 调用相比可显著节省成本。有关乘数如何相互作用,请参阅提示缓存定价。
接受哪些付款方式?
标准账户接受主要信用卡。企业客户可以安排发票付款和其他付款方式。
如有其他定价相关问题,请联系 [email protected]。
Was this page helpful?