本頁面提供 Anthropic 模型與功能的詳細定價資訊。所有價格均以美元計價。
如需最新定價資訊,請造訪 claude.com/pricing。
下表顯示所有 Claude 模型的定價:
| 模型 | 基本輸入 Token | 5 分鐘快取寫入 | 1 小時快取寫入 | 快取命中與重新整理 | 輸出 Token |
|---|---|---|---|---|---|
| Claude Fable 5 | $10 / MTok | $12.50 / MTok | $20 / MTok | $1 / MTok | $50 / MTok |
| Claude Mythos 5(限量供應) | $10 / MTok | $12.50 / MTok | $20 / MTok | $1 / MTok | $50 / MTok |
| Claude Opus 5 | $5 / MTok | $6.25 / MTok | $10 / MTok | $0.50 / MTok | $25 / MTok |
| Claude Opus 4.8 | $5 / MTok | $6.25 / MTok | $10 / MTok | $0.50 / MTok | $25 / MTok |
| Claude Opus 4.7 | $5 / MTok | $6.25 / MTok | $10 / MTok | $0.50 / MTok | $25 / MTok |
| Claude Opus 4.6 | $5 / MTok | $6.25 / MTok | $10 / MTok | $0.50 / MTok | $25 / MTok |
| Claude Opus 4.5 | $5 / MTok | $6.25 / MTok | $10 / MTok | $0.50 / MTok | $25 / MTok |
| Claude Opus 4.1(已停用,Bedrock 和 Google Cloud 除外) | $15 / MTok | $18.75 / MTok | $30 / MTok | $1.50 / MTok | $75 / MTok |
| Claude Opus 4(已停用,Google Cloud 除外) | $15 / MTok | $18.75 / MTok | $30 / MTok | $1.50 / MTok | $75 / MTok |
| Claude Sonnet 5 | $2 / MTok | $2.50 / MTok | $4 / MTok | $0.20 / MTok | $10 / MTok |
| Claude Sonnet 4.6 | $3 / MTok | $3.75 / MTok | $6 / MTok | $0.30 / MTok | $15 / MTok |
| Claude Sonnet 4.5 | $3 / MTok | $3.75 / MTok | $6 / MTok | $0.30 / MTok | $15 / MTok |
| Claude Sonnet 4(已停用,Bedrock 和 Google Cloud 除外) | $3 / MTok | $3.75 / MTok | $6 / MTok | $0.30 / MTok | $15 / MTok |
| Claude Haiku 4.5 | $1 / MTok | $1.25 / MTok | $2 / MTok | $0.10 / MTok | $5 / MTok |
| Claude Haiku 3.5(已停用,Bedrock 和 Google Cloud 除外) | $0.80 / MTok | $1 / MTok | $1.60 / MTok | $0.08 / MTok | $4 / MTok |
如需 Claude Platform on AWS 的定價,請參閱 Claude Platform on AWS 定價。
本節涵蓋由合作夥伴營運的雲端平台,由雲端供應商向您開立發票。如需透過市集計費的 Anthropic 營運雲端平台,請參閱 Claude Platform on AWS 定價和 Claude in Microsoft Foundry 定價。
Claude 模型可在 Amazon Bedrock 和 Google Cloud 上使用。如需官方定價,請造訪:
Claude Platform on AWS 透過 AWS Marketplace 使用 Claude Consumption Units(CCU)計費。Anthropic 會依照各模型、各功能的標準費率以美元計算您的 token 使用量,套用任何協商折扣,以每 CCU $0.01 的匯率將結果轉換為 CCU,並每小時向 AWS Marketplace 回報 CCU 數量。您的 AWS 帳單會顯示單一 CCU 項目。
| 概念 | 詳細資訊 |
|---|---|
| 計費單位 | Claude Consumption Unit(CCU) |
| CCU 價格 | 每 CCU $0.01(固定;折扣套用於 token 轉 CCU 的換算,而非 CCU 價格) |
| 換算 | Token 使用量依各模型、各功能的標準費率以美元計價(與 Claude API 定價相同),然後以每 CCU $0.01 轉換為 CCU |
| 計費週期 | 每小時向 AWS Marketplace 計量;每月開立發票 |
| 付款模式 | 僅限後付(postpaid);無預付額度 |
| 折扣 | 以計量較少的 CCU 方式套用 |
| 稅金 | 稅前計量;由 AWS Marketplace 處理稅金 |
| 成本可見度 | 在 Claude Console 中即時查看明細(透過 AWS Console 存取);AWS Cost Explorer 顯示彙總的 CCU |
對於 Claude 4.6 及更新版本的模型,使用 inference_geo: "us" 會套用 1.1 倍的定價乘數。inference_geo: "global"(預設)使用標準定價。詳情請參閱資料駐留。
當您在 AWS Console 的 Claude Platform on AWS 服務頁面上註冊時,AWS Console 會查詢與您帳戶相關聯的任何私人優惠,並提示您在 AWS Marketplace 中接受。如需私人優惠條款,請聯絡您的 Anthropic 客戶代表。
Claude in Microsoft Foundry 透過 Azure Marketplace 使用 Claude Consumption Units(CCU)計費。Anthropic 會依照各模型、各功能的標準費率以美元計算您的 token 使用量,套用任何協商折扣,以每 CCU $0.01 的匯率將結果轉換為 CCU,並每小時向 Azure Marketplace 回報 CCU 數量。您的 Azure 帳單會顯示單一 CCU 項目。
| 概念 | 詳細資訊 |
|---|---|
| 計費單位 | Claude Consumption Unit(CCU) |
| CCU 價格 | 每 CCU $0.01(固定;折扣套用於 token 轉 CCU 的換算,而非 CCU 價格) |
| 換算 | Token 使用量依各模型、各功能的標準費率以美元計價(與 Claude API 定價相同),然後以每 CCU $0.01 轉換為 CCU |
| 計費週期 | 每小時向 Azure Marketplace 計量;每月開立發票 |
| 付款模式 | 僅限後付(postpaid);無預付額度 |
| 折扣 | 以計量較少的 CCU 方式套用 |
| 稅金 | 稅前計量;由 Azure Marketplace 處理稅金 |
| 成本可見度 | Azure Cost Management 顯示彙總的 CCU |
託管於 Azure 的部署可使用 US Data Zone Standard 部署類型,將推論限制在美國境內。這相當於 Claude API 上的 inference_geo: "us",並套用相同的 1.1 倍定價乘數。詳情請參閱資料駐留。
「Prompt caching」(提示快取)透過在 API 呼叫之間重複使用先前處理過的提示部分,來降低成本和延遲。API 不會在每次請求時重新處理相同的大型系統提示、文件或對話歷史記錄,而是以標準輸入價格的一小部分從快取中讀取。
有兩種方式可啟用提示快取:
cache_control 欄位。系統會隨著對話增長自動管理快取斷點。這是大多數使用案例的建議起點。cache_control,以精細控制要快取的確切內容。提示快取使用以下相對於基本輸入 token 費率的定價乘數:
| 快取操作 | 乘數 | 持續時間 |
|---|---|---|
| 5 分鐘快取寫入 | 基本輸入價格的 1.25 倍 | 快取有效期 5 分鐘 |
| 1 小時快取寫入 | 基本輸入價格的 2 倍 | 快取有效期 1 小時 |
| 快取讀取(命中) | 基本輸入價格的 0.1 倍 | 與前一次寫入相同的持續時間 |
快取寫入 token 在內容首次儲存時收費。快取讀取 token 在後續請求擷取快取內容時收費。快取命中的成本為標準輸入價格的 10%,這表示對於 5 分鐘持續時間(1.25 倍寫入),快取在一次快取讀取後即可回本;對於 1 小時持續時間(2 倍寫入),則在兩次快取讀取後回本。
這些乘數會與其他定價修飾符疊加,包括 Batch API 折扣和資料駐留。
如需實作詳細資訊、支援的模型和程式碼範例,請參閱提示快取。
對於 Claude 4.6 及更新版本的模型,透過 inference_geo 參數指定僅限美國推論,會對所有 token 定價類別套用 1.1 倍乘數,包括輸入 token、輸出 token、快取寫入和快取讀取。全球路由(預設)使用標準定價。
這適用於 Claude API(第一方)和 Claude Platform on AWS。在 Claude in Microsoft Foundry 上,相同的 1.1 倍乘數適用於使用 US Data Zone Standard 部署類型的部署(請參閱推論地理位置)。合作夥伴營運的平台(Bedrock 和 Google Cloud)有獨立的區域定價。詳情請參閱 Bedrock 和 Google Cloud。較早的模型不支援 inference_geo 參數,一律使用標準定價;在這些模型上包含此參數的請求會傳回 400 錯誤。
如需更多資訊,請參閱資料駐留。
快速模式目前處於研究預覽階段,以進階定價為 Claude Opus 5 和 Claude Opus 4.8 提供顯著更快的輸出。快速模式定價適用於完整的上下文視窗,包括超過 20 萬輸入 token 的請求。快速模式僅在 Claude API(第一方)上提供;不適用於 Claude Platform on AWS 或合作夥伴營運的雲端平台。
| 模型 | 輸入 | 輸出 |
|---|---|---|
| Claude Opus 5 / Claude Opus 4.8 | $10 / MTok | $50 / MTok |
快速模式不適用於 Claude Opus 4.7(帶有 speed: "fast" 的請求會傳回錯誤)或 Claude Opus 4.6(請求以標準速度執行並按標準費率計費)。請參閱快速模式。
快速模式定價會與其他定價修飾符疊加:
快速模式不適用於 Batch API。
如需更多資訊,請參閱快速模式。
Batch API 允許非同步處理大量請求,輸入和輸出 token 均享有 50% 折扣。
| 模型 | 批次輸入 | 批次輸出 |
|---|---|---|
| Claude Fable 5 | $5 / MTok | $25 / MTok |
| Claude Mythos 5(限量供應) | $5 / MTok | $25 / MTok |
| Claude Opus 5 | $2.50 / MTok | $12.50 / MTok |
| Claude Opus 4.8 | $2.50 / MTok | $12.50 / MTok |
| Claude Opus 4.7 | $2.50 / MTok | $12.50 / MTok |
| Claude Opus 4.6 | $2.50 / MTok | $12.50 / MTok |
| Claude Opus 4.5 | $2.50 / MTok | $12.50 / MTok |
| Claude Opus 4.1(已停用,Bedrock 和 Google Cloud 除外) | $7.50 / MTok | $37.50 / MTok |
| Claude Opus 4(已停用,Google Cloud 除外) | $7.50 / MTok | $37.50 / MTok |
| Claude Sonnet 5 | $1 / MTok | $5 / MTok |
| Claude Sonnet 4.6 | $1.50 / MTok | $7.50 / MTok |
| Claude Sonnet 4.5 | $1.50 / MTok | $7.50 / MTok |
| Claude Sonnet 4(已停用,Bedrock 和 Google Cloud 除外) | $1.50 / MTok | $7.50 / MTok |
| Claude Haiku 4.5 | $0.50 / MTok | $2.50 / MTok |
| Claude Haiku 3.5(已停用,Bedrock 和 Google Cloud 除外) | $0.40 / MTok | $2 / MTok |
如需批次處理的更多資訊,請參閱批次處理。
Claude 4.6 及更新版本的模型以及 Claude Mythos Preview 以標準定價包含完整的 100 萬 token 上下文視窗。(90 萬 token 的請求與 9 千 token 的請求按相同的每 token 費率計費。)提示快取和批次處理折扣在完整上下文視窗中均以標準費率套用。
工具使用請求的計價依據如下:
tools 參數中的內容)用戶端工具的計價方式與任何其他 Claude API 請求相同,而伺服器端工具則可能根據其特定使用情況產生額外費用。
工具使用所產生的額外 token 來自:
tools 參數(工具名稱、描述和結構定義)tool_use 內容區塊tool_result 內容區塊當您使用 tools 時,API 也會自動為模型加入一個特殊的系統提示以啟用工具使用。每個模型所需的工具使用 token 數量列於下表(不包含前述的額外 token)。請注意,此表假設至少提供了 1 個工具。如果未提供任何 tools,則工具選擇為 none 時會使用 0 個額外的系統提示 token。
| 模型 | 工具選擇 | 工具使用系統提示 token 數量 |
|---|---|---|
| Claude Opus 5 | auto、noneany、tool | 286 個 token 406 個 token |
| Claude Opus 4.8 | auto、noneany、tool | 290 個 token 410 個 token |
| Claude Opus 4.7 | auto、noneany、tool | 675 個 token 804 個 token |
| Claude Opus 4.6 | auto、noneany、tool | 497 個 token 589 個 token |
| Claude Opus 4.5 | auto、noneany、tool | 496 個 token 588 個 token |
| Claude Opus 4.1(已停用,Bedrock 和 Google Cloud 除外) | auto、noneany、tool | 313 個 token 315 個 token |
| Claude Opus 4(已停用,Google Cloud 除外) | auto、noneany、tool | 313 個 token 315 個 token |
| Claude Sonnet 5 | auto、noneany、tool | 354 個 token 474 個 token |
| Claude Sonnet 4.6 | auto、noneany、tool | 497 個 token 589 個 token |
| Claude Sonnet 4.5 | auto、noneany、tool | 496 個 token 588 個 token |
| Claude Sonnet 4(已停用,Bedrock 和 Google Cloud 除外) | auto、noneany、tool | 313 個 token 315 個 token |
| Claude Haiku 4.5 | auto、noneany、tool | 496 個 token 588 個 token |
| Claude Haiku 3.5(已停用,Bedrock 和 Google Cloud 除外) | auto、noneany、tool | 264 個 token 355 個 token |
這些 token 數量會加到您正常的輸入和輸出 token 中,以計算請求的總成本。
如需目前各模型的價格,請參閱模型定價一節。
如需工具使用實作和最佳實務的更多資訊,請參閱工具使用。
bash 工具定義會在您的請求中增加以下輸入 token。這是在每個模型的工具使用系統提示之外額外增加的,後者在任何工具存在時都會適用。
| 模型 | 額外輸入 token |
|---|---|
| Claude Opus 5、Claude Opus 4.8 和 Claude Opus 4.7 | 325 個 token |
| Claude Opus 4.6、Claude Sonnet 4.6 及更早版本 | 244 個 token |
額外的 token 會被以下內容消耗:
如需完整定價詳細資訊,請參閱工具使用定價。
程式碼執行在與網路搜尋或網路擷取一起使用時是免費的。 當您的 API 請求中包含 web_search_20260209(或更新版本)或 web_fetch_20260209(或更新版本)時,除了標準的輸入和輸出 token 費用外,程式碼執行工具呼叫不會產生額外費用。
在不使用這些工具的情況下,程式碼執行會依執行時間計費,與 token 使用量分開追蹤:
程式碼執行使用量會在回應中追蹤:
{
"usage": {
"input_tokens": 105,
"output_tokens": 239,
"server_tool_use": {
"code_execution_requests": 1
}
}
}文字編輯器工具採用與 Claude 其他工具相同的定價結構。它遵循基於您所使用的 Claude 模型的標準輸入和輸出 token 定價。
除了基本 token 之外,文字編輯器工具還需要以下額外的輸入 token:
| 工具 | 額外輸入 token |
|---|---|
text_editor_20250429(Claude 4.x) | 700 個 token |
如需完整定價詳細資訊,請參閱工具使用定價。
網路搜尋的使用費用會在 token 使用費用之外額外收取:
{
"usage": {
"input_tokens": 105,
"output_tokens": 6039,
"cache_read_input_tokens": 7123,
"cache_creation_input_tokens": 7345,
"server_tool_use": {
"web_search_requests": 1
}
}
}網路搜尋在 Claude API 上的費用為每 1,000 次搜尋 $10 美元,外加搜尋生成內容的標準 token 費用。在整個對話過程中擷取的網路搜尋結果會被計為輸入 token,包括在單一回合中執行的搜尋迭代以及後續對話回合中的結果。
每次網路搜尋都計為一次使用,無論傳回的結果數量為何。如果在網路搜尋期間發生錯誤,該次網路搜尋將不會被計費。
網頁擷取的使用除了標準 token 費用外,不會產生額外費用:
{
"usage": {
"input_tokens": 25039,
"output_tokens": 931,
"cache_read_input_tokens": 0,
"cache_creation_input_tokens": 0,
"server_tool_use": {
"web_fetch_requests": 1
}
}
}網頁擷取工具在 Claude API 上可供使用,且無需額外費用。您只需為成為對話上下文一部分的擷取內容支付標準 token 費用。
為了避免無意間擷取大量內容而消耗過多 token,請使用 max_content_tokens 參數,根據您的使用情境和預算考量設定適當的限制。
典型內容的 token 使用量範例:
電腦使用遵循標準的工具使用定價。使用電腦使用工具時:
系統提示額外開銷: 電腦使用 beta 會在系統提示中增加 466–499 個 token
電腦使用工具 token 用量:
| 模型 | 每個工具定義的輸入 token 數 |
|---|---|
| Claude 4.x 模型 | 735 個 token |
額外的 token 消耗:
Claude Managed Agents 依兩個維度計費:token 和工作階段執行時間。
Claude Managed Agents 工作階段消耗的所有 token 均按模型定價中顯示的費率計費。提示快取乘數以相同方式套用。工作階段內觸發的網頁搜尋會產生標準的每 1,000 次搜尋 $10 費用。在 Claude Platform on AWS 上,工作階段 token 和執行時間費用會以標準匯率轉換為 Claude Consumption Units。當代理程式的 model.speed 設定為 "fast" 時,會套用快速模式進階定價。
資料駐留乘數也適用:當代理程式的 model.inference_geo 固定為 "us" 時,執行該代理程式的工作階段所消耗的 token 會以標準費率的 1.1 倍計費,與 Messages API 上僅限美國推論所套用的乘數相同。
以下 Messages API 修飾符不適用於 Claude Managed Agents 工作階段:
| 修飾符 | 不適用的原因 |
|---|---|
| Batch API 折扣 | 工作階段具有狀態且為互動式。沒有批次模式。 |
| 雲端平台定價 | 不適用於合作夥伴營運的雲端平台。 |
| SKU | 費率 | 計量 |
|---|---|---|
| 工作階段執行時間 | 每工作階段小時 $0.08 | running 狀態持續時間 |
執行時間以毫秒為單位測量,且僅在工作階段狀態為 running 時累計。處於 idle(等待您的下一則訊息或工具確認)、rescheduling 或 terminated 狀態的時間不計入執行時間。
使用 Claude Opus 5 的一小時程式編寫工作階段,消耗 50,000 個輸入 token 和 15,000 個輸出 token:
| 項目 | 計算 | 成本 |
|---|---|---|
| 輸入 token | 50,000 × $5 / 1,000,000 | $0.25 |
| 輸出 token | 15,000 × $25 / 1,000,000 | $0.375 |
| 工作階段執行時間 | 1.0 小時 × $0.08 | $0.08 |
| 總計 | $0.705 |
如果提示快取已啟用,且 40,000 個輸入 token 為快取讀取:
| 項目 | 計算 | 成本 |
|---|---|---|
| 未快取輸入 token | 10,000 × $5 / 1,000,000 | $0.05 |
| 快取讀取 token | 40,000 × $5 × 0.1 / 1,000,000 | $0.02 |
| 輸出 token | 15,000 × $25 / 1,000,000 | $0.375 |
| 工作階段執行時間 | 1.0 小時 × $0.08 | $0.08 |
| 總計 | $0.525 |
如需此計算的詳細說明,請參閱客戶支援代理程式指南。
使用 Claude 建置代理程式時:
「Rate limit」(速率限制)依使用層級而異,並影響您可以發出的請求數量:
如需詳細的速率限制資訊,請參閱速率限制。
如需超出 Scale 層級的限制或客製化定價方案,請聯絡銷售團隊。
高用量使用者可能享有用量折扣。這些折扣依個案協商。
針對有特定需求的企業客戶:
請透過 [email protected] 或 Claude Console 聯絡銷售團隊,以討論企業定價選項。
如何計算 token 使用量?
Token 是模型處理的文本片段。粗略估計,1 個 token 約等於 4 個字元或 0.75 個英文單字。確切數量因語言和內容類型而異。
是否有免費層級或試用?
新使用者會獲得少量免費額度以測試 API。如需企業評估的延長試用資訊,請聯絡銷售。
折扣如何疊加?
Batch API 和提示快取折扣可以合併使用。例如,同時使用這兩項功能相較於標準 API 呼叫可大幅節省成本。請參閱提示快取定價以了解乘數如何互動。
接受哪些付款方式?
標準帳戶接受主要信用卡。企業客戶可安排發票付款和其他付款方式。
如有其他定價相關問題,請聯絡 [email protected]。
Was this page helpful?