Claude Opus 5 相較於 Claude Opus 4.8 是一次跨越式的改進,在深度推理、代理式與長程任務,以及測試時運算擴展方面的提升最為顯著。本頁面總結了 Claude Opus 5 的所有新內容,包括預設啟用思考、對話中途工具變更,以及關於何時可以停用思考的一項重大變更。
| 模型 | API 模型 ID | 說明 |
|---|---|---|
| Claude Opus 5 | claude-opus-5 | 適用於複雜的代理式程式編寫與企業工作 |
Claude Opus 5 具有 1M token 上下文視窗(1M tokens 既是預設值也是最大值;沒有較小的上下文變體)、128k 最大輸出 tokens,以及預設啟用的 thinking(思考)。
如需完整的定價與規格,請參閱模型概述。
您可以在對話的各回合之間新增或移除工具,同時保留提示快取,而不必在整個工作階段期間重複傳送固定的工具清單。對話中途工具變更目前為測試版:請在您的請求中包含 mid-conversation-tool-changes-2026-07-01 測試版標頭。使用方式請參閱對話中途工具變更。
fallbacks 參數支援新的 "default" 模式,該模式會依拒絕類別套用 Anthropic 建議的備援模型,而非由您自行維護的模型清單。整個 fallbacks 參數目前為測試版。請使用 server-side-fallback-2026-07-01 測試版標頭,該標頭同時支援 "default" 模式與明確的模型清單(較早的 server-side-fallback-2026-06-01 標頭僅接受明確清單)。請參閱拒絕與備援。
Claude Opus 5 上可快取的最小提示長度為 512 tokens,低於 Claude Opus 4.8 的 1,024 tokens。在 Claude Opus 4.8 上因太短而無法快取的提示,現在無需變更程式碼即可建立快取項目。各模型的最小值請參閱提示快取。
快速模式(研究預覽)僅在 Claude API 上提供給 Claude Opus 5 使用;目前在 Amazon Bedrock、Google Cloud 或 Microsoft Foundry 上尚未提供。Claude Opus 5 的快速模式定價為每百萬輸入 tokens 10 美元,每百萬輸出 tokens 50 美元。存取方式、支援的模型與定價請參閱快速模式。
在 Claude Opus 4.8 上,除非您設定 thinking: {"type": "adaptive"},否則請求會在不啟用思考的情況下執行。在 Claude Opus 5 上,相同的請求會在啟用 thinking(思考)的情況下執行:模型會決定每個回合何時思考以及思考多少,而 effort 參數則是控制思考深度的方式。傳輸值保持不變;thinking: {"type": "adaptive"} 仍然有效且等同於預設值。
由於 max_tokens 是總輸出(思考加上回應文字)的硬性限制,請針對在 Claude Opus 4.8 上未啟用思考執行的工作負載重新檢視此設定。
API 保留了停用思考的選項,但須遵守下方的 effort 限制。
Claude Opus 5 比任何先前的 Opus 模型都能更可靠地將額外的 effort(努力程度)轉化為更好的結果,因此您選擇的 effort 等級影響更大。完整的等級階梯皆可使用:low、medium、high、xhigh 和 max,其中 max 是最高層級,用於最深入的推理。從預設值 high 開始,並根據您的評估結果向任一方向調整:在品質維持的情況下降低等級以節省 tokens 和延遲,或針對最嚴苛的工作提高等級。在 xhigh 或 max effort 下執行時,請設定較大的 max_tokens,讓模型有足夠空間在子代理和工具呼叫之間進行思考與行動。
此請求將 effort 調至最高的 max:
client = anthropic.Anthropic()
with client.messages.stream(
model="claude-opus-5",
max_tokens=64000,
output_config={"effort": "max"},
messages=[
{
"role": "user",
"content": "Explain why the sum of two even numbers is always even.",
}
],
) as stream:
response = stream.get_final_message()
print(response)在 Claude Opus 5 上,思考預設為啟用,因此不需要 thinking 欄位。
high 或以下在 Claude Opus 5 上,只有當 effort 等級為 high 或以下時,才接受 thinking: {"type": "disabled"}。將 thinking: {"type": "disabled"} 與 effort xhigh 或 max 一起設定會回傳 400 錯誤。這是 Claude Opus 5 起正式提供的行為,會在每個請求上強制執行,且這是相對於 Claude Opus 4.8 的重大變更——在 Claude Opus 4.8 中,停用思考與 effort 等級無關。如果您目前在高 effort 等級下停用思考,請保持停用思考並將 effort 設為 high 或以下,或保持 effort 等級並移除 thinking 欄位。
在停用思考的情況下,Claude Opus 5 偶爾會將工具呼叫寫入其文字輸出中,而非發出 tool_use 區塊,或在其可見回應中包含內部 XML 標籤。在可能的情況下,請保持啟用思考並透過較低的 effort 等級來控制 token 成本;對於必須保持停用思考的整合,請參閱在停用思考的情況下執行以了解提示緩解方法。
除了上述 API 變更之外,Claude Opus 5 的行為與 Claude Opus 4.8 有所不同,您可能在不變更任何程式碼的情況下就會注意到。預設的面向使用者回應和書面交付成果會更長。在代理式工作階段中,模型會更頻繁地向使用者敘述其進度。在多代理框架中,它會更積極地委派給子代理。它也會在未被告知的情況下驗證自己的工作,因此請移除從先前模型沿用的驗證指示(「包含最終驗證步驟」、「使用子代理進行驗證」);這些指示會導致 Claude Opus 5 過度驗證。如需調整這些行為的提示模式,請參閱為 Claude Opus 5 設計提示。
與 Claude Opus 4.8 相比,Claude Opus 5 是一次跨越式的改進而非漸進式改進,並以 Claude Fable 5 一半的成本提供前沿智慧。最大的提升在於:
max 等級)轉化為更好的結果。low 和 medium effort 以較高設定的一小部分 tokens 和延遲產出高品質結果。如需充分發揮這些能力的提示模式,請參閱為 Claude Opus 5 設計提示。
Claude Opus 5 的定價為每百萬輸入 tokens 5 美元,每百萬輸出 tokens 25 美元,與 Claude Opus 4.8 相同。
完整定價(包括批次處理、提示快取和快速模式費率)請參閱定價。
Claude Opus 5 可在以下平台使用:
claude-opus-5。anthropic.claude-opus-5。Claude Opus 5 也可透過 bedrock-runtime 上的 InvokeModel API 存取,由相同的基礎架構提供服務;Claude on Amazon Bedrock(舊版)整合未將其納入 ARN 版本化模型 ID 表中。claude-opus-5。Claude Opus 4.8 在上述所有平台上仍然可用。
若要從 Claude Opus 4.8 遷移,請更新您的模型 ID:
model = "claude-opus-4-8" # Before
model = "claude-opus-5" # After然後檢視兩項行為變更:思考預設為啟用,以及在 effort 為 xhigh 或 max 時停用思考會回傳 400 錯誤。逐步說明請參閱遷移指南。
所有目前 Claude 模型的完整規格與定價。
Claude Opus 5 特有的行為差異與提示模式。
控制 Claude 回應時使用的 tokens 數量,從 low 到 max。
思考在預設啟用時如何運作,以及何時可以停用。
為 Claude 提供建議性的 token 預算,以調配其工作節奏。
從先前 Claude 版本遷移至最新 Claude 模型的指南。
以進階定價從 Claude Opus 模型獲得更高的每秒輸出 tokens。
Was this page helpful?