「effort」參數讓您能夠控制 Claude 在回應請求時所花費的 token 數量。您可以透過單一模型在回應完整性與 token 效率之間取得平衡。effort 參數在所有支援的模型上皆可使用,無需 beta 標頭。
預設情況下,Claude 使用 high effort,會盡可能使用所需的 token 以獲得優異的結果。您可以將 effort 等級提高至 max 以獲得絕對最高的能力,或降低等級以更保守地使用 token,在接受部分能力降低的同時,針對速度和成本進行最佳化。
effort 參數會影響回應中的所有 token,包括:
這種方法有兩個主要優點:
| 等級 | 說明 | 典型使用情境 |
|---|---|---|
max | 絕對最高能力,對 token 花費沒有任何限制。適用於 Claude Fable 5、Claude Mythos 5、Claude Opus 5、Claude Opus 4.8、Claude Mythos Preview、Claude Opus 4.7、Claude Opus 4.6、Claude Sonnet 5 和 Claude Sonnet 4.6。 | 需要最深入推理和最徹底分析的任務 |
xhigh | 適用於長期工作的擴展能力。適用於 Claude Fable 5、Claude Mythos 5、Claude Opus 5、Claude Opus 4.8、Claude Opus 4.7 和 Claude Sonnet 5。 | 長時間執行的代理和程式編寫任務(超過 30 分鐘),token 預算達數百萬 |
high | 高能力。等同於不設定此參數。 | 複雜推理、困難的程式編寫問題、代理任務 |
medium | 平衡的方法,適度節省 token。 | 需要在速度、成本和效能之間取得平衡的代理任務 |
low | 最高效率。大幅節省 token,但能力有所降低。 | 需要最佳速度和最低成本的較簡單任務,例如子代理 |
xhigh 是較新的等級;部分支援 max 的模型不支援 xhigh。
Claude Sonnet 5 在 Claude API 和 Claude Code 上預設為 high effort。
Sonnet 4.6 預設為 high effort。使用 Sonnet 4.6 時請明確設定 effort,以避免非預期的延遲:
針對程式編寫和代理使用情境,請從 xhigh 開始,並將 high 作為大多數對智慧敏感工作負載的最低設定。對於成本敏感的工作負載,可降至 medium;僅當您的評估顯示在 xhigh 下仍有可測量的提升空間時,才升至 max。
API 預設值為 high。若要使用 xhigh,請明確設定 effort;您傳入的值會覆寫預設值。
| Effort | Claude Opus 4.7 的指引 |
|---|---|
low | 高效率,但最適合簡短、範圍明確的任務。如果您的任務有多個部分,請將 low 與明確的檢查清單搭配使用。 |
medium | 適用於一般工作流程的直接替代選項,讓您在降低成本的同時獲得良好結果。 |
high | 仍需要在智慧與 token 消耗之間取得平衡的進階使用情境。這通常是品質與 token 效率之間的最佳平衡點。 |
xhigh | 程式編寫和代理工作的建議起點,也適用於探索性任務,例如重複的工具呼叫、詳細的網路搜尋和知識庫搜尋。預期 token 使用量會明顯高於 high。 |
max | 保留給真正的前沿問題。在大多數工作負載上,max 會增加大量成本,但品質提升相對有限;在某些結構化輸出或對智慧較不敏感的任務上,可能導致過度思考。 |
Claude Opus 4.7 也比 Claude Opus 4.6 更嚴格地遵守 effort 等級,尤其是在 low 和 medium 等級。在較低的 effort 等級下,模型會將工作範圍限定在所要求的內容,而不會做超出要求的事。如果您在使用 Claude Opus 4.7 處理複雜問題時觀察到推理過於淺顯,請提高 effort,而非透過提示來繞過此問題。如果您必須為了延遲而保持低 effort,請加入針對性的指引,例如「此任務涉及多步驟推理。請在回應前仔細思考。」
在以 xhigh 或 max effort 執行 Claude Opus 4.7 時,請設定較大的 max_tokens,讓模型有足夠空間在子代理和工具呼叫之間進行思考和行動。從 64k token 開始並據此調整是合理的預設值。
Claude Opus 4.7 的指引同樣適用於 Claude Opus 4.8。針對程式編寫和代理使用情境,請從 xhigh 開始,對於大多數其他對智慧敏感的工作負載使用 high,僅當您已透過評估確認較低等級能維持品質時,才降至 medium 或 low。
API 預設值為 high。若要使用不同的等級,請明確設定 effort;您傳入的值會覆寫預設值。
在以 xhigh 或 max effort 執行 Claude Opus 4.8 時,請設定較大的 max_tokens,讓模型有足夠空間在子代理和工具呼叫之間進行思考和行動。從 64k token 開始並據此調整是合理的預設值。
Claude Opus 5 支援全部五個 effort 等級。從預設值 high 開始,並根據您的評估進行調整:對於要求較高的程式編寫和代理工作,升至 xhigh;當任務值得不受限制的 token 花費時,升至 max;在您的評估顯示品質能夠維持的情況下,可大方地使用 low 和 medium 作為控制 token 成本和回應時間的主要手段。如果您沿用了先前模型的 effort 設定,請在您的評估上重新進行 effort 掃描,而非直接重複使用。
Effort 控制的是思考量,而非可見的回應長度:在 Claude Opus 5 上,變更 effort 並不能可靠地縮短回應,因此請改為透過提示控制長度。
API 預設值為 high。若要使用不同的等級,請明確設定 effort;您傳入的值會覆寫預設值。
在 Claude Opus 5 上,xhigh 或 max effort 下無法停用思考:在這些等級下設定 thinking: {"type": "disabled"} 的請求會回傳 400 錯誤。請參閱 Effort 與思考。
在以 xhigh 或 max effort 執行 Claude Opus 5 時,請設定較大的 max_tokens,讓模型有足夠空間在子代理和工具呼叫之間進行思考和行動。從 64k token 開始並據此調整是合理的預設值。
Effort 是在 Claude Fable 5 上權衡智慧、延遲和成本的主要控制手段。對於大多數任務,請從預設值 high 開始,對於最需要能力的工作負載使用 xhigh,對於例行工作則降至 medium 或 low。Claude Fable 5 上較低的 effort 設定仍然表現良好,且通常超越先前模型在 xhigh 下的表現。在 high 和 xhigh 下,請設定較大的 max_tokens:這是總輸出(思考加上回應文字)的硬性限制。請參閱成本控制。
如果任務能夠完成但花費的時間超過必要,或者您想要更快速、更具互動性的工作方式,請降低 effort。相同的建議也適用於 Claude Mythos 5。如需更完整的指引,請參閱為 Claude Fable 5 撰寫提示。
client = anthropic.Anthropic()
response = client.messages.create(
model="claude-opus-5",
max_tokens=4096,
messages=[
{
"role": "user",
"content": "Analyze the trade-offs between microservices and monolithic architectures",
}
],
output_config={"effort": "medium"},
)
for block in response.content:
if block.type == "text":
print(block.text)使用工具時,effort 參數會同時影響工具呼叫周圍的說明以及工具呼叫本身。較低的 effort 等級傾向於:
較高的 effort 等級可能會:
thinking 參數控制 Claude 是否在回答前於思考區塊中進行思考;effort 參數控制 Claude 在整個回應中投入多少工作量,在 adaptive 模式下,這包括思考的頻率和深度。請勿將 adaptive 作為 effort 的值傳入:adaptive 是一種思考模式,而不是一個工作量等級。
在較高的 effort 等級下,Claude 會對大多數請求進行思考,且思考篇幅更長;在較低的等級下,對於較簡單的問題可能完全跳過思考。請參閱思考與 effort 以取得關於這兩種控制方式如何協同運作的完整指引。
在 Claude Opus 4.5(唯一支援 effort 的僅限擴展思考模型)上,effort 與 budget_tokens 搭配運作:為您的任務設定 effort 等級,然後根據任務所需的推理深度設定思考 token 預算。
關於各模型的思考可用性,請參閱各模型設定表。Effort 無論是否啟用思考皆可運作;請參閱 Effort 的運作方式。
output_config.effort 是請求層級的設定:每個請求都帶有自己的值,因此若要在對話的後續部分以不同的 effort 等級執行,請在下一個請求中設定新值。effort 等級會套用至整個請求。由於 effort 會影響渲染的提示,在請求之間變更它不會保留先前回合的快取前綴;如果您在長時間的工作階段中依賴提示快取,請在開始時選定一個 effort 等級並保持不變。
high,但正確的起點取決於您的模型和工作負載。為 Claude 提供完整代理迴圈的建議性 token 預算,協助模型在長時間的代理任務中自我調節。
了解自適應思考(Claude 決定何時思考以及思考多少),並透過 effort 和提示來引導它。
了解思考的運作方式、Claude 預設何時思考,以及思考如何與 effort 互動。
| Supported models |
|
|---|---|
| Supported platforms |
|
Was this page helpful?