"Effort"(努力程度)参数让您可以控制 Claude 在响应请求时花费的令牌数量。您可以通过单个模型在响应完整性和令牌效率之间进行权衡。effort 参数在所有受支持的模型上均可用,无需 beta 标头。
默认情况下,Claude 使用 high(高)effort,根据需要花费尽可能多的令牌以获得出色的结果。您可以将 effort 级别提高到 max 以获得绝对最高的能力,或降低级别以更保守地使用令牌,在接受一定能力降低的同时优化速度和成本。
effort 参数会影响响应中的所有令牌,包括:
这种方法有两个主要优势:
| 级别 | 描述 | 典型用例 |
|---|---|---|
max | 绝对最高能力,对令牌消耗没有限制。在 Claude Fable 5、Claude Mythos 5、Claude Opus 5、Claude Opus 4.8、Claude Mythos Preview、Claude Opus 4.7、Claude Opus 4.6、Claude Sonnet 5 和 Claude Sonnet 4.6 上可用。 | 需要尽可能深入的推理和最彻底分析的任务 |
xhigh | 适用于长周期工作的扩展能力。在 Claude Fable 5、Claude Mythos 5、Claude Opus 5、Claude Opus 4.8、Claude Opus 4.7 和 Claude Sonnet 5 上可用。 | 长时间运行的智能体和编码任务(超过 30 分钟),令牌预算达数百万 |
high | 高能力。等同于不设置该参数。 | 复杂推理、困难的编码问题、智能体任务 |
medium | 平衡方法,适度节省令牌。 | 需要在速度、成本和性能之间取得平衡的智能体任务 |
low | 最高效。显著节省令牌,但能力有所降低。 | 需要最佳速度和最低成本的简单任务,例如子智能体 |
xhigh 是较新的级别;某些支持 max 的模型不支持 xhigh。
Claude Sonnet 5 在 Claude API 和 Claude Code 上默认使用 high effort。
Sonnet 4.6 默认使用 high effort。使用 Sonnet 4.6 时请显式设置 effort,以避免意外的延迟:
对于编码和智能体用例,从 xhigh 开始,对于大多数对智能要求较高的工作负载,将 high 作为最低级别。对于成本敏感的工作负载,降级到 medium;仅当您的评估显示在 xhigh 下仍有可衡量的提升空间时,才升级到 max。
API 默认值为 high。要使用 xhigh,请显式设置 effort;您传递的值会覆盖默认值。
| Effort | Claude Opus 4.7 使用指南 |
|---|---|
low | 高效,但最适合简短、范围明确的任务。如果您的任务包含多个部分,请将 low 与明确的检查清单配合使用。 |
medium | 适用于希望在降低成本的同时获得良好结果的一般工作流的直接替代选项。 |
high | 仍需要在智能和令牌消耗之间取得平衡的高级用例。这通常是质量和令牌效率之间的最佳平衡点。 |
xhigh | 编码和智能体工作的推荐起点,也适用于探索性任务,如重复工具调用、详细的网络搜索和知识库搜索。预计令牌使用量会明显高于 high。 |
max | 保留用于真正的前沿问题。在大多数工作负载上,max 会显著增加成本,但质量提升相对较小;在某些结构化输出或对智能要求较低的任务上,它可能导致过度思考。 |
Claude Opus 4.7 对 effort 级别的遵循也比 Claude Opus 4.6 更严格,尤其是在 low 和 medium 级别。在较低的 effort 级别下,模型会将其工作范围限定在所要求的内容上,而不会做超出要求的事情。如果您在使用 Claude Opus 4.7 处理复杂问题时观察到推理较浅,请提高 effort 而不是通过提示来绕过。如果您必须为了延迟而保持较低的 effort,请添加针对性的指导,例如"此任务涉及多步推理。请在回答前仔细思考。"
在 xhigh 或 max effort 下运行 Claude Opus 4.7 时,请设置较大的 max_tokens,以便模型有足够的空间在子智能体和工具调用之间进行思考和行动。从 64k 令牌开始并据此调整是一个合理的默认值。
Claude Opus 4.7 的指南同样适用于 Claude Opus 4.8。对于编码和智能体用例,从 xhigh 开始,对于大多数其他对智能要求较高的工作负载使用 high,仅当您通过评估确认较低级别能够保持质量时,才降级到 medium 或 low。
API 默认值为 high。显式设置 effort 以使用不同的级别;您传递的值会覆盖默认值。
在 xhigh 或 max effort 下运行 Claude Opus 4.8 时,请设置较大的 max_tokens,以便模型有足够的空间在子智能体和工具调用之间进行思考和行动。从 64k 令牌开始并据此调整是一个合理的默认值。
Claude Opus 5 支持全部五个 effort 级别。从默认的 high 开始,并根据您的评估进行调整:对于要求较高的编码和智能体工作,升级到 xhigh;当任务值得不受限制地消耗令牌时,升级到 max;在您的评估显示质量能够保持的情况下,可以大量使用 low 和 medium 作为控制令牌成本和响应时间的主要手段。如果您沿用了早期模型的 effort 设置,请在您的评估上重新进行 effort 扫描,而不是直接复用。
Effort 控制的是思考量,而非可见的响应长度:在 Claude Opus 5 上,更改 effort 并不能可靠地缩短响应,因此请改为通过提示控制长度。
API 默认值为 high。显式设置 effort 以使用不同的级别;您传递的值会覆盖默认值。
在 Claude Opus 5 上,xhigh 或 max effort 下无法禁用思考:在这些级别下设置 thinking: {"type": "disabled"} 的请求会返回 400 错误。请参阅 Effort 与思考。
在 xhigh 或 max effort 下运行 Claude Opus 5 时,请设置较大的 max_tokens,以便模型有足够的空间在子智能体和工具调用之间进行思考和行动。从 64k 令牌开始并据此调整是一个合理的默认值。
Effort 是在 Claude Fable 5 上权衡智能、延迟和成本的主要控制手段。对于大多数任务,从默认的 high 开始,对于对能力最敏感的工作负载使用 xhigh,对于常规工作降级到 medium 或 low。Claude Fable 5 上较低的 effort 设置仍然表现良好,通常超过先前模型在 xhigh 下的表现。在 high 和 xhigh 下,请设置较大的 max_tokens:它是总输出(思考加响应文本)的硬性限制。请参阅成本控制。
如果任务完成但耗时超过必要时间,或者您希望获得更快、更具交互性的工作方式,请降低 effort。同样的建议也适用于 Claude Mythos 5。有关更完整的指南,请参阅为 Claude Fable 5 编写提示。
client = anthropic.Anthropic()
response = client.messages.create(
model="claude-opus-5",
max_tokens=4096,
messages=[
{
"role": "user",
"content": "Analyze the trade-offs between microservices and monolithic architectures",
}
],
output_config={"effort": "medium"},
)
for block in response.content:
if block.type == "text":
print(block.text)使用工具时,effort 参数会同时影响工具调用周围的解释和工具调用本身。较低的 effort 级别倾向于:
较高的 effort 级别可能会:
thinking 参数控制 Claude 是否在回答前在思考块中进行思考;effort 参数控制 Claude 在整个响应中投入的工作量,在自适应模式下,这包括思考的频率和深度。不要将 adaptive 作为 effort 的值传递:adaptive 是一种思考模式,而不是一个努力程度级别。
在较高的 effort 级别下,Claude 会对大多数请求进行思考,且思考时间更长;在较低级别下,对于较简单的问题,它可以完全跳过思考。有关这两种控制方式如何协同工作的完整指南,请参阅思考与 effort。
在 Claude Opus 4.5(唯一支持 effort 的仅扩展思考模型)上,它与 budget_tokens 协同工作:为您的任务设置 effort 级别,然后根据任务所需的推理深度设置思考令牌预算。
有关各模型的思考可用性,请参阅各模型配置表。无论是否启用思考,effort 都可以正常工作;请参阅 Effort 的工作原理。
output_config.effort 是请求级别的设置:每个请求都携带自己的值,因此要在对话的后续部分以不同的 effort 级别运行,请在下一个请求中设置新值。effort 级别适用于整个请求。由于 effort 会影响渲染的提示,在请求之间更改它不会保留早期轮次的缓存前缀;如果您在长会话中依赖提示缓存,请在开始时选择一个 effort 级别并保持不变。
high,但正确的起点取决于您的模型和工作负载。为 Claude 提供完整智能体循环的建议性令牌预算,帮助模型在长时间运行的智能体任务中自我调节。
了解自适应思考(Claude 自行决定何时以及思考多少),并通过 effort 和提示来引导它。
了解思考的工作原理、Claude 默认何时思考,以及思考如何与 effort 交互。
| Supported models |
|
|---|---|
| Supported platforms |
|
Was this page helpful?