Claude Opus 5 相较于 Claude Opus 4.8 实现了跨越式的改进,在深度推理、智能体任务和长周期任务以及测试时计算扩展方面的提升最为显著。本页总结了 Claude Opus 5 的所有新特性,包括默认开启思考、对话中途工具变更,以及关于何时可以禁用思考的一项破坏性变更。
| 模型 | API 模型 ID | 描述 |
|---|---|---|
| Claude Opus 5 | claude-opus-5 | 适用于复杂的智能体编码和企业级工作 |
Claude Opus 5 拥有 100 万令牌的上下文窗口(100 万令牌既是默认值也是最大值;没有更小的上下文变体)、128k 最大输出令牌,并且默认开启思考功能。
有关完整的定价和规格信息,请参阅模型概述。
您可以在对话的轮次之间添加或移除工具,同时保留提示缓存,而无需在整个会话期间重复发送固定的工具列表。对话中途工具变更目前处于测试阶段:请在您的请求中包含 mid-conversation-tool-changes-2026-07-01 测试版标头。有关用法,请参阅对话中途工具变更。
fallbacks 参数支持新的 "default" 模式,该模式按拒绝类别应用 Anthropic 推荐的回退模型,而不是由您自行维护的模型列表。整个 fallbacks 参数处于测试阶段。请使用 server-side-fallback-2026-07-01 测试版标头,该标头同时支持 "default" 模式和显式模型列表(较早的 server-side-fallback-2026-06-01 标头仅接受显式列表)。请参阅拒绝与回退。
Claude Opus 5 上可缓存提示的最小长度为 512 个令牌,低于 Claude Opus 4.8 上的 1,024 个令牌。在 Claude Opus 4.8 上因过短而无法缓存的提示现在无需更改代码即可创建缓存条目。有关各模型的最小值,请参阅提示缓存。
快速模式(研究预览版)仅在 Claude API 上为 Claude Opus 5 提供;目前在 Amazon Bedrock、Google Cloud 或 Microsoft Foundry 上不可用。Claude Opus 5 的快速模式定价为每百万输入令牌 10 美元,每百万输出令牌 50 美元。有关访问方式、支持的模型和定价,请参阅快速模式。
在 Claude Opus 4.8 上,除非您设置 thinking: {"type": "adaptive"},否则请求不会启用思考。在 Claude Opus 5 上,相同的请求会在开启思考的情况下运行:模型会自行决定每轮何时思考以及思考多少,而 effort 参数则用于控制思考深度。传输值保持不变;thinking: {"type": "adaptive"} 仍然有效,且等同于默认设置。
由于 max_tokens 是对总输出(思考加响应文本)的硬性限制,请重新审视那些在 Claude Opus 4.8 上未启用思考运行的工作负载的该参数设置。
API 保留了禁用思考的选项,但受下文所述的 effort 限制约束。
Claude Opus 5 比任何早期的 Opus 模型都能更可靠地将额外的 effort 转化为更好的结果,因此您选择的 effort 级别具有更大的影响。完整的级别阶梯均可用:low、medium、high、xhigh 和 max,其中 max 是用于最深度推理的最高级别。从默认值 high 开始,并根据您的评估结果向任一方向调整:在质量保持稳定的情况下降低级别以节省令牌和延迟,或为最苛刻的工作提高级别。在以 xhigh 或 max effort 运行时,请设置较大的 max_tokens,以便模型有足够的空间在子智能体和工具调用之间进行思考和行动。
以下请求将 effort 调至最高级别 max:
client = anthropic.Anthropic()
with client.messages.stream(
model="claude-opus-5",
max_tokens=64000,
output_config={"effort": "max"},
messages=[
{
"role": "user",
"content": "Explain why the sum of two even numbers is always even.",
}
],
) as stream:
response = stream.get_final_message()
print(response)在 Claude Opus 5 上,思考默认开启,因此无需 thinking 字段。
high 或更低在 Claude Opus 5 上,仅当 effort 级别为 high 或更低时,才接受 thinking: {"type": "disabled"}。在 effort 为 xhigh 或 max 时设置 thinking: {"type": "disabled"} 会返回 400 错误。这是 Claude Opus 5 及后续版本上正式可用的行为,在每个请求上强制执行,并且这是相对于 Claude Opus 4.8 的一项破坏性变更——在 Claude Opus 4.8 中,禁用思考与 effort 级别无关。如果您目前在高 effort 级别下禁用思考,请保持禁用思考并将 effort 设置为 high 或更低,或者保持 effort 级别并移除 thinking 字段。
在禁用思考的情况下,Claude Opus 5 偶尔会将工具调用写入其文本输出而不是发出 tool_use 块,或在其可见响应中包含内部 XML 标签。在可能的情况下,请保持启用思考并通过较低的 effort 级别来控制令牌成本;对于必须保持禁用思考的集成,请参阅在禁用思考的情况下运行以了解提示缓解措施。
除了上述 API 变更之外,Claude Opus 5 的行为与 Claude Opus 4.8 存在差异,您可能在不更改任何代码的情况下就会注意到。默认的面向用户的响应和书面交付物篇幅更长。在智能体会话中,模型会更频繁地向用户叙述其进展。在多智能体框架中,它更倾向于委派给子智能体。它还会在未被告知的情况下验证自己的工作,因此请移除从早期模型沿用的验证指令("包含最终验证步骤"、"使用子智能体进行验证");这些指令会导致 Claude Opus 5 过度验证。有关调整这些行为的提示模式,请参阅为 Claude Opus 5 编写提示。
与 Claude Opus 4.8 相比,Claude Opus 5 是跨越式的改进而非渐进式改进,并且以 Claude Fable 5 一半的成本提供前沿智能。最大的提升体现在:
max 级别)转化为更好的结果。low 和 medium effort 以较高设置的一小部分令牌和延迟产出高质量结果。有关充分发挥这些能力的提示模式,请参阅为 Claude Opus 5 编写提示。
Claude Opus 5 的定价为每百万输入令牌 5 美元,每百万输出令牌 25 美元,与 Claude Opus 4.8 保持不变。
有关完整定价(包括批处理、提示缓存和快速模式费率),请参阅定价。
Claude Opus 5 可在以下平台使用:
claude-opus-5。anthropic.claude-opus-5。Claude Opus 5 也可通过 bedrock-runtime 上的 InvokeModel API 访问,由相同的基础设施提供服务;Amazon Bedrock 上的 Claude(旧版)集成未将其包含在 ARN 版本化的模型 ID 表中。claude-opus-5。Claude Opus 4.8 在所有这些平台上仍然可用。
要从 Claude Opus 4.8 迁移,请更新您的模型 ID:
model = "claude-opus-4-8" # Before
model = "claude-opus-5" # After然后查看两项行为变更:思考默认开启,以及在 effort 为 xhigh 或 max 时禁用思考会返回 400 错误。有关分步说明,请参阅迁移指南。
所有当前 Claude 模型的完整规格和定价。
Claude Opus 5 特有的行为差异和提示模式。
控制 Claude 响应时使用的令牌数量,从 low 到 max。
思考在默认开启时的工作方式,以及何时可以禁用。
为 Claude 提供建议性的令牌预算以调整其工作节奏。
从先前 Claude 版本迁移到最新 Claude 模型的指南。
以高级定价从 Claude Opus 模型获得更高的每秒输出令牌数。
Was this page helpful?