El parámetro "effort" (esfuerzo) te permite controlar cuántos tokens gasta Claude al responder a las solicitudes. Puedes equilibrar entre la exhaustividad de la respuesta y la eficiencia de tokens con un solo modelo. El parámetro effort está disponible en todos los modelos compatibles sin necesidad de un encabezado beta.
De forma predeterminada, Claude usa effort alto, gastando tantos tokens como sea necesario para obtener resultados excelentes. Puedes aumentar el nivel de effort a max para obtener la máxima capacidad absoluta, o reducirlo para ser más conservador con el uso de tokens, optimizando la velocidad y el costo mientras aceptas cierta reducción en la capacidad.
El parámetro effort afecta a todos los tokens de la respuesta, incluyendo:
Este enfoque tiene dos ventajas principales:
| Nivel | Descripción | Caso de uso típico |
|---|---|---|
max | Capacidad máxima absoluta sin restricciones en el gasto de tokens. Disponible en Claude Fable 5, Claude Mythos 5, Claude Opus 5, Claude Opus 4.8, Claude Mythos Preview, Claude Opus 4.7, Claude Opus 4.6, Claude Sonnet 5 y Claude Sonnet 4.6. | Tareas que requieren el razonamiento más profundo posible y el análisis más exhaustivo |
xhigh | Capacidad extendida para trabajo de largo horizonte. Disponible en Claude Fable 5, Claude Mythos 5, Claude Opus 5, Claude Opus 4.8, Claude Opus 4.7 y Claude Sonnet 5. | Tareas agénticas y de programación de larga duración (más de 30 minutos) con presupuestos de tokens en millones |
high | Capacidad alta. Equivalente a no establecer el parámetro. | Razonamiento complejo, problemas de programación difíciles, tareas agénticas |
medium | Enfoque equilibrado con ahorro moderado de tokens. | Tareas agénticas que requieren un equilibrio entre velocidad, costo y rendimiento |
low | El más eficiente. Ahorro significativo de tokens con cierta reducción de capacidad. | Tareas más simples que necesitan la mejor velocidad y los costos más bajos, como subagentes |
xhigh es un nivel más reciente; algunos modelos que admiten max no admiten xhigh.
Claude Sonnet 5 usa effort high de forma predeterminada en la API de Claude y Claude Code.
Sonnet 4.6 usa effort high de forma predeterminada. Establece effort explícitamente al usar Sonnet 4.6 para evitar latencia inesperada:
Comienza con xhigh para casos de uso de programación y agénticos, y usa high como mínimo para la mayoría de las cargas de trabajo sensibles a la inteligencia. Baja a medium para cargas de trabajo sensibles al costo, o sube a max solo cuando tus evaluaciones muestren margen de mejora medible en xhigh.
El valor predeterminado de la API es high. Para usar xhigh, establece effort explícitamente; el valor que pases anula el predeterminado.
| Effort | Orientación para Claude Opus 4.7 |
|---|---|
low | Eficiente, pero mejor para tareas cortas y acotadas. Combina low con listas de verificación explícitas si tu tarea tiene múltiples secciones. |
medium | La opción directa para el flujo de trabajo promedio donde quieres buenos resultados mientras reduces costos. |
high | Casos de uso avanzados que aún necesitan un equilibrio entre inteligencia y consumo de tokens. Este suele ser el mejor equilibrio entre calidad y eficiencia de tokens. |
xhigh | El punto de partida recomendado para trabajo de programación y agéntico, y para tareas exploratorias como llamadas repetidas a herramientas, búsqueda web detallada y búsqueda en bases de conocimiento. Espera un uso de tokens significativamente mayor que con high. |
max | Resérvalo para problemas genuinamente de frontera. En la mayoría de las cargas de trabajo, max agrega un costo significativo a cambio de ganancias de calidad relativamente pequeñas, y en algunas tareas de salida estructurada o menos sensibles a la inteligencia puede llevar a pensar en exceso. |
Claude Opus 4.7 también respeta los niveles de effort de forma más estricta que Claude Opus 4.6, especialmente en low y medium. En niveles de effort más bajos, el modelo limita su trabajo a lo que se pidió en lugar de hacer más de lo solicitado. Si observas razonamiento superficial en problemas complejos con Claude Opus 4.7, aumenta el effort en lugar de intentar compensarlo con el prompt. Si debes mantener el effort bajo por latencia, agrega orientación específica como "Esta tarea implica razonamiento de múltiples pasos. Piensa cuidadosamente antes de responder."
Al ejecutar Claude Opus 4.7 con effort xhigh o max, establece un max_tokens grande para que el modelo tenga espacio para pensar y actuar a través de subagentes y llamadas a herramientas. Comenzar con 64k tokens y ajustar desde ahí es un valor predeterminado razonable.
La orientación para Claude Opus 4.7 también aplica a Claude Opus 4.8. Comienza con xhigh para casos de uso de programación y agénticos, usa high para la mayoría de las demás cargas de trabajo sensibles a la inteligencia, y baja a medium o low solo cuando hayas medido que el nivel más bajo mantiene la calidad en tus evaluaciones.
El valor predeterminado de la API es high. Establece effort explícitamente para usar un nivel diferente; el valor que pases anula el predeterminado.
Al ejecutar Claude Opus 4.8 con effort xhigh o max, establece un max_tokens grande para que el modelo tenga espacio para pensar y actuar a través de subagentes y llamadas a herramientas. Comenzar con 64k tokens y ajustar desde ahí es un valor predeterminado razonable.
Claude Opus 5 admite los cinco niveles de effort. Comienza con high, el valor predeterminado, y ajusta según tus evaluaciones: sube a xhigh para trabajo exigente de programación y agéntico, o a max cuando una tarea justifique un gasto de tokens sin restricciones, y usa low y medium libremente como tu control principal para el costo de tokens y el tiempo de respuesta siempre que tus evaluaciones muestren que la calidad se mantiene. Si trasladaste configuraciones de effort desde un modelo anterior, ejecuta un barrido de effort nuevo en tus evaluaciones en lugar de reutilizarlas.
Effort controla el volumen de pensamiento, no la longitud visible de la respuesta: en Claude Opus 5, cambiar el effort no acorta las respuestas de forma confiable, así que usa el prompt para controlar la longitud en su lugar.
El valor predeterminado de la API es high. Establece effort explícitamente para usar un nivel diferente; el valor que pases anula el predeterminado.
En Claude Opus 5, el pensamiento no se puede deshabilitar con effort xhigh o max: las solicitudes que establecen thinking: {"type": "disabled"} en esos niveles devuelven un error 400. Consulta Effort con pensamiento.
Al ejecutar Claude Opus 5 con effort xhigh o max, establece un max_tokens grande para que el modelo tenga espacio para pensar y actuar a través de subagentes y llamadas a herramientas. Comenzar con 64k tokens y ajustar desde ahí es un valor predeterminado razonable.
Effort es el control principal para equilibrar inteligencia, latencia y costo en Claude Fable 5. Comienza con high, el valor predeterminado, para la mayoría de las tareas, usa xhigh para las cargas de trabajo más sensibles a la capacidad, y baja a medium o low para trabajo rutinario. Las configuraciones de effort más bajas en Claude Fable 5 siguen funcionando bien y a menudo superan el rendimiento de xhigh en modelos anteriores. En high y xhigh, establece un max_tokens grande: es un límite estricto sobre la salida total, pensamiento más texto de respuesta. Consulta Control de costos.
Reduce el effort si una tarea se completa pero tarda más de lo necesario, o si quieres un estilo de trabajo más rápido e interactivo. Las mismas recomendaciones aplican a Claude Mythos 5. Para una orientación más completa, consulta Prompting para Claude Fable 5.
client = anthropic.Anthropic()
response = client.messages.create(
model="claude-opus-5",
max_tokens=4096,
messages=[
{
"role": "user",
"content": "Analyze the trade-offs between microservices and monolithic architectures",
}
],
output_config={"effort": "medium"},
)
for block in response.content:
if block.type == "text":
print(block.text)Al usar herramientas, el parámetro effort afecta tanto las explicaciones alrededor de las llamadas a herramientas como las llamadas a herramientas en sí. Los niveles de effort más bajos tienden a:
Los niveles de effort más altos pueden:
El parámetro thinking controla si Claude piensa en bloques de pensamiento antes de responder; el parámetro effort controla cuánto trabajo dedica Claude a toda la respuesta, lo que en el modo adaptativo incluye con qué frecuencia y con qué profundidad piensa. No pases adaptive como valor de effort: adaptive es un modo de pensamiento, no un nivel de esfuerzo.
En niveles de effort más altos, Claude piensa en la mayoría de las solicitudes y con mayor extensión; en niveles más bajos, puede omitir el pensamiento por completo para problemas más simples. Consulta Pensamiento y effort para obtener orientación completa sobre cómo funcionan juntos los dos controles.
En Claude Opus 4.5, el único modelo exclusivo de pensamiento extendido que admite effort, funciona junto con budget_tokens: establece el nivel de effort para tu tarea, luego establece el presupuesto de tokens de pensamiento según cuánta profundidad de razonamiento necesite la tarea.
Para la disponibilidad de pensamiento por modelo, consulta la tabla de configuración por modelo. Effort funciona con o sin pensamiento; consulta Cómo funciona effort.
output_config.effort es una configuración a nivel de solicitud: cada solicitud lleva su propio valor, así que para ejecutar una parte posterior de una conversación con un nivel de effort diferente, establece el nuevo valor en la siguiente solicitud. El nivel de effort se aplica a toda la solicitud. Debido a que effort da forma al prompt renderizado, cambiarlo entre solicitudes no preserva los prefijos en caché de turnos anteriores; si dependes del almacenamiento en caché de prompts a lo largo de una sesión larga, elige un nivel de effort al inicio y mantenlo constante.
high de forma predeterminada, pero el punto de partida correcto depende de tu modelo y carga de trabajo.Dale a Claude un presupuesto de tokens orientativo para el ciclo agéntico completo para ayudar al modelo a autorregularse en tareas agénticas largas.
Comprende el pensamiento adaptativo, donde Claude decide cuándo y cuánto pensar, y dirígelo con effort y prompting.
Comprende cómo funciona el pensamiento, cuándo piensa Claude de forma predeterminada y cómo interactúa el pensamiento con effort.
| Supported models |
|
|---|---|
| Supported platforms |
|
Was this page helpful?