Il parametro "effort" (sforzo) ti consente di controllare quanti token Claude impiega quando risponde alle richieste. Puoi bilanciare tra completezza della risposta ed efficienza dei token con un singolo modello. Il parametro effort è disponibile su tutti i modelli supportati senza necessità di header beta.
Per impostazione predefinita, Claude utilizza effort alto, impiegando tutti i token necessari per ottenere risultati eccellenti. Puoi aumentare il livello di effort a max per ottenere la massima capacità assoluta, oppure abbassarlo per essere più conservativo nell'uso dei token, ottimizzando velocità e costi accettando una certa riduzione delle capacità.
Il parametro effort influisce su tutti i token nella risposta, inclusi:
Questo approccio presenta due vantaggi principali:
| Livello | Descrizione | Caso d'uso tipico |
|---|---|---|
max | Capacità massima assoluta senza vincoli sulla spesa di token. Disponibile su Claude Fable 5, Claude Mythos 5, Claude Opus 5, Claude Opus 4.8, Claude Mythos Preview, Claude Opus 4.7, Claude Opus 4.6, Claude Sonnet 5 e Claude Sonnet 4.6. | Attività che richiedono il ragionamento più profondo possibile e l'analisi più approfondita |
xhigh | Capacità estesa per lavori a lungo orizzonte. Disponibile su Claude Fable 5, Claude Mythos 5, Claude Opus 5, Claude Opus 4.8, Claude Opus 4.7 e Claude Sonnet 5. | Attività agentiche e di coding di lunga durata (oltre 30 minuti) con budget di token nell'ordine dei milioni |
high | Capacità elevata. Equivalente a non impostare il parametro. | Ragionamento complesso, problemi di coding difficili, attività agentiche |
medium | Approccio bilanciato con risparmio moderato di token. | Attività agentiche che richiedono un equilibrio tra velocità, costo e prestazioni |
low | Il più efficiente. Risparmio significativo di token con una certa riduzione delle capacità. |
xhigh è un livello più recente; alcuni modelli che supportano max non supportano xhigh.
Claude Sonnet 5 utilizza per impostazione predefinita effort high sulla Claude API e su Claude Code.
Sonnet 4.6 utilizza per impostazione predefinita effort high. Imposta esplicitamente effort quando usi Sonnet 4.6 per evitare latenze impreviste:
Inizia con xhigh per casi d'uso di coding e agentici, e usa high come minimo per la maggior parte dei carichi di lavoro sensibili all'intelligenza. Scendi a medium per carichi di lavoro sensibili ai costi, oppure sali a max solo quando le tue valutazioni mostrano un margine misurabile a xhigh.
Il valore predefinito dell'API è high. Per usare xhigh, imposta effort esplicitamente; il valore che passi sovrascrive quello predefinito.
| Effort | Indicazioni per Claude Opus 4.7 |
|---|---|
low | Efficiente, ma ideale per attività brevi e circoscritte. Abbina low a checklist esplicite se la tua attività ha più sezioni. |
medium | La scelta immediata per il flusso di lavoro medio in cui desideri buoni risultati riducendo i costi. |
high | Casi d'uso avanzati che necessitano comunque di un equilibrio tra intelligenza e consumo di token. Questo è spesso il miglior equilibrio tra qualità ed efficienza dei token. |
xhigh | Il punto di partenza consigliato per lavori di coding e agentici, e per attività esplorative come chiamate ripetute agli strumenti, ricerca web dettagliata e ricerca in knowledge base. Aspettati un utilizzo di token significativamente più alto rispetto a high. |
max | Riservalo per problemi realmente di frontiera. Sulla maggior parte dei carichi di lavoro max aggiunge costi significativi per guadagni di qualità relativamente piccoli, e su alcune attività con output strutturato o meno sensibili all'intelligenza può portare a un eccesso di ragionamento. |
Claude Opus 4.7 rispetta inoltre i livelli di effort in modo più rigoroso rispetto a Claude Opus 4.6, specialmente a low e medium. A livelli di effort più bassi, il modello limita il proprio lavoro a ciò che è stato richiesto anziché fare più del necessario. Se osservi un ragionamento superficiale su problemi complessi con Claude Opus 4.7, aumenta effort anziché aggirare il problema tramite prompting. Se devi mantenere effort basso per motivi di latenza, aggiungi indicazioni mirate come "Questa attività richiede un ragionamento in più passaggi. Rifletti attentamente prima di rispondere."
Quando esegui Claude Opus 4.7 con effort xhigh o max, imposta un max_tokens elevato in modo che il modello abbia spazio per ragionare e agire attraverso subagent e chiamate agli strumenti. Iniziare da 64k token e regolare da lì è un valore predefinito ragionevole.
Le indicazioni per Claude Opus 4.7 si applicano anche a Claude Opus 4.8. Inizia con xhigh per casi d'uso di coding e agentici, usa high per la maggior parte degli altri carichi di lavoro sensibili all'intelligenza, e scendi a medium o low solo quando hai verificato che il livello inferiore mantiene la qualità nelle tue valutazioni.
Il valore predefinito dell'API è high. Imposta effort esplicitamente per usare un livello diverso; il valore che passi sovrascrive quello predefinito.
Quando esegui Claude Opus 4.8 con effort xhigh o max, imposta un max_tokens elevato in modo che il modello abbia spazio per ragionare e agire attraverso subagent e chiamate agli strumenti. Iniziare da 64k token e regolare da lì è un valore predefinito ragionevole.
Claude Opus 5 supporta tutti e cinque i livelli di effort. Inizia con high, il valore predefinito, e regola in base alle tue valutazioni: sali a xhigh per lavori di coding e agentici impegnativi, oppure a max quando un'attività giustifica una spesa di token senza vincoli, e usa liberamente low e medium come controllo principale per il costo dei token e il tempo di risposta ovunque le tue valutazioni mostrino che la qualità si mantiene. Se hai riportato le impostazioni di effort da un modello precedente, esegui una nuova analisi di effort sulle tue valutazioni anziché riutilizzarle.
Effort controlla il volume del thinking, non la lunghezza visibile della risposta: su Claude Opus 5, modificare effort non accorcia in modo affidabile le risposte, quindi usa il prompting per la lunghezza.
Il valore predefinito dell'API è high. Imposta effort esplicitamente per usare un livello diverso; il valore che passi sovrascrive quello predefinito.
Su Claude Opus 5, il thinking non può essere disabilitato con effort xhigh o max: le richieste che impostano thinking: {"type": "disabled"} a quei livelli restituiscono un errore 400. Consulta Effort con thinking.
Quando esegui Claude Opus 5 con effort xhigh o max, imposta un max_tokens elevato in modo che il modello abbia spazio per ragionare e agire attraverso subagent e chiamate agli strumenti. Iniziare da 64k token e regolare da lì è un valore predefinito ragionevole.
Effort è il controllo principale per bilanciare intelligenza, latenza e costo su Claude Fable 5. Inizia con high, il valore predefinito, per la maggior parte delle attività, usa xhigh per i carichi di lavoro più sensibili alle capacità, e scendi a medium o low per lavori di routine. Le impostazioni di effort più basse su Claude Fable 5 offrono comunque buone prestazioni e spesso superano le prestazioni di xhigh sui modelli precedenti. A high e xhigh, imposta un max_tokens elevato: è un limite rigido sull'output totale, thinking più testo di risposta. Consulta Controllo dei costi.
Riduci effort se un'attività viene completata ma richiede più tempo del necessario, o se desideri uno stile di lavoro più veloce e interattivo. Le stesse raccomandazioni si applicano a Claude Mythos 5. Per indicazioni più complete, consulta Prompting di Claude Fable 5.
Quando si utilizzano strumenti, il parametro effort influisce sia sulle spiegazioni relative alle chiamate agli strumenti sia sulle chiamate stesse. Livelli di effort più bassi tendono a:
Livelli di effort più alti possono:
Il parametro thinking controlla se Claude pensa in blocchi di pensiero prima di rispondere; il parametro effort controlla quanto lavoro Claude dedica all'intera risposta, il che in modalità adattiva include quanto spesso e quanto in profondità pensa. Non passare adaptive come valore di effort: adaptive è una modalità di pensiero, non un livello di effort.
A livelli di effort più alti, Claude ragiona sulla maggior parte delle richieste e più a lungo; a livelli più bassi, può saltare completamente il thinking per problemi più semplici. Consulta Thinking ed effort per indicazioni complete su come i due controlli funzionano insieme.
Su Claude Opus 4.5, l'unico modello con solo pensiero esteso che supporta effort, funziona insieme a budget_tokens: imposta il livello di effort per la tua attività, quindi imposta il budget di token per il thinking in base alla profondità di ragionamento necessaria.
Per la disponibilità del thinking per modello, consulta la tabella di configurazione per modello. Effort funziona con o senza thinking; consulta Come funziona effort.
output_config.effort è un'impostazione a livello di richiesta: ogni richiesta porta il proprio valore, quindi per eseguire una parte successiva di una conversazione a un livello di effort diverso, imposta il nuovo valore nella richiesta successiva. Il livello di effort si applica all'intera richiesta. Poiché effort modella il prompt renderizzato, modificarlo tra le richieste non preserva i prefissi memorizzati nella cache dai turni precedenti; se fai affidamento sulla cache dei prompt durante una sessione lunga, scegli un livello di effort all'inizio e mantienilo costante.
high come valore predefinito, ma il punto di partenza corretto dipende dal tuo modello e dal carico di lavoro.Fornisci a Claude un budget di token indicativo per l'intero ciclo agentico per aiutare il modello ad autoregolarsi su attività agentiche lunghe.
Comprendi l'adaptive thinking, in cui Claude decide quando e quanto ragionare, e guidalo con effort e prompting.
Comprendi come funziona il thinking, quando Claude ragiona per impostazione predefinita e come il thinking interagisce con effort.
| Supported models |
|
|---|---|
| Supported platforms |
|
Was this page helpful?
| Attività più semplici che necessitano della massima velocità e dei costi più bassi, come i subagent |
client = anthropic.Anthropic()
response = client.messages.create(
model="claude-opus-5",
max_tokens=4096,
messages=[
{
"role": "user",
"content": "Analyze the trade-offs between microservices and monolithic architectures",
}
],
output_config={"effort": "medium"},
)
for block in response.content:
if block.type == "text":
print(block.text)