Claude Opus 5 rappresenta un miglioramento radicale rispetto a Claude Opus 4.8, con i progressi più significativi nel ragionamento profondo, nei compiti agentici e a lungo orizzonte, e nello scaling del calcolo in fase di test. Questa pagina riassume tutte le novità di Claude Opus 5, incluso il pensiero attivo per impostazione predefinita, le modifiche agli strumenti a metà conversazione e una modifica non retrocompatibile relativa a quando il pensiero può essere disabilitato.
| Modello | ID modello API | Descrizione |
|---|---|---|
| Claude Opus 5 | claude-opus-5 | Per coding agentico complesso e lavoro enterprise |
Claude Opus 5 ha una finestra di contesto da 1M token (1M token è sia il valore predefinito che il massimo; non esiste una variante di contesto più piccola), 128k token di output massimi e il pensiero attivo per impostazione predefinita.
Per prezzi e specifiche complete, consulta la panoramica dei modelli.
Puoi aggiungere o rimuovere strumenti tra i turni di una conversazione preservando la cache dei prompt, invece di reinviare un elenco fisso di strumenti per tutta la durata di una sessione. Le modifiche agli strumenti a metà conversazione sono in beta: includi l'header beta mid-conversation-tool-changes-2026-07-01 nelle tue richieste. Consulta Modifiche agli strumenti a metà conversazione per l'utilizzo.
Il parametro fallbacks supporta una nuova modalità "default", che applica i modelli di fallback consigliati da Anthropic per categoria di rifiuto invece di un elenco di modelli che gestisci tu stesso. L'intero parametro fallbacks è in beta. Usa l'header beta server-side-fallback-2026-07-01, che supporta sia la modalità "default" che gli elenchi espliciti di modelli (l'header precedente server-side-fallback-2026-06-01 accetta solo elenchi espliciti). Consulta Rifiuti e fallback.
La lunghezza minima del prompt memorizzabile in cache su Claude Opus 5 è di 512 token, rispetto ai 1.024 token di Claude Opus 4.8. I prompt che erano troppo brevi per essere memorizzati in cache su Claude Opus 4.8 possono ora creare voci di cache senza modifiche al codice. Consulta Cache dei prompt per i minimi per modello.
La fast mode (anteprima di ricerca) è disponibile per Claude Opus 5 solo sull'API di Claude; attualmente non è disponibile su Amazon Bedrock, Google Cloud o Microsoft Foundry. La fast mode per Claude Opus 5 ha un prezzo di 10 USD per milione di token di input e 50 USD per milione di token di output. Consulta Fast mode per accesso, modelli supportati e prezzi.
Su Claude Opus 4.8, le richieste vengono eseguite senza pensiero a meno che non imposti thinking: {"type": "adaptive"}. Su Claude Opus 5, le stesse richieste vengono eseguite con il pensiero attivo: il modello decide quando e quanto pensare a ogni turno, e il parametro effort è il controllo per la profondità del pensiero. Il valore trasmesso è invariato; thinking: {"type": "adaptive"} rimane valido ed equivalente al valore predefinito.
Poiché max_tokens è un limite rigido sull'output totale (pensiero più testo di risposta), rivedilo per i carichi di lavoro che venivano eseguiti senza pensiero su Claude Opus 4.8.
L'API mantiene l'opzione di disabilitare il pensiero, soggetta alla restrizione sull'effort descritta di seguito.
Claude Opus 5 converte l'effort aggiuntivo in risultati migliori in modo più affidabile rispetto a qualsiasi modello Opus precedente, quindi il livello di effort che scegli ha un peso maggiore. È disponibile l'intera scala: low, medium, high, xhigh e max, con max come livello massimo per il ragionamento più profondo possibile. Inizia dal valore predefinito, high, e regola in entrambe le direzioni in base alle tue valutazioni: scendi di livello dove la qualità si mantiene per risparmiare token e latenza, oppure sali per il lavoro più impegnativo. Quando esegui con effort xhigh o max, imposta un max_tokens elevato in modo che il modello abbia spazio per pensare e agire attraverso subagenti e chiamate agli strumenti.
Questa richiesta porta l'effort al massimo fino a max:
client = anthropic.Anthropic()
with client.messages.stream(
model="claude-opus-5",
max_tokens=64000,
output_config={"effort": "max"},
messages=[
{
"role": "user",
"content": "Explain why the sum of two even numbers is always even.",
}
],
) as stream:
response = stream.get_final_message()
print(response)Il pensiero è attivo per impostazione predefinita su Claude Opus 5, quindi non è necessario alcun campo thinking.
high o inferioreSu Claude Opus 5, thinking: {"type": "disabled"} è accettato solo quando il livello di effort è high o inferiore. Impostare thinking: {"type": "disabled"} con effort xhigh o max restituisce un errore 400. Questo è un comportamento generalmente disponibile da Claude Opus 5 in poi, applicato a ogni richiesta, ed è una modifica non retrocompatibile rispetto a Claude Opus 4.8, dove la disabilitazione del pensiero era indipendente dal livello di effort. Se oggi disabiliti il pensiero a livelli di effort elevati, mantieni il pensiero disabilitato e imposta l'effort su high o inferiore, oppure mantieni il livello di effort e rimuovi il campo thinking.
Con il pensiero disabilitato, Claude Opus 5 può occasionalmente scrivere una chiamata a uno strumento nel suo output di testo invece di emettere un blocco tool_use, o includere tag XML interni nella sua risposta visibile. Dove possibile, mantieni il pensiero abilitato e controlla il costo in token con livelli di effort inferiori; per le integrazioni che devono mantenere il pensiero disabilitato, consulta Esecuzione con pensiero disabilitato per le mitigazioni tramite prompt.
Oltre alle modifiche API sopra descritte, Claude Opus 5 si comporta diversamente da Claude Opus 4.8 in modi che potresti notare senza modificare alcun codice. Le risposte predefinite rivolte all'utente e i deliverable scritti sono più lunghi. Nelle sessioni agentiche, il modello narra i propri progressi all'utente più spesso. Nei framework multi-agente, delega ai subagenti più prontamente. Verifica anche il proprio lavoro senza che gli venga richiesto, quindi rimuovi le istruzioni di verifica ereditate da modelli precedenti ("includi un passaggio di verifica finale", "usa un subagente per verificare"); causano una verifica eccessiva su Claude Opus 5. Per i pattern di prompting che regolano ciascuno di questi comportamenti, consulta Prompting di Claude Opus 5.
Rispetto a Claude Opus 4.8, Claude Opus 5 rappresenta un miglioramento radicale piuttosto che incrementale, e offre intelligenza di frontiera a metà del costo di Claude Fable 5. I progressi più significativi riguardano:
max) in risultati migliori.low e medium che producono qualità elevata a una frazione dei token e della latenza delle impostazioni superiori.Per i pattern di prompting che sfruttano al meglio queste capacità, consulta Prompting di Claude Opus 5.
Claude Opus 5 ha un prezzo di 5 USD per milione di token di input e 25 USD per milione di token di output, invariato rispetto a Claude Opus 4.8.
Consulta Prezzi per i prezzi completi, incluse le tariffe per l'elaborazione batch, la cache dei prompt e la fast mode.
Claude Opus 5 è disponibile su:
claude-opus-5.anthropic.claude-opus-5. Claude Opus 5 è raggiungibile anche tramite l'API InvokeModel su bedrock-runtime, servita dalla stessa infrastruttura; l'integrazione Claude on Amazon Bedrock (legacy) non lo include nella sua tabella di ID modello con versione ARN.claude-opus-5.Claude Opus 4.8 rimane disponibile su tutte queste piattaforme.
Per migrare da Claude Opus 4.8, aggiorna il tuo ID modello:
model = "claude-opus-4-8" # Before
model = "claude-opus-5" # AfterQuindi rivedi le due modifiche di comportamento: il pensiero è attivo per impostazione predefinita, e disabilitare il pensiero con effort xhigh o max restituisce un errore 400. Consulta la guida alla migrazione per istruzioni passo passo.
Specifiche complete e prezzi per tutti i modelli Claude attuali.
Differenze comportamentali e pattern di prompting specifici per Claude Opus 5.
Controlla quanti token Claude utilizza quando risponde, da low a max.
Come funziona il pensiero quando è attivo per impostazione predefinita e quando può essere disabilitato.
Fornisci a Claude un budget di token indicativo su cui calibrare il proprio lavoro.
Guida per migrare ai modelli Claude più recenti dalle versioni precedenti di Claude.
Ottieni più token di output al secondo dai modelli Claude Opus a prezzi premium.
Was this page helpful?