Questa pagina fornisce informazioni dettagliate sui prezzi dei modelli e delle funzionalità di Anthropic. Tutti i prezzi sono in USD.
Per le informazioni più aggiornate sui prezzi, visita claude.com/pricing.
La tabella seguente mostra i prezzi per tutti i modelli Claude:
| Modello | Token di input base | Scritture cache 5m | Scritture cache 1h | Hit e aggiornamenti cache | Token di output |
|---|---|---|---|---|---|
| Claude Fable 5 | $10 / MTok | $12,50 / MTok | $20 / MTok | $1 / MTok | $50 / MTok |
| Claude Mythos 5 (disponibilità limitata) | $10 / MTok | $12,50 / MTok | $20 / MTok | $1 / MTok | $50 / MTok |
| Claude Opus 5 | $5 / MTok | $6,25 / MTok | $10 / MTok | $0,50 / MTok | $25 / MTok |
| Claude Opus 4.8 | $5 / MTok | $6,25 / MTok | $10 / MTok | $0,50 / MTok | $25 / MTok |
| Claude Opus 4.7 | $5 / MTok | $6,25 / MTok | $10 / MTok | $0,50 / MTok | $25 / MTok |
| Claude Opus 4.6 | $5 / MTok | $6,25 / MTok | $10 / MTok | $0,50 / MTok | $25 / MTok |
| Claude Opus 4.5 | $5 / MTok | $6,25 / MTok | $10 / MTok | $0,50 / MTok | $25 / MTok |
| Claude Opus 4.1 (ritirato, eccetto su Bedrock e Google Cloud) | $15 / MTok | $18,75 / MTok | $30 / MTok | $1,50 / MTok | $75 / MTok |
| Claude Opus 4 (ritirato, eccetto su Google Cloud) | $15 / MTok | $18,75 / MTok | $30 / MTok | $1,50 / MTok | $75 / MTok |
| Claude Sonnet 5 | $2 / MTok | $2,50 / MTok | $4 / MTok | $0,20 / MTok | $10 / MTok |
| Claude Sonnet 4.6 | $3 / MTok | $3,75 / MTok | $6 / MTok | $0,30 / MTok | $15 / MTok |
| Claude Sonnet 4.5 | $3 / MTok | $3,75 / MTok | $6 / MTok | $0,30 / MTok | $15 / MTok |
| Claude Sonnet 4 (ritirato, eccetto su Bedrock e Google Cloud) | $3 / MTok | $3,75 / MTok | $6 / MTok | $0,30 / MTok | $15 / MTok |
| Claude Haiku 4.5 | $1 / MTok | $1,25 / MTok | $2 / MTok | $0,10 / MTok | $5 / MTok |
| Claude Haiku 3.5 (ritirato, eccetto su Bedrock e Google Cloud) | $0,80 / MTok | $1 / MTok | $1,60 / MTok | $0,08 / MTok | $4 / MTok |
Per i prezzi di Claude Platform on AWS, consulta Prezzi di Claude Platform on AWS.
Questa sezione riguarda le piattaforme cloud gestite dai partner, in cui il provider cloud emette la fattura. Per le piattaforme cloud gestite da Anthropic e fatturate tramite un marketplace, consulta Prezzi di Claude Platform on AWS e Prezzi di Claude in Microsoft Foundry.
I modelli Claude sono disponibili su Amazon Bedrock e Google Cloud. Per i prezzi ufficiali, visita:
Claude Platform on AWS fattura tramite AWS Marketplace utilizzando le Claude Consumption Units (CCU). Anthropic calcola l'utilizzo dei token in USD alle tariffe standard per modello e per funzionalità, applica eventuali sconti negoziati, converte il risultato in CCU a $0,01 per CCU e comunica la quantità di CCU ad AWS Marketplace ogni ora. La tua fattura AWS mostra una singola voce CCU.
| Concetto | Dettagli |
|---|---|
| Unità di fatturazione | Claude Consumption Unit (CCU) |
| Prezzo CCU | $0,01 per CCU (fisso; gli sconti si applicano alla conversione da token a CCU, non al prezzo della CCU) |
| Conversione | Utilizzo dei token calcolato in USD alle tariffe standard per modello e per funzionalità (uguali ai prezzi della Claude API), poi convertito in CCU a $0,01 per CCU |
| Cadenza di fatturazione | Misurazione oraria verso AWS Marketplace; fatture mensili |
| Modello di pagamento | Solo posticipato (postpaid); nessun credito prepagato |
| Sconti | Applicati come minor numero di CCU misurate |
| Tasse | Misurazione al lordo delle tasse; AWS Marketplace gestisce le tasse |
| Visibilità dei costi | Dettaglio in tempo reale nella Claude Console (accesso tramite la AWS Console); AWS Cost Explorer mostra le CCU aggregate |
Per i modelli Claude 4.6 e successivi, l'utilizzo di inference_geo: "us" applica un moltiplicatore di prezzo di 1,1x. inference_geo: "global" (impostazione predefinita) utilizza i prezzi standard. Consulta Residenza dei dati per i dettagli.
Quando ti registri nella pagina del servizio Claude Platform on AWS della AWS Console, la AWS Console cerca eventuali offerte private associate al tuo account e ti chiede di accettarle in AWS Marketplace. Contatta il tuo rappresentante commerciale Anthropic per i termini delle offerte private.
Claude in Microsoft Foundry fattura tramite Azure Marketplace utilizzando le Claude Consumption Units (CCU). Anthropic calcola l'utilizzo dei token in USD alle tariffe standard per modello e per funzionalità, applica eventuali sconti negoziati, converte il risultato in CCU a $0,01 per CCU e comunica la quantità di CCU ad Azure Marketplace ogni ora. La tua fattura Azure mostra una singola voce CCU.
| Concetto | Dettagli |
|---|---|
| Unità di fatturazione | Claude Consumption Unit (CCU) |
| Prezzo CCU | $0,01 per CCU (fisso; gli sconti si applicano alla conversione da token a CCU, non al prezzo della CCU) |
| Conversione | Utilizzo dei token calcolato in USD alle tariffe standard per modello e per funzionalità (uguali ai prezzi della Claude API), poi convertito in CCU a $0,01 per CCU |
| Cadenza di fatturazione | Misurazione oraria verso Azure Marketplace; fatture mensili |
| Modello di pagamento | Solo posticipato (postpaid); nessun credito prepagato |
| Sconti | Applicati come minor numero di CCU misurate |
| Tasse | Misurazione al lordo delle tasse; Azure Marketplace gestisce le tasse |
| Visibilità dei costi | Azure Cost Management mostra le CCU aggregate |
I deployment ospitati su Azure possono utilizzare il tipo di deployment US Data Zone Standard, che mantiene l'inferenza all'interno degli Stati Uniti. Questo equivale a inference_geo: "us" sulla Claude API e applica lo stesso moltiplicatore di prezzo di 1,1x. Consulta Residenza dei dati per i dettagli.
La "prompt caching" (cache dei prompt) riduce i costi e la latenza riutilizzando porzioni del prompt già elaborate in precedenza tra le chiamate API. Invece di rielaborare lo stesso prompt di sistema di grandi dimensioni, documento o cronologia della conversazione a ogni richiesta, l'API legge dalla cache a una frazione del prezzo standard dell'input.
Esistono due modi per abilitare la cache dei prompt:
cache_control al livello superiore della richiesta. Il sistema gestisce automaticamente i breakpoint della cache man mano che le conversazioni crescono. Questo è il punto di partenza consigliato per la maggior parte dei casi d'uso.cache_control direttamente sui singoli blocchi di contenuto per un controllo granulare su cosa viene esattamente memorizzato nella cache.La cache dei prompt utilizza i seguenti moltiplicatori di prezzo rispetto alle tariffe base dei token di input:
| Operazione di cache | Moltiplicatore | Durata |
|---|---|---|
| Scrittura cache 5 minuti | 1,25x prezzo base input | Cache valida per 5 minuti |
| Scrittura cache 1 ora | 2x prezzo base input | Cache valida per 1 ora |
| Lettura cache (hit) | 0,1x prezzo base input | Stessa durata della scrittura precedente |
I token di scrittura cache vengono addebitati quando il contenuto viene memorizzato per la prima volta. I token di lettura cache vengono addebitati quando una richiesta successiva recupera il contenuto memorizzato nella cache. Un cache hit costa il 10% del prezzo standard dell'input, il che significa che la cache diventa conveniente dopo una sola lettura per la durata di 5 minuti (scrittura 1,25x), o dopo due letture per la durata di 1 ora (scrittura 2x).
Questi moltiplicatori si combinano con altri modificatori di prezzo, inclusi lo sconto della Batch API e la residenza dei dati.
Per dettagli di implementazione, modelli supportati ed esempi di codice, consulta Cache dei prompt.
Per i modelli Claude 4.6 e successivi, specificare l'inferenza solo negli Stati Uniti tramite il parametro inference_geo comporta un moltiplicatore di 1,1x su tutte le categorie di prezzo dei token, inclusi token di input, token di output, scritture cache e letture cache. Il routing globale (impostazione predefinita) utilizza i prezzi standard.
Questo si applica alla Claude API (first-party) e a Claude Platform on AWS. Su Claude in Microsoft Foundry, lo stesso moltiplicatore di 1,1x si applica ai deployment che utilizzano il tipo di deployment US Data Zone Standard (consulta Geografia dell'inferenza). Le piattaforme gestite dai partner (Bedrock e Google Cloud) hanno prezzi regionali indipendenti. Consulta Bedrock e Google Cloud per i dettagli. I modelli precedenti non supportano il parametro inference_geo e utilizzano sempre i prezzi standard; le richieste che includono il parametro su questi modelli restituiscono un errore 400.
Per ulteriori informazioni, consulta Residenza dei dati.
La modalità veloce, in anteprima di ricerca, fornisce output significativamente più veloce per Claude Opus 5 e Claude Opus 4.8 a un prezzo premium. I prezzi della modalità veloce si applicano all'intera finestra di contesto, incluse le richieste con oltre 200k token di input. La modalità veloce è disponibile solo sulla Claude API (first-party); non è disponibile su Claude Platform on AWS o sulle piattaforme cloud gestite dai partner.
| Modello | Input | Output |
|---|---|---|
| Claude Opus 5 / Claude Opus 4.8 | $10 / MTok | $50 / MTok |
La modalità veloce non è disponibile su Claude Opus 4.7 (le richieste con speed: "fast" restituiscono un errore) o Claude Opus 4.6 (le richieste vengono eseguite a velocità standard e fatturate alle tariffe standard). Consulta Modalità veloce.
I prezzi della modalità veloce si combinano con altri modificatori di prezzo:
La modalità veloce non è disponibile con la Batch API.
Per ulteriori informazioni, consulta Modalità veloce.
La Batch API consente l'elaborazione asincrona di grandi volumi di richieste con uno sconto del 50% sia sui token di input che di output.
| Modello | Input batch | Output batch |
|---|---|---|
| Claude Fable 5 | $5 / MTok | $25 / MTok |
| Claude Mythos 5 (disponibilità limitata) | $5 / MTok | $25 / MTok |
| Claude Opus 5 | $2,50 / MTok | $12,50 / MTok |
| Claude Opus 4.8 | $2,50 / MTok | $12,50 / MTok |
| Claude Opus 4.7 | $2,50 / MTok | $12,50 / MTok |
| Claude Opus 4.6 | $2,50 / MTok | $12,50 / MTok |
| Claude Opus 4.5 | $2,50 / MTok | $12,50 / MTok |
| Claude Opus 4.1 (ritirato, eccetto su Bedrock e Google Cloud) | $7,50 / MTok | $37,50 / MTok |
| Claude Opus 4 (ritirato, eccetto su Google Cloud) | $7,50 / MTok | $37,50 / MTok |
| Claude Sonnet 5 | $1 / MTok | $5 / MTok |
| Claude Sonnet 4.6 | $1,50 / MTok | $7,50 / MTok |
| Claude Sonnet 4.5 | $1,50 / MTok | $7,50 / MTok |
| Claude Sonnet 4 (ritirato, eccetto su Bedrock e Google Cloud) | $1,50 / MTok | $7,50 / MTok |
| Claude Haiku 4.5 | $0,50 / MTok | $2,50 / MTok |
| Claude Haiku 3.5 (ritirato, eccetto su Bedrock e Google Cloud) | $0,40 / MTok | $2 / MTok |
Per ulteriori informazioni sull'elaborazione batch, consulta Elaborazione batch.
I modelli Claude 4.6 e successivi e Claude Mythos Preview includono l'intera finestra di contesto da 1M di token ai prezzi standard. (Una richiesta da 900k token viene fatturata alla stessa tariffa per token di una richiesta da 9k token.) Gli sconti della cache dei prompt e dell'elaborazione batch si applicano alle tariffe standard sull'intera finestra di contesto.
Le richieste di uso degli strumenti vengono tariffate in base a:
tools)Gli strumenti lato client hanno lo stesso prezzo di qualsiasi altra richiesta API di Claude, mentre gli strumenti lato server possono comportare costi aggiuntivi in base al loro utilizzo specifico.
I token aggiuntivi derivanti dall'uso degli strumenti provengono da:
tools nelle richieste API (nomi, descrizioni e schemi degli strumenti)tool_use nelle richieste e risposte APItool_result nelle richieste APIQuando usi tools, l'API include automaticamente anche uno speciale prompt di sistema per il modello che abilita l'uso degli strumenti. Il numero di token per l'uso degli strumenti richiesto per ciascun modello è elencato nella tabella seguente (esclusi i token aggiuntivi elencati in precedenza). Nota che la tabella presuppone che venga fornito almeno 1 strumento. Se non vengono forniti tools, una scelta dello strumento impostata su none utilizza 0 token aggiuntivi del prompt di sistema.
| Modello | Scelta dello strumento | Conteggio token del prompt di sistema per l'uso degli strumenti |
|---|---|---|
| Claude Opus 5 | auto, noneany, tool | 286 token 406 token |
| Claude Opus 4.8 | auto, noneany, tool | 290 token 410 token |
| Claude Opus 4.7 | auto, noneany, tool | 675 token 804 token |
| Claude Opus 4.6 | auto, noneany, tool | 497 token 589 token |
| Claude Opus 4.5 | auto, noneany, tool | 496 token 588 token |
| Claude Opus 4.1 (ritirato, eccetto su Bedrock e Google Cloud) | auto, noneany, tool | 313 token 315 token |
| Claude Opus 4 (ritirato, eccetto su Google Cloud) | auto, noneany, tool | 313 token 315 token |
| Claude Sonnet 5 | auto, noneany, tool | 354 token 474 token |
| Claude Sonnet 4.6 | auto, noneany, tool | 497 token 589 token |
| Claude Sonnet 4.5 | auto, noneany, tool | 496 token 588 token |
| Claude Sonnet 4 (ritirato, eccetto su Bedrock e Google Cloud) | auto, noneany, tool | 313 token 315 token |
| Claude Haiku 4.5 | auto, noneany, tool | 496 token 588 token |
| Claude Haiku 3.5 (ritirato, eccetto su Bedrock e Google Cloud) | auto, noneany, tool | 264 token 355 token |
Questi conteggi di token vengono aggiunti ai normali token di input e output per calcolare il costo totale di una richiesta.
Per i prezzi attuali per modello, consulta la sezione prezzi dei modelli.
Per ulteriori informazioni sull'implementazione dell'uso degli strumenti e sulle best practice, consulta Uso degli strumenti.
La definizione dello strumento bash aggiunge i seguenti token di input alla tua richiesta. Questo si aggiunge al prompt di sistema per l'uso degli strumenti specifico per modello che si applica ogni volta che è presente uno strumento.
| Modello | Token di input aggiuntivi |
|---|---|
| Claude Opus 5, Claude Opus 4.8 e Claude Opus 4.7 | 325 token |
| Claude Opus 4.6, Claude Sonnet 4.6 e precedenti | 244 token |
Token aggiuntivi vengono consumati da:
Consulta prezzi dell'uso degli strumenti per i dettagli completi sui prezzi.
L'esecuzione di codice è gratuita quando viene utilizzata con la ricerca web o il recupero web. Quando web_search_20260209 (o versioni successive) o web_fetch_20260209 (o versioni successive) è incluso nella tua richiesta API, non ci sono costi aggiuntivi per le chiamate allo strumento di esecuzione del codice oltre ai costi standard dei token di input e output.
Quando viene utilizzata senza questi strumenti, l'esecuzione di codice viene fatturata in base al tempo di esecuzione, tracciato separatamente dall'utilizzo dei token:
L'utilizzo dell'esecuzione di codice viene tracciato nella risposta:
{
"usage": {
"input_tokens": 105,
"output_tokens": 239,
"server_tool_use": {
"code_execution_requests": 1
}
}
}Lo strumento editor di testo utilizza la stessa struttura di prezzi degli altri strumenti usati con Claude. Segue la tariffazione standard basata sui token di input e output in base al modello Claude che stai utilizzando.
Oltre ai token di base, sono necessari i seguenti token di input aggiuntivi per lo strumento editor di testo:
| Strumento | Token di input aggiuntivi |
|---|---|
text_editor_20250429 (Claude 4.x) | 700 token |
Consulta prezzi dell'uso degli strumenti per i dettagli completi sui prezzi.
L'utilizzo della ricerca web viene addebitato in aggiunta all'utilizzo dei token:
{
"usage": {
"input_tokens": 105,
"output_tokens": 6039,
"cache_read_input_tokens": 7123,
"cache_creation_input_tokens": 7345,
"server_tool_use": {
"web_search_requests": 1
}
}
}La ricerca web è disponibile sull'API di Claude al costo di 10 $ per 1.000 ricerche, oltre ai costi standard dei token per i contenuti generati dalla ricerca. I risultati della ricerca web recuperati nel corso di una conversazione vengono conteggiati come token di input, sia nelle iterazioni di ricerca eseguite durante un singolo turno sia nei turni successivi della conversazione.
Ogni ricerca web viene conteggiata come un singolo utilizzo, indipendentemente dal numero di risultati restituiti. Se si verifica un errore durante la ricerca web, questa non verrà addebitata.
L'utilizzo di web fetch non comporta alcun costo aggiuntivo oltre ai costi standard dei token:
{
"usage": {
"input_tokens": 25039,
"output_tokens": 931,
"cache_read_input_tokens": 0,
"cache_creation_input_tokens": 0,
"server_tool_use": {
"web_fetch_requests": 1
}
}
}Lo strumento web fetch è disponibile sull'API di Claude senza costi aggiuntivi. Paghi solo i costi standard dei token per il contenuto recuperato che diventa parte del contesto della tua conversazione.
Per proteggerti dal recupero involontario di contenuti di grandi dimensioni che consumerebbero un numero eccessivo di token, usa il parametro max_content_tokens per impostare limiti appropriati in base al tuo caso d'uso e alle tue considerazioni di budget.
Esempio di utilizzo di token per contenuti tipici:
L'uso del computer segue i prezzi standard dell'uso degli strumenti. Quando usi lo strumento di uso del computer:
Overhead del prompt di sistema: La beta dell'uso del computer aggiunge 466–499 token al prompt di sistema
Utilizzo di token dello strumento di uso del computer:
| Modello | Token di input per definizione dello strumento |
|---|---|
| Modelli Claude 4.x | 735 token |
Consumo aggiuntivo di token:
Claude Managed Agents viene fatturato su due dimensioni: token e tempo di esecuzione della sessione.
Tutti i token consumati da una sessione di Claude Managed Agents vengono fatturati alle tariffe mostrate in Prezzi dei modelli. I moltiplicatori della cache dei prompt si applicano in modo identico. La ricerca web attivata all'interno di una sessione comporta il costo standard di $10 per 1.000 ricerche. Su Claude Platform on AWS, i costi dei token e del tempo di esecuzione della sessione vengono convertiti in Claude Consumption Units alla tariffa standard. I prezzi premium della modalità veloce si applicano quando model.speed di un agente è impostato su "fast".
Si applica anche il moltiplicatore della residenza dei dati: quando model.inference_geo di un agente è fissato su "us", i token consumati dalle sessioni che eseguono quell'agente vengono fatturati a 1,1x le tariffe standard, lo stesso moltiplicatore che si applica all'inferenza solo negli Stati Uniti sulla Messages API.
I seguenti modificatori della Messages API non si applicano alle sessioni di Claude Managed Agents:
| Modificatore | Perché non si applica |
|---|---|
| Sconto Batch API | Le sessioni sono stateful e interattive. Non esiste una modalità batch. |
| Prezzi delle piattaforme cloud | Non disponibile sulle piattaforme cloud gestite dai partner. |
| SKU | Tariffa | Misurazione |
|---|---|---|
| Tempo di esecuzione della sessione | $0,08 per ora-sessione | Durata dello stato running |
Il tempo di esecuzione viene misurato al millisecondo e si accumula solo mentre lo stato della sessione è running. Il tempo trascorso in stato idle (in attesa del tuo prossimo messaggio o di una conferma dello strumento), rescheduling o terminated non viene conteggiato nel tempo di esecuzione.
Una sessione di coding di un'ora utilizzando Claude Opus 5 che consuma 50.000 token di input e 15.000 token di output:
| Voce | Calcolo | Costo |
|---|---|---|
| Token di input | 50.000 × $5 / 1.000.000 | $0,25 |
| Token di output | 15.000 × $25 / 1.000.000 | $0,375 |
| Tempo di esecuzione della sessione | 1,0 ora × $0,08 | $0,08 |
| Totale | $0,705 |
Se la cache dei prompt è attiva e 40.000 dei token di input sono letture dalla cache:
| Voce | Calcolo | Costo |
|---|---|---|
| Token di input non in cache | 10.000 × $5 / 1.000.000 | $0,05 |
| Token di lettura cache | 40.000 × $5 × 0,1 / 1.000.000 | $0,02 |
| Token di output | 15.000 × $25 / 1.000.000 | $0,375 |
| Tempo di esecuzione della sessione | 1,0 ora × $0,08 | $0,08 |
| Totale | $0,525 |
Per una spiegazione dettagliata di questo calcolo, consulta la guida all'agente di supporto clienti.
Quando crei agenti con Claude:
I "rate limits" (limiti di velocità) variano in base al livello di utilizzo e influiscono sul numero di richieste che puoi effettuare:
Per informazioni dettagliate sui limiti di velocità, consulta Limiti di velocità.
Per limiti oltre il livello Scale o accordi di prezzo personalizzati, contatta il team vendite.
Gli sconti per volume possono essere disponibili per utenti ad alto volume. Questi vengono negoziati caso per caso.
Per clienti enterprise con esigenze specifiche:
Contatta il team vendite all'indirizzo [email protected] o tramite la Claude Console per discutere le opzioni di prezzo enterprise.
Come viene calcolato l'utilizzo dei token?
I token sono porzioni di testo che i modelli elaborano. Come stima approssimativa, 1 token corrisponde a circa 4 caratteri o 0,75 parole in inglese. Il conteggio esatto varia in base alla lingua e al tipo di contenuto.
Esistono livelli gratuiti o prove?
I nuovi utenti ricevono una piccola quantità di crediti gratuiti per testare l'API. Contatta le vendite per informazioni su prove estese per la valutazione enterprise.
Come si combinano gli sconti?
Gli sconti della Batch API e della cache dei prompt possono essere combinati. Ad esempio, l'utilizzo di entrambe le funzionalità insieme offre risparmi significativi rispetto alle chiamate API standard. Consulta prezzi della cache dei prompt per capire come interagiscono i moltiplicatori.
Quali metodi di pagamento sono accettati?
Le principali carte di credito sono accettate per gli account standard. I clienti enterprise possono concordare fatturazione e altri metodi di pagamento.
Per ulteriori domande sui prezzi, contatta [email protected].
Was this page helpful?