Anthropic offre tre livelli di servizio:
Il livello standard è il livello di servizio predefinito per tutte le richieste API. L'API dà priorità a queste richieste insieme a tutte le altre richieste con disponibilità best-effort.
L'API dà priorità alle richieste in questo livello rispetto a tutte le altre richieste. Questa prioritizzazione aiuta a minimizzare gli errori "server overloaded", anche durante i periodi di picco.
Per maggiori informazioni, consulta Impegni Priority Tier esistenti.
Durante la gestione di una richiesta, Anthropic decide di assegnare una richiesta al Priority Tier nei seguenti scenari:
Anthropic conteggia l'utilizzo rispetto alla capacità Priority Tier come segue:
Token di input
inference_geo: "us") sui modelli Claude 4.6 e successivi, i token di input sono 1,1 token per tokenToken di output
inference_geo: "us") sui modelli Claude 4.6 e successivi, i token di output sono 1,1 token per tokenAltrimenti, le richieste procedono al livello standard.
Puoi controllare quali livelli di servizio possono essere utilizzati per una richiesta impostando il parametro service_tier:
client = anthropic.Anthropic()
message = client.messages.create(
model="claude-opus-4-8",
max_tokens=1024,
messages=[{"role": "user", "content": "Hello, Claude!"}],
service_tier="auto", # Automatically use Priority Tier when available, fallback to standard
)
print(message.usage.service_tier)Il parametro service_tier accetta i seguenti valori:
"auto" (predefinito) - Utilizza la capacità Priority Tier se disponibile, ripiegando sull'altra capacità in caso contrario"standard_only" - Utilizza solo la capacità del livello standard, utile se non vuoi utilizzare la tua capacità Priority TierL'oggetto usage della risposta include anche il livello di servizio assegnato alla richiesta:
{
"usage": {
"input_tokens": 410,
"cache_creation_input_tokens": 0,
"cache_read_input_tokens": 0,
"output_tokens": 585,
"service_tier": "priority"
}
}Questo ti consente di determinare quale livello di servizio è stato assegnato alla richiesta.
Quando richiedi service_tier="auto" con un modello con un impegno Priority Tier, questi header di risposta forniscono informazioni utili:
anthropic-priority-input-tokens-limit: 10000
anthropic-priority-input-tokens-remaining: 9618
anthropic-priority-input-tokens-reset: 2025-01-12T23:11:59Z
anthropic-priority-output-tokens-limit: 10000
anthropic-priority-output-tokens-remaining: 6000
anthropic-priority-output-tokens-reset: 2025-01-12T23:12:21ZPuoi utilizzare la presenza di questi header per rilevare se la tua richiesta era idonea per il Priority Tier, anche se superava il limite.
Un impegno Priority Tier consiste in:
Il Priority Tier punta a un uptime del 99,5% con risorse computazionali prioritarie. Le richieste oltre la tua capacità impegnata ricadono automaticamente sul livello standard.
Il Priority Tier è supportato su tutti i modelli Claude disponibili eccetto Claude Mythos 5, Claude Mythos Preview, Claude Opus 5 e Claude Sonnet 5.
Consulta la Panoramica dei modelli per maggiori dettagli sui modelli disponibili.
Was this page helpful?