Diese Seite bietet detaillierte Preisinformationen für Anthropics Modelle und Funktionen. Alle Preise sind in USD angegeben.
Die aktuellsten Preisinformationen findest du unter claude.com/pricing.
Die folgende Tabelle zeigt die Preise für alle Claude-Modelle:
| Modell | Basis-Input-Token | 5-Min.-Cache-Schreibvorgänge | 1-Std.-Cache-Schreibvorgänge | Cache-Treffer & -Aktualisierungen | Output-Token |
|---|---|---|---|---|---|
| Claude Fable 5 | 10 $ / MTok | 12,50 $ / MTok | 20 $ / MTok | 1 $ / MTok | 50 $ / MTok |
| Claude Mythos 5 (begrenzte Verfügbarkeit) | 10 $ / MTok | 12,50 $ / MTok | 20 $ / MTok | 1 $ / MTok | 50 $ / MTok |
| Claude Opus 5 | 5 $ / MTok | 6,25 $ / MTok | 10 $ / MTok | 0,50 $ / MTok | 25 $ / MTok |
| Claude Opus 4.8 | 5 $ / MTok | 6,25 $ / MTok | 10 $ / MTok | 0,50 $ / MTok | 25 $ / MTok |
| Claude Opus 4.7 | 5 $ / MTok | 6,25 $ / MTok | 10 $ / MTok | 0,50 $ / MTok | 25 $ / MTok |
| Claude Opus 4.6 | 5 $ / MTok | 6,25 $ / MTok | 10 $ / MTok | 0,50 $ / MTok | 25 $ / MTok |
| Claude Opus 4.5 | 5 $ / MTok | 6,25 $ / MTok | 10 $ / MTok | 0,50 $ / MTok | 25 $ / MTok |
| Claude Opus 4.1 (eingestellt, außer auf Bedrock und Google Cloud) | 15 $ / MTok | 18,75 $ / MTok | 30 $ / MTok | 1,50 $ / MTok | 75 $ / MTok |
| Claude Opus 4 (eingestellt, außer auf Google Cloud) | 15 $ / MTok | 18,75 $ / MTok | 30 $ / MTok | 1,50 $ / MTok | 75 $ / MTok |
| Claude Sonnet 5 | 2 $ / MTok | 2,50 $ / MTok | 4 $ / MTok | 0,20 $ / MTok | 10 $ / MTok |
| Claude Sonnet 4.6 | 3 $ / MTok | 3,75 $ / MTok | 6 $ / MTok | 0,30 $ / MTok | 15 $ / MTok |
| Claude Sonnet 4.5 | 3 $ / MTok | 3,75 $ / MTok | 6 $ / MTok | 0,30 $ / MTok | 15 $ / MTok |
| Claude Sonnet 4 (eingestellt, außer auf Bedrock und Google Cloud) | 3 $ / MTok | 3,75 $ / MTok | 6 $ / MTok | 0,30 $ / MTok | 15 $ / MTok |
| Claude Haiku 4.5 | 1 $ / MTok | 1,25 $ / MTok | 2 $ / MTok | 0,10 $ / MTok | 5 $ / MTok |
| Claude Haiku 3.5 (eingestellt, außer auf Bedrock und Google Cloud) | 0,80 $ / MTok | 1 $ / MTok | 1,60 $ / MTok | 0,08 $ / MTok | 4 $ / MTok |
Für Preise von Claude Platform on AWS siehe Claude Platform on AWS – Preise.
Dieser Abschnitt behandelt von Partnern betriebene Cloud-Plattformen, bei denen der Cloud-Anbieter dir die Rechnung stellt. Für von Anthropic betriebene Cloud-Plattformen, die über einen Marketplace abgerechnet werden, siehe Claude Platform on AWS – Preise und Claude in Microsoft Foundry – Preise.
Claude-Modelle sind auf Amazon Bedrock und Google Cloud verfügbar. Offizielle Preise findest du unter:
Claude Platform on AWS rechnet über den AWS Marketplace mit „Claude Consumption Units" (Claude-Verbrauchseinheiten), oder CCUs, ab. Anthropic bewertet deine Token-Nutzung in USD zu den Standardtarifen pro Modell und Funktion, wendet etwaige ausgehandelte Rabatte an, konvertiert das Ergebnis in CCUs zu 0,01 $ pro CCU und meldet die CCU-Menge stündlich an den AWS Marketplace. Deine AWS-Rechnung zeigt einen einzelnen CCU-Posten.
| Konzept | Details |
|---|---|
| Abrechnungseinheit | Claude Consumption Unit (CCU) |
| CCU-Preis | 0,01 $ pro CCU (fest; Rabatte werden bei der Token-zu-CCU-Konvertierung angewendet, nicht auf den CCU-Preis) |
| Konvertierung | Token-Nutzung wird in USD zu Standardtarifen pro Modell und Funktion bewertet (identisch mit Claude API-Preisen), dann in CCUs zu 0,01 $ pro CCU konvertiert |
| Abrechnungsrhythmus | Stündliche Messung an den AWS Marketplace; monatliche Rechnungen |
| Zahlungsmodell | Nur nachträglich (Postpaid); keine Prepaid-Guthaben |
| Rabatte | Werden als weniger gemessene CCUs angewendet |
| Steuern | Messung vor Steuern; AWS Marketplace übernimmt die Steuerabwicklung |
| Kostentransparenz | Echtzeit-Aufschlüsselung in der Claude Console (Zugriff über die AWS Console); AWS Cost Explorer zeigt aggregierte CCU |
Für Claude 4.6 und spätere Modelle wird bei Verwendung von inference_geo: "us" ein Preismultiplikator von 1,1x angewendet. inference_geo: "global" (Standard) verwendet die Standardpreise. Siehe Datenresidenz für Details.
Wenn du dich auf der Serviceseite Claude Platform on AWS in der AWS Console anmeldest, sucht die AWS Console nach einem mit deinem Konto verknüpften privaten Angebot und fordert dich auf, es im AWS Marketplace zu akzeptieren. Kontaktiere deinen Anthropic-Ansprechpartner für die Bedingungen privater Angebote.
Claude in Microsoft Foundry rechnet über den Azure Marketplace mit Claude Consumption Units (CCUs) ab. Anthropic bewertet deine Token-Nutzung in USD zu den Standardtarifen pro Modell und Funktion, wendet etwaige ausgehandelte Rabatte an, konvertiert das Ergebnis in CCUs zu 0,01 $ pro CCU und meldet die CCU-Menge stündlich an den Azure Marketplace. Deine Azure-Rechnung zeigt einen einzelnen CCU-Posten.
| Konzept | Details |
|---|---|
| Abrechnungseinheit | Claude Consumption Unit (CCU) |
| CCU-Preis | 0,01 $ pro CCU (fest; Rabatte werden bei der Token-zu-CCU-Konvertierung angewendet, nicht auf den CCU-Preis) |
| Konvertierung | Token-Nutzung wird in USD zu Standardtarifen pro Modell und Funktion bewertet (identisch mit Claude API-Preisen), dann in CCUs zu 0,01 $ pro CCU konvertiert |
| Abrechnungsrhythmus | Stündliche Messung an den Azure Marketplace; monatliche Rechnungen |
| Zahlungsmodell | Nur nachträglich (Postpaid); keine Prepaid-Guthaben |
| Rabatte | Werden als weniger gemessene CCUs angewendet |
| Steuern | Messung vor Steuern; Azure Marketplace übernimmt die Steuerabwicklung |
| Kostentransparenz | Azure Cost Management zeigt aggregierte CCU |
Auf Azure gehostete Deployments können den Deployment-Typ „US Data Zone Standard" verwenden, der die Inferenz innerhalb der Vereinigten Staaten hält. Dies entspricht inference_geo: "us" in der Claude API und wendet denselben Preismultiplikator von 1,1x an. Siehe Datenresidenz für Details.
„Prompt caching" (Prompt-Caching) reduziert Kosten und „latency" (Latenz), indem zuvor verarbeitete Teile deines Prompts über API-Aufrufe hinweg wiederverwendet werden. Anstatt denselben großen System-Prompt, dasselbe Dokument oder denselben Gesprächsverlauf bei jeder Anfrage erneut zu verarbeiten, liest die API aus dem Cache zu einem Bruchteil des Standard-Input-Preises.
Es gibt zwei Möglichkeiten, Prompt-Caching zu aktivieren:
cache_control-Feld auf der obersten Ebene deiner Anfrage hinzu. Das System verwaltet Cache-Breakpoints automatisch, während Gespräche wachsen. Dies ist der empfohlene Ausgangspunkt für die meisten Anwendungsfälle.cache_control direkt auf einzelnen Content-Blöcken für eine feingranulare Kontrolle darüber, was genau gecacht wird.Prompt-Caching verwendet die folgenden Preismultiplikatoren relativ zu den Basis-Input-Token-Tarifen:
| Cache-Operation | Multiplikator | Dauer |
|---|---|---|
| 5-Minuten-Cache-Write | 1,25x Basis-Input-Preis | Cache 5 Minuten gültig |
| 1-Stunden-Cache-Write | 2x Basis-Input-Preis | Cache 1 Stunde gültig |
| Cache-Read (Hit) | 0,1x Basis-Input-Preis | Gleiche Dauer wie der vorangegangene Write |
Cache-Write-Token werden berechnet, wenn Inhalte erstmals gespeichert werden. Cache-Read-Token werden berechnet, wenn eine nachfolgende Anfrage den gecachten Inhalt abruft. Ein Cache-Hit kostet 10 % des Standard-Input-Preises, was bedeutet, dass sich das Caching nach einem Cache-Read für die 5-Minuten-Dauer (1,25x Write) bzw. nach zwei Cache-Reads für die 1-Stunden-Dauer (2x Write) amortisiert.
Diese Multiplikatoren kombinieren sich mit anderen Preismodifikatoren, einschließlich des Batch-API-Rabatts und der Datenresidenz.
Für Implementierungsdetails, unterstützte Modelle und Codebeispiele siehe Prompt-Caching.
Für Claude 4.6 und spätere Modelle führt die Angabe von US-only-Inferenz über den Parameter inference_geo zu einem Multiplikator von 1,1x auf alle Token-Preiskategorien, einschließlich Input-Token, Output-Token, Cache-Writes und Cache-Reads. Globales Routing (Standard) verwendet die Standardpreise.
Dies gilt für die Claude API (First-Party) und Claude Platform on AWS. Bei Claude in Microsoft Foundry gilt derselbe Multiplikator von 1,1x für Deployments, die den Deployment-Typ „US Data Zone Standard" verwenden (siehe Inferenz-Geografie). Von Partnern betriebene Plattformen (Bedrock und Google Cloud) haben unabhängige regionale Preise. Siehe Bedrock und Google Cloud für Details. Frühere Modelle unterstützen den Parameter inference_geo nicht und verwenden immer die Standardpreise; Anfragen, die den Parameter bei diesen Modellen enthalten, geben einen 400-Fehler zurück.
Weitere Informationen findest du unter Datenresidenz.
Fast Mode, in der Research Preview, bietet deutlich schnellere Ausgaben für Claude Opus 5 und Claude Opus 4.8 zu Premium-Preisen. Fast-Mode-Preise gelten über das gesamte Kontextfenster, einschließlich Anfragen mit über 200k Input-Token. Fast Mode ist nur in der Claude API (First-Party) verfügbar; er ist nicht auf Claude Platform on AWS oder von Partnern betriebenen Cloud-Plattformen verfügbar.
| Modell | Input | Output |
|---|---|---|
| Claude Opus 5 / Claude Opus 4.8 | 10 $ / MTok | 50 $ / MTok |
Fast Mode ist nicht verfügbar für Claude Opus 4.7 (Anfragen mit speed: "fast" geben einen Fehler zurück) oder Claude Opus 4.6 (Anfragen laufen mit Standardgeschwindigkeit und werden zu Standardtarifen abgerechnet). Siehe Fast Mode.
Fast-Mode-Preise kombinieren sich mit anderen Preismodifikatoren:
Fast Mode ist nicht mit der Batch API verfügbar.
Weitere Informationen findest du unter Fast Mode.
Die Batch API ermöglicht die asynchrone Verarbeitung großer Mengen von Anfragen mit einem Rabatt von 50 % auf Input- und Output-Token.
| Modell | Batch-Input | Batch-Output |
|---|---|---|
| Claude Fable 5 | 5 $ / MTok | 25 $ / MTok |
| Claude Mythos 5 (begrenzte Verfügbarkeit) | 5 $ / MTok | 25 $ / MTok |
| Claude Opus 5 | 2,50 $ / MTok | 12,50 $ / MTok |
| Claude Opus 4.8 | 2,50 $ / MTok | 12,50 $ / MTok |
| Claude Opus 4.7 | 2,50 $ / MTok | 12,50 $ / MTok |
| Claude Opus 4.6 | 2,50 $ / MTok | 12,50 $ / MTok |
| Claude Opus 4.5 | 2,50 $ / MTok | 12,50 $ / MTok |
| Claude Opus 4.1 (eingestellt, außer auf Bedrock und Google Cloud) | 7,50 $ / MTok | 37,50 $ / MTok |
| Claude Opus 4 (eingestellt, außer auf Google Cloud) | 7,50 $ / MTok | 37,50 $ / MTok |
| Claude Sonnet 5 | 1 $ / MTok | 5 $ / MTok |
| Claude Sonnet 4.6 | 1,50 $ / MTok | 7,50 $ / MTok |
| Claude Sonnet 4.5 | 1,50 $ / MTok | 7,50 $ / MTok |
| Claude Sonnet 4 (eingestellt, außer auf Bedrock und Google Cloud) | 1,50 $ / MTok | 7,50 $ / MTok |
| Claude Haiku 4.5 | 0,50 $ / MTok | 2,50 $ / MTok |
| Claude Haiku 3.5 (eingestellt, außer auf Bedrock und Google Cloud) | 0,40 $ / MTok | 2 $ / MTok |
Weitere Informationen zur Batch-Verarbeitung findest du unter Batch-Verarbeitung.
Claude 4.6 und spätere Modelle sowie Claude Mythos Preview beinhalten das vollständige 1M-Token-Kontextfenster zu Standardpreisen. (Eine Anfrage mit 900k Token wird zum gleichen Preis pro Token abgerechnet wie eine Anfrage mit 9k Token.) Prompt-Caching- und Batch-Verarbeitungs-Rabatte gelten zu Standardtarifen über das gesamte Kontextfenster.
Anfragen mit Tool-Nutzung werden basierend auf folgenden Faktoren berechnet:
tools-Parameters)Clientseitige Tools werden genauso berechnet wie jede andere Claude-API-Anfrage, während serverseitige Tools je nach ihrer spezifischen Nutzung zusätzliche Kosten verursachen können.
Die zusätzlichen Token durch Tool-Nutzung stammen aus:
tools-Parameter in API-Anfragen (Tool-Namen, Beschreibungen und Schemas)tool_use-Inhaltsblöcken in API-Anfragen und -Antwortentool_result-Inhaltsblöcken in API-AnfragenWenn du tools verwendest, fügt die API automatisch auch einen speziellen System-Prompt für das Modell hinzu, der die Tool-Nutzung ermöglicht. Die Anzahl der für jedes Modell erforderlichen Tool-Nutzungs-Token ist in der folgenden Tabelle aufgeführt (ohne die zuvor aufgeführten zusätzlichen Token). Beachte, dass die Tabelle davon ausgeht, dass mindestens 1 Tool bereitgestellt wird. Wenn keine tools bereitgestellt werden, verwendet eine Tool-Auswahl von none 0 zusätzliche System-Prompt-Token.
| Modell | Tool-Auswahl | Token-Anzahl des Tool-Nutzungs-System-Prompts |
|---|---|---|
| Claude Opus 5 | auto, noneany, tool | 286 Token 406 Token |
| Claude Opus 4.8 | auto, noneany, tool | 290 Token 410 Token |
| Claude Opus 4.7 | auto, noneany, tool | 675 Token 804 Token |
| Claude Opus 4.6 | auto, noneany, tool | 497 Token 589 Token |
| Claude Opus 4.5 | auto, noneany, tool | 496 Token 588 Token |
| Claude Opus 4.1 (eingestellt, außer auf Bedrock und Google Cloud) | auto, noneany, tool | 313 Token 315 Token |
| Claude Opus 4 (eingestellt, außer auf Google Cloud) | auto, noneany, tool | 313 Token 315 Token |
| Claude Sonnet 5 | auto, noneany, tool | 354 Token 474 Token |
| Claude Sonnet 4.6 | auto, noneany, tool | 497 Token 589 Token |
| Claude Sonnet 4.5 | auto, noneany, tool | 496 Token 588 Token |
| Claude Sonnet 4 (eingestellt, außer auf Bedrock und Google Cloud) | auto, noneany, tool | 313 Token 315 Token |
| Claude Haiku 4.5 | auto, noneany, tool | 496 Token 588 Token |
| Claude Haiku 3.5 (eingestellt, außer auf Bedrock und Google Cloud) | auto, noneany, tool | 264 Token 355 Token |
Diese Token-Anzahlen werden zu deinen normalen Input- und Output-Token addiert, um die Gesamtkosten einer Anfrage zu berechnen.
Aktuelle Preise pro Modell findest du im Abschnitt Modellpreise.
Weitere Informationen zur Implementierung von Tool-Nutzung und Best Practices findest du unter Tool-Nutzung.
Die Bash-Tool-Definition fügt deiner Anfrage die folgenden Input-Token hinzu. Dies kommt zusätzlich zum modellspezifischen System-Prompt für Tool-Nutzung hinzu, der immer dann gilt, wenn ein Tool vorhanden ist.
| Modell | Zusätzliche Input-Token |
|---|---|
| Claude Opus 5, Claude Opus 4.8 und Claude Opus 4.7 | 325 Token |
| Claude Opus 4.6, Claude Sonnet 4.6 und früher | 244 Token |
Zusätzliche Token werden verbraucht durch:
Siehe Tool-Nutzungs-Preise für vollständige Preisdetails.
Code-Ausführung ist kostenlos, wenn sie mit Websuche oder Web-Fetch verwendet wird. Wenn web_search_20260209 (oder neuer) oder web_fetch_20260209 (oder neuer) in deiner API-Anfrage enthalten ist, fallen für Code-Ausführungs-Tool-Aufrufe keine zusätzlichen Kosten über die standardmäßigen Input- und Output-Token-Kosten hinaus an.
Bei Verwendung ohne diese Tools wird die Code-Ausführung nach Ausführungszeit abgerechnet, die getrennt von der Token-Nutzung erfasst wird:
Die Nutzung der Code-Ausführung wird in der Antwort erfasst:
{
"usage": {
"input_tokens": 105,
"output_tokens": 239,
"server_tool_use": {
"code_execution_requests": 1
}
}
}Das Texteditor-Tool verwendet dieselbe Preisstruktur wie andere Tools, die mit Claude verwendet werden. Es folgt der standardmäßigen Preisgestaltung für Input- und Output-Token basierend auf dem Claude-Modell, das du verwendest.
Zusätzlich zu den Basis-Token werden die folgenden zusätzlichen Input-Token für das Texteditor-Tool benötigt:
| Tool | Zusätzliche Input-Token |
|---|---|
text_editor_20250429 (Claude 4.x) | 700 Token |
Siehe Tool-Nutzungs-Preise für vollständige Preisdetails.
Die Nutzung der Websuche wird zusätzlich zur Token-Nutzung berechnet:
{
"usage": {
"input_tokens": 105,
"output_tokens": 6039,
"cache_read_input_tokens": 7123,
"cache_creation_input_tokens": 7345,
"server_tool_use": {
"web_search_requests": 1
}
}
}Die Websuche ist über die Claude API für 10 $ pro 1.000 Suchanfragen verfügbar, zuzüglich der Standard-Token-Kosten für suchgenerierte Inhalte. Websuchergebnisse, die im Verlauf einer Konversation abgerufen werden, werden als Input-Token gezählt – sowohl in Suchiterationen, die während eines einzelnen Turns ausgeführt werden, als auch in nachfolgenden Konversations-Turns.
Jede Websuche zählt als eine Nutzung, unabhängig von der Anzahl der zurückgegebenen Ergebnisse. Wenn während der Websuche ein Fehler auftritt, wird die Websuche nicht in Rechnung gestellt.
Die Nutzung von Web Fetch verursacht keine zusätzlichen Kosten über die standardmäßigen Token-Kosten hinaus:
{
"usage": {
"input_tokens": 25039,
"output_tokens": 931,
"cache_read_input_tokens": 0,
"cache_creation_input_tokens": 0,
"server_tool_use": {
"web_fetch_requests": 1
}
}
}Das Web-Fetch-Tool ist über die Claude API ohne zusätzliche Kosten verfügbar. Du zahlst nur die standardmäßigen Token-Kosten für die abgerufenen Inhalte, die Teil deines Konversationskontexts werden.
Um dich davor zu schützen, versehentlich große Inhalte abzurufen, die übermäßig viele Tokens verbrauchen würden, verwende den Parameter max_content_tokens, um angemessene Limits basierend auf deinem Anwendungsfall und deinen Budgetüberlegungen festzulegen.
Beispiel für den Token-Verbrauch bei typischen Inhalten:
Computer use folgt der standardmäßigen Preisgestaltung für Tool-Nutzung. Bei der Verwendung des Computer-use-Tools:
System-Prompt-Overhead: Die Computer-use-Beta fügt dem System-Prompt 466–499 Token hinzu
Token-Verbrauch des Computer-use-Tools:
| Modell | Input-Token pro Tool-Definition |
|---|---|
| Claude 4.x Modelle | 735 Token |
Zusätzlicher Token-Verbrauch:
Claude Managed Agents wird in zwei Dimensionen abgerechnet: Token und Session-Laufzeit.
Alle Token, die von einer Claude-Managed-Agents-Session verbraucht werden, werden zu den in Modellpreise angegebenen Tarifen abgerechnet. Prompt-Caching-Multiplikatoren gelten identisch. Websuche, die innerhalb einer Session ausgelöst wird, verursacht die Standardkosten von 10 $ pro 1.000 Suchen. Auf Claude Platform on AWS werden Session-Token- und Laufzeitgebühren zum Standardtarif in Claude Consumption Units konvertiert. Fast-Mode-Premium-Preise gelten, wenn model.speed eines Agents auf "fast" gesetzt ist.
Der Datenresidenz-Multiplikator gilt ebenfalls: Wenn model.inference_geo eines Agents auf "us" festgelegt ist, werden Token, die von Sessions mit diesem Agent verbraucht werden, zu 1,1x der Standardtarife abgerechnet – derselbe Multiplikator, der für US-only-Inferenz in der Messages API gilt.
Die folgenden Messages-API-Modifikatoren gelten nicht für Claude-Managed-Agents-Sessions:
| Modifikator | Warum er nicht gilt |
|---|---|
| Batch-API-Rabatt | Sessions sind zustandsbehaftet und interaktiv. Es gibt keinen Batch-Modus. |
| Cloud-Plattform-Preise | Nicht auf von Partnern betriebenen Cloud-Plattformen verfügbar. |
| SKU | Tarif | Messung |
|---|---|---|
| Session-Laufzeit | 0,08 $ pro Session-Stunde | Dauer des running-Status |
Die Laufzeit wird auf die Millisekunde genau gemessen und fällt nur an, während der Status der Session running ist. Zeit im Status idle (Warten auf deine nächste Nachricht oder eine Tool-Bestätigung), rescheduling oder terminated zählt nicht zur Laufzeit.
Eine einstündige Coding-Session mit Claude Opus 5, die 50.000 Input-Token und 15.000 Output-Token verbraucht:
| Posten | Berechnung | Kosten |
|---|---|---|
| Input-Token | 50.000 × 5 $ / 1.000.000 | 0,25 $ |
| Output-Token | 15.000 × 25 $ / 1.000.000 | 0,375 $ |
| Session-Laufzeit | 1,0 Stunde × 0,08 $ | 0,08 $ |
| Gesamt | 0,705 $ |
Wenn Prompt-Caching aktiv ist und 40.000 der Input-Token Cache-Reads sind:
| Posten | Berechnung | Kosten |
|---|---|---|
| Ungecachte Input-Token | 10.000 × 5 $ / 1.000.000 | 0,05 $ |
| Cache-Read-Token | 40.000 × 5 $ × 0,1 / 1.000.000 | 0,02 $ |
| Output-Token | 15.000 × 25 $ / 1.000.000 | 0,375 $ |
| Session-Laufzeit | 1,0 Stunde × 0,08 $ | 0,08 $ |
| Gesamt | 0,525 $ |
Eine detaillierte Erläuterung dieser Berechnung findest du im Leitfaden für Kundensupport-Agents.
Beim Erstellen von Agents mit Claude:
Ratenlimits variieren je nach Nutzungsstufe und beeinflussen, wie viele Anfragen du stellen kannst:
Detaillierte Informationen zu Ratenlimits findest du unter Ratenlimits.
Für Limits über die Scale-Stufe hinaus oder individuelle Preisvereinbarungen kontaktiere das Vertriebsteam.
Mengenrabatte können für Nutzer mit hohem Volumen verfügbar sein. Diese werden individuell ausgehandelt.
Für Enterprise-Kunden mit spezifischen Anforderungen:
Kontaktiere das Vertriebsteam unter [email protected] oder über die Claude Console, um Enterprise-Preisoptionen zu besprechen.
Wie wird die Token-Nutzung berechnet?
Token sind Textteile, die Modelle verarbeiten. Als grobe Schätzung entspricht 1 Token etwa 4 Zeichen oder 0,75 Wörtern im Englischen. Die genaue Anzahl variiert je nach Sprache und Inhaltstyp.
Gibt es kostenlose Stufen oder Testversionen?
Neue Nutzer erhalten eine kleine Menge kostenloser Guthaben, um die API zu testen. Kontaktiere den Vertrieb für Informationen über erweiterte Testversionen für die Enterprise-Evaluierung.
Wie kombinieren sich Rabatte?
Batch-API- und Prompt-Caching-Rabatte können kombiniert werden. Die gemeinsame Nutzung beider Funktionen bietet beispielsweise erhebliche Kosteneinsparungen im Vergleich zu Standard-API-Aufrufen. Siehe Prompt-Caching-Preise für Informationen darüber, wie die Multiplikatoren zusammenwirken.
Welche Zahlungsmethoden werden akzeptiert?
Gängige Kreditkarten werden für Standardkonten akzeptiert. Enterprise-Kunden können Rechnungsstellung und andere Zahlungsmethoden vereinbaren.
Für weitere Fragen zu Preisen kontaktiere [email protected].
Was this page helpful?