Claude Opus 5 ist eine sprunghafte Verbesserung gegenüber Claude Opus 4.8, mit den größten Fortschritten bei tiefem Reasoning, agentischen und langfristigen Aufgaben sowie beim Test-Time-Compute-Scaling. Diese Seite fasst alles Neue in Claude Opus 5 zusammen, einschließlich standardmäßig aktiviertem Thinking, Tool-Änderungen mitten in der Konversation und einer Breaking Change bezüglich der Bedingungen, unter denen Thinking deaktiviert werden kann.
| Modell | API-Modell-ID | Beschreibung |
|---|---|---|
| Claude Opus 5 | claude-opus-5 | Für komplexes agentisches Coding und Enterprise-Arbeit |
Claude Opus 5 hat ein Kontextfenster von 1 Mio. Token (1 Mio. Token ist sowohl der Standard als auch das Maximum; es gibt keine kleinere Kontextvariante), 128k maximale Output-Token und standardmäßig aktiviertes Thinking.
Vollständige Preise und Spezifikationen findest du in der Modellübersicht.
Du kannst Tools zwischen den Turns einer Konversation hinzufügen oder entfernen und dabei den Prompt-Cache beibehalten, anstatt für die gesamte Dauer einer Session eine feste Tool-Liste erneut zu senden. Tool-Änderungen mitten in der Konversation befinden sich in der Beta-Phase: Füge den Beta-Header mid-conversation-tool-changes-2026-07-01 in deine Requests ein. Siehe Tool-Änderungen mitten in der Konversation für die Verwendung.
Der fallbacks-Parameter unterstützt einen neuen "default"-Modus, der Anthropics empfohlene Fallback-Modelle nach Refusal-Kategorie anwendet, anstatt einer Modellliste, die du selbst pflegst. Der gesamte fallbacks-Parameter befindet sich in der Beta-Phase. Verwende den Beta-Header server-side-fallback-2026-07-01, der sowohl den "default"-Modus als auch explizite Modelllisten unterstützt (der frühere Header server-side-fallback-2026-06-01 akzeptiert nur explizite Listen). Siehe Refusals und Fallback.
Die minimale cachebare Prompt-Länge bei Claude Opus 5 beträgt 512 Token, gegenüber 1.024 Token bei Claude Opus 4.8. Prompts, die bei Claude Opus 4.8 zu kurz zum Cachen waren, können jetzt ohne Code-Änderungen Cache-Einträge erstellen. Siehe Prompt-Caching für die Mindestwerte pro Modell.
Fast Mode (Research Preview) ist für Claude Opus 5 nur über die Claude API verfügbar; er ist derzeit nicht auf Amazon Bedrock, Google Cloud oder Microsoft Foundry verfügbar. Fast Mode für Claude Opus 5 kostet 10 USD pro Million Input-Token und 50 USD pro Million Output-Token. Siehe Fast Mode für Zugang, unterstützte Modelle und Preise.
Bei Claude Opus 4.8 laufen Requests ohne Thinking, es sei denn, du setzt thinking: {"type": "adaptive"}. Bei Claude Opus 5 laufen dieselben Requests mit aktiviertem Thinking: Das Modell entscheidet bei jedem Turn, wann und wie viel es nachdenkt, und der Effort-Parameter steuert die Thinking-Tiefe. Der Wire-Wert bleibt unverändert; thinking: {"type": "adaptive"} bleibt gültig und entspricht dem Standard.
Da max_tokens ein hartes Limit für die gesamte Ausgabe ist (Thinking plus Antworttext), solltest du diesen Wert für Workloads überprüfen, die bei Claude Opus 4.8 ohne Thinking liefen.
Die API behält die Option, Thinking zu deaktivieren, vorbehaltlich der unten beschriebenen Effort-Einschränkung.
Claude Opus 5 wandelt zusätzlichen Effort zuverlässiger in bessere Ergebnisse um als jedes frühere Opus-Modell, daher hat das von dir gewählte Effort-Level mehr Gewicht. Die gesamte Skala ist verfügbar: low, medium, high, xhigh und max, wobei max die höchste Stufe für das tiefstmögliche Reasoning ist. Beginne mit dem Standard high und passe ihn basierend auf deinen Evals in beide Richtungen an: Gehe nach unten, wo die Qualität hält, um Token und Latenz zu sparen, oder nach oben für die anspruchsvollsten Aufgaben. Wenn du mit Effort xhigh oder max arbeitest, setze einen großen max_tokens-Wert, damit das Modell genug Raum hat, um über Subagenten und Tool-Aufrufe hinweg zu denken und zu handeln.
Dieser Request dreht den Effort ganz auf max hoch:
client = anthropic.Anthropic()
with client.messages.stream(
model="claude-opus-5",
max_tokens=64000,
output_config={"effort": "max"},
messages=[
{
"role": "user",
"content": "Explain why the sum of two even numbers is always even.",
}
],
) as stream:
response = stream.get_final_message()
print(response)Thinking ist bei Claude Opus 5 standardmäßig aktiviert, daher ist kein thinking-Feld erforderlich.
high oder niedrigerBei Claude Opus 5 wird thinking: {"type": "disabled"} nur akzeptiert, wenn das Effort-Level high oder niedriger ist. Das Setzen von thinking: {"type": "disabled"} mit Effort xhigh oder max gibt einen 400-Fehler zurück. Dies ist allgemein verfügbares Verhalten ab Claude Opus 5, das bei jedem Request durchgesetzt wird, und es ist eine Breaking Change gegenüber Claude Opus 4.8, wo das Deaktivieren von Thinking unabhängig vom Effort-Level war. Wenn du heute Thinking bei hohen Effort-Levels deaktivierst, lasse entweder Thinking deaktiviert und setze Effort auf high oder niedriger, oder behalte das Effort-Level bei und entferne das thinking-Feld.
Mit deaktiviertem Thinking kann Claude Opus 5 gelegentlich einen Tool-Aufruf in seine Textausgabe schreiben, anstatt einen tool_use-Block auszugeben, oder interne XML-Tags in seine sichtbare Antwort einfügen. Lasse Thinking nach Möglichkeit aktiviert und steuere die Token-Kosten über niedrigere Effort-Levels; für Integrationen, die Thinking deaktiviert lassen müssen, siehe Ausführung mit deaktiviertem Thinking für Prompting-Abhilfen.
Über die oben genannten API-Änderungen hinaus verhält sich Claude Opus 5 anders als Claude Opus 4.8, und zwar auf Weisen, die dir auffallen können, ohne dass du Code änderst. Standardmäßige nutzerseitige Antworten und schriftliche Arbeitsergebnisse fallen länger aus. In agentischen Sessions berichtet das Modell dem Nutzer häufiger über seinen Fortschritt. In Multi-Agent-Frameworks delegiert es bereitwilliger an Subagenten. Es verifiziert auch seine eigene Arbeit, ohne dazu aufgefordert zu werden – entferne daher Verifizierungsanweisungen, die von früheren Modellen übernommen wurden („füge einen abschließenden Verifizierungsschritt hinzu", „verwende einen Subagenten zur Verifizierung"); sie führen bei Claude Opus 5 zu übermäßiger Verifizierung. Prompting-Muster, mit denen du jedes dieser Verhaltensweisen anpassen kannst, findest du unter Prompting für Claude Opus 5.
Im Vergleich zu Claude Opus 4.8 ist Claude Opus 5 eine sprunghafte und keine inkrementelle Verbesserung und liefert Frontier-Intelligenz zum halben Preis von Claude Fable 5. Die größten Fortschritte liegen in:
max-Level) in bessere Ergebnisse umgewandelt wird.low und medium Effort starke Qualität bei einem Bruchteil der Token und Latenz höherer Einstellungen liefern.Die Prompting-Muster, mit denen du das Beste aus diesen Fähigkeiten herausholst, findest du unter Prompting für Claude Opus 5.
Claude Opus 5 kostet 5 USD pro Million Input-Token und 25 USD pro Million Output-Token, unverändert gegenüber Claude Opus 4.8.
Siehe Preise für vollständige Preisinformationen, einschließlich Batch-Verarbeitung, Prompt-Caching und Fast-Mode-Tarifen.
Claude Opus 5 ist verfügbar auf:
claude-opus-5.anthropic.claude-opus-5. Claude Opus 5 ist auch über die InvokeModel-API auf bedrock-runtime erreichbar, bereitgestellt von derselben Infrastruktur; die Claude on Amazon Bedrock (Legacy)-Integration führt es nicht in ihrer ARN-versionierten Modell-ID-Tabelle auf.claude-opus-5.Claude Opus 4.8 bleibt auf all diesen Plattformen verfügbar.
Um von Claude Opus 4.8 zu migrieren, aktualisiere deine Modell-ID:
model = "claude-opus-4-8" # Before
model = "claude-opus-5" # AfterÜberprüfe dann die beiden Verhaltensänderungen: Thinking ist standardmäßig aktiviert, und das Deaktivieren von Thinking mit Effort xhigh oder max gibt einen 400-Fehler zurück. Siehe den Migrationsleitfaden für Schritt-für-Schritt-Anweisungen.
Vollständige Spezifikationen und Preise für alle aktuellen Claude-Modelle.
Verhaltensunterschiede und Prompting-Muster speziell für Claude Opus 5.
Steuere, wie viele Token Claude beim Antworten verwendet, von low bis max.
Wie Thinking funktioniert, wenn es standardmäßig aktiviert ist, und wann es deaktiviert werden kann.
Gib Claude ein empfohlenes Token-Budget vor, an dem es seine Arbeit ausrichten kann.
Leitfaden für die Migration zu den neuesten Claude-Modellen von früheren Claude-Versionen.
Erhalte mehr Output-Token pro Sekunde von Claude Opus-Modellen zu Premium-Preisen.
Was this page helpful?