Die Compliance API liefert jetzt Transkripte von Cowork- und Claude Code-Sitzungen, die auf den Rechnern deiner Nutzer laufen, als Beta für Claude Enterprise-Organisationen. GET /v1/compliance/apps/sessions/local listet Sitzungen in deiner Organisation auf, GET /v1/compliance/apps/sessions/local/{session_id} ruft die Metadaten einer Sitzung ab und GET /v1/compliance/apps/sessions/local/{session_id}/messages liefert deren Transkript – alles mit deinem bestehenden Compliance Access Key und dem Scope read:compliance_user_data. Siehe Lokale Sitzungen abrufen.
10. August 2026
Der Einführungspreis für Claude Sonnet 5 (2 $ / 10 $ pro MTok) ist jetzt der Standardpreis: Die zuvor für den 1. September 2026 geplante Erhöhung auf 3 $ / 15 $ pro MTok findet nicht statt. Siehe Preise.
7. August 2026
Du kannst jetzt ein Budget für eine Claude Managed Agents-Sitzung festlegen: eine harte Obergrenze für die Ausgaben der Sitzung, berechnet zu öffentlichen Listenpreisen. Eine Sitzung, die ihr Budget erreicht, pausiert mit dem Stop-Reason budget_reached, anstatt neue Modellanfragen zu starten; das Ändern oder Entfernen des Budgets setzt sie fort. Deployments akzeptieren dasselbe Budget und wenden es auf jede Sitzung an, die sie starten. Siehe Sitzungsbudgets.
Du kannst einer Claude Managed Agents-Sitzung jetzt einen Advisor geben: ein Modell, das mindestens so leistungsfähig ist wie das des Agenten selbst und das der primäre Thread der Sitzung mitten im Turn für strategische Beratung konsultieren kann. Konfiguriere ihn als {"type": "advisor"}-Eintrag im Multiagent-Roster des Agenten und gib das zu konsultierende model an. Siehe Der Sitzung einen Advisor geben.
Claude Managed Agents-Sitzungen können jetzt Skills aus einem GitHub-Repository laden. Wenn eine Sitzung ein Repository einbindet, werden alle Skills im Root-Verzeichnis .claude/skills beim Sitzungsstart automatisch erkannt und stehen dem Agenten für diese Sitzung zur Verfügung.
5. August 2026
Inference Hooks sind jetzt als Beta für Claude Enterprise-Organisationen verfügbar. Verweise Claude auf den KI-Sicherheitsserver deiner Organisation, und jeder gesteuerte Prompt über claude.ai, Cowork und Claude Code wird für das Allow- oder Deny-Urteil des Servers zurückgehalten, bevor die Inferenz fortgesetzt wird. Anfragen werden signiert, die Fehlerbehandlung ist konfigurierbar, und jede Ablehnung wird im Compliance-Activity Feed protokolliert. Siehe Inference Hooks.
Wir haben das Modell Claude Opus 4.1 (claude-opus-4-1-20250805) eingestellt. Alle Anfragen an dieses Modell über die Claude API geben jetzt einen Fehler zurück. Wir empfehlen ein Upgrade auf Claude Opus 5. Forscher können über das External Researcher Access Program weiterhin Zugang beantragen.
3. August 2026
Die Compliance API liefert jetzt Transkripte von Cowork-Sitzungen, die auf claude.ai Web oder Mobile gestartet wurden, als Beta für Claude Enterprise-Organisationen. GET /v1/compliance/apps/sessions/remote listet Sitzungen auf und GET /v1/compliance/apps/sessions/remote/{session_id}/messages liefert das Transkript einer Sitzung, unter Verwendung deines bestehenden Compliance Access Key mit dem Scope read:compliance_user_data. Siehe Remote-Sitzungen abrufen.
Wir haben Claude Opus 5 (claude-opus-5) veröffentlicht, eine sprunghafte Verbesserung gegenüber Claude Opus 4.8. Claude Opus 5 unterstützt ein Kontextfenster von 1 Mio. Token (sowohl Standard als auch Maximum), 128k maximale Output-Token und standardmäßig aktiviertes Thinking, zu 5 $ / 25 $ USD pro MTok – derselbe Preis wie Claude Opus 4.8. Es ist verfügbar über die Claude API, Claude in Amazon Bedrock, Claude on Google Cloud und Claude in Microsoft Foundry. Siehe Was ist neu in Claude Opus 5 für neue Features, Verhaltensänderungen und Migrationshinweise sowie die Modellübersicht für vollständige Spezifikationen.
Bei Claude Opus 5 ist das Deaktivieren von Thinking nur bei Effort high oder niedriger erlaubt: thinking: {"type": "disabled"} mit Effort xhigh oder max gibt einen 400-Fehler zurück – eine Breaking Change gegenüber Claude Opus 4.8. Siehe Was ist neu in Claude Opus 5.
Effort ist die primäre Steuerung für Claude Opus 5: Das Modell unterstützt die vollständige Skala (low, medium, high, xhigh, max), wobei max für leistungskritische Arbeit vorgesehen ist.
Tool-Änderungen mitten in der Konversation sind jetzt als Beta für Claude Fable 5, Claude Mythos 5, Claude Opus 4.8 und Claude Opus 5 verfügbar: Füge zwischen den Turns einer Konversation Tools hinzu oder entferne sie, während der Prompt-Cache erhalten bleibt. Füge den Beta-Header mid-conversation-tool-changes-2026-07-01 in deine Anfragen ein.
Der Parameter fallbacks unterstützt jetzt einen "default"-Modus, der Anthropics empfohlene Fallback-Modelle nach Ablehnungskategorie anwendet. Serverseitiger Fallback ist in Beta, und der "default"-Modus erfordert den Beta-Header server-side-fallback-2026-07-01. Siehe Ablehnungen und Fallback.
Wir haben den Fast Mode für Claude Opus 4.7 entfernt. Anfragen an claude-opus-4-7 mit speed: "fast" geben jetzt einen Fehler zurück; anders als bei Claude Opus 4.6 fallen sie nicht auf Standardgeschwindigkeit zurück. Claude Opus 4.7 selbst bleibt mit Standardgeschwindigkeit verfügbar. Um den Fast Mode weiterhin zu nutzen, migriere zu Claude Opus 5 oder Claude Opus 4.8. Mehr dazu unter Fast Mode.
22. Juli 2026
Du kannst jetzt ein effort-Level in der Modellkonfiguration eines Claude Managed Agents-Agenten festlegen. Übergib effort innerhalb des model-Objekts, wenn du den Agenten erstellst. Siehe Effort-Level für Details zu den einzelnen Levels.
Webhooks für Claude Managed Agents decken jetzt den Lebenszyklus von Environment und Memory Store ab: vier environment.*-Event-Typen und drei memory_store.*-Event-Typen. Du kannst auf Lebenszyklusänderungen von Environment und Memory Store reagieren, ohne zu pollen. Siehe die Tabs „Environment events" und „Memory store events" unter Webhooks abonnieren.
Beim Erstellen einer Claude Managed Agents-Sitzung kannst du sie jetzt mit initialen Events vorbefüllen. Übergib initial_events bei POST /v1/sessions mit bis zu 50 user.message- und user.define_outcome-Events. Eine nicht-leere Liste startet die Agent-Loop im selben Aufruf, sodass du keine separate Send-Events-Anfrage benötigst, um die Arbeit zu starten.
Das Feld version ist jetzt optional beim Aktualisieren eines Claude Managed Agents-Agenten. Gib es für optimistische Nebenläufigkeit an (eine Nichtübereinstimmung gibt einen 409-Fehler zurück), oder lass es weg, um das Update bedingungslos anzuwenden. Siehe Update-Semantik.
Event-Streams von Claude Managed Agents-Sitzungs-Threads unterstützen jetzt Event-Deltas. GET /v1/sessions/{session_id}/threads/{thread_id}/stream akzeptiert denselben Query-Parameter event_deltas[] wie der Stream auf Sitzungsebene, sodass du den Text eines Subagenten als Vorschau sehen kannst, während das Modell ihn generiert. Eine Verbindung zeigt nur den Thread als Vorschau, den sie liest. Siehe Sitzungs-Thread-Events als Vorschau anzeigen.
17. Juli 2026
Die veraltete Workbench (platform.claude.com/workbench) in der Claude Console wird eingestellt; der Zugriff endet am 17. August 2026. Gespeicherte Prompts, Variablen und Evals werden in der aktualisierten Workbench nicht unterstützt. Du kannst alle Daten, die du behalten möchtest, über das Banner und unter deinen Organisationseinstellungen exportieren. Weitere Informationen findest du unter Wie verwende ich die Workbench? im Claude Help Center.
Die experimentellen Prompt-Tools-APIs zum Generieren, Verbessern und Templatisieren von Prompts (/v1/experimental/generate_prompt, /v1/experimental/improve_prompt und /v1/experimental/templatize_prompt) werden zusammen mit der Workbench am 17. August 2026 eingestellt. Nach der Entfernung geben Anfragen an diese Endpunkte einen Fehler zurück.
Du kannst jetzt die Personen in deiner Claude Enterprise-Organisation (claude.ai) mit der Admin API verwalten, als Beta für alle Claude Enterprise-Organisationen: Mitglieder auflisten und per E-Mail-Adresse nachschlagen, die Rolle eines Mitglieds ändern, Mitglieder entfernen, Einladungen senden und zurückziehen, Gruppen und deren Mitgliedschaft verwalten sowie benutzerdefinierte Rollen lesen. Gruppen- und Custom-Role-Anfragen erfordern den Beta-Header anthropic-beta: ce-user-management-2026-07-13; Mitglieder- und Einladungsanfragen benötigen keinen Beta-Header. Ein Admin-API-Key mit dem Scope read:org_audit kann außerdem jeden GET-Endpunkt der Benutzerverwaltung aufrufen. Siehe Benutzerverwaltung.
10. Juli 2026
Dreams (Research Preview) unterstützt jetzt Claude Fable 5 und Claude Sonnet 5. Siehe Unterstützte Modelle.
Wir haben die Access Transparency-Dokumentation zu cmek_preserve-Events um ein Filterbeispiel, ein Beispiel-Event-Payload und zwei Preservation-Reason-Codes (policy_violation_investigation, csae_report) erweitert. Die Dokumentation stellt jetzt auch klar, dass ein Preservation-Event geschrieben wird, unabhängig davon, ob die Preservation von einem menschlichen Prüfer oder einer automatisierten Safety-Pipeline initiiert wurde. Siehe CMEK-Inhaltsaufbewahrung.
8. Juli 2026
Du kannst jetzt ein Ablaufdatum festlegen, wenn du einen API-Key oder einen Admin-API-Key in der Claude Console erstellst. Wähle eine Voreinstellung, eine benutzerdefinierte Dauer oder Nie. Bei Keys mit einer Lebensdauer von mindestens 7 Tagen sendet Anthropic dem Ersteller vor Ablauf eine E-Mail. Bestehende Keys sind nicht betroffen. Die Admin API meldet das Ablaufdatum jedes Keys im Feld expires_at. Siehe Authentifizierung.
2. Juli 2026
Wir haben den Beta-Header agent-memory-2026-07-22 hinzugefügt, der das Verhalten beim Auflisten von Memories (GET /v1/memory_stores/{memory_store_id}/memories) ändert: Ergebnisse werden in einer stabilen, serverdefinierten Reihenfolge zurückgegeben und die Parameter order_by und order werden ignoriert; depth akzeptiert nur 0, 1 oder das Weglassen (andere Werte geben einen 400-Fehler zurück); und path_prefix muss mit / enden und matcht ganze Pfadsegmente statt eines Substrings. Page-Cursor, die ohne den Header ausgegeben wurden, sind mit ihm nicht gültig, starte also von der ersten Seite neu, wenn du ihn übernimmst. Bei Memory-Store-Endpunkten ersetzt agent-memory-2026-07-22 den Header managed-agents-2026-04-01; das Senden beider gibt einen 400-Fehler zurück. Am 22. Juli 2026 übernimmt der Header managed-agents-2026-04-01 dasselbe Listenverhalten. Siehe Beta-Header.
Die SDKs für Python (0.116.0), TypeScript (0.110.0), Go (1.56.0), Java (2.48.0), Ruby (1.55.0), PHP (0.36.0), C# (12.35.0) und CLI (1.16.0) senden jetzt agent-memory-2026-07-22 bei allen Memory-Store-Aufrufen statt managed-agents-2026-04-01. Wenn dein Code betas explizit bei Memory-Store-Aufrufen übergibt, ersetze dort managed-agents-2026-04-01 durch agent-memory-2026-07-22, anstatt einen zweiten Wert hinzuzufügen.
1. Juli 2026
Wir haben den Zugriff auf Claude Fable 5 und Claude Mythos 5 wiederhergestellt. Siehe unsere Stellungnahme für weitere Informationen.
30. Juni 2026
Wir haben Claude Sonnet 5 (claude-sonnet-5) veröffentlicht, die nächste Generation unserer Sonnet-Modellfamilie, zum Einführungspreis von 2 $ / 10 $ pro MTok (am 10. August 2026 zum Standardpreis gemacht). Claude Sonnet 5 unterstützt ein Kontextfenster von 1 Mio. Token, 128k maximale Output-Token und denselben Satz an Tools und Plattform-Features wie Claude Sonnet 4.6, mit Ausnahme von Priority Tier, das für Claude Sonnet 5 nicht verfügbar ist. Drei Verhaltensänderungen gelten bei der Migration: Adaptive Thinking ist jetzt standardmäßig aktiviert; manuelles erweitertes Denken (thinking: {type: "enabled", budget_tokens: N}) wurde entfernt und gibt einen 400-Fehler zurück (es war bei Sonnet 4.6 abgekündigt); und das Setzen von Sampling-Parametern (temperature, top_p, top_k) auf Nicht-Standardwerte gibt einen 400-Fehler zurück. Claude Sonnet 5 verwendet außerdem einen neuen Tokenizer, der für denselben Text etwa 30 % mehr Token erzeugt. Die genaue Zunahme hängt vom Inhalt und der Workload-Struktur ab. Siehe Was ist neu in Claude Sonnet 5 für Details und Migrationshinweise. Für Verhaltensunterschiede und modellspezifische Prompting-Muster siehe Prompting für Claude Sonnet 5.
Event-Streams von Claude Managed Agents-Sitzungen unterstützen jetzt Event-Deltas. Aktiviere sie mit dem Query-Parameter event_deltas[] bei GET /v1/sessions/{session_id}/events/stream. Die Events event_start und event_delta zeigen den Text einer Agent-Nachricht als Vorschau, während er generiert wird, bevor das vollständige agent.message-Event eintrifft.
Das Auflisten von Sitzungen für Claude Managed Agents unterstützt jetzt Rückwärts-Paginierung. GET /v1/sessions gibt neben next_page einen prev_page-Cursor zurück; übergib ihn als page-Parameter, um zur vorherigen Seite zurückzukehren. Siehe Paginierung.
Beim Erstellen einer Claude Managed Agents-Sitzung kannst du jetzt die Konfiguration des Agenten für diese Sitzung überschreiben. Übergib agent mit type: "agent_with_overrides", um das Modell, den System-Prompt, die Tools, MCP-Server oder Skills für eine einzelne Sitzung zu ersetzen. Der Agent selbst bleibt unverändert.
Claude Managed Agents-Vaults unterstützen jetzt eine injection_location-Einstellung bei Umgebungsvariablen-Credentials (Tab „Environment variable"). Sie steuert, ob der Wert des Credentials beim Egress in die ausgehenden Request-Header des Agenten, den Request-Body oder beides eingesetzt wird.
Webhooks für Claude Managed Agents decken jetzt den Lebenszyklus von Agent, Deployment und Deployment-Run ab. Du kannst auf eine neu veröffentlichte Agent-Version, ein pausiertes Deployment oder einen fehlgeschlagenen geplanten Run reagieren, ohne zu pollen. Siehe die Tabs „Agent events", „Deployment events" und „Deployment run events" unter Webhooks abonnieren.
29. Juni 2026
Wir haben den Fast Mode für Claude Opus 4.6 entfernt. Anfragen an claude-opus-4-6 mit speed: "fast" laufen nicht mehr mit Fast-Geschwindigkeit oder Premium-Preisen: Sie laufen mit Standardgeschwindigkeit, werden zu Standardtarifen abgerechnet und geben keinen Fehler zurück. Das Feld usage.speed in der Antwort meldet die verwendete Geschwindigkeit. Um den Fast Mode weiterhin zu nutzen, migriere zu Claude Opus 4.8. Mehr dazu unter Fast Mode.
26. Juni 2026
Wir haben die Ratenlimits für die gesamte Claude API erhöht. Die Ratenlimits für Claude Sonnet und Claude Haiku entsprechen jetzt denen von Claude Opus auf jeder Nutzungsstufe, und die Nutzungsstufen wurden auf drei konsolidiert: Start, Build und Scale. Die meisten Organisationen wechseln auf eine höhere Stufe, keine Organisation erhält niedrigere Limits als zuvor, und es ist keine Aktion erforderlich. Du kannst deine Stufe und aktuellen Limits in der Claude Console einsehen.
25. Juni 2026
Wir haben den Fast Mode für Claude Opus 4.7 abgekündigt, mit Entfernung am 24. Juli 2026. Nach der Entfernung geben Anfragen an claude-opus-4-7 mit speed: "fast" einen Fehler zurück. Migriere zum Fast Mode für Claude Opus 4.8. Mehr dazu unter Fast Mode.
22. Juni 2026
MCP-Tunnel (Research Preview): Die Management-API wurde von /v1/organizations/tunnels in der Admin API zu /v1/tunnels in der Claude API verschoben. Die neue Oberfläche verwendet den Header anthropic-beta: mcp-tunnels-2026-06-22 und den WIF-Scope workspace:manage_tunnels. Die vorherige Oberfläche bleibt während eines Migrationsfensters verfügbar. Siehe die Tunnels-API-Referenz.
18. Juni 2026
Die SDKs für Python, TypeScript, Go, Java, Ruby, PHP und C# enthalten jetzt Unterstützung für code_execution_20260120, die Version des Code-Execution-Tools, die REPL-State-Persistenz hinzufügt und die Mindestversion für programmatisches Tool-Calling ist. Um sie zu übernehmen, setze den type des Tools auf code_execution_20260120; es ist kein Beta-Header erforderlich. Sie ist verfügbar für Claude Fable 5, Claude Mythos 5, Claude Opus 4.5 und neuer sowie Claude Sonnet 4.5 und neuer; siehe die Modellkompatibilitätstabelle.
15. Juni 2026
Wir haben das Modell Claude Sonnet 4 (claude-sonnet-4-20250514) und das Modell Claude Opus 4 (claude-opus-4-20250514) eingestellt. Alle Anfragen an diese Modelle über die Claude API geben jetzt einen Fehler zurück. Wir empfehlen ein Upgrade auf Claude Sonnet 4.6 bzw. Claude Opus 4.8. Forscher können über das External Researcher Access Program weiterhin Zugang beantragen.
11. Juni 2026
Das Code-Execution-Tool unterstützt jetzt code_execution_20260521, das das 90-Sekunden-Ausführungszeitlimit pro Zelle in der Tool-Beschreibung offenlegt, damit Claude langlaufende Zellen einplanen kann. Es ist kein Beta-Header erforderlich.
Das Web-Search-Tool und das Web-Fetch-Tool unterstützen jetzt web_search_20260318 und web_fetch_20260318, die einen response_inclusion-Parameter hinzufügen, um verbrauchte Ergebnisblöcke aus der API-Antwort für agentische Workflows zu entfernen. Es ist kein Beta-Header erforderlich.
Wir haben Claude Fable 5 (claude-fable-5) veröffentlicht, unser leistungsfähigstes allgemein verfügbares Modell, zusammen mit Claude Mythos 5 (claude-mythos-5) für Project Glasswing-Teilnehmer. Beide Modelle unterstützen standardmäßig ein Kontextfenster von 1 Mio. Token, 128k maximale Output-Token und immer aktives Adaptive Thinking. Siehe Vorstellung von Claude Fable 5 und Claude Mythos 5 für Fähigkeiten, API-Änderungen und Verfügbarkeit.
Claude Fable 5 und Claude Mythos 5 verwenden den mit Claude Opus 4.7 eingeführten Tokenizer. Im Vergleich zu Modellen vor Claude Opus 4.7 erzeugt derselbe Text etwa 30 % mehr Token. Die genaue Zunahme hängt vom Inhalt und der Workload-Struktur ab. Verwende die Token-Counting-API mit model: "claude-fable-5", um deine Prompts unter dem neuen Tokenizer zu messen.
Claude Fable 5 führt Safety-Classifier auf Anfragen und während der Antwortgenerierung aus. Wenn ein Classifier eine Anfrage ablehnt, gibt die Messages API stop_reason: "refusal" zurück. Dir wird keine Anfrage in Rechnung gestellt, die abgelehnt wird, bevor eine Ausgabe generiert wurde. Ein optionaler fallbacks-Parameter (in Beta auf der Claude API und Claude Platform on AWS; nicht unterstützt auf der Message Batches API) führt abgelehnte Anfragen auf einem anderen Modell erneut aus, abgerechnet zu den Tarifen des Fallback-Modells. Siehe Umgang mit Stop-Reasons.
Das Feld stop_details.category bei Ablehnungsantworten enthält jetzt "reasoning_extraction" bei Claude Fable 5, zurückgegeben, wenn eine Anfrage gemäß den Einschränkungen der Anthropic-Nutzungsbedingungen zu Reverse Engineering oder Duplizieren von Modellausgaben blockiert wird. Die bestehenden Kategorien "cyber" und "bio" bleiben unverändert. Es ist kein Beta-Header erforderlich.
Bei Claude Fable 5 und Claude Mythos 5 ist Adaptive Thinking der einzige Thinking-Modus: thinking: {"type": "disabled"} wird nicht unterstützt, und manuelle Budgets für erweitertes Denken sowie Assistant-Prefill werden nicht unterstützt (beide geben einen 400-Fehler zurück). Siehe Migration von Claude Mythos Preview zu Claude Mythos 5.
Bei Claude Fable 5 und Claude Mythos 5 ist thinking.display standardmäßig auf "omitted" gesetzt, genauso wie bei Claude Opus 4.8, Claude Opus 4.7 und Claude Mythos Preview; setze display: "summarized", um lesbare Thinking-Zusammenfassungen zu erhalten. Die rohe Gedankenkette wird nie zurückgegeben; übergib Thinking-Blöcke unverändert in Multi-Turn-Konversationen mit demselben Modell zurück. Siehe Thinking-Ausgabe bei Claude Fable 5 und Claude Mythos 5.
Claude Managed Agents unterstützt jetzt geplante Deployments, mit denen du Sitzungen nach einem Cron-Zeitplan ausführen kannst, ohne einen eigenen Scheduler zu verwalten.
Claude Managed Agents-Vaults unterstützen jetzt Umgebungsvariablen-Credentials, sodass du Secrets sicher in die Sandbox des Agenten injizieren kannst – für CLIs, SDKs und andere Dienste, die sich über Umgebungsvariablen authentifizieren.
Die session.thread_*-Webhook-Events enthalten jetzt ein session_thread_id-Feld, das den Multiagent-Thread identifiziert, der das Event ausgelöst hat.
Wir haben ein Swift-Package als Beta veröffentlicht, das Claude als serverseitiges LanguageModel in Apples Foundation Models Framework hinzufügt. Rufe Claude über dieselbe LanguageModelSession-API auf wie Apples On-Device-Modell unter iOS 27, macOS 27, visionOS 27 und watchOS 27 (Beta).
5. Juni 2026
Wir haben die Abkündigung des Modells Claude Opus 4.1 (claude-opus-4-1-20250805) angekündigt, mit Einstellung auf der Claude API geplant für den 5. August 2026. Wir empfehlen die Migration zu Claude Opus 4.8. Mehr dazu unter Modellabkündigungen.
2. Juni 2026
Das Advisor-Tool unterstützt jetzt einen max_tokens-Parameter, um die Ausgabe des Advisor-Modells pro Aufruf zu begrenzen und so Latenz und Output-Token-Kosten für Workloads zu reduzieren, die keine vollständigen Advisor-Antworten benötigen. Setze tools[].max_tokens in der Advisor-Tool-Definition; siehe Advisor-Ausgabe begrenzen.
Auf der Claude API wird dir eine Anfrage nicht mehr in Rechnung gestellt, wenn sie stop_reason: "refusal" zurückgibt, ohne dass Claude eine Ausgabe generiert hat. Siehe Streaming-Ablehnungen zum Erkennen und Behandeln von Ablehnungen.
Wir haben Claude Opus 4.8 () veröffentlicht, unser leistungsfähigstes allgemein verfügbares Modell. Claude Opus 4.8 unterstützt standardmäßig ein Kontextfenster von 1 Mio. Token auf der Claude API, Amazon Bedrock, Google Cloud und Microsoft Foundry, 128k maximale Output-Token und denselben Satz an Tools und Plattform-Features wie Claude Opus 4.7. Siehe den Migrationsleitfaden für Baseline-Einstellungen, Features und Migrationshinweise.
Wir haben System-Nachrichten mitten in der Konversation eingeführt. Bei Claude Opus 4.8 kannst du role: "system"-Nachrichten nach einem User-Turn (vorbehaltlich der Platzierungsregeln) im messages-Array senden und dabei Prompt-Cache-Treffer erhalten, wenn sich Anweisungen während einer langlaufenden Sitzung ändern. Es ist kein Beta-Header erforderlich.
Das Feld stop_details bei Ablehnungsantworten ist jetzt öffentlich dokumentiert; es gibt eine category (cyber, bio oder null) und eine menschenlesbare explanation zurück, sodass deine Anwendung verschiedene Klassen von Ablehnungen zum richtigen nächsten Schritt weiterleiten kann. Es ist kein Beta-Header erforderlich.
Bei Claude Opus 4.8 ist der Effort-Parameter standardmäßig auf high gesetzt, über alle Oberflächen hinweg, einschließlich Claude Code und der Messages API.
Bei Claude Opus 4.8 beträgt die minimale cachebare Prompt-Länge für Prompt-Caching 1.024 Token, niedriger als bei Claude Opus 4.7.
Mit aktiviertem Adaptive Thinking löst Claude Opus 4.8 Reasoning nur aus, wenn ein Turn es benötigt, wodurch verschwendete Thinking-Token im Vergleich zu Claude Opus 4.7 bei gleichem Effort-Level reduziert werden.
Claude Opus 4.8 unterstützt hochauflösende Bildeingabe (bis zu 2576 Pixel an der langen Kante), genauso wie Claude Opus 4.7.
Fast Mode für Claude Opus 4.8 ist als Research Preview nur auf der Claude API verfügbar.
Das Setzen der Sampling-Parameter temperature, top_p oder top_k auf einen Nicht-Standardwert gibt bei Claude Opus 4.8 einen 400-Fehler zurück, genauso wie bei Claude Opus 4.7. Siehe den Migrationsleitfaden für Details.
In Claude Code haben wir den Auto-Modus für langlaufende Aufgaben auf mehr Nutzer ausgeweitet. Siehe die Claude Code-Dokumentation.
In Claude Code sind Workflows als Research Preview verfügbar, mit denen du mehrstufige agentische Pläne definieren und ausführen kannst. Siehe die Claude Code-Dokumentation.
Wir haben den Fast Mode für Claude Opus 4.6 abgekündigt, mit Entfernung etwa 30 Tage nach dem Launch. Migriere zum Fast Mode für Claude Opus 4.8 oder Claude Opus 4.7. Mehr dazu unter Fast Mode.
Für Updates zu claude.ai, Cowork, Claude for Microsoft 365 und anderen Claude-Apps in diesem Release siehe die Release Notes für Claude Apps.
27. Mai 2026
Die Messages-API-Antwort enthält jetzt usage.output_tokens_details.thinking_tokens, das angibt, wie viele der abgerechneten Output-Token erweitertes Denken waren. Beim Streaming erscheint die Aufschlüsselung nur im finalen message_delta-Event. Es ist kein Beta-Header erforderlich.
19. Mai 2026
MCP-Tunnel ist jetzt als Research Preview verfügbar, sodass du dich mit MCP-Servern in deinem privaten Netzwerk verbinden kannst.
Selbst gehostete Sandboxes sind jetzt für Claude Managed Agents verfügbar, als Alternative zur Ausführung von Tool-Execution in Anthropics Infrastruktur. Siehe Selbst gehostete Sandboxes.
Mit Claude Managed Agents kannst du jetzt die MCP-Server- und Tool-Konfigurationen des Agenten aktualisieren, die mit einer aktiven Sitzung verknüpft sind.
Mit Claude Managed Agents werden große Ausgaben von agent_toolset- und MCP-Tools, die 100K Zeichen (etwa 25K Token) überschreiten, jetzt automatisch in eine Datei in der Sandbox ausgelagert. Das Modell erhält eine gekürzte Vorschau mit dem Dateipfad und kann den vollständigen Inhalt von dort lesen.
18. Mai 2026
Das Web-Search-Tool liefert jetzt umfangreichere SEC-Filing-Daten, wodurch es einfacher wird, Finanzrecherche-Agenten, Earnings-Analysen und Due-Diligence-Workflows mit Zitaten auf Primärquellen zu stützen.
13. Mai 2026
Wir haben Cache-Diagnostik als Public Beta eingeführt. Übergib diagnostics.previous_message_id bei einer Messages-Anfrage, und die API meldet einen cache_miss_reason, der erklärt, wo das Prompt-Cache-Präfix vom vorherigen Turn abgewichen ist. Füge den Beta-Header cache-diagnosis-2026-04-07 in deine Anfragen ein.
12. Mai 2026
Fast Mode (Forschungsvorschau) unterstützt jetzt Claude Opus 4.7. Setze speed: "fast" mit model: "claude-opus-4-7" und dem Beta-Header fast-mode-2026-02-01 für eine deutlich schnellere Generierung von Output-Token zu Premium-Preisen. Preise, Ratenlimits und Zugang sind dieselben wie für den Fast Mode von Opus 4.6; interessierte Kunden sollten sich in die Warteliste eintragen.
11. Mai 2026
Wir haben Claude Platform on AWS eingeführt, wodurch die Claude API auf von Anthropic verwalteter Infrastruktur bereitgestellt wird, die über AWS zugänglich ist – mit AWS-Abrechnung und IAM-Authentifizierung. Greife über native AWS-Endpunkte auf die vollständige Messages API, Files API, Message Batches API, Claude Managed Agents, Agent Skills, Code-Ausführung und Tool-Nutzung zu. Erfahre mehr unter Claude Platform on AWS.
6. Mai 2026
Multiagent-Orchestrierung und Outcomes sind jetzt in der öffentlichen Beta unter dem Standard-Beta-Header managed-agents-2026-04-01 verfügbar.
Die Hintergrundaktualisierung von Vault-Anmeldedaten für Claude Managed Agents wird jetzt für mcp_oauth-Anmeldedaten unterstützt. Siehe Mit Vaults authentifizieren.
Webhooks für Claude Managed Agents werden jetzt unterstützt. Webhook-Ereignistypen umfassen Session- und Vault-Lebenszyklusereignisse. Siehe Webhooks abonnieren.
Zusätzliche Filter- und Sortieroptionen werden jetzt für Claude Managed Agents unterstützt. Sessions können nach Status gefiltert werden, und Ereignisse können nach Typ gefiltert werden. Ereignisse können jetzt nach Erstellungszeit gefiltert werden.
Dreams für Claude Managed Agents sind jetzt als Forschungsvorschau verfügbar. Ein Dream liest einen bestehenden Memory-Store zusammen mit vergangenen Session-Transkripten und erzeugt einen neu organisierten Output-Memory-Store, in dem Duplikate zusammengeführt, veraltete Einträge ersetzt und neue Erkenntnisse hervorgehoben werden. Dream-Endpunkte sind durch den Beta-Header dreaming-2026-04-21 geschützt. Zugang anfordern, um es auszuprobieren.
4. Mai 2026
Workload Identity Federation ist jetzt allgemein verfügbar. Authentifiziere Workloads bei der Claude API mit kurzlebigen OIDC-Token von deinem eigenen Identity Provider (AWS IAM, Google Cloud, GitHub Actions, Kubernetes, Microsoft Entra ID, Okta, SPIFFE und mehr) anstelle von langlebigen statischen API-Keys. Konfiguriere Issuer und Federation-Regeln in der Claude Console, und das SDK übernimmt den Token-Austausch und die Aktualisierung automatisch. Siehe Authentifizierung.
30. April 2026
Wir haben die Beta für das 1M-Token-Kontextfenster (context-1m-2025-08-07) für Claude Sonnet 4.5 und Claude Sonnet 4 eingestellt. Der Beta-Header hat jetzt keine Auswirkung mehr auf diese Modelle, und Anfragen, die das Standard-Kontextfenster von 200k Token überschreiten, geben einen Fehler zurück. Um das 1M-Kontextfenster zu nutzen, migriere zu Claude Sonnet 4.6 oder Claude Opus 4.6, wo es allgemein verfügbar ist – zu Standardpreisen und ohne erforderlichen Beta-Header.
29. April 2026
Wir haben den Claude API Skill veröffentlicht, einen Open-Source-Agent Skill, der Claude aktuelles Referenzmaterial für die Entwicklung mit der Messages API und Claude Managed Agents in 8 Sprachen bereitstellt. Der Skill ist in Claude Code enthalten und im Anthropic-Skills-Repository verfügbar.
24. April 2026
Wir haben die Rate Limits API veröffentlicht, mit der Administratoren die für ihre Organisation und Workspaces konfigurierten Ratenlimits programmatisch abfragen können.
23. April 2026
Memory für Claude Managed Agents ist jetzt in der öffentlichen Beta unter dem Standard-Header managed-agents-2026-04-01 verfügbar. Siehe Agent-Memory verwenden für den vollständigen Integrationsleitfaden.
20. April 2026
Wir haben das Modell Claude Haiku 3 (claude-3-haiku-20240307) eingestellt. Alle Anfragen an dieses Modell geben jetzt einen Fehler zurück. Wir empfehlen ein Upgrade auf Claude Haiku 4.5.
16. April 2026
Wir haben Claude Opus 4.7 eingeführt, unser leistungsfähigstes allgemein verfügbares Modell für komplexes Reasoning und agentisches Coding, zum gleichen Preis von 5 $ / 25 $ pro MTok wie Opus 4.6. Siehe Neuerungen in Claude Opus 4.7 für Verbesserungen der Fähigkeiten, neue Funktionen und den aktualisierten Tokenizer. Opus 4.7 enthält API-Breaking-Changes gegenüber Opus 4.6; siehe den Migrationsleitfaden vor dem Upgrade.
Claude in Amazon Bedrock ist jetzt für alle Amazon Bedrock-Kunden verfügbar. Claude Opus 4.7 und Claude Haiku 4.5 sind per Self-Service über die Bedrock-Konsole über den Messages-API-Endpunkt unter /anthropic/v1/messages verfügbar, in 27 AWS-Regionen mit globalen und regionalen Endpunkten.
Wir haben Task Budgets in der Beta für Claude Opus 4.7 eingeführt. Gib Claude ein empfohlenes Token-Budget für eine vollständige agentische Schleife (Denken, Tool-Aufrufe, Tool-Ergebnisse und Output), und das Modell sieht einen laufenden Countdown, den es nutzt, um Arbeit zu priorisieren und elegant abzuschließen, während das Budget verbraucht wird. Füge den Beta-Header task-budgets-2026-03-13 in deine Anfragen ein.
Claude Opus 4.7 unterstützt hochauflösende Bildeingabe, wodurch die maximale Bildauflösung von 1568 auf 2576 Pixel an der langen Kante erhöht wird – für verbesserte Leistung bei Computer Use, Screenshot-Verständnis und Dokumentenanalyse. Die Unterstützung für hohe Auflösung erfolgt automatisch und erfordert keinen Beta-Header; Bilder können bis zu etwa 3x mehr Bild-Token verbrauchen als bei früheren Modellen.
Wir haben die Effort-Stufe xhigh für Claude Opus 4.7 hinzugefügt. xhigh liegt zwischen high und max und ist auf lang laufende agentische und Coding-Aufgaben (über 30 Minuten) mit Token-Budgets im Millionenbereich abgestimmt. Es ist kein Beta-Header erforderlich.
14. April 2026
Wir haben die Abkündigung des Modells Claude Sonnet 4 (claude-sonnet-4-20250514) und des Modells Claude Opus 4 (claude-opus-4-20250514) angekündigt, mit geplanter Einstellung auf der Claude API am 15. Juni 2026. Wir empfehlen die Migration zu Claude Sonnet 4.6 bzw. Claude Opus 4.8. Mehr dazu unter Modell-Abkündigungen.
9. April 2026
Wir haben das Advisor-Tool in der öffentlichen Beta eingeführt. Kombiniere ein schnelleres Executor-Modell mit einem intelligenteren Advisor-Modell, das während der Generierung strategische Anleitung gibt, sodass agentische Workloads mit langem Horizont nahezu die Qualität des Advisor-Modells allein erreichen, während der Großteil der Token-Generierung zu Executor-Modell-Preisen erfolgt. Füge den Beta-Header advisor-tool-2026-03-01 in deine Anfragen ein.
8. April 2026
Wir haben Claude Managed Agents in der öffentlichen Beta eingeführt, ein vollständig verwaltetes Agent-Harness zum Ausführen von Claude als autonomen Agenten mit sicherem Sandboxing, integrierten Tools und Server-Sent-Event-Streaming. Erstelle Agenten, konfiguriere Container und führe Sessions über die API aus. Alle Endpunkte erfordern den Beta-Header managed-agents-2026-04-01. Erfahre mehr in der Übersicht zu Claude Managed Agents.
Wir haben die ant-CLI eingeführt, einen Kommandozeilen-Client für die Claude API, der eine schnellere Interaktion mit der Claude API, native Integration mit Claude Code und Versionierung von API-Ressourcen in YAML-Dateien ermöglicht. Erfahre mehr im CLI-Schnellstart.
7. April 2026
Wir haben angekündigt, dass Claude Mythos Preview als geschlossene Forschungsvorschau für defensive Cybersecurity-Arbeit im Rahmen von Project Glasswing verfügbar ist. Der Zugang erfolgt nur auf Einladung.
Die Messages API ist jetzt als Forschungsvorschau auf Amazon Bedrock verfügbar. Der neue Claude-in-Amazon-Bedrock-Endpunkt unter /anthropic/v1/messages verwendet dieselbe Request-Struktur wie die First-Party-Claude-API und läuft auf AWS-verwalteter Infrastruktur ohne Operator-Zugriff. Verfügbar in us-east-1; kontaktiere deinen Anthropic-Account-Executive, um Zugang anzufordern. Erfahre mehr unter Claude in Amazon Bedrock.
30. März 2026
Wir haben die max_tokens-Obergrenze auf 300k für die Message Batches API für Claude Opus 4.6 und Sonnet 4.6 angehoben. Füge den Beta-Header output-300k-2026-03-24 ein, um längere Single-Turn-Outputs für Langform-Inhalte, strukturierte Daten und große Code-Generierungsaufgaben zu erzeugen.
Wir stellen die Beta für das 1M-Token-Kontextfenster für Claude Sonnet 4.5 und Claude Sonnet 4 am 30. April 2026 ein. Nach diesem Datum hat der Beta-Header context-1m-2025-08-07 keine Auswirkung mehr auf diese Modelle, und Anfragen, die das Standard-Kontextfenster von 200k Token überschreiten, geben einen Fehler zurück. Um weiterhin 1M-Kontextfenster zu nutzen, migriere zu Claude Sonnet 4.6 oder Claude Opus 4.6, die das vollständige 1M-Token-Kontextfenster zu Standardpreisen ohne erforderlichen Beta-Header unterstützen.
18. März 2026
Wir haben Modellfähigkeitsfelder zur Models API hinzugefügt. GET /v1/models und GET /v1/models/{model_id} geben jetzt max_input_tokens, max_tokens und ein capabilities-Objekt zurück. Frage die API ab, um herauszufinden, was jedes Modell unterstützt.
16. März 2026
Wir haben das display-Feld für erweitertes Denken eingeführt, mit dem du Denkinhalte aus Antworten weglassen kannst, um schnelleres Streaming zu erhalten. Setze thinking.display: "omitted", um Thinking-Blöcke mit einem leeren thinking-Feld und der erhaltenen signature für Multi-Turn-Kontinuität zu empfangen. Die Abrechnung bleibt unverändert. Erfahre mehr unter Anzeige des Denkens steuern.
13. März 2026
Das 1M-Token-Kontextfenster ist jetzt allgemein verfügbar für Claude Opus 4.6 und Sonnet 4.6 zu Standardpreisen. Anfragen über 200k Token funktionieren für diese Modelle automatisch ohne erforderlichen Beta-Header. Das 1M-Token-Kontextfenster bleibt für Claude Sonnet 4.5 und Sonnet 4 in der Beta.
Wir haben die dedizierten 1M-Ratenlimits für alle unterstützten Modelle entfernt. Deine Standard-Account-Limits gelten jetzt für jede Kontextlänge.
Wir haben das Medienlimit von 100 auf 600 Bilder oder PDF-Seiten pro Anfrage erhöht, wenn das 1M-Token-Kontextfenster verwendet wird.
19. Februar 2026
Wir haben automatisches Caching für die Messages API eingeführt. Füge ein einzelnes cache_control-Feld zu deinem Request-Body hinzu, und das System cacht automatisch den letzten cachebaren Block und verschiebt den Cache-Punkt nach vorne, während Konversationen wachsen. Keine manuelle Breakpoint-Verwaltung erforderlich. Funktioniert zusammen mit der bestehenden Cache-Steuerung auf Block-Ebene für feingranulare Optimierung. Verfügbar auf der Claude API und Microsoft Foundry (Vorschau). Erfahre mehr unter Prompt-Caching.
Wir haben das Modell Claude Sonnet 3.7 (claude-3-7-sonnet-20250219) und das Modell Claude Haiku 3.5 (claude-3-5-haiku-20241022) eingestellt. Alle Anfragen an Claude Sonnet 3.7 geben jetzt einen Fehler zurück. Anfragen an Claude Haiku 3.5 auf der Claude API geben jetzt einen Fehler zurück; es bleibt auf Amazon Bedrock und Google Cloud verfügbar. Wir empfehlen ein Upgrade auf Claude Sonnet 4.6 bzw. Claude Haiku 4.5. Forscher können über das External Researcher Access Program fortlaufenden Zugang beantragen.
Wir haben die Abkündigung des Modells Claude Haiku 3 (claude-3-haiku-20240307) angekündigt, mit geplanter Einstellung am 20. April 2026. Wir empfehlen die Migration zu Claude Haiku 4.5. Mehr dazu unter Modell-Abkündigungen.
17. Februar 2026
Wir haben Claude Sonnet 4.6 eingeführt, unser neuestes ausgewogenes Modell, das Geschwindigkeit und Intelligenz für alltägliche Aufgaben kombiniert. Sonnet 4.6 bietet verbesserte agentische Suchleistung bei geringerem Token-Verbrauch. Sonnet 4.6 unterstützt erweitertes Denken und ein 1M-Token-Kontextfenster (Beta). Siehe Modelle & Preise für Details.
API-Code-Ausführung ist jetzt kostenlos bei Verwendung mit Web Search oder Web Fetch. Sandboxed Code-Ausführung verbessert die Modellfähigkeiten und Token-Effizienz. Siehe die Preisdetails für die eigenständige Nutzung.
Das Web-Search-Tool und programmatisches Tool-Calling sind jetzt allgemein verfügbar (kein Beta-Header erforderlich). Web Search und Web Fetch unterstützen jetzt dynamisches Filtern, das Code-Ausführung verwendet, um Ergebnisse zu filtern, bevor sie das Kontextfenster erreichen – für bessere Leistung und reduzierte Token-Kosten.
Wir haben Fast Mode als Forschungsvorschau für Opus 4.6 eingeführt, der über den speed-Parameter eine deutlich schnellere Generierung von Output-Token bietet. Fast Mode ist bis zu 2,5x so schnell zu Premium-Preisen. Interessierte Kunden sollten sich in die Warteliste eintragen.
5. Februar 2026
Wir haben Claude Opus 4.6 eingeführt, unser intelligentestes Modell für komplexe agentische Aufgaben und Arbeit mit langem Horizont. Opus 4.6 empfiehlt adaptives Denken (thinking: {type: "adaptive"}); manuelles Denken (type: "enabled" mit budget_tokens) ist abgekündigt. Opus 4.6 unterstützt kein Prefilling von Assistant-Nachrichten. Erfahre mehr unter Neuerungen in Claude 4.6.
Der Effort-Parameter ist jetzt allgemein verfügbar (kein Beta-Header erforderlich) und unterstützt Claude Opus 4.6. Effort ersetzt budget_tokens zur Steuerung der Denktiefe bei neuen Modellen.
Wir haben die Compaction API in der Beta eingeführt, die serverseitige Kontextzusammenfassung für effektiv unbegrenzte Konversationen bietet. Verfügbar auf Opus 4.6.
Wir haben Data-Residency-Kontrollen eingeführt, mit denen du über den inference_geo-Parameter festlegen kannst, wo die Modellinferenz ausgeführt wird. Inferenz nur in den USA ist zum 1,1-fachen Preis für Modelle verfügbar, die nach dem 1. Februar 2026 veröffentlicht wurden.
Das 1M-Token-Kontextfenster ist jetzt in der Beta für Claude Opus 4.6 verfügbar, zusätzlich zu Sonnet 4.5 und Sonnet 4. Long-Context-Preise gelten für Anfragen, die 200k Input-Token überschreiten.
Feingranulares Tool-Streaming ist jetzt allgemein verfügbar auf allen Modellen und Plattformen (kein Beta-Header erforderlich).
29. Januar 2026
Strukturierte Outputs sind jetzt allgemein verfügbar auf der Claude API für Claude Sonnet 4.5, Claude Opus 4.5 und Claude Haiku 4.5. Die GA umfasst erweiterte Schema-Unterstützung, verbesserte Latenz bei der Grammatik-Kompilierung und einen vereinfachten Integrationspfad ohne erforderlichen Beta-Header. Der output_format-Parameter wurde nach output_config.format verschoben. Bestehende Beta-Nutzer können den Beta-Header während der Übergangsphase weiterhin verwenden. Strukturierte Outputs bleiben auf Amazon Bedrock und Microsoft Foundry in der öffentlichen Beta.
12. Januar 2026
console.anthropic.com leitet jetzt zu platform.claude.com weiter. Die Claude Console ist im Rahmen unserer Claude-Markenkonsolidierung an ihren neuen Standort umgezogen. Bestehende Lesezeichen und Links funktionieren weiterhin über eine automatische Weiterleitung. Weitere Details findest du in der Ankündigung vom 16. September 2025.
5. Januar 2026
Wir haben das Modell Claude Opus 3 (claude-3-opus-20240229) eingestellt. Alle Anfragen an dieses Modell geben jetzt einen Fehler zurück. Wir empfehlen ein Upgrade auf Claude Opus 4.5, das deutlich verbesserte Intelligenz zu einem Drittel der Kosten bietet. Forscher können über das External Researcher Access Program fortlaufenden Zugang zu Claude Opus 3 auf der API beantragen.
19. Dezember 2025
Wir haben die Abkündigung des Modells Claude Haiku 3.5 angekündigt. Mehr dazu unter Modell-Abkündigungen.
Wir haben Claude Opus 4.5 eingeführt, unser intelligentestes Modell, das maximale Leistungsfähigkeit mit praktischer Performance kombiniert. Ideal für komplexe spezialisierte Aufgaben, professionelles Software-Engineering und fortgeschrittene Agenten. Bietet sprunghafte Verbesserungen bei Vision, Coding und Computer Use zu einem zugänglicheren Preispunkt als frühere Opus-Modelle. Erfahre mehr in der Modellübersicht.
Wir haben programmatisches Tool-Calling in der öffentlichen Beta eingeführt, wodurch Claude Tools innerhalb der Code-Ausführung aufrufen kann, um Latenz und Token-Verbrauch in Multi-Tool-Workflows zu reduzieren.
Wir haben das Tool-Search-Tool in der öffentlichen Beta eingeführt, mit dem Claude Tools aus großen Tool-Katalogen dynamisch entdecken und bei Bedarf laden kann.
Wir haben den Effort-Parameter in der öffentlichen Beta für Claude Opus 4.5 eingeführt, mit dem du den Token-Verbrauch steuern kannst, indem du zwischen Gründlichkeit und Effizienz der Antworten abwägst.
Wir haben clientseitige Compaction zu unseren Python- und TypeScript-SDKs hinzugefügt, die den Konversationskontext automatisch durch Zusammenfassung verwaltet, wenn tool_runner verwendet wird.
21. November 2025
Search-Result-Content-Blöcke sind jetzt allgemein verfügbar auf Amazon Bedrock. Erfahre mehr unter Suchergebnisse.
19. November 2025
Wir haben eine neue Dokumentationsplattform unter platform.claude.com/docs eingeführt. Unsere Dokumentation befindet sich jetzt direkt neben der Claude Console und bietet eine einheitliche Entwicklererfahrung. Die bisherige Docs-Seite unter docs.claude.com leitet zum neuen Standort weiter.
18. November 2025
Wir haben Claude in Microsoft Foundry eingeführt, wodurch Claude-Modelle für Azure-Kunden mit Azure-Abrechnung und OAuth-Authentifizierung verfügbar werden. Greife auf die vollständige Messages API zu, einschließlich erweitertem Denken, Prompt-Caching (5 Minuten und 1 Stunde), PDF-Unterstützung, Files API, Agent Skills und Tool-Nutzung. Erfahre mehr unter Claude in Microsoft Foundry.
14. November 2025
Wir haben strukturierte Outputs in der öffentlichen Beta eingeführt, die garantierte Schema-Konformität für Claudes Antworten bieten. Verwende JSON-Outputs für strukturierte Datenantworten oder strikte Tool-Nutzung für validierte Tool-Inputs. Verfügbar für Claude Sonnet 4.5 und Claude Opus 4.1. Zum Aktivieren verwende den Beta-Header structured-outputs-2025-11-13.
28. Oktober 2025
Wir haben die Abkündigung des Modells Claude Sonnet 3.7 angekündigt. Mehr dazu unter Modell-Abkündigungen.
Wir haben die Claude Sonnet 3.5-Modelle eingestellt. Alle Anfragen an diese Modelle geben jetzt einen Fehler zurück.
Wir haben Context Editing um das Löschen von Thinking-Blöcken (clear_thinking_20251015) erweitert, wodurch die automatische Verwaltung von Thinking-Blöcken ermöglicht wird. Erfahre mehr unter Context Editing.
16. Oktober 2025
Wir haben Agent Skills (Beta skills-2025-10-02) eingeführt, eine neue Möglichkeit, Claudes Fähigkeiten zu erweitern. Skills sind organisierte Ordner mit Anweisungen, Skripten und Ressourcen, die Claude dynamisch lädt, um spezialisierte Aufgaben auszuführen. Die erste Version umfasst:
Von Anthropic verwaltete Skills: Vorgefertigte Skills für die Arbeit mit PowerPoint- (.pptx), Excel- (.xlsx), Word- (.docx) und PDF-Dateien
Benutzerdefinierte Skills: Lade deine eigenen Skills über die Skills API (/v1/skills-Endpunkte) hoch, um Domänenexpertise und organisatorische Workflows zu bündeln
Wir haben Claude Haiku 4.5 eingeführt, unser schnellstes und intelligentestes Haiku-Modell mit nahezu Frontier-Leistung. Ideal für Echtzeitanwendungen, Verarbeitung großer Volumen und kostensensible Deployments, die starkes Reasoning erfordern. Erfahre mehr in der Modellübersicht.
29. September 2025
Wir haben Claude Sonnet 4.5 eingeführt, unser bestes Modell für komplexe Agenten und Coding, mit der höchsten Intelligenz über die meisten Aufgaben hinweg. Erfahre mehr in der Modellübersicht.
Wir haben Global-Endpoint-Preise für Amazon Bedrock und Vertex AI eingeführt. Die Preise der Claude API (1P) sind davon nicht betroffen.
Wir haben einen neuen Stop-Reason model_context_window_exceeded eingeführt, mit dem du die maximal möglichen Token anfordern kannst, ohne die Input-Größe zu berechnen. Erfahre mehr unter Umgang mit Stop-Reasons.
Wir haben das Memory-Tool in der Beta eingeführt, mit dem Claude Informationen über Konversationen hinweg speichern und abrufen kann. Erfahre mehr unter Memory-Tool.
Wir haben Context Editing in der Beta eingeführt, das Strategien zur automatischen Verwaltung des Konversationskontexts bietet. Die erste Version unterstützt das Löschen älterer Tool-Ergebnisse und -Aufrufe bei Annäherung an Token-Limits. Erfahre mehr unter Context Editing.
17. September 2025
Wir haben Tool-Helper in der Beta für die Python- und TypeScript-SDKs eingeführt, die die Tool-Erstellung und -Ausführung mit typsicherer Input-Validierung und einem Tool-Runner für automatisierte Tool-Verarbeitung in Konversationen vereinfachen. Details findest du in der Dokumentation für das Python-SDK und das TypeScript-SDK.
16. September 2025
Wir haben unsere Entwicklerangebote unter der Marke Claude vereinheitlicht. Du solltest aktualisierte Namen und URLs auf unserer Plattform und in unserer Dokumentation sehen, aber unsere Entwicklerschnittstellen bleiben unverändert. Hier sind einige bemerkenswerte Änderungen:
API-Endpunkte, Header, Umgebungsvariablen und SDKs bleiben unverändert. Deine bestehenden Integrationen funktionieren weiterhin ohne Änderungen.
10. September 2025
Wir haben das Web-Fetch-Tool in der Beta eingeführt, mit dem Claude vollständige Inhalte von angegebenen Webseiten und PDF-Dokumenten abrufen kann. Erfahre mehr unter Web-Fetch-Tool.
Wir haben die Claude Code Analytics API eingeführt, mit der Organisationen programmatisch auf täglich aggregierte Nutzungsmetriken für Claude Code zugreifen können, einschließlich Produktivitätsmetriken, Tool-Nutzungsstatistiken und Kostendaten.
8. September 2025
Wir haben eine Beta-Version des C#-SDK veröffentlicht.
5. September 2025
Wir haben Ratenlimit-Diagramme auf der Usage-Seite der Konsole eingeführt, mit denen du deine API-Ratenlimit-Nutzung und Caching-Raten im Zeitverlauf überwachen kannst.
3. September 2025
Wir haben Unterstützung für zitierbare Dokumente in clientseitigen Tool-Ergebnissen eingeführt. Erfahre mehr unter Tool-Aufrufe verarbeiten.
2. September 2025
Wir haben v2 des Code-Execution-Tools in der öffentlichen Beta eingeführt, das das ursprüngliche reine Python-Tool durch Bash-Befehlsausführung und direkte Dateimanipulationsfähigkeiten ersetzt, einschließlich des Schreibens von Code in anderen Sprachen.
27. August 2025
Wir haben eine Beta-Version des PHP-SDK veröffentlicht.
26. August 2025
Wir haben die Ratenlimits für das 1M-Token-Kontextfenster für Claude Sonnet 4 auf der Claude API erhöht.
Das 1M-Token-Kontextfenster ist jetzt auf Vertex AI verfügbar. Weitere Informationen findest du unter Claude auf Vertex AI.
19. August 2025
Request-IDs sind jetzt direkt in Fehlerantwort-Bodies enthalten, zusätzlich zum bestehenden request-id-Header. Erfahre mehr unter Fehler.
18. August 2025
Wir haben die Usage & Cost API veröffentlicht, mit der Administratoren die Nutzungs- und Kostendaten ihrer Organisation programmatisch überwachen können.
Wir haben einen neuen Endpunkt zur Admin API zum Abrufen von Organisationsinformationen hinzugefügt. Details findest du in der Organization Info Admin API-Referenz.
13. August 2025
Wir haben die Abkündigung der Claude Sonnet 3.5-Modelle (claude-3-5-sonnet-20240620 und claude-3-5-sonnet-20241022) angekündigt. Diese Modelle werden am 28. Oktober 2025 eingestellt. Wir empfehlen die Migration zu Claude Sonnet 4.5 (claude-sonnet-4-5-20250929) für verbesserte Leistung und Fähigkeiten. Mehr dazu unter Modell-Abkündigungen.
Die 1-Stunden-Cache-Dauer für Prompt-Caching ist jetzt allgemein verfügbar. Du kannst jetzt die erweiterte Cache-TTL ohne Beta-Header verwenden. Erfahre mehr unter Prompt-Caching.
12. August 2025
Wir haben Beta-Unterstützung für ein 1M-Token-Kontextfenster in Claude Sonnet 4 auf der Claude API und Amazon Bedrock eingeführt.
11. August 2025
Einige Kunden könnten nach einem starken Anstieg der API-Nutzung aufgrund von Beschleunigungslimits auf der API auf 429-Fehler (rate_limit_error) stoßen. Zuvor traten in ähnlichen Szenarien 529-Fehler (overloaded_error) auf.
8. August 2025
Search-Result-Content-Blöcke sind jetzt allgemein verfügbar auf der Claude API und Vertex AI. Diese Funktion ermöglicht natürliche Zitate für RAG-Anwendungen mit korrekter Quellenangabe. Der Beta-Header search-results-2025-06-09 ist nicht mehr erforderlich. Erfahre mehr unter Suchergebnisse.
5. August 2025
Wir haben Claude Opus 4.1 eingeführt, ein inkrementelles Update von Claude Opus 4 mit erweiterten Fähigkeiten und Leistungsverbesserungen.* Erfahre mehr in der Modellübersicht.
*Opus 4.1 erlaubt nicht, dass sowohl der temperature- als auch der top_p-Parameter angegeben werden. Bitte verwende nur einen davon.
28. Juli 2025
Wir haben text_editor_20250728 veröffentlicht, ein aktualisiertes Text-Editor-Tool, das einige Probleme der vorherigen Versionen behebt und einen optionalen max_characters-Parameter hinzufügt, mit dem du die Kürzungslänge beim Anzeigen großer Dateien steuern kannst.
24. Juli 2025
Wir haben die Ratenlimits für Claude Opus 4 auf der Claude API erhöht, um dir mehr Kapazität zum Entwickeln und Skalieren mit Claude zu geben. Für Kunden mit Ratenlimits der Nutzungsstufen 1–4 gelten diese Änderungen sofort für dein Konto – keine Aktion erforderlich.
21. Juli 2025
Wir haben die Modelle Claude 2.0, Claude 2.1 und Claude Sonnet 3 eingestellt. Alle Anfragen an diese Modelle geben jetzt einen Fehler zurück. Mehr dazu unter Modell-Abkündigungen.
17. Juli 2025
Wir haben die Ratenlimits für Claude Sonnet 4 auf der Claude API erhöht, um dir mehr Kapazität zum Entwickeln und Skalieren mit Claude zu geben. Für Kunden mit Ratenlimits der Nutzungsstufen 1–4 gelten diese Änderungen sofort für dein Konto – keine Aktion erforderlich.
3. Juli 2025
Wir haben Search-Result-Content-Blöcke in der Beta eingeführt, die natürliche Zitate für RAG-Anwendungen ermöglichen. Tools können jetzt Suchergebnisse mit korrekter Quellenangabe zurückgeben, und Claude zitiert diese Quellen automatisch in seinen Antworten – mit derselben Zitatqualität wie bei der Websuche. Dies beseitigt die Notwendigkeit von Dokument-Workarounds in benutzerdefinierten Wissensdatenbank-Anwendungen. Erfahre mehr unter Suchergebnisse. Um diese Funktion zu aktivieren, verwende den Beta-Header search-results-2025-06-09.
30. Juni 2025
Wir haben die Abkündigung des Modells Claude Opus 3 angekündigt. Mehr dazu unter Modell-Abkündigungen.
23. Juni 2025
Konsolennutzer mit der Developer-Rolle können jetzt auf die Cost-Seite zugreifen. Zuvor erlaubte die Developer-Rolle den Zugriff auf die Usage-Seite, aber nicht auf die Cost-Seite.
11. Juni 2025
Wir haben feingranulares Tool-Streaming in der öffentlichen Beta eingeführt, eine Funktion, die es Claude ermöglicht, Tool-Use-Parameter ohne Pufferung / JSON-Validierung zu streamen. Um feingranulares Tool-Streaming zu aktivieren, verwende den Beta-Headerfine-grained-tool-streaming-2025-05-14.
Das Standardverhalten von erweitertem Denken in Claude 4-Modellen gibt eine Zusammenfassung von Claudes vollständigem Denkprozess zurück, wobei der vollständige Denkprozess verschlüsselt im signature-Feld der thinking-Block-Ausgabe zurückgegeben wird.
Wir haben Interleaved Thinking (verschachteltes Denken) als öffentliche Beta veröffentlicht, eine Funktion, die es Claude ermöglicht, zwischen Tool-Aufrufen zu denken. Um Interleaved Thinking zu aktivieren, verwende den Beta-Headerinterleaved-thinking-2025-05-14.
Wir haben die Files API als öffentliche Beta veröffentlicht, mit der du Dateien hochladen und in der Messages API und im Code-Execution-Tool referenzieren kannst.
Wir haben das Code-Execution-Tool als öffentliche Beta veröffentlicht, ein Tool, das es Claude ermöglicht, Python-Code in einer sicheren Sandbox-Umgebung auszuführen.
Wir haben den MCP-Connector als öffentliche Beta veröffentlicht, eine Funktion, mit der du dich direkt über die Messages API mit Remote-MCP-Servern verbinden kannst.
Um die Antwortqualität zu erhöhen und Tool-Fehler zu verringern, haben wir den Standardwert für den top_p-Parameter (Nucleus Sampling) in der Messages API für alle Modelle von 0,999 auf 0,99 geändert. Um diese Änderung rückgängig zu machen, setze top_p auf 0,999.
Zusätzlich kannst du jetzt, wenn erweitertes Denken aktiviert ist, top_p auf Werte zwischen 0,95 und 1 setzen.
Wir haben unser Go SDK von Beta auf GA umgestellt.
Wir haben der Usage-Seite der Console eine Granularität auf Minuten- und Stundenebene hinzugefügt, zusammen mit 429-Fehlerraten auf der Usage-Seite.
21. Mai 2025
Wir haben unser Ruby SDK von Beta auf GA umgestellt.
7. Mai 2025
Wir haben ein Websuche-Tool in der API veröffentlicht, das es Claude ermöglicht, auf aktuelle Informationen aus dem Web zuzugreifen. Erfahre mehr unter Websuche-Tool.
1. Mai 2025
Cache-Control muss jetzt direkt im übergeordneten content-Block von tool_result und document.source angegeben werden. Aus Gründen der Abwärtskompatibilität wird Cache-Control, wenn es im letzten Block in tool_result.content oder document.source.content erkannt wird, automatisch stattdessen auf den übergeordneten Block angewendet. Cache-Control in allen anderen Blöcken innerhalb von tool_result.content und document.source.content führt zu einem Validierungsfehler.
9. April 2025
Wir haben eine Beta-Version des Ruby SDK veröffentlicht.
31. März 2025
Wir haben unser Java SDK von Beta auf GA umgestellt.
Wir haben unser Go SDK von Alpha auf Beta umgestellt.
27. Februar 2025
Wir haben URL-Quellblöcke für Bilder und PDFs in der Messages API hinzugefügt. Du kannst jetzt Bilder und PDFs direkt über eine URL referenzieren, anstatt sie base64-kodieren zu müssen. Erfahre mehr unter Vision und PDF-Unterstützung.
Wir haben Unterstützung für eine none-Option für den tool_choice-Parameter in der Messages API hinzugefügt, die verhindert, dass Claude Tools aufruft. Außerdem musst du nicht mehr tools angeben, wenn du tool_use- und tool_result-Blöcke einbindest.
Wir haben einen OpenAI-kompatiblen API-Endpunkt veröffentlicht, mit dem du Claude-Modelle testen kannst, indem du nur deinen API-Key, die Basis-URL und den Modellnamen in bestehenden OpenAI-Integrationen änderst. Diese Kompatibilitätsschicht unterstützt die Kernfunktionalität für Chat-Completions. Erfahre mehr unter OpenAI SDK-Kompatibilität.
24. Februar 2025
Wir haben Claude Sonnet 3.7 veröffentlicht, unser bisher intelligentestes Modell. Claude Sonnet 3.7 kann nahezu sofortige Antworten liefern oder sein erweitertes Denken Schritt für Schritt zeigen. Ein Modell, zwei Arten zu denken. Erfahre mehr über alle Claude-Modelle in der Modellübersicht.
Wir haben Vision-Unterstützung zu Claude Haiku 3.5 hinzugefügt, wodurch das Modell Bilder analysieren und verstehen kann.
Wir haben eine Token-effiziente Implementierung für Tool-Nutzung veröffentlicht, die die Gesamtleistung bei der Verwendung von Tools mit Claude verbessert. Erfahre mehr unter Tool-Nutzung mit Claude.
Wir haben die Standardtemperatur in der Console für neue Prompts von 0 auf 1 geändert, um Konsistenz mit der Standardtemperatur in der API zu gewährleisten. Bestehende gespeicherte Prompts bleiben unverändert.
Wir haben aktualisierte Versionen unserer Tools veröffentlicht, die die Text-Edit- und Bash-Tools vom Computer-Use-System-Prompt entkoppeln:
bash_20250124: Gleiche Funktionalität wie die vorherige Version, aber unabhängig von Computer Use. Erfordert keinen Beta-Header.
text_editor_20250124: Gleiche Funktionalität wie die vorherige Version, aber unabhängig von Computer Use. Erfordert keinen Beta-Header.
computer_20250124: Aktualisiertes Computer-Use-Tool mit neuen Befehlsoptionen, darunter „hold_key", „left_mouse_down", „left_mouse_up", „scroll", „triple_click" und „wait". Dieses Tool erfordert den anthropic-beta-Header „computer-use-2025-01-24".
Erfahre mehr unter Tool-Nutzung mit Claude.
10. Februar 2025
Wir haben den anthropic-organization-id-Response-Header zu allen API-Antworten hinzugefügt. Dieser Header liefert die Organisations-ID, die mit dem in der Anfrage verwendeten API-Key verknüpft ist.
31. Januar 2025
Wir haben unser Java SDK von Alpha auf Beta umgestellt.
23. Januar 2025
Wir haben die Citations-Funktion (Zitate) in der API veröffentlicht, die es Claude ermöglicht, Quellenangaben für Informationen bereitzustellen. Erfahre mehr unter Citations.
Wir haben Unterstützung für Klartext-Dokumente und benutzerdefinierte Content-Dokumente in der Messages API hinzugefügt.
21. Januar 2025
Wir haben die Abkündigung der Modelle Claude 2, Claude 2.1 und Claude Sonnet 3 angekündigt. Lies mehr unter Modell-Abkündigungen.
15. Januar 2025
Wir haben Prompt-Caching aktualisiert, um die Nutzung zu vereinfachen. Wenn du jetzt einen Cache-Breakpoint setzt, lesen wir automatisch aus deinem längsten zuvor gecachten Präfix.
Du kannst Claude jetzt Worte in den Mund legen, wenn du Tools verwendest.
Wir haben die Möglichkeit hinzugefügt, auf den Seiten Usage und Cost der Developer Console nach API-Key zu gruppieren.
Wir haben zwei neue Spalten Last used at und Cost sowie die Möglichkeit hinzugefügt, nach jeder Spalte auf der Seite API keys der Developer Console zu sortieren.
21. November 2024
Wir haben die Admin API veröffentlicht, mit der Nutzer die Ressourcen ihrer Organisation programmatisch verwalten können.
20. November 2024
Wir haben unsere Ratenlimits für die Messages API aktualisiert. Wir haben das Ratenlimit für Token pro Minute durch neue Ratenlimits für Input- und Output-Token pro Minute ersetzt. Lies mehr unter Ratenlimits.
Wir haben PDF-Unterstützung für alle Claude Sonnet 3.5-Modelle hinzugefügt. Lies mehr unter PDF-Unterstützung.
6. November 2024
Wir haben die Claude 1- und Instant-Modelle eingestellt. Lies mehr unter Modell-Abkündigungen.
4. November 2024
Claude Haiku 3.5 ist jetzt in der Claude API als reines Textmodell verfügbar.
1. November 2024
Wir haben PDF-Unterstützung für die Verwendung mit dem neuen Claude Sonnet 3.5 hinzugefügt. Lies mehr unter PDF-Unterstützung.
Wir haben außerdem Token-Zählung hinzugefügt, mit der du die Gesamtzahl der Token in einer Message ermitteln kannst, bevor du sie an Claude sendest. Lies mehr unter Token-Zählung.
22. Oktober 2024
Wir haben von Anthropic definierte Computer-Use-Tools zu unserer API für die Verwendung mit dem neuen Claude Sonnet 3.5 hinzugefügt. Lies mehr unter Computer-Use-Tool.
Claude Sonnet 3.5, unser bisher intelligentestes Modell, hat gerade ein Upgrade erhalten und ist jetzt in der Claude API verfügbar. Lies mehr in der Claude Sonnet-Dokumentation.
8. Oktober 2024
Die Message Batches API ist jetzt als Beta verfügbar. Verarbeite große Batches von Anfragen asynchron in der Claude API zu 50 % geringeren Kosten. Lies mehr unter Batch-Verarbeitung.
Wir haben die Einschränkungen bei der Reihenfolge von user/assistant-Turns in unserer Messages API gelockert. Aufeinanderfolgende user/assistant-Nachrichten werden zu einer einzigen Nachricht zusammengefasst, anstatt einen Fehler auszulösen, und wir verlangen nicht mehr, dass die erste Eingabenachricht eine user-Nachricht ist.
Wir haben die Build- und Scale-Pläne zugunsten eines Standard-Funktionspakets (früher als Build bezeichnet) abgekündigt, zusammen mit zusätzlichen Funktionen, die über den Vertrieb verfügbar sind. Lies mehr in unseren API-Preisinformationen.
3. Oktober 2024
Wir haben die Möglichkeit hinzugefügt, parallele Tool-Nutzung in der API zu deaktivieren. Setze disable_parallel_tool_use: true im tool_choice-Feld, um sicherzustellen, dass Claude höchstens ein Tool verwendet. Lies mehr unter Parallele Tool-Nutzung.
10. September 2024
Wir haben Workspaces zur Developer Console hinzugefügt. Workspaces ermöglichen es dir, benutzerdefinierte Ausgaben- oder Ratenlimits festzulegen, API-Keys zu gruppieren, die Nutzung nach Projekt zu verfolgen und den Zugriff mit Benutzerrollen zu steuern. Lies mehr in unserem Blogbeitrag.
4. September 2024
Wir haben die Abkündigung der Claude 1-Modelle angekündigt. Lies mehr unter Modell-Abkündigungen.
22. August 2024
Wir haben Unterstützung für die Verwendung des SDK in Browsern hinzugefügt, indem CORS-Header in den API-Antworten zurückgegeben werden. Setze dangerouslyAllowBrowser: true bei der SDK-Instanziierung, um diese Funktion zu aktivieren.
19. August 2024
Wir haben Ausgaben mit 8.192 Token für Claude Sonnet 3.5 von Beta auf allgemeine Verfügbarkeit umgestellt.
14. August 2024
Prompt-Caching ist jetzt als Beta-Funktion in der Claude API verfügbar. Cache und verwende Prompts wieder, um die Latenz um bis zu 80 % und die Kosten um bis zu 90 % zu reduzieren.
15. Juli 2024
Generiere Ausgaben mit bis zu 8.192 Token Länge von Claude Sonnet 3.5 mit dem neuen Header anthropic-beta: max-tokens-3-5-sonnet-2024-07-15.
9. Juli 2024
Generiere automatisch Testfälle für deine Prompts mit Claude in der Developer Console.
Vergleiche die Ausgaben verschiedener Prompts nebeneinander im neuen Ausgabevergleichsmodus in der Developer Console.
27. Juni 2024
Sieh dir die API-Nutzung und Abrechnung aufgeschlüsselt nach Dollarbetrag, Token-Anzahl und API-Keys in den neuen Tabs Usage und Cost in der Developer Console an.
Claude Sonnet 3.5, unser bisher intelligentestes Modell, ist jetzt allgemein verfügbar über die Claude API, Amazon Bedrock und Vertex AI.
30. Mai 2024
Tool-Nutzung ist jetzt allgemein verfügbar über die Claude API, Amazon Bedrock und Vertex AI.
10. Mai 2024
Unser Prompt-Generator-Tool ist jetzt in der Developer Console verfügbar. Der Prompt-Generator macht es einfach, Claude anzuleiten, hochwertige Prompts zu generieren, die auf deine spezifischen Aufgaben zugeschnitten sind. Lies mehr in unserem Blogbeitrag.