La Compliance API renvoie désormais les transcriptions des sessions Cowork et Claude Code exécutées sur les machines de vos utilisateurs, en bêta pour les organisations Claude Enterprise. GET /v1/compliance/apps/sessions/local liste les sessions de votre organisation, GET /v1/compliance/apps/sessions/local/{session_id} récupère les métadonnées d'une session, et GET /v1/compliance/apps/sessions/local/{session_id}/messages renvoie sa transcription, le tout avec votre Compliance Access Key existante et le scope read:compliance_user_data. Consultez Récupérer les sessions locales.
10 août 2026
Le tarif de lancement de Claude Sonnet 5 (2 $ / 10 $ par MTok) est désormais le tarif standard : l'augmentation précédemment prévue à 3 $ / 15 $ par MTok au 1er septembre 2026 n'aura pas lieu. Consultez Tarification.
7 août 2026
Vous pouvez désormais définir un budget sur une session Claude Managed Agents : un plafond strict sur les dépenses de la session, calculé aux tarifs publics. Une session qui atteint son budget se met en pause avec le stop reason budget_reached au lieu de lancer de nouvelles requêtes au modèle ; modifier ou supprimer le budget la relance. Les déploiements acceptent le même budget et l'appliquent à chaque session qu'ils démarrent. Consultez Budgets de session.
Vous pouvez désormais attribuer un conseiller à une session Claude Managed Agents : un modèle au moins aussi capable que celui de l'agent, que le thread principal de la session peut consulter en cours de tour pour obtenir des conseils stratégiques. Configurez-le comme une entrée {"type": "advisor"} dans la liste multiagent de l'agent, en nommant le model à consulter. Consultez Attribuer un conseiller à la session.
Vous pouvez désormais contrôler où s'exécute l'inférence du modèle pour un agent Claude Managed Agents. Définissez inference_geo dans l'objet model lorsque vous créez l'agent, ou remplacez-le pour une seule session. Consultez Résidence des données pour les zones géographiques disponibles et la tarification.
Les sessions Claude Managed Agents peuvent désormais charger des skills depuis un dépôt GitHub. Lorsqu'une session monte un dépôt, tous les skills présents dans son répertoire racine .claude/skills sont découverts automatiquement au démarrage de la session et mis à la disposition de l'agent pour cette session.
5 août 2026
Les inference hooks (hooks d'inférence) sont désormais en bêta pour les organisations Claude Enterprise. Pointez Claude vers le serveur de sécurité IA de votre organisation, et chaque prompt gouverné sur claude.ai, Cowork et Claude Code est mis en attente du verdict d'autorisation ou de refus du serveur avant que l'inférence ne se poursuive. Les requêtes sont signées, la gestion des échecs est configurable, et chaque refus est enregistré dans le flux d'activité de conformité. Consultez Hooks d'inférence.
Nous avons retiré le modèle Claude Opus 4.1 (claude-opus-4-1-20250805). Toutes les requêtes vers ce modèle sur l'API Claude renverront désormais une erreur. Nous recommandons de passer à Claude Opus 5. Les chercheurs peuvent demander un accès continu via le External Researcher Access Program.
3 août 2026
La Compliance API renvoie désormais les transcriptions des sessions Cowork démarrées sur claude.ai web ou mobile, en bêta pour les organisations Claude Enterprise. GET /v1/compliance/apps/sessions/remote liste les sessions et GET /v1/compliance/apps/sessions/remote/{session_id}/messages renvoie la transcription d'une session, en utilisant votre Compliance Access Key existante avec le scope read:compliance_user_data. Consultez Récupérer les sessions distantes.
Sur Claude Opus 5, la désactivation de la réflexion n'est autorisée qu'au niveau d'effort high ou inférieur : thinking: {"type": "disabled"} avec un effort xhigh ou max renvoie une erreur 400, un changement incompatible par rapport à Claude Opus 4.8. Consultez Nouveautés de Claude Opus 5.
L'effort est le contrôle principal pour piloter Claude Opus 5 : le modèle prend en charge l'échelle complète (low, medium, high, xhigh, max), avec max pour les tâches où la capacité est critique.
Les changements d'outils en cours de conversation sont désormais en bêta sur Claude Fable 5, Claude Mythos 5, Claude Opus 4.8 et Claude Opus 5 : ajoutez ou supprimez des outils entre les tours d'une conversation tout en préservant le cache de prompts. Incluez l'en-tête bêta mid-conversation-tool-changes-2026-07-01 dans vos requêtes.
Le paramètre fallbacks prend désormais en charge un mode "default", qui applique les modèles de repli recommandés par Anthropic selon la catégorie de refus. Le repli côté serveur est en bêta, et le mode "default" nécessite l'en-tête bêta server-side-fallback-2026-07-01. Consultez Refus et repli.
Nous avons supprimé le mode rapide pour Claude Opus 4.7. Les requêtes vers claude-opus-4-7 avec speed: "fast" renvoient désormais une erreur ; contrairement à Claude Opus 4.6, elles ne basculent pas vers la vitesse standard. Claude Opus 4.7 lui-même reste disponible à vitesse standard. Pour continuer à utiliser le mode rapide, migrez vers Claude Opus 5 ou Claude Opus 4.8. Pour en savoir plus, consultez Mode rapide.
22 juillet 2026
Vous pouvez désormais définir un niveau d'effort dans la configuration du modèle d'un agent Claude Managed Agents. Passez effort dans l'objet model lorsque vous créez l'agent. Consultez Niveaux d'effort pour comprendre ce que fait chaque niveau.
Les webhooks pour Claude Managed Agents couvrent désormais le cycle de vie des environnements et des memory stores : quatre types d'événements environment.* et trois types d'événements memory_store.*. Vous pouvez réagir aux changements du cycle de vie des environnements et des memory stores sans polling. Consultez les onglets Événements d'environnement et Événements de memory store dans S'abonner aux webhooks.
Lors de la création d'une session Claude Managed Agents, vous pouvez désormais l'initialiser avec des événements initiaux. Passez initial_events sur POST /v1/sessions avec jusqu'à 50 événements user.message et user.define_outcome. Une liste non vide démarre la boucle de l'agent dans le même appel, vous n'avez donc pas besoin d'une requête d'envoi d'événements distincte pour démarrer le travail.
Le champ version est désormais facultatif lors de la mise à jour d'un agent Claude Managed Agents. Fournissez-le pour la concurrence optimiste (une non-correspondance renvoie une erreur 409), ou omettez-le pour appliquer la mise à jour sans condition. Consultez Sémantique de mise à jour.
Les flux d'événements de thread de session Claude Managed Agents prennent désormais en charge les deltas d'événements. GET /v1/sessions/{session_id}/threads/{thread_id}/stream accepte le même paramètre de requête event_deltas[] que le flux au niveau de la session, vous pouvez donc prévisualiser le texte d'un sous-agent au fur et à mesure que le modèle le génère. Une connexion ne prévisualise que le thread qu'elle lit. Consultez Prévisualiser les événements de thread de session.
17 juillet 2026
L'ancien Workbench (platform.claude.com/workbench) dans la Claude Console est en cours de retrait, avec fin d'accès le 17 août 2026. Les prompts enregistrés, les variables et les évaluations ne sont pas pris en charge dans le Workbench mis à jour. Vous pouvez exporter toutes les données que vous souhaitez conserver depuis la bannière et sous vos Paramètres organisationnels. Pour en savoir plus, consultez Comment utiliser le Workbench ? dans le Centre d'aide Claude.
Les API expérimentales d'outils de prompt pour générer, améliorer et transformer en template des prompts (/v1/experimental/generate_prompt, /v1/experimental/improve_prompt et /v1/experimental/templatize_prompt) sont retirées en même temps que le Workbench le 17 août 2026. Après leur suppression, les requêtes vers ces endpoints renverront une erreur.
Vous pouvez désormais gérer les personnes de votre organisation Claude Enterprise (claude.ai) avec l'Admin API, en bêta pour toutes les organisations Claude Enterprise : lister les membres et les rechercher par adresse e-mail, modifier le rôle d'un membre, supprimer des membres, envoyer et retirer des invitations, gérer les groupes et leur composition, et lire les rôles personnalisés. Les requêtes de groupes et de rôles personnalisés nécessitent l'en-tête bêta anthropic-beta: ce-user-management-2026-07-13 ; les requêtes de membres et d'invitations ne nécessitent aucun en-tête bêta. Une clé Admin API avec le scope read:org_audit peut également appeler tous les endpoints GET de gestion des utilisateurs. Consultez Gestion des utilisateurs.
10 juillet 2026
Dreams (aperçu de recherche) prend désormais en charge Claude Fable 5 et Claude Sonnet 5. Consultez Modèles pris en charge.
Nous avons enrichi la documentation Access Transparency des événements cmek_preserve avec un exemple de filtre, un exemple de charge utile d'événement et deux codes de motif de préservation (policy_violation_investigation, csae_report). La documentation précise également désormais qu'un événement de préservation est écrit que la préservation ait été initiée par un examinateur humain ou par un pipeline de sécurité automatisé. Consultez Préservation de contenu CMEK.
8 juillet 2026
Vous pouvez désormais définir une expiration lorsque vous créez une clé API ou une clé Admin API dans la Claude Console. Choisissez un préréglage, une durée personnalisée ou Jamais. Pour les clés d'une durée de vie d'au moins 7 jours, Anthropic envoie un e-mail au créateur avant l'expiration. Les clés existantes ne sont pas affectées. L'Admin API indique l'expiration de chaque clé dans le champ expires_at. Consultez Authentification.
2 juillet 2026
Nous avons ajouté l'en-tête bêta agent-memory-2026-07-22, qui modifie le comportement du listage des mémoires (GET /v1/memory_stores/{memory_store_id}/memories) : les résultats sont renvoyés dans un ordre stable défini par le serveur et les paramètres order_by et order sont ignorés ; depth n'accepte que 0, 1 ou l'omission (les autres valeurs renvoient une erreur 400) ; et path_prefix doit se terminer par / et correspond à des segments de chemin entiers plutôt qu'à une sous-chaîne. Les curseurs de page émis sans l'en-tête ne sont pas valides avec celui-ci, redémarrez donc depuis la première page lorsque vous l'adoptez. Sur les endpoints de memory store, agent-memory-2026-07-22 remplace managed-agents-2026-04-01 ; envoyer les deux renvoie une erreur 400. Le 22 juillet 2026, l'en-tête managed-agents-2026-04-01 adopte le même comportement de listage. Consultez En-têtes bêta.
Les SDK Python (0.116.0), TypeScript (0.110.0), Go (1.56.0), Java (2.48.0), Ruby (1.55.0), PHP (0.36.0), C# (12.35.0) et CLI (1.16.0) envoient désormais agent-memory-2026-07-22 sur tous les appels de memory store au lieu de managed-agents-2026-04-01. Si votre code passe betas explicitement sur les appels de memory store, remplacez-y managed-agents-2026-04-01 par agent-memory-2026-07-22 plutôt que d'ajouter une seconde valeur.
1er juillet 2026
Nous avons rétabli l'accès à Claude Fable 5 et Claude Mythos 5. Consultez notre déclaration pour plus d'informations.
30 juin 2026
Nous avons lancé Claude Sonnet 5 (claude-sonnet-5), la nouvelle génération de notre famille de modèles Sonnet, au tarif de lancement de 2 $ / 10 $ par MTok (devenu le tarif standard le 10 août 2026). Claude Sonnet 5 prend en charge une fenêtre de contexte de 1M de tokens, 128k tokens de sortie maximum, et le même ensemble d'outils et de fonctionnalités de plateforme que Claude Sonnet 4.6, à l'exception du Priority Tier, qui n'est pas disponible sur Claude Sonnet 5. Trois changements de comportement s'appliquent lors de la migration : la réflexion adaptative est désormais activée par défaut ; la réflexion étendue manuelle (thinking: {type: "enabled", budget_tokens: N}) est supprimée et renvoie une erreur 400 (elle était dépréciée sur Sonnet 4.6) ; et définir les paramètres d'échantillonnage (temperature, top_p, top_k) à des valeurs autres que celles par défaut renvoie une erreur 400. Claude Sonnet 5 utilise également un nouveau tokenizer qui produit environ 30 % de tokens en plus pour le même texte. L'augmentation exacte dépend du contenu et de la forme de la charge de travail. Consultez Nouveautés de Claude Sonnet 5 pour les détails et les conseils de migration. Pour les différences de comportement et les patterns de prompting spécifiques au modèle, consultez Prompting de Claude Sonnet 5.
Les flux d'événements de session Claude Managed Agents prennent désormais en charge les deltas d'événements. Activez-les avec le paramètre de requête event_deltas[] sur GET /v1/sessions/{session_id}/events/stream. Les événements event_start et event_delta prévisualisent le texte d'un message d'agent au fur et à mesure de sa génération, avant l'arrivée de l'événement agent.message complet.
Le listage des sessions pour Claude Managed Agents prend désormais en charge la pagination arrière. GET /v1/sessions renvoie un curseur prev_page en plus de next_page ; passez-le comme paramètre page pour revenir à la page précédente. Consultez Pagination.
Lors de la création d'une session Claude Managed Agents, vous pouvez désormais remplacer la configuration de l'agent pour cette session. Passez agent avec type: "agent_with_overrides" pour remplacer le modèle, l'invite système, les outils, les serveurs MCP ou les skills pour une seule session. L'agent lui-même reste inchangé.
Les vaults Claude Managed Agents prennent désormais en charge un paramètre injection_location sur les identifiants de variable d'environnement (onglet Variable d'environnement). Il contrôle si la valeur de l'identifiant est substituée, à la sortie, dans les en-têtes de requête sortante de l'agent, dans le corps de la requête, ou dans les deux.
Les webhooks pour Claude Managed Agents couvrent désormais le cycle de vie des agents, des déploiements et des exécutions de déploiement. Vous pouvez réagir à une nouvelle version d'agent publiée, à un déploiement mis en pause ou à une exécution planifiée échouée sans polling. Consultez les onglets Événements d'agent, Événements de déploiement et Événements d'exécution de déploiement dans S'abonner aux webhooks.
29 juin 2026
Nous avons supprimé le mode rapide pour Claude Opus 4.6. Les requêtes vers claude-opus-4-6 avec speed: "fast" ne s'exécutent plus à vitesse rapide ni au tarif premium : elles s'exécutent à vitesse standard, sont facturées aux tarifs standard et ne renvoient pas d'erreur. Le champ usage.speed de la réponse indique la vitesse utilisée. Pour continuer à utiliser le mode rapide, migrez vers Claude Opus 4.8. Pour en savoir plus, consultez Mode rapide.
26 juin 2026
Nous avons augmenté les limites de débit sur l'ensemble de l'API Claude. Les limites de débit de Claude Sonnet et Claude Haiku correspondent désormais à celles de Claude Opus à chaque niveau d'utilisation, et les niveaux d'utilisation ont été consolidés en trois : Start, Build et Scale. La plupart des organisations passent à un niveau supérieur, aucune organisation ne reçoit de limites inférieures à celles d'avant, et aucune action n'est requise. Vous pouvez consulter votre niveau et vos limites actuelles dans la Claude Console.
25 juin 2026
Nous avons déprécié le mode rapide pour Claude Opus 4.7, avec suppression le 24 juillet 2026. Après la suppression, les requêtes vers claude-opus-4-7 avec speed: "fast" renverront une erreur. Migrez vers le mode rapide pour Claude Opus 4.8. Pour en savoir plus, consultez Mode rapide.
22 juin 2026
Tunnels MCP (aperçu de recherche) : l'API de gestion est passée de /v1/organizations/tunnels sur l'Admin API à /v1/tunnels sur l'API Claude. La nouvelle surface utilise l'en-tête anthropic-beta: mcp-tunnels-2026-06-22 et le scope WIF workspace:manage_tunnels. La surface précédente reste disponible pendant une période de migration. Consultez la référence de l'API Tunnels.
18 juin 2026
Les SDK Python, TypeScript, Go, Java, Ruby, PHP et C# incluent désormais la prise en charge de code_execution_20260120, la version de l'outil d'exécution de code qui ajoute la persistance de l'état REPL et constitue la version minimale pour l'appel d'outils programmatique. Pour l'adopter, définissez le type de l'outil sur code_execution_20260120 ; aucun en-tête bêta n'est requis. Elle est disponible sur Claude Fable 5, Claude Mythos 5, Claude Opus 4.5 et versions ultérieures, et Claude Sonnet 4.5 et versions ultérieures ; consultez le tableau de compatibilité des modèles.
15 juin 2026
Nous avons retiré le modèle Claude Sonnet 4 (claude-sonnet-4-20250514) et le modèle Claude Opus 4 (claude-opus-4-20250514). Toutes les requêtes vers ces modèles sur l'API Claude renverront désormais une erreur. Nous recommandons de passer respectivement à Claude Sonnet 4.6 et Claude Opus 4.8. Les chercheurs peuvent demander un accès continu via le External Researcher Access Program.
11 juin 2026
L'outil d'exécution de code prend désormais en charge code_execution_20260521, qui divulgue la limite de temps d'exécution de 90 secondes par cellule dans la description de l'outil afin que Claude puisse budgétiser les cellules à exécution longue. Aucun en-tête bêta n'est requis.
L'outil de recherche web et l'outil de récupération web prennent désormais en charge web_search_20260318 et web_fetch_20260318, ajoutant un paramètre response_inclusion pour supprimer les blocs de résultats consommés de la réponse de l'API pour les workflows agentiques. Aucun en-tête bêta n'est requis.
Nous avons lancé Claude Fable 5 (claude-fable-5), notre modèle le plus capable largement diffusé, aux côtés de Claude Mythos 5 (claude-mythos-5) pour les participants à Project Glasswing. Les deux modèles prennent en charge une fenêtre de contexte de 1M de tokens par défaut, 128k tokens de sortie maximum, et la réflexion adaptative toujours activée. Consultez Présentation de Claude Fable 5 et Claude Mythos 5 pour les capacités, les changements d'API et la disponibilité.
Claude Fable 5 et Claude Mythos 5 utilisent le tokenizer introduit avec Claude Opus 4.7. Par rapport aux modèles antérieurs à Claude Opus 4.7, le même texte produit environ 30 % de tokens en plus. L'augmentation exacte dépend du contenu et de la forme de la charge de travail. Utilisez l'API de comptage de tokens avec model: "claude-fable-5" pour mesurer vos prompts avec le nouveau tokenizer.
Claude Fable 5 exécute des classificateurs de sécurité sur les requêtes et pendant la génération des réponses. Lorsqu'un classificateur refuse une requête, l'API Messages renvoie stop_reason: "refusal". Vous n'êtes pas facturé pour une requête refusée avant qu'une sortie ne soit générée. Un paramètre fallbacks optionnel (en bêta sur l'API Claude et Claude Platform sur AWS ; non pris en charge sur l'API Message Batches) réexécute les requêtes refusées sur un autre modèle, facturé aux tarifs du modèle de repli. Consultez Gestion des stop reasons.
Le champ stop_details.category sur les réponses de refus inclut désormais "reasoning_extraction" sur Claude Fable 5, renvoyé lorsqu'une requête est bloquée en vertu des restrictions des Conditions d'utilisation d'Anthropic sur la rétro-ingénierie ou la duplication des sorties du modèle. Les catégories existantes "cyber" et "bio" restent inchangées. Aucun en-tête bêta n'est requis.
Sur Claude Fable 5 et Claude Mythos 5, la réflexion adaptative est le seul mode de réflexion : thinking: {"type": "disabled"} n'est pas pris en charge, et les budgets de réflexion étendue manuels ainsi que le préremplissage de l'assistant ne sont pas pris en charge (les deux renvoient une erreur 400). Consultez Migration de Claude Mythos Preview vers Claude Mythos 5.
Sur Claude Fable 5 et Claude Mythos 5, thinking.display est par défaut "omitted", comme sur Claude Opus 4.8, Claude Opus 4.7 et Claude Mythos Preview ; définissez display: "summarized" pour recevoir des résumés de réflexion lisibles. La chaîne de pensée brute n'est jamais renvoyée ; repassez les blocs de réflexion inchangés dans les conversations multi-tours sur le même modèle. Consultez Sortie de réflexion sur Claude Fable 5 et Claude Mythos 5.
Claude Managed Agents prend désormais en charge les déploiements planifiés, vous permettant d'exécuter des sessions selon un calendrier cron sans gérer votre propre planificateur.
Les vaults Claude Managed Agents prennent désormais en charge les identifiants de variable d'environnement, vous permettant d'injecter de manière sécurisée des secrets dans le sandbox de l'agent pour les CLI, SDK et autres services qui s'authentifient via des variables d'environnement.
Les événements webhook session.thread_* incluent désormais un champ session_thread_id identifiant le thread multiagent qui a déclenché l'événement.
Nous avons publié un package Swift en bêta qui ajoute Claude comme LanguageModel côté serveur dans le framework Foundation Models d'Apple. Appelez Claude via la même API LanguageModelSession que le modèle embarqué d'Apple sur iOS 27, macOS 27, visionOS 27 et watchOS 27 (bêta).
5 juin 2026
Nous avons annoncé la dépréciation du modèle Claude Opus 4.1 (claude-opus-4-1-20250805), avec retrait sur l'API Claude prévu pour le 5 août 2026. Nous recommandons de migrer vers Claude Opus 4.8. Pour en savoir plus, consultez Dépréciations de modèles.
2 juin 2026
L'outil conseiller prend désormais en charge un paramètre max_tokens pour plafonner la sortie du modèle conseiller par appel, réduisant la latence et le coût en tokens de sortie pour les charges de travail qui n'ont pas besoin de réponses de conseiller complètes. Définissez tools[].max_tokens sur la définition de l'outil conseiller ; consultez Plafonner la sortie du conseiller.
Sur l'API Claude, vous n'êtes plus facturé pour une requête lorsqu'elle renvoie stop_reason: "refusal" sans que Claude ait généré de sortie. Consultez Refus en streaming pour détecter et gérer les refus.
Nous avons lancé Claude Opus 4.8 (), notre modèle le plus capable en disponibilité générale. Claude Opus 4.8 prend en charge une fenêtre de contexte de 1M de tokens par défaut sur l'API Claude, Amazon Bedrock, Google Cloud et Microsoft Foundry, 128k tokens de sortie maximum, et le même ensemble d'outils et de fonctionnalités de plateforme que Claude Opus 4.7. Consultez le guide de migration pour les paramètres de référence, les fonctionnalités et les conseils de migration.
Nous avons lancé les messages système en cours de conversation. Sur Claude Opus 4.8, vous pouvez envoyer des messages role: "system" après un tour utilisateur (sous réserve des règles de placement) dans le tableau messages, préservant les hits du cache de prompts lorsque les instructions changent pendant une session de longue durée. Aucun en-tête bêta n'est requis.
Le champ stop_details sur les réponses de refus est désormais documenté publiquement ; il renvoie une category (cyber, bio ou null) et une explanation lisible par un humain, afin que votre application puisse router différentes classes de refus vers l'étape suivante appropriée. Aucun en-tête bêta n'est requis.
Sur Claude Opus 4.8, le paramètre d'effort est par défaut high sur toutes les surfaces, y compris Claude Code et l'API Messages.
Sur Claude Opus 4.8, la longueur minimale de prompt pouvant être mise en cache pour la mise en cache des prompts est de 1 024 tokens, inférieure à celle de Claude Opus 4.7.
Avec la réflexion adaptative activée, Claude Opus 4.8 ne déclenche le raisonnement que lorsqu'un tour en a besoin, réduisant les tokens de réflexion gaspillés par rapport à Claude Opus 4.7 au même niveau d'effort.
Claude Opus 4.8 prend en charge l'entrée d'image haute résolution (jusqu'à 2576 pixels sur le côté long), comme Claude Opus 4.7.
Les budgets de tâche prennent désormais en charge Claude Opus 4.8.
Le mode rapide pour Claude Opus 4.8 est disponible en aperçu de recherche sur l'API Claude uniquement.
Définir les paramètres d'échantillonnage temperature, top_p ou top_k à une valeur autre que celle par défaut renvoie une erreur 400 sur Claude Opus 4.8, comme sur Claude Opus 4.7. Consultez le guide de migration pour plus de détails.
Dans Claude Code, nous avons étendu le mode Auto à davantage d'utilisateurs pour les tâches de longue durée. Consultez la documentation de Claude Code.
Dans Claude Code, les utilisateurs du forfait Max utilisent désormais par défaut le mode rapide sur Claude Opus 4.8. Consultez la documentation de Claude Code.
Dans Claude Code, les Workflows sont disponibles en aperçu de recherche, vous permettant de définir et d'exécuter des plans agentiques multi-étapes. Consultez la documentation de Claude Code.
Nous avons déprécié le mode rapide pour Claude Opus 4.6, avec suppression environ 30 jours après le lancement. Migrez vers le mode rapide pour Claude Opus 4.8 ou Claude Opus 4.7. Pour en savoir plus, consultez Mode rapide.
Pour les mises à jour de claude.ai, Cowork, Claude pour Microsoft 365 et d'autres applications Claude dans cette version, consultez les notes de version des applications Claude.
27 mai 2026
La réponse de l'API Messages inclut désormais usage.output_tokens_details.thinking_tokens, indiquant combien de tokens de sortie facturés correspondaient à de la réflexion étendue. En streaming, la répartition n'apparaît que sur l'événement message_delta final. Aucun en-tête bêta n'est requis.
19 mai 2026
Les tunnels MCP sont désormais disponibles en aperçu de recherche, vous permettant de vous connecter à des serveurs MCP dans votre réseau privé.
Les sandboxes auto-hébergés sont désormais disponibles pour Claude Managed Agents, comme alternative à l'exécution des outils dans l'infrastructure d'Anthropic. Consultez Sandboxes auto-hébergés.
Avec Claude Managed Agents, vous pouvez désormais mettre à jour les configurations de serveur MCP et d'outils de l'agent associées à une session active.
Avec Claude Managed Agents, les sorties volumineuses des outils agent_toolset et MCP dépassant 100K caractères (environ 25K tokens) sont désormais automatiquement déversées dans un fichier du sandbox. Le modèle reçoit un aperçu tronqué avec le chemin du fichier et peut lire le contenu complet à partir de là.
18 mai 2026
L'outil de recherche web renvoie désormais des données de dépôts SEC plus riches, facilitant l'ancrage des agents de recherche financière, de l'analyse des résultats et des workflows de due diligence dans des sources primaires avec citations.
13 mai 2026
Nous avons lancé les diagnostics de cache en bêta publique. Passez diagnostics.previous_message_id sur une requête Messages et l'API renvoie un cache_miss_reason expliquant où le préfixe du cache de prompts a divergé du tour précédent. Incluez l'en-tête bêta cache-diagnosis-2026-04-07 dans vos requêtes.
12 mai 2026
Le mode rapide (aperçu de recherche) prend désormais en charge Claude Opus 4.7. Définissez speed: "fast" avec model: "claude-opus-4-7" et l'en-tête bêta fast-mode-2026-02-01 pour une génération de tokens de sortie nettement plus rapide à un tarif premium. La tarification, les limites de débit et l'accès sont identiques à ceux du mode rapide d'Opus 4.6 ; les clients intéressés doivent s'inscrire sur la liste d'attente.
11 mai 2026
Nous avons lancé Claude Platform on AWS, qui apporte l'API Claude à une infrastructure gérée par Anthropic accessible via AWS, avec la facturation AWS et l'authentification IAM. Accédez à l'intégralité de l'API Messages, de l'API Files, de l'API Message Batches, de Claude Managed Agents, des Agent Skills, de l'exécution de code et de l'utilisation d'outils via des points de terminaison AWS natifs. Pour en savoir plus, consultez Claude Platform on AWS.
L'actualisation en arrière-plan des identifiants de coffre-fort de Claude Managed Agents est désormais prise en charge pour les identifiants mcp_oauth. Consultez S'authentifier avec des coffres-forts.
Les webhooks pour Claude Managed Agents sont désormais pris en charge. Les types d'événements webhook incluent les événements de cycle de vie des sessions et des coffres-forts. Consultez S'abonner aux webhooks.
Des options supplémentaires de filtrage et de tri sont désormais prises en charge pour Claude Managed Agents. Les sessions peuvent être filtrées par statut, et les événements peuvent être filtrés par type. Les événements peuvent désormais être filtrés par date de création.
Les Dreams pour Claude Managed Agents sont désormais disponibles en aperçu de recherche. Un « dream » lit un magasin de mémoire existant ainsi que les transcriptions de sessions passées et produit un magasin de mémoire de sortie réorganisé avec les doublons fusionnés, les entrées obsolètes remplacées et de nouvelles informations mises en évidence. Les points de terminaison Dream sont contrôlés par l'en-tête bêta dreaming-2026-04-21. Demandez l'accès pour l'essayer.
4 mai 2026
La Workload Identity Federation est désormais en disponibilité générale. Authentifiez les charges de travail auprès de l'API Claude avec des jetons OIDC de courte durée provenant de votre propre fournisseur d'identité (AWS IAM, Google Cloud, GitHub Actions, Kubernetes, Microsoft Entra ID, Okta, SPIFFE, et plus encore) au lieu de clés API statiques de longue durée. Configurez les émetteurs et les règles de fédération dans la Claude Console, et le SDK gère automatiquement l'échange et l'actualisation des jetons. Consultez Authentification.
30 avril 2026
Nous avons retiré la bêta de la fenêtre de contexte de 1M de tokens (context-1m-2025-08-07) pour Claude Sonnet 4.5 et Claude Sonnet 4. L'en-tête bêta n'a désormais aucun effet sur ces modèles, et les requêtes dépassant la fenêtre de contexte standard de 200k tokens renvoient une erreur. Pour utiliser la fenêtre de contexte de 1M, migrez vers Claude Sonnet 4.6 ou Claude Opus 4.6, où elle est en disponibilité générale au tarif standard sans en-tête bêta requis.
29 avril 2026
Nous avons publié le skill Claude API, un Agent Skill open source qui fournit à Claude du matériel de référence à jour pour développer sur l'API Messages et Claude Managed Agents dans 8 langages. Le skill est intégré à Claude Code et disponible dans le dépôt de skills Anthropic.
24 avril 2026
Nous avons publié l'API Rate Limits, permettant aux administrateurs d'interroger par programmation les limites de débit configurées pour leur organisation et leurs espaces de travail.
23 avril 2026
La mémoire pour Claude Managed Agents est désormais en bêta publique sous l'en-tête standard managed-agents-2026-04-01. Consultez Utiliser la mémoire d'agent pour le guide d'intégration complet.
20 avril 2026
Nous avons retiré le modèle Claude Haiku 3 (claude-3-haiku-20240307). Toutes les requêtes vers ce modèle renverront désormais une erreur. Nous recommandons de passer à Claude Haiku 4.5.
16 avril 2026
Nous avons lancé Claude Opus 4.7, notre modèle en disponibilité générale le plus performant pour le raisonnement complexe et le codage agentique, au même tarif de 5 $ / 25 $ par MTok qu'Opus 4.6. Consultez Nouveautés de Claude Opus 4.7 pour les améliorations de capacités, les nouvelles fonctionnalités et le tokenizer mis à jour. Opus 4.7 inclut des changements incompatibles de l'API par rapport à Opus 4.6 ; consultez le guide de migration avant de procéder à la mise à niveau.
Claude in Amazon Bedrock est désormais ouvert à tous les clients Amazon Bedrock. Claude Opus 4.7 et Claude Haiku 4.5 sont disponibles en libre-service depuis la console Bedrock via le point de terminaison de l'API Messages à /anthropic/v1/messages, dans 27 régions AWS avec des points de terminaison globaux et régionaux.
Nous avons lancé les budgets de tâche en bêta sur Claude Opus 4.7. Donnez à Claude un budget de tokens indicatif pour une boucle agentique complète (réflexion, appels d'outils, résultats d'outils et sortie) et le modèle voit un compte à rebours en temps réel, l'utilisant pour prioriser le travail et terminer proprement à mesure que le budget est consommé. Incluez l'en-tête bêta task-budgets-2026-03-13 dans vos requêtes.
Claude Opus 4.7 prend en charge l'entrée d'images haute résolution, augmentant la résolution d'image maximale de 1568 à 2576 pixels sur le côté long pour de meilleures performances sur l'utilisation d'ordinateur, la compréhension de captures d'écran et l'analyse de documents. La prise en charge haute résolution est automatique et ne nécessite aucun en-tête bêta ; les images peuvent utiliser jusqu'à environ 3 fois plus de tokens d'image que sur les modèles précédents.
Nous avons ajouté le niveau d'effortxhigh sur Claude Opus 4.7. xhigh se situe entre high et max et est optimisé pour les tâches agentiques et de codage de longue durée (plus de 30 minutes) avec des budgets de tokens de l'ordre du million. Aucun en-tête bêta n'est requis.
14 avril 2026
Nous avons annoncé la dépréciation du modèle Claude Sonnet 4 (claude-sonnet-4-20250514) et du modèle Claude Opus 4 (claude-opus-4-20250514), avec un retrait sur l'API Claude prévu pour le 15 juin 2026. Nous recommandons de migrer respectivement vers Claude Sonnet 4.6 et Claude Opus 4.8. Pour en savoir plus, consultez Dépréciations de modèles.
9 avril 2026
Nous avons lancé l'outil advisor en bêta publique. Associez un modèle exécuteur plus rapide à un modèle conseiller de plus haute intelligence qui fournit des conseils stratégiques en cours de génération, afin que les charges de travail agentiques à long horizon obtiennent une qualité proche de celle du conseiller seul, tandis que l'essentiel de la génération de tokens se fait aux tarifs du modèle exécuteur. Incluez l'en-tête bêta advisor-tool-2026-03-01 dans vos requêtes.
8 avril 2026
Nous avons lancé Claude Managed Agents en bêta publique, un harnais d'agent entièrement géré pour exécuter Claude en tant qu'agent autonome avec un bac à sable sécurisé, des outils intégrés et le streaming d'événements envoyés par le serveur. Créez des agents, configurez des conteneurs et exécutez des sessions via l'API. Tous les points de terminaison nécessitent l'en-tête bêta managed-agents-2026-04-01. Pour en savoir plus, consultez Aperçu de Claude Managed Agents.
Nous avons lancé la CLI ant, un client en ligne de commande pour l'API Claude qui permet une interaction plus rapide avec l'API Claude, une intégration native avec Claude Code et le versionnage des ressources API dans des fichiers YAML. Pour en savoir plus, consultez le démarrage rapide de la CLI.
7 avril 2026
Nous avons annoncé que Claude Mythos Preview est disponible en aperçu de recherche à accès restreint pour les travaux de cybersécurité défensive dans le cadre de Project Glasswing. L'accès est sur invitation uniquement.
L'API Messages est désormais disponible sur Amazon Bedrock en aperçu de recherche. Le nouveau point de terminaison Claude in Amazon Bedrock à /anthropic/v1/messages utilise la même structure de requête que l'API Claude de première partie et s'exécute sur une infrastructure gérée par AWS avec zéro accès opérateur. Disponible dans us-east-1 ; contactez votre responsable de compte Anthropic pour demander l'accès. Pour en savoir plus, consultez Claude in Amazon Bedrock.
30 mars 2026
Nous avons relevé le plafond de max_tokens à 300k sur l'API Message Batches pour Claude Opus 4.6 et Sonnet 4.6. Incluez l'en-tête bêta output-300k-2026-03-24 pour générer des sorties à tour unique plus longues pour le contenu long, les données structurées et les tâches de génération de code volumineuses.
Nous retirons la bêta de la fenêtre de contexte de 1M de tokens pour Claude Sonnet 4.5 et Claude Sonnet 4 le 30 avril 2026. Après cette date, l'en-tête bêta context-1m-2025-08-07 n'aura aucun effet sur ces modèles, et les requêtes dépassant la fenêtre de contexte standard de 200k tokens renverront une erreur. Pour continuer à utiliser les fenêtres de contexte de 1M, migrez vers Claude Sonnet 4.6 ou Claude Opus 4.6, qui prennent en charge la fenêtre de contexte complète de 1M de tokens au tarif standard sans en-tête bêta requis.
18 mars 2026
Nous avons ajouté des champs de capacités de modèle à l'API Models. GET /v1/models et GET /v1/models/{model_id} renvoient désormais max_input_tokens, max_tokens et un objet capabilities. Interrogez l'API pour découvrir ce que chaque modèle prend en charge.
16 mars 2026
Nous avons lancé le champ display pour la réflexion étendue, vous permettant d'omettre le contenu de réflexion des réponses pour un streaming plus rapide. Définissez thinking.display: "omitted" pour recevoir des blocs de réflexion avec un champ thinking vide et la signature préservée pour la continuité multi-tours. La facturation reste inchangée. Pour en savoir plus, consultez Contrôler l'affichage de la réflexion.
13 mars 2026
La fenêtre de contexte de 1M de tokens est désormais en disponibilité générale pour Claude Opus 4.6 et Sonnet 4.6 au tarif standard. Les requêtes de plus de 200k tokens fonctionnent automatiquement pour ces modèles sans en-tête bêta requis. La fenêtre de contexte de 1M de tokens reste en bêta pour Claude Sonnet 4.5 et Sonnet 4.
Nous avons supprimé les limites de débit dédiées au 1M pour tous les modèles pris en charge. Vos limites de compte standard s'appliquent désormais à toutes les longueurs de contexte.
Nous avons relevé la limite de médias de 100 à 600 images ou pages PDF par requête lors de l'utilisation de la fenêtre de contexte de 1M de tokens.
19 février 2026
Nous avons lancé la mise en cache automatique pour l'API Messages. Ajoutez un seul champ cache_control au corps de votre requête et le système met automatiquement en cache le dernier bloc pouvant être mis en cache, déplaçant le point de cache vers l'avant à mesure que les conversations s'allongent. Aucune gestion manuelle des points d'arrêt n'est requise. Fonctionne parallèlement au contrôle de cache existant au niveau des blocs pour une optimisation fine. Disponible sur l'API Claude et Microsoft Foundry (aperçu). Pour en savoir plus, consultez Mise en cache des prompts.
Nous avons retiré le modèle Claude Sonnet 3.7 (claude-3-7-sonnet-20250219) et le modèle Claude Haiku 3.5 (claude-3-5-haiku-20241022). Toutes les requêtes vers Claude Sonnet 3.7 renverront désormais une erreur. Les requêtes vers Claude Haiku 3.5 sur l'API Claude renverront désormais une erreur ; il reste disponible sur Amazon Bedrock et Google Cloud. Nous recommandons de passer respectivement à Claude Sonnet 4.6 et Claude Haiku 4.5. Les chercheurs peuvent demander un accès continu via le programme d'accès pour chercheurs externes.
Nous avons annoncé la dépréciation du modèle Claude Haiku 3 (claude-3-haiku-20240307), avec un retrait prévu pour le 20 avril 2026. Nous recommandons de migrer vers Claude Haiku 4.5. Pour en savoir plus, consultez Dépréciations de modèles.
17 février 2026
Nous avons lancé Claude Sonnet 4.6, notre dernier modèle équilibré combinant vitesse et intelligence pour les tâches quotidiennes. Sonnet 4.6 offre des performances de recherche agentique améliorées tout en consommant moins de tokens. Sonnet 4.6 prend en charge la réflexion étendue et une fenêtre de contexte de 1M de tokens (bêta). Consultez Modèles et tarification pour plus de détails.
L'exécution de code de l'API est désormais gratuite lorsqu'elle est utilisée avec la recherche web ou la récupération web. L'exécution de code en bac à sable améliore les capacités du modèle et l'efficacité des tokens. Consultez les détails de tarification pour l'utilisation autonome.
L'outil de recherche web et l'appel d'outils programmatique sont désormais en disponibilité générale (aucun en-tête bêta requis). La recherche web et la récupération web prennent désormais en charge le filtrage dynamique, qui utilise l'exécution de code pour filtrer les résultats avant qu'ils n'atteignent la fenêtre de contexte, pour de meilleures performances et un coût en tokens réduit.
Nous avons lancé le mode rapide en aperçu de recherche pour Opus 4.6, offrant une génération de tokens de sortie nettement plus rapide via le paramètre speed. Le mode rapide est jusqu'à 2,5 fois plus rapide à un tarif premium. Les clients intéressés doivent s'inscrire sur la liste d'attente.
5 février 2026
Nous avons lancé Claude Opus 4.6, notre modèle le plus intelligent pour les tâches agentiques complexes et le travail à long horizon. Opus 4.6 recommande la réflexion adaptative (thinking: {type: "adaptive"}) ; la réflexion manuelle (type: "enabled" avec budget_tokens) est dépréciée. Opus 4.6 ne prend pas en charge le préremplissage des messages assistant. Pour en savoir plus, consultez Nouveautés de Claude 4.6.
Le paramètre effort est désormais en disponibilité générale (aucun en-tête bêta requis) et prend en charge Claude Opus 4.6. Effort remplace budget_tokens pour contrôler la profondeur de réflexion sur les nouveaux modèles.
Nous avons lancé l'API de compaction en bêta, offrant une synthèse de contexte côté serveur pour des conversations effectivement infinies. Disponible sur Opus 4.6.
Nous avons introduit les contrôles de résidence des données, vous permettant de spécifier où s'exécute l'inférence du modèle avec le paramètre inference_geo. L'inférence aux États-Unis uniquement est disponible à 1,1x le tarif pour les modèles publiés après le 1er février 2026.
Les sorties structurées sont désormais en disponibilité générale sur l'API Claude pour Claude Sonnet 4.5, Claude Opus 4.5 et Claude Haiku 4.5. La disponibilité générale inclut une prise en charge étendue des schémas, une latence de compilation de grammaire améliorée et un chemin d'intégration simplifié sans en-tête bêta requis. Le paramètre output_format a été déplacé vers output_config.format. Les utilisateurs bêta existants peuvent continuer à utiliser l'en-tête bêta pendant la période de transition. Les sorties structurées restent en bêta publique sur Amazon Bedrock et Microsoft Foundry.
12 janvier 2026
console.anthropic.com redirige désormais vers platform.claude.com. La Claude Console a déménagé vers sa nouvelle adresse dans le cadre de notre consolidation de la marque Claude. Les favoris et liens existants continueront de fonctionner grâce à une redirection automatique. Pour plus de détails, consultez l'annonce du 16 septembre 2025.
5 janvier 2026
Nous avons retiré le modèle Claude Opus 3 (claude-3-opus-20240229). Toutes les requêtes vers ce modèle renverront désormais une erreur. Nous recommandons de passer à Claude Opus 4.5, qui offre une intelligence nettement améliorée pour un tiers du coût. Les chercheurs peuvent demander un accès continu à Claude Opus 3 sur l'API via le programme d'accès pour chercheurs externes.
19 décembre 2025
Nous avons annoncé la dépréciation du modèle Claude Haiku 3.5. Pour en savoir plus, consultez Dépréciations de modèles.
Nous avons lancé Claude Opus 4.5, notre modèle le plus intelligent combinant capacité maximale et performances pratiques. Idéal pour les tâches spécialisées complexes, l'ingénierie logicielle professionnelle et les agents avancés. Présente des améliorations majeures en vision, codage et utilisation d'ordinateur à un prix plus accessible que les modèles Opus précédents. Pour en savoir plus, consultez Aperçu des modèles.
Nous avons lancé l'appel d'outils programmatique en bêta publique, permettant à Claude d'appeler des outils depuis l'exécution de code pour réduire la latence et l'utilisation de tokens dans les flux de travail multi-outils.
Nous avons lancé l'outil de recherche d'outils en bêta publique, permettant à Claude de découvrir et charger dynamiquement des outils à la demande à partir de grands catalogues d'outils.
Nous avons lancé le paramètre effort en bêta publique pour Claude Opus 4.5, vous permettant de contrôler l'utilisation de tokens en arbitrant entre l'exhaustivité et l'efficacité des réponses.
Nous avons ajouté la compaction côté client à nos SDK Python et TypeScript, gérant automatiquement le contexte de conversation par synthèse lors de l'utilisation de tool_runner.
21 novembre 2025
Les blocs de contenu de résultats de recherche sont désormais en disponibilité générale sur Amazon Bedrock. Pour en savoir plus, consultez Résultats de recherche.
19 novembre 2025
Nous avons lancé une nouvelle plateforme de documentation sur platform.claude.com/docs. Notre documentation se trouve désormais aux côtés de la Claude Console, offrant une expérience développeur unifiée. L'ancien site de documentation sur docs.claude.com redirigera vers le nouvel emplacement.
18 novembre 2025
Nous avons lancé Claude in Microsoft Foundry, apportant les modèles Claude aux clients Azure avec la facturation Azure et l'authentification OAuth. Accédez à l'intégralité de l'API Messages, y compris la réflexion étendue, la mise en cache des prompts (5 minutes et 1 heure), la prise en charge des PDF, l'API Files, les Agent Skills et l'utilisation d'outils. Pour en savoir plus, consultez Claude in Microsoft Foundry.
14 novembre 2025
Nous avons lancé les sorties structurées en bêta publique, offrant une conformité garantie au schéma pour les réponses de Claude. Utilisez les sorties JSON pour des réponses de données structurées ou l'utilisation d'outils stricte pour des entrées d'outils validées. Disponible pour Claude Sonnet 4.5 et Claude Opus 4.1. Pour l'activer, utilisez l'en-tête bêta structured-outputs-2025-11-13.
28 octobre 2025
Nous avons annoncé la dépréciation du modèle Claude Sonnet 3.7. Pour en savoir plus, consultez Dépréciations de modèles.
Nous avons retiré les modèles Claude Sonnet 3.5. Toutes les requêtes vers ces modèles renverront désormais une erreur.
Nous avons étendu l'édition de contexte avec l'effacement des blocs de réflexion (clear_thinking_20251015), permettant la gestion automatique des blocs de réflexion. Pour en savoir plus, consultez Édition de contexte.
16 octobre 2025
Nous avons lancé les Agent Skills (bêta skills-2025-10-02), une nouvelle façon d'étendre les capacités de Claude. Les Skills sont des dossiers organisés d'instructions, de scripts et de ressources que Claude charge dynamiquement pour effectuer des tâches spécialisées. La version initiale comprend :
Skills gérés par Anthropic : Skills préconstruits pour travailler avec des fichiers PowerPoint (.pptx), Excel (.xlsx), Word (.docx) et PDF
Skills personnalisés : Téléversez vos propres Skills via l'API Skills (points de terminaison /v1/skills) pour packager l'expertise de domaine et les flux de travail organisationnels
Nous avons lancé Claude Haiku 4.5, notre modèle Haiku le plus rapide et le plus intelligent avec des performances proches de la frontière. Idéal pour les applications en temps réel, le traitement à haut volume et les déploiements sensibles aux coûts nécessitant un raisonnement solide. Pour en savoir plus, consultez Aperçu des modèles.
29 septembre 2025
Nous avons lancé Claude Sonnet 4.5, notre meilleur modèle pour les agents complexes et le codage, avec la plus haute intelligence sur la plupart des tâches. Pour en savoir plus, consultez l'aperçu des modèles.
Nous avons introduit une nouvelle raison d'arrêt model_context_window_exceeded qui vous permet de demander le maximum de tokens possible sans calculer la taille de l'entrée. Pour en savoir plus, consultez Gestion des raisons d'arrêt.
Nous avons lancé l'outil de mémoire en bêta, permettant à Claude de stocker et consulter des informations entre les conversations. Pour en savoir plus, consultez Outil de mémoire.
Nous avons lancé l'édition de contexte en bêta, offrant des stratégies pour gérer automatiquement le contexte de conversation. La version initiale prend en charge l'effacement des anciens résultats et appels d'outils à l'approche des limites de tokens. Pour en savoir plus, consultez Édition de contexte.
17 septembre 2025
Nous avons lancé des assistants d'outils en bêta pour les SDK Python et TypeScript, simplifiant la création et l'exécution d'outils avec une validation d'entrée à typage sûr et un exécuteur d'outils pour la gestion automatisée des outils dans les conversations. Pour plus de détails, consultez la documentation du SDK Python et du SDK TypeScript.
16 septembre 2025
Nous avons unifié nos offres développeur sous la marque Claude. Vous devriez voir des noms et des URL mis à jour sur notre plateforme et notre documentation, mais nos interfaces développeur resteront les mêmes. Voici quelques changements notables :
Les points de terminaison API, les en-têtes, les variables d'environnement et les SDK restent les mêmes. Vos intégrations existantes continueront de fonctionner sans aucune modification.
10 septembre 2025
Nous avons lancé l'outil de récupération web en bêta, permettant à Claude de récupérer le contenu complet de pages web et de documents PDF spécifiés. Pour en savoir plus, consultez Outil de récupération web.
Nous avons lancé l'API Claude Code Analytics, permettant aux organisations d'accéder par programmation aux métriques d'utilisation quotidiennes agrégées pour Claude Code, y compris les métriques de productivité, les statistiques d'utilisation d'outils et les données de coût.
Nous avons lancé des graphiques de limites de débit dans la page Usage de la Console, vous permettant de surveiller votre utilisation des limites de débit de l'API et vos taux de mise en cache au fil du temps.
3 septembre 2025
Nous avons lancé la prise en charge des documents citables dans les résultats d'outils côté client. Pour en savoir plus, consultez Gérer les appels d'outils.
2 septembre 2025
Nous avons lancé la v2 de l'outil d'exécution de code en bêta publique, remplaçant l'outil original limité à Python par l'exécution de commandes Bash et des capacités de manipulation directe de fichiers, y compris l'écriture de code dans d'autres langages.
La fenêtre de contexte de 1M de tokens est désormais disponible sur Vertex AI. Pour plus d'informations, consultez Claude sur Vertex AI.
19 août 2025
Les identifiants de requête sont désormais inclus directement dans les corps de réponse d'erreur, en plus de l'en-tête request-id existant. Pour en savoir plus, consultez Erreurs.
18 août 2025
Nous avons publié l'API Usage & Cost, permettant aux administrateurs de surveiller par programmation les données d'utilisation et de coût de leur organisation.
Nous avons ajouté un nouveau point de terminaison à l'API Admin pour récupérer les informations d'organisation. Pour plus de détails, consultez la référence de l'API Admin Organization Info.
13 août 2025
Nous avons annoncé la dépréciation des modèles Claude Sonnet 3.5 (claude-3-5-sonnet-20240620 et claude-3-5-sonnet-20241022). Ces modèles seront retirés le 28 octobre 2025. Nous recommandons de migrer vers Claude Sonnet 4.5 (claude-sonnet-4-5-20250929) pour des performances et des capacités améliorées. Pour en savoir plus, consultez Dépréciations de modèles.
La durée de cache de 1 heure pour la mise en cache des prompts est désormais en disponibilité générale. Vous pouvez désormais utiliser le TTL de cache étendu sans en-tête bêta. Pour en savoir plus, consultez Mise en cache des prompts.
Certains clients peuvent rencontrer des erreurs 429 (rate_limit_error) suite à une forte augmentation de l'utilisation de l'API en raison des limites d'accélération sur l'API. Auparavant, des erreurs 529 (overloaded_error) se produisaient dans des scénarios similaires.
8 août 2025
Les blocs de contenu de résultats de recherche sont désormais en disponibilité générale sur l'API Claude et Vertex AI. Cette fonctionnalité permet des citations naturelles pour les applications RAG avec une attribution de source appropriée. L'en-tête bêta search-results-2025-06-09 n'est plus requis. Pour en savoir plus, consultez Résultats de recherche.
5 août 2025
Nous avons lancé Claude Opus 4.1, une mise à jour incrémentale de Claude Opus 4 avec des capacités améliorées et des gains de performance.* Pour en savoir plus, consultez Aperçu des modèles.
*Opus 4.1 ne permet pas de spécifier à la fois les paramètres temperature et top_p. Veuillez n'en utiliser qu'un seul.
28 juillet 2025
Nous avons publié text_editor_20250728, un outil d'éditeur de texte mis à jour qui corrige certains problèmes des versions précédentes et ajoute un paramètre optionnel max_characters qui vous permet de contrôler la longueur de troncature lors de l'affichage de fichiers volumineux.
24 juillet 2025
Nous avons augmenté les limites de débit pour Claude Opus 4 sur l'API Claude afin de vous donner plus de capacité pour développer et évoluer avec Claude. Pour les clients avec des limites de débit de niveau d'utilisation 1 à 4, ces changements s'appliquent immédiatement à votre compte — aucune action requise.
21 juillet 2025
Nous avons retiré les modèles Claude 2.0, Claude 2.1 et Claude Sonnet 3. Toutes les requêtes vers ces modèles renverront désormais une erreur. Pour en savoir plus, consultez Dépréciations de modèles.
17 juillet 2025
Nous avons augmenté les limites de débit pour Claude Sonnet 4 sur l'API Claude afin de vous donner plus de capacité pour développer et évoluer avec Claude. Pour les clients avec des limites de débit de niveau d'utilisation 1 à 4, ces changements s'appliquent immédiatement à votre compte — aucune action requise.
3 juillet 2025
Nous avons lancé les blocs de contenu de résultats de recherche en bêta, permettant des citations naturelles pour les applications RAG. Les outils peuvent désormais renvoyer des résultats de recherche avec une attribution de source appropriée, et Claude citera automatiquement ces sources dans ses réponses — correspondant à la qualité de citation de la recherche web. Cela élimine le besoin de contournements par documents dans les applications de base de connaissances personnalisées. Pour en savoir plus, consultez Résultats de recherche. Pour activer cette fonctionnalité, utilisez l'en-tête bêta search-results-2025-06-09.
30 juin 2025
Nous avons annoncé la dépréciation du modèle Claude Opus 3. Pour en savoir plus, consultez Dépréciations de modèles.
23 juin 2025
Les utilisateurs de la Console avec le rôle Développeur peuvent désormais accéder à la page Cost. Auparavant, le rôle Développeur permettait l'accès à la page Usage, mais pas à la page Cost.
11 juin 2025
Nous avons lancé le streaming d'outils à granularité fine en bêta publique, une fonctionnalité qui permet à Claude de diffuser en streaming les paramètres d'utilisation d'outils sans mise en tampon ni validation JSON. Pour activer le streaming d'outils à granularité fine, utilisez l'en-tête bêtafine-grained-tool-streaming-2025-05-14.
Le comportement par défaut de la réflexion étendue dans les modèles Claude 4 renvoie un résumé du processus de réflexion complet de Claude, la réflexion complète étant chiffrée et renvoyée dans le champ signature de la sortie du bloc thinking.
Nous avons lancé la réflexion entrelacée en bêta publique, une fonctionnalité qui permet à Claude de réfléchir entre les appels d'outils. Pour activer la réflexion entrelacée, utilisez l'en-tête bêtainterleaved-thinking-2025-05-14.
Nous avons lancé l'API Files en bêta publique, vous permettant de téléverser des fichiers et de les référencer dans l'API Messages et l'outil d'exécution de code.
Nous avons lancé l'outil d'exécution de code en bêta publique, un outil qui permet à Claude d'exécuter du code Python dans un environnement sécurisé et isolé (sandbox).
Nous avons lancé le connecteur MCP en bêta publique, une fonctionnalité qui vous permet de vous connecter à des serveurs MCP distants directement depuis l'API Messages.
Pour améliorer la qualité des réponses et réduire les erreurs d'outils, nous avons modifié la valeur par défaut du paramètre top_p de nucleus sampling (échantillonnage par noyau) dans l'API Messages de 0,999 à 0,99 pour tous les modèles. Pour annuler cette modification, définissez top_p sur 0,999.
De plus, lorsque la réflexion étendue est activée, vous pouvez désormais définir top_p sur des valeurs comprises entre 0,95 et 1.
Nous avons fait passer notre SDK Go de la version bêta à la disponibilité générale (GA).
Nous avons ajouté une granularité au niveau de la minute et de l'heure à la page Usage de la Console, ainsi que les taux d'erreur 429 sur la page Usage.
21 mai 2025
Nous avons fait passer notre SDK Ruby de la version bêta à la disponibilité générale (GA).
7 mai 2025
Nous avons lancé un outil de recherche web dans l'API, permettant à Claude d'accéder à des informations à jour provenant du web. Pour en savoir plus, consultez Outil de recherche web.
1er mai 2025
Le contrôle du cache doit désormais être spécifié directement dans le bloc content parent de tool_result et document.source. Pour assurer la rétrocompatibilité, si un contrôle du cache est détecté sur le dernier bloc dans tool_result.content ou document.source.content, il sera automatiquement appliqué au bloc parent à la place. Un contrôle du cache sur tout autre bloc dans tool_result.content et document.source.content entraînera une erreur de validation.
Nous avons fait passer notre SDK Java de la version bêta à la disponibilité générale (GA).
Nous avons fait passer notre SDK Go de la version alpha à la version bêta.
27 février 2025
Nous avons ajouté des blocs source URL pour les images et les PDF dans l'API Messages. Vous pouvez désormais référencer des images et des PDF directement via une URL au lieu de devoir les encoder en base64. Pour en savoir plus, consultez Vision et Prise en charge des PDF.
Nous avons ajouté la prise en charge d'une option none pour le paramètre tool_choice dans l'API Messages, qui empêche Claude d'appeler des outils. De plus, vous n'êtes plus obligé de fournir des tools lorsque vous incluez des blocs tool_use et tool_result.
Nous avons lancé un point de terminaison d'API compatible avec OpenAI, vous permettant de tester les modèles Claude en modifiant simplement votre clé API, votre URL de base et le nom du modèle dans vos intégrations OpenAI existantes. Cette couche de compatibilité prend en charge les fonctionnalités de base de chat completions. Pour en savoir plus, consultez Compatibilité avec le SDK OpenAI.
24 février 2025
Nous avons lancé Claude Sonnet 3.7, notre modèle le plus intelligent à ce jour. Claude Sonnet 3.7 peut produire des réponses quasi instantanées ou montrer sa réflexion étendue étape par étape. Un seul modèle, deux façons de réfléchir. Pour en savoir plus sur tous les modèles Claude, consultez la Vue d'ensemble des modèles.
Nous avons ajouté la prise en charge de la vision à Claude Haiku 3.5, permettant au modèle d'analyser et de comprendre des images.
Nous avons publié une implémentation d'utilisation d'outils économe en tokens, améliorant les performances globales lors de l'utilisation d'outils avec Claude. Pour en savoir plus, consultez Utilisation d'outils avec Claude.
Nous avons modifié la température par défaut dans la Console pour les nouveaux prompts de 0 à 1, par souci de cohérence avec la température par défaut dans l'API. Les prompts enregistrés existants restent inchangés.
Nous avons publié des versions mises à jour de nos outils qui découplent les outils d'édition de texte et bash de l'invite système de computer use :
bash_20250124 : Même fonctionnalité que la version précédente, mais indépendante de computer use. Ne nécessite pas d'en-tête bêta.
text_editor_20250124 : Même fonctionnalité que la version précédente, mais indépendante de computer use. Ne nécessite pas d'en-tête bêta.
computer_20250124 : Outil computer use mis à jour avec de nouvelles options de commande, notamment « hold_key », « left_mouse_down », « left_mouse_up », « scroll », « triple_click » et « wait ». Cet outil nécessite l'en-tête anthropic-beta « computer-use-2025-01-24 ».
Pour en savoir plus, consultez Utilisation d'outils avec Claude.
10 février 2025
Nous avons ajouté l'en-tête de réponse anthropic-organization-id à toutes les réponses de l'API. Cet en-tête fournit l'identifiant de l'organisation associée à la clé API utilisée dans la requête.
31 janvier 2025
Nous avons fait passer notre SDK Java de la version alpha à la version bêta.
23 janvier 2025
Nous avons lancé la fonctionnalité de citations dans l'API, permettant à Claude de fournir l'attribution des sources pour les informations. Pour en savoir plus, consultez Citations.
Nous avons ajouté la prise en charge des documents en texte brut et des documents à contenu personnalisé dans l'API Messages.
21 janvier 2025
Nous avons annoncé la dépréciation des modèles Claude 2, Claude 2.1 et Claude Sonnet 3. Pour en savoir plus, consultez Dépréciations de modèles.
15 janvier 2025
Nous avons mis à jour la mise en cache des prompts pour la rendre plus facile à utiliser. Désormais, lorsque vous définissez un point d'arrêt de cache, nous lisons automatiquement à partir de votre plus long préfixe précédemment mis en cache.
Vous pouvez désormais mettre des mots dans la bouche de Claude lors de l'utilisation d'outils.
Les fonctionnalités suivantes sont désormais en disponibilité générale dans l'API Claude :
API Models : Interrogez les modèles disponibles, validez les identifiants de modèle et résolvez les alias de modèle vers leurs identifiants de modèle canoniques.
API Message Batches : Traitez de grands lots de messages de manière asynchrone à 50 % du coût standard de l'API.
API de comptage de tokens : Calculez le nombre de tokens des Messages avant de les envoyer à Claude.
Mise en cache des prompts : Réduisez les coûts jusqu'à 90 % et la latence jusqu'à 80 % en mettant en cache et en réutilisant le contenu des prompts.
Prise en charge des PDF : Traitez des PDF pour analyser à la fois le texte et le contenu visuel des documents.
Nous avons également publié de nouveaux SDK officiels :
Nous avons ajouté la possibilité de regrouper par clé API sur les pages Usage et Cost de la Developer Console.
Nous avons ajouté deux nouvelles colonnes Last used at (Dernière utilisation) et Cost (Coût), ainsi que la possibilité de trier par n'importe quelle colonne sur la page API keys de la Developer Console.
21 novembre 2024
Nous avons publié l'API Admin, permettant aux utilisateurs de gérer par programmation les ressources de leur organisation.
20 novembre 2024
Nous avons mis à jour nos limites de débit pour l'API Messages. Nous avons remplacé la limite de débit de tokens par minute par de nouvelles limites de débit de tokens d'entrée et de sortie par minute. Pour en savoir plus, consultez Limites de débit.
Nous avons ajouté la prise en charge des PDF pour tous les modèles Claude Sonnet 3.5. Pour en savoir plus, consultez Prise en charge des PDF.
6 novembre 2024
Nous avons retiré les modèles Claude 1 et Instant. Pour en savoir plus, consultez Dépréciations de modèles.
4 novembre 2024
Claude Haiku 3.5 est désormais disponible sur l'API Claude en tant que modèle texte uniquement.
1er novembre 2024
Nous avons ajouté la prise en charge des PDF pour une utilisation avec le nouveau Claude Sonnet 3.5. Pour en savoir plus, consultez Prise en charge des PDF.
Nous avons également ajouté le comptage de tokens, qui vous permet de déterminer le nombre total de tokens dans un Message avant de l'envoyer à Claude. Pour en savoir plus, consultez Comptage de tokens.
22 octobre 2024
Nous avons ajouté des outils de computer use définis par Anthropic à notre API pour une utilisation avec le nouveau Claude Sonnet 3.5. Pour en savoir plus, consultez Outil computer use.
Claude Sonnet 3.5, notre modèle le plus intelligent à ce jour, vient d'être mis à niveau et est désormais disponible sur l'API Claude. Pour en savoir plus, consultez la documentation Claude Sonnet.
8 octobre 2024
L'API Message Batches est désormais disponible en version bêta. Traitez de grands lots de requêtes de manière asynchrone dans l'API Claude pour 50 % de coût en moins. Pour en savoir plus, consultez Traitement par lots.
Nous avons assoupli les restrictions sur l'ordre des tours user/assistant dans notre API Messages. Les messages user/assistant consécutifs seront combinés en un seul message au lieu de générer une erreur, et nous n'exigeons plus que le premier message d'entrée soit un message user.
Nous avons déprécié les forfaits Build et Scale au profit d'une suite de fonctionnalités standard (anciennement appelée Build), ainsi que de fonctionnalités supplémentaires disponibles via l'équipe commerciale. Pour en savoir plus, consultez nos informations sur la tarification de l'API.
3 octobre 2024
Nous avons ajouté la possibilité de désactiver l'utilisation d'outils en parallèle dans l'API. Définissez disable_parallel_tool_use: true dans le champ tool_choice pour vous assurer que Claude utilise au maximum un seul outil. Pour en savoir plus, consultez Utilisation d'outils en parallèle.
10 septembre 2024
Nous avons ajouté les Workspaces à la Developer Console. Les Workspaces vous permettent de définir des limites de dépenses ou de débit personnalisées, de regrouper des clés API, de suivre l'utilisation par projet et de contrôler l'accès avec des rôles utilisateur. Pour en savoir plus, consultez notre article de blog.
4 septembre 2024
Nous avons annoncé la dépréciation des modèles Claude 1. Pour en savoir plus, consultez Dépréciations de modèles.
22 août 2024
Nous avons ajouté la prise en charge de l'utilisation du SDK dans les navigateurs en renvoyant des en-têtes CORS dans les réponses de l'API. Définissez dangerouslyAllowBrowser: true lors de l'instanciation du SDK pour activer cette fonctionnalité.
19 août 2024
Nous avons fait passer les sorties de 8 192 tokens de la version bêta à la disponibilité générale pour Claude Sonnet 3.5.
14 août 2024
La mise en cache des prompts est désormais disponible en tant que fonctionnalité bêta dans l'API Claude. Mettez en cache et réutilisez des prompts pour réduire la latence jusqu'à 80 % et les coûts jusqu'à 90 %.
15 juillet 2024
Générez des sorties allant jusqu'à 8 192 tokens de longueur à partir de Claude Sonnet 3.5 avec le nouvel en-tête anthropic-beta: max-tokens-3-5-sonnet-2024-07-15.
9 juillet 2024
Générez automatiquement des cas de test pour vos prompts à l'aide de Claude dans la Developer Console.
Comparez côte à côte les sorties de différents prompts dans le nouveau mode de comparaison de sorties de la Developer Console.
27 juin 2024
Consultez l'utilisation de l'API et la facturation ventilées par montant en dollars, nombre de tokens et clés API dans les nouveaux onglets Usage et Cost de la Developer Console.
Claude Sonnet 3.5, notre modèle le plus intelligent à ce jour, est désormais en disponibilité générale sur l'API Claude, Amazon Bedrock et Vertex AI.
30 mai 2024
L'utilisation d'outils est désormais en disponibilité générale sur l'API Claude, Amazon Bedrock et Vertex AI.
10 mai 2024
Notre outil de génération de prompts est désormais disponible dans la Developer Console. Le générateur de prompts facilite l'orientation de Claude pour générer des prompts de haute qualité adaptés à vos tâches spécifiques. Pour en savoir plus, consultez notre article de blog.