Claude Sonnet 5 est la nouvelle génération de la famille de modèles Sonnet d'Anthropic. Il s'agit d'une mise à niveau directe de Claude Sonnet 4.6 avec trois changements de comportement : la réflexion adaptative est activée par défaut, la réflexion étendue manuelle renvoie désormais une erreur 400 (elle était dépréciée sur Claude Sonnet 4.6), et la définition des paramètres d'échantillonnage (temperature, top_p, top_k) à des valeurs autres que celles par défaut renvoie une erreur 400. Cette page résume toutes les nouveautés au lancement, y compris un nouveau tokenizer.
| Modèle | ID de modèle API | Description |
|---|---|---|
| Claude Sonnet 5 | claude-sonnet-5 | La meilleure combinaison de vitesse et d'intelligence |
Claude Sonnet 5 prend en charge la fenêtre de contexte de 1M de tokens par défaut (1M de tokens est à la fois la valeur par défaut et le maximum ; il n'existe pas de variante de contexte plus petite), 128k tokens de sortie maximum, la réflexion adaptative, et le même ensemble d'outils et de fonctionnalités de plateforme que Claude Sonnet 4.6, à l'exception du Priority Tier, qui n'est pas disponible sur Claude Sonnet 5.
Pour la tarification complète et les spécifications, consultez la vue d'ensemble des modèles.
Sur Claude Sonnet 4.6, les requêtes sans champ thinking s'exécutent sans réflexion. Sur Claude Sonnet 5, les mêmes requêtes s'exécutent avec la réflexion adaptative. Pour désactiver la réflexion, passez thinking: {type: "disabled"}. Étant donné que max_tokens est une limite stricte sur la sortie totale (réflexion plus texte de réponse), réexaminez cette valeur pour les charges de travail qui s'exécutaient sans réflexion sur Claude Sonnet 4.6.
Définir temperature, top_p ou top_k à une valeur autre que celle par défaut renvoie une erreur 400. Supprimez ces paramètres lors de la migration ; la valeur par défaut (ou l'omission du paramètre) est acceptée. Utilisez des instructions dans l'invite système pour guider le comportement du modèle. Ceci est nouveau pour les modèles de classe Sonnet ; la même contrainte avait été introduite précédemment sur Claude Opus 4.7.
La réflexion étendue manuelle (thinking: {type: "enabled", budget_tokens: N}) était dépréciée sur Claude Sonnet 4.6 ; sur Claude Sonnet 5, elle est supprimée et renvoie une erreur 400, comme sur Claude Opus 4.8 et Claude Opus 4.7. Utilisez plutôt la réflexion adaptative avec le paramètre effort.
# Non pris en charge sur Claude Sonnet 5 (renvoie 400)
thinking = {"type": "enabled", "budget_tokens": 32000}
# Utilisez ceci à la place
thinking = {"type": "adaptive"}Claude Sonnet 5 utilise un nouveau « tokenizer » (tokeniseur). Le même texte d'entrée produit environ 30 % de tokens de plus que sur Claude Sonnet 4.6. L'augmentation exacte dépend du contenu. Il ne s'agit pas d'un changement d'API : les requêtes, les réponses et les événements de streaming conservent la même structure, et aucune modification de code n'est requise.
Ce changement affecte tout ce que vous mesurez ou budgétisez en tokens :
usage et les résultats du comptage de tokens pour le même texte sont plus élevés que sur Claude Sonnet 4.6. Ne réutilisez pas les comptages mesurés avec des modèles antérieurs ; recomptez avec Claude Sonnet 5.max_tokens : une limite de sortie ajustée pour Claude Sonnet 4.6 peut tronquer une sortie équivalente sur Claude Sonnet 5. Réexaminez les limites dimensionnées au plus près de votre longueur de sortie attendue.Le préremplissage du message assistant renvoie une erreur 400, comme sur Claude Sonnet 4.6. Utilisez plutôt les sorties structurées, des instructions dans l'invite système, ou output_config.format.
Claude Sonnet 5 est une amélioration des capacités par rapport à Claude Sonnet 4.6 à un prix inférieur. C'est également une option pour les charges de travail qui nécessitent plus de capacités que ce que Claude Sonnet 4.6 offre, sans passer à un modèle de classe Opus.
Les gains les plus importants par rapport à Claude Sonnet 4.6 concernent les tâches de programmation et les tâches agentiques. Pour les résultats des benchmarks, consultez le Transparency Hub d'Anthropic.
Claude Sonnet 5 est le premier modèle de niveau Sonnet doté de protections de cybersécurité en temps réel. Les requêtes impliquant des sujets de cybersécurité interdits ou à haut risque peuvent être refusées. Les refus sont renvoyés sous forme de réponse HTTP 200 réussie avec stop_reason: "refusal", et non comme une erreur. Consultez Protections, avertissements et recours pour plus de contexte.
Claude Sonnet 5 est facturé à 2 $ par million de tokens d'entrée et 10 $ par million de tokens de sortie, soit une tarification par token inférieure aux 3 $/15 $ de Claude Sonnet 4.6. Étant donné que le nouveau tokenizer produit environ 30 % de tokens de plus pour le même texte, le coût d'une requête équivalente ne diminue pas en proportion directe des prix par token lors de la comparaison avec Claude Sonnet 4.6. La différence exacte dépend du contenu et de la nature de la charge de travail.
Consultez la page Tarification pour la tarification complète, y compris les tarifs de traitement par lots et de mise en cache des prompts.
Au lancement, Claude Sonnet 5 est disponible sur :
InvokeModel, servie par la même infrastructure que Claude dans Amazon Bedrock. L'intégration héritée Claude sur Amazon Bedrock (Opus 4.6 et versions antérieures) n'inclut pas Claude Sonnet 5.Claude Sonnet 5 prend en charge la rétention zéro des données pour les organisations disposant d'accords ZDR.
Claude Sonnet 5 est un remplacement direct de Claude Sonnet 4.6. Mettez à jour votre ID de modèle :
model = "claude-sonnet-4-6" # Before
model = "claude-sonnet-5" # AfterPuis passez en revue les points suivants :
max_tokens dimensionnées au plus près de votre longueur de sortie attendue.budget_tokens, migrez vers la réflexion adaptative. La réflexion étendue manuelle (thinking: {type: "enabled"}) n'est pas prise en charge et renvoie une erreur 400.temperature, top_p, top_k) à une valeur autre que celle par défaut renvoient une erreur 400 ; supprimez-les lors de la migration. Les définitions d'outils et les structures de réponse sont inchangées, et le préremplissage du message assistant n'était déjà pas pris en charge sur Claude Sonnet 4.6.Consultez la section Claude Sonnet 5 du guide de migration pour plus de détails.
Spécifications complètes et tarification pour tous les modèles Claude actuels.
Mesurez vos prompts avec le nouveau tokenizer avant de migrer.
Le mode de réflexion activée recommandé sur Claude Sonnet 5.
Fonctionnement de la fenêtre de contexte de 1M de tokens.
Tarification complète, y compris les tarifs de traitement par lots et de mise en cache des prompts.
Was this page helpful?