Ce guide vous montre comment configurer et effectuer des appels API vers Claude dans Microsoft Foundry en utilisant l'un des SDK clients d'Anthropic ou des requêtes HTTP directes. Lorsque vous accédez à Claude dans Microsoft Foundry, votre utilisation de Claude est facturée via l'Azure Marketplace. Vous pouvez utiliser les derniers modèles Claude, notamment Claude Opus 5, Claude Opus 4.8 et Claude Sonnet 5, ainsi que des fonctionnalités telles que la fenêtre de contexte de 1 million de tokens, tout en gérant les coûts via votre abonnement Azure.
Claude est disponible dans les types de déploiement Global Standard et US Data Zone Standard au sein des ressources Foundry, facturé en Claude Consumption Units via l'Azure Marketplace. Consultez la tarification de Claude dans Microsoft Foundry pour plus de détails.
Les modèles Claude dans Microsoft Foundry sont disponibles avec deux options d'hébergement. Vous choisissez l'option d'hébergement lors de la configuration du déploiement.
| Hébergé sur Azure | Hébergé sur Anthropic | |
|---|---|---|
| Lieu d'exécution de l'inférence | Service exploité par Anthropic s'exécutant sur l'infrastructure Azure | Service exploité par Anthropic s'exécutant sur l'infrastructure Anthropic |
| Disponibilité des modèles | Les derniers modèles des familles Opus, Sonnet et Haiku | Tous les modèles Claude disponibles sur Microsoft Foundry |
| Types de déploiement | Global Standard, US Data Zone Standard | Global Standard |
| Recommandé pour | La plupart des charges de travail | Accès aux fonctionnalités ou modèles non encore hébergés sur Azure |
Avant de commencer, assurez-vous de disposer des éléments suivants :
Les SDK clients d'Anthropic prennent en charge Foundry via un package ou une classe client spécifique à la plateforme. Les exemples de cette page montrent également des requêtes avec cURL et la CLI ant. Pour configurer la CLI, consultez le démarrage rapide de la CLI.
pip install -U "anthropic"
# Pour l'authentification Entra ID, installez également la bibliothèque Azure Identity
pip install azure-identityFoundry utilise une hiérarchie à deux niveaux : les ressources contiennent votre configuration de sécurité et de facturation, tandis que les déploiements sont les instances de modèle que vous appelez via l'API. Vous créerez d'abord une ressource Foundry, puis un ou plusieurs déploiements Claude au sein de celle-ci.
Créez une ressource Foundry, nécessaire pour utiliser et gérer les services dans Azure. Vous pouvez suivre ces instructions pour créer une ressource Foundry. Vous pouvez également commencer par créer un projet Foundry, ce qui implique la création d'une ressource Foundry.
Pour provisionner votre ressource :
{resource} dans les points de terminaison de l'API (par exemple, https://{resource}.services.ai.azure.com/anthropic/v1/*).Après avoir créé votre ressource, déployez un modèle Claude pour le rendre disponible pour les appels API. Ces étapes décrivent le nouveau portail Foundry (le bouton New Foundry est activé) :
my-claude-deployment). Le nom du déploiement ne peut pas être modifié après sa création.inference_geo: "us" sur l'API Claude.Si le bouton New Foundry est désactivé, vous êtes dans la disposition classique du portail. Dans ce cas, ouvrez Model catalog dans le volet de gauche pour rechercher et déployer un modèle, et ouvrez Models + endpoints (sous My assets) pour afficher vos déploiements et les détails de leurs points de terminaison.
Claude dans Microsoft Foundry prend en charge deux méthodes d'authentification : les clés API et les jetons Entra ID. Les deux méthodes utilisent des points de terminaison hébergés sur Azure au format https://{resource}.services.ai.azure.com/anthropic/v1/*.
Après avoir provisionné votre ressource Foundry Claude, vous pouvez obtenir une clé API depuis le portail Foundry :
api-key ou x-api-key dans vos requêtes, ou fournissez-la au SDK.Les SDK Foundry nécessitent une clé API et soit un nom de ressource, soit une URL de base. Les SDK C#, Java, PHP, Python et TypeScript lisent automatiquement ces valeurs à partir des variables d'environnement suivantes si elles sont définies :
ANTHROPIC_FOUNDRY_API_KEY - Votre clé APIANTHROPIC_FOUNDRY_RESOURCE - Le nom de votre ressource (par exemple, example-resource)ANTHROPIC_FOUNDRY_BASE_URL - Alternative au nom de ressource : l'URL de base complète (par exemple, https://example-resource.services.ai.azure.com/anthropic/). Le SDK C# ne lit pas cette variable : il construit toujours l'URL de base à partir du nom de la ressource.Exemple utilisant une clé API :
import os
from anthropic import AnthropicFoundry
client = AnthropicFoundry(
api_key=os.environ.get("ANTHROPIC_FOUNDRY_API_KEY"),
resource="example-resource", # your resource name
)
message = client.messages.create(
model="claude-opus-5",
max_tokens=1024,
messages=[{"role": "user", "content": "Hello!"}],
)
print(message.content)L'authentification Entra ID vous permet de gérer les accès avec Azure RBAC, de vous intégrer à la gestion des identités de votre organisation et d'éviter de manipuler manuellement les clés API. Pour utiliser les jetons Entra ID :
Authorization: Bearer {TOKEN}.Exemple utilisant Entra ID :
from anthropic import AnthropicFoundry
from azure.identity import DefaultAzureCredential, get_bearer_token_provider
# Obtenir le jeton Microsoft Entra ID via le modèle de fournisseur de jetons
token_provider = get_bearer_token_provider(
DefaultAzureCredential(), "https://ai.azure.com/.default"
)
# Créer le client avec l'authentification Entra ID
client = AnthropicFoundry(
resource="example-resource", # your resource name
azure_ad_token_provider=token_provider, # Use token provider for Entra ID auth
)
# Effectuer la requête
message = client.messages.create(
model="claude-opus-5",
max_tokens=1024,
messages=[{"role": "user", "content": "Hello!"}],
)
print(message.content)Foundry inclut des identifiants de requête dans les en-têtes de réponse HTTP pour le débogage et le traçage. Lorsque vous contactez le support, fournissez à la fois les valeurs request-id et apim-request-id (Azure API Management) pour aider les équipes à localiser et examiner rapidement votre requête dans les systèmes Anthropic et Azure.
Claude dans Microsoft Foundry prend en charge la plupart des fonctionnalités de Claude. Vous trouverez toutes les fonctionnalités actuellement prises en charge dans la vue d'ensemble des fonctionnalités.
Claude Fable 5, Claude Opus 5, Claude Opus 4.8, Claude Opus 4.7, Claude Opus 4.6, Claude Sonnet 5 et Claude Sonnet 4.6 disposent d'une fenêtre de contexte de 1 million de tokens sur Microsoft Foundry. Les autres modèles Claude, y compris Claude Sonnet 4.5, disposent d'une fenêtre de contexte de 200 000 tokens.
fallbacks ; utilisez plutôt le modèle de fallback côté client)Les fonctionnalités suivantes sont disponibles pour les déploiements hébergés sur Anthropic mais ne sont pas prises en charge pour les déploiements hébergés sur Azure :
Les requêtes qui utilisent ces fonctionnalités sur un déploiement hébergé sur Azure renvoient une erreur 400 Bad Request par conception. Claude Code détecte les déploiements hébergés sur Azure et adapte automatiquement son ensemble de fonctionnalités.
Les réponses de l'API de Claude dans Microsoft Foundry suivent le format de réponse standard de l'API Claude. Cela inclut l'objet usage dans les corps de réponse, qui fournit des informations détaillées sur la consommation de tokens pour vos requêtes. L'objet usage est cohérent sur toutes les plateformes (API Claude, Amazon Bedrock, Claude Platform sur AWS, Foundry et Google Cloud).
Pour plus de détails sur les en-têtes de réponse spécifiques à Foundry, consultez Identifiants de corrélation des requêtes.
Les termes du cycle de vie (Déprécié, Retiré) sont définis dans Dépréciations de modèles. Microsoft Foundry suit le calendrier du cycle de vie de l'API Claude.
Les modèles Claude suivants sont disponibles via Foundry :
| Modèle | Nom de déploiement par défaut | Hébergé sur Azure | Hébergé sur Anthropic |
|---|---|---|---|
| Claude Fable 5 | ✓ | ||
| Claude Opus 5 | ✓ | ✓ | |
| Claude Opus 4.8 | ✓ | ✓ | |
| Claude Opus 4.7 | ✓ | ||
| Claude Opus 4.6 | ✓ | ||
| Claude Opus 4.5 | ✓ | ||
| Claude Sonnet 5 | ✓ | ✓ | |
| Claude Sonnet 4.6 | ✓ | ||
| Claude Sonnet 4.5 | ✓ | ||
| Claude Haiku 4.5 | ✓ | ✓ |
Par défaut, les noms de déploiement correspondent aux ID de modèles indiqués dans le tableau précédent. Cependant, vous pouvez créer des déploiements personnalisés avec des noms différents dans le portail Foundry pour gérer différentes configurations, versions ou limites de débit. Utilisez le nom du déploiement (pas nécessairement l'ID du modèle) dans vos requêtes API.
Claude dans Microsoft Foundry est facturé via l'Azure Marketplace. L'utilisation est libellée en Claude Consumption Units (CCU), mesurée toutes les heures et facturée mensuellement à terme échu sur votre facture Azure. Les CCU ne sont pas des crédits prépayés. Il n'y a ni solde ni engagement de CCU.
Pour le prix des CCU, les mécanismes de conversion et les tarifs de tokens par modèle, consultez la tarification de Claude dans Microsoft Foundry.
Pour déplacer un déploiement existant d'une option d'hébergement à l'autre :
model.Si le nouveau déploiement se trouve dans la même ressource Foundry, l'URL de votre point de terminaison et votre authentification restent inchangées. Si vous avez créé une nouvelle ressource, mettez à jour le point de terminaison et les identifiants de votre application pour pointer vers celle-ci.
Azure fournit la surveillance et la journalisation de votre utilisation de Claude via les modèles standard d'Azure :
Anthropic recommande de journaliser votre activité sur une base glissante d'au moins 30 jours afin de comprendre les modèles d'utilisation et d'examiner tout problème potentiel.
Erreur : 401 Unauthorized ou Invalid API key
Erreur : 403 Forbidden
Erreur : 429 Too Many Requests
Foundry n'inclut pas les en-têtes de limite de débit standard d'Anthropic (anthropic-ratelimit-tokens-limit, anthropic-ratelimit-tokens-remaining, anthropic-ratelimit-tokens-reset, anthropic-ratelimit-input-tokens-limit, anthropic-ratelimit-input-tokens-remaining, anthropic-ratelimit-input-tokens-reset, anthropic-ratelimit-output-tokens-limit, anthropic-ratelimit-output-tokens-remaining et anthropic-ratelimit-output-tokens-reset) dans les réponses. Gérez plutôt la limitation de débit via les outils de surveillance d'Azure.
Erreur : Model not found ou Deployment not found
Erreur : Invalid model parameter
Explorez les fonctionnalités et capacités avancées de Claude.
Découvrez la structure tarifaire d'Anthropic pour les modèles et les fonctionnalités.
À mesure que des modèles plus sûrs et plus performants sont lancés, Anthropic retire régulièrement les anciens. Consultez toutes les dépréciations de l'API, ainsi que les remplacements recommandés.
Parcourez les modèles Anthropic dans le catalogue Foundry.
Consultez les détails de tarification de Microsoft pour Azure AI Foundry.
Consultez les détails de tarification par modèle d'Anthropic.
Gérez vos ressources Azure.
Was this page helpful?