Claude Opus 5 est le dernier modèle de la série Opus d’Anthropic, lancé le 24 juillet 2026. Anthropic le positionne pour le codage agentique complexe et les charges de travail d’entreprise, et le présente comme le point de départ par défaut si vous ne savez pas quel modèle choisir. Son tarif est de 5 $ par million de jetons d’entrée et 25 $ par million de jetons de sortie, soit le même prix qu’Opus 4.8 et la moitié du tarif annoncé pour Fable 5.
Essayez Apidog dès aujourd’hui
Ce guide détaille les spécifications, les coûts, les benchmarks annoncés par Anthropic, les changements d’API à prendre en compte lors d’une migration depuis Opus 4.8, les plateformes disponibles et les limites du modèle. Si vous appelez le modèle via HTTP, vous pouvez envoyer et inspecter vos requêtes dans Apidog.
Claude Opus 5 en un coup d’œil
| Spécification | Valeur |
|---|---|
| ID de modèle API |
claude-opus-5 — sans suffixe de date |
| Lancé le | 24 juillet 2026 |
| Fenêtre de contexte | 1 000 000 de jetons, par défaut et maximum |
| Sortie maximale | 128 000 jetons avec l’API Messages ; 300 000 avec l’API Batch et l’en-tête bêta output-300k-2026-03-24
|
| Tarification de base | 5 $ par M de jetons d’entrée ; 25 $ par M de jetons de sortie |
| Date limite de connaissance | Mai 2026 |
| Pensée adaptative | Activée par défaut |
| Niveaux d’effort |
low, medium, high, xhigh, max ; valeur par défaut : high
|
| Niveau de priorité | Non pris en charge |
| Disponibilité | API Claude, claude.ai, Claude Code, Claude Cowork, Amazon Bedrock, Plateforme Claude sur AWS, Google Cloud, Microsoft Foundry, GitHub Copilot |
Points à retenir avant de l’intégrer :
- La fenêtre de contexte de 1M de jetons est disponible sans en-tête bêta et sans surcharge de prix pour les longs contextes.
- La date limite de connaissance de mai 2026 est plus récente que celle de Sonnet 5 et Fable 5, annoncée à janvier 2026.
- Le Niveau de Priorité, disponible sur Opus 4.8, n’est pas pris en charge par Opus 5. Si votre planification de capacité en dépend, consultez le guide de migration.
Pour la liste complète des modèles et champs API, consultez l’aperçu des modèles d’Anthropic.
Identifier et sélectionner le modèle
Opus 5 succède à Claude Opus 4.8.
Utilisez l’ID correspondant à votre plateforme :
| Plateforme | ID |
|---|---|
| API Claude | claude-opus-5 |
| Amazon Bedrock | anthropic.claude-opus-5 |
| Google Cloud | claude-opus-5 |
| Plateforme Claude sur AWS | ID propriétaire |
La gamme Opus se situe au-dessus de Sonnet et sous les modèles de recherche Fable et Mythos. Le changement important avec Opus 5 est son positionnement : Anthropic recommande désormais de commencer par ce modèle, alors que Sonnet était auparavant le choix par défaut et Opus l’option de montée en gamme.
Opus 5 est aussi le modèle par défaut pour les abonnés Max et le modèle le plus performant disponible sur Pro. Pour comparer les options d’accès, consultez les chemins gratuits et les moins chers.
Coût : calculez avant de migrer
| Tarif | Entrée, par M de jetons | Sortie, par M de jetons |
|---|---|---|
| Standard | 5,00 $ | 25,00 $ |
| API Batch, réduction de 50 % | 2,50 $ | 12,50 $ |
| Mode rapide, aperçu de recherche | 10,00 $ | 50,00 $ |
| Écriture cache, TTL 5 minutes | 6,25 $ | n/a |
| Écriture cache, TTL 1 heure | 10,00 $ | n/a |
| Lecture et rafraîchissement du cache | 0,50 $ | n/a |
Claude Fable 5 est tarifé à 10 $ par M de jetons d’entrée et 50 $ par M de jetons de sortie. Anthropic affirme qu’Opus 5 se situe à moins de 0,5 % de Fable 5 sur le codage agentique, pour la moitié du prix.
Quelques optimisations pratiques :
- Activez le cache pour les prompts système réutilisés. Le minimum de mise en cache passe à 512 jetons, contre 1 024 sur Opus 4.8.
- Utilisez Batch pour les tâches non interactives. Le tarif est réduit de moitié.
- Évitez le mode rapide sans besoin explicite. Il double les prix et n’est disponible que sur l’API propriétaire.
-
Évaluez l’impact de
inference_geo: "us". Ce réglage ajoute un multiplicateur de1.1xsur les jetons d’entrée, de sortie et de cache. -
Mesurez vos appels d’outils. Le surcoût de prompt système pour
tool_choice: "auto"ou"none"est de 286 jetons, contre 290 sur Opus 4.8 et 675 sur Opus 4.7.
Pour des scénarios détaillés, consultez l’analyse de la tarification et le guide pour réduire votre facture API Claude. La page de tarification d’Anthropic reste la référence.
Benchmarks : traitez-les comme des affirmations fournisseur
Les résultats suivants ont été publiés par Anthropic au lancement. Au 25 juillet 2026, ils n’avaient pas été reproduits indépendamment. Utilisez-les pour orienter vos hypothèses, mais exécutez vos propres évaluations avant tout déploiement en production.
| Benchmark | Affirmation d’Anthropic |
|---|---|
| Frontier-Bench v0.1 | Surpasse les autres modèles et plus que double le score d’Opus 4.8, à coût par tâche inférieur |
| ARC-AGI 3 | Environ 3× le score du deuxième meilleur modèle |
| OSWorld 2.0 | Surpasse Fable 5 pour un tiers du coût |
| CursorBench 3.2 | À moins de 0,5 % de Fable 5, pour la moitié du prix |
| Zapier AutomationBench | Taux de réussite environ 1,5× supérieur au deuxième meilleur modèle |
| Chimie organique | +10,2 points par rapport à Opus 4.8 |
| Analyse des protéines | +7,7 points par rapport à Opus 4.8 |
Pour une décision d’implémentation, les résultats CursorBench et OSWorld sont les plus pertinents si vous développez des agents de code ou des workflows pilotés par outils. Mais un écart annoncé de 0,5 % peut être inférieur à l’impact de votre codebase, de vos prompts, de vos outils et de votre protocole d’évaluation.
L’analyse des benchmarks détaille ce que ces évaluations mesurent et les tests à reproduire dans votre environnement.
Limites : Opus 5 n’est pas le sommet de la gamme
Opus 5 n’est pas le modèle Claude le plus performant sur tous les cas d’usage.
Fable 5 conserve la désignation de « modèle le plus performant largement disponible ». Anthropic indique également que Mythos 5 reste devant sur deux domaines spécifiques :
- l’exploitation de cybersécurité ;
- la recherche autonome en biologie.
Pour le codage agentique et l’automatisation d’entreprise, cette limite ne sera généralement pas bloquante. En revanche, pour la recherche en sécurité ou le travail scientifique autonome, elle doit entrer dans votre choix de modèle.
Consultez l’explication du modèle de classe Mythos et Fable 5 vs Mythos 5.
Migrer depuis Opus 4.8 : deux changements qui cassent le code
Changer seulement l’ID du modèle n’est pas suffisant. Deux comportements peuvent casser vos appels dès la première requête.
1. La pensée est activée par défaut
Avec Opus 4.8, une requête sans champ thinking s’exécutait sans pensée. Avec Opus 5, cette même requête utilise la pensée adaptative.
max_tokens couvre toujours à la fois les jetons de pensée et la sortie visible. Si vous aviez fixé ce plafond au plus près de la taille de réponse attendue, votre réponse peut être tronquée sans erreur explicite.
Action recommandée : augmentez max_tokens, puis mesurez la consommation réelle dans vos tests.
{
"model": "claude-opus-5",
"max_tokens": 8192,
"messages": [
{
"role": "user",
"content": "Refactorise ce gestionnaire et explique les compromis."
}
]
}
2. Désactiver la pensée est incompatible avec certains efforts
Cette combinaison renvoie une erreur HTTP 400 :
{
"thinking": { "type": "disabled" },
"output_config": {
"effort": "xhigh"
}
}
La désactivation de la pensée est limitée au niveau d’effort high. Les niveaux xhigh et max ne sont pas compatibles avec thinking: { "type": "disabled" }.
Autres points à vérifier pendant votre migration :
- les niveaux d’effort ont été recalibrés ;
- l’en-tête bêta de fenêtre de contexte a disparu ;
- les messages système au cours d’une conversation sont acceptés, alors qu’Opus 4.8 les rejetait avec une erreur 400 ;
- le Niveau de Priorité a disparu.
Utilisez le guide de migration Opus 4.8 vers Opus 5 pour les exemples avant/après, ainsi que le guide de migration d’Anthropic. Si vous maintenez encore l’ancienne intégration, consultez aussi la présentation de l’API Opus 4.8.
Configurer output_config.effort
Le paramètre output_config.effort contrôle la quantité de réflexion du modèle avant sa réponse, donc le coût et la capacité de raisonnement mobilisée.
Les valeurs disponibles sont :
low
medium
high
xhigh
max
La valeur par défaut est high.
Exemple :
{
"model": "claude-opus-5",
"max_tokens": 8192,
"output_config": {
"effort": "xhigh"
},
"messages": [
{
"role": "user",
"content": "Analyse ce diff, identifie les régressions potentielles et propose un patch minimal."
}
]
}
Approche pratique pour sélectionner un niveau :
| Cas d’usage | Point de départ |
|---|---|
| Classification, extraction, transformations simples |
low ou medium
|
| Révision de code, analyse métier, génération structurée | high |
| Codage agentique, débogage complexe, boucles avec outils | xhigh |
| Cas nécessitant le maximum de capacité | max |
Ne réutilisez pas aveuglément vos paramètres Opus 4.8 : Anthropic indique que les niveaux ont été recalibrés. Testez au minimum low, high et xhigh sur un jeu d’évaluations représentatif.
Le guide du paramètre d’effort explique comment comparer les niveaux et leur interaction avec max_tokens.
Adapter vos prompts au comportement d’Opus 5
Le guide de prompting Opus 5 d’Anthropic décrit plusieurs changements de comportement utiles à prendre en compte.
- Le modèle vérifie davantage son travail. Retirez les consignes héritées telles que « vérifie deux fois ta réponse » si elles ne sont pas nécessaires : elles peuvent entraîner une sur-vérification et augmenter les coûts.
- Les réponses sont plus longues par défaut. Réduire l’effort diminue la pensée, pas forcément la taille de la sortie visible. Demandez explicitement une réponse concise si nécessaire.
- Le modèle délègue plus facilement à des sous-agents. Délimitez cette délégation pour les workflows sensibles au coût.
- Le modèle peut étendre la portée d’une tâche. Définissez clairement les fichiers, composants, contraintes et critères d’acceptation.
Exemple de prompt contraint :
Corrige uniquement la validation de l’entrée dans src/auth/login.ts.
Contraintes :
- Ne modifie aucun autre fichier.
- Ne change pas l’API publique.
- Retourne un patch unifié.
- Limite l’explication à cinq puces.
Lorsque la pensée est désactivée, deux artefacts peuvent apparaître : des appels d’outils écrits en texte brut qui ne s’exécutent jamais et des balises XML internes dans la sortie. Dans une boucle agentique, ce texte peut corrompre les tours suivants.
L’atténuation recommandée par Anthropic consiste à laisser la pensée activée et à réduire plutôt le niveau d’effort. Pour des exemples prêts à copier, consultez l’analyse d’ingénierie des invites et le guide Claude Code.
Où exécuter Claude Opus 5
| Plateforme | Statut |
|---|---|
| API Claude | Disponible, ID : claude-opus-5
|
| claude.ai | Disponible ; par défaut pour Max, modèle supérieur pour Pro |
| Claude Code | Disponible |
| Claude Cowork | Disponible |
| Amazon Bedrock | Disponible sous anthropic.claude-opus-5
|
| Plateforme Claude sur AWS | Disponible, ID propriétaire |
| Google Cloud | Disponible sous claude-opus-5
|
| Microsoft Foundry | Disponible |
| GitHub Copilot | Disponible |
Le mode rapide est l’exception : il est disponible uniquement via l’API propriétaire, et non sur Bedrock, Google Cloud, Microsoft Foundry ou l’API Batch.
Tester vos requêtes Opus 5 dans Apidog
Tester Opus 5 implique de valider des en-têtes d’authentification, un corps JSON, des réponses en streaming et des erreurs reproductibles. Avec Apidog, vous pouvez envoyer les requêtes, les enregistrer dans une collection, utiliser des variables d’environnement pour les secrets et inspecter chaque réponse.
Configuration recommandée :
- Stockez
ANTHROPIC_API_KEYdans une variable d’environnement. - Créez une requête Messages de référence.
- Dupliquez-la pour comparer
low,highetxhighavec exactement le même prompt. - Activez le streaming et inspectez le flux SSE pour identifier précisément les troncatures.
- Vérifiez le bloc
usagesur chaque réponse pour suivre les jetons et les accès au cache.
Requête de référence :
curl https://api.anthropic.com/v1/messages \
--header "x-api-key: $ANTHROPIC_API_KEY" \
--header "anthropic-version: 2023-06-01" \
--header "content-type: application/json" \
--data '{
"model": "claude-opus-5",
"max_tokens": 8192,
"messages": [
{
"role": "user",
"content": "Refactor this handler and explain the tradeoffs."
}
]
}'
Cette requête utilise la pensée adaptative puisque le champ thinking n’est pas défini. Ne réutilisez pas automatiquement une valeur de max_tokens faible qui fonctionnait avec Opus 4.8 : elle peut provoquer une troncature avec Opus 5.
Pour reproduire ce test, téléchargez Apidog et importez la requête. Le guide API étape par étape couvre le streaming, l’utilisation d’outils et l’analyse de usage.
Quand choisir Opus 5
Choisissez Opus 5 si :
- Vous construisez des agents ou des workflows intensifs en outils. C’est le cas d’usage ciblé par Anthropic.
- Vous utilisez Fable 5 et devez réduire les coûts. L’écart annoncé mérite une évaluation sur vos propres tâches. Consultez Opus 5 vs Fable 5.
- Vous utilisez déjà Opus 4.8. Le tarif est identique, la date de connaissance est plus récente et les performances annoncées sont meilleures ; prévoyez toutefois le travail de migration.
- Vous avez besoin de connaissances récentes. La date limite de mai 2026 est environ quatre mois plus récente que les autres modèles Claude actuels mentionnés ici.
Conservez votre modèle actuel si :
- Le Niveau de Priorité est indispensable. Opus 4.8 le prend en charge ; Opus 5 non. Vérifiez la tarification et les niveaux d’Opus 4.8.
- Votre charge est simple, massive et sensible au coût. Sonnet 5 peut être suffisant. Consultez Opus 5 vs Sonnet 5.
- Vous réalisez de l’exploitation de cybersécurité ou de la recherche autonome en biologie. Mythos 5 reste devant sur ces capacités spécifiques.
FAQ
Quel est l’ID du modèle Claude Opus 5 ?
Utilisez claude-opus-5, sans suffixe de date. Sur Amazon Bedrock, utilisez anthropic.claude-opus-5.
Combien coûte Claude Opus 5 ?
5 $ par million de jetons d’entrée et 25 $ par million de jetons de sortie. L’API Batch réduit ces tarifs à 2,50 $ et 12,50 $. Le mode rapide les double à 10 $ et 50 $.
Claude Opus 5 est-il meilleur que Fable 5 ?
Selon les chiffres publiés par Anthropic, Opus 5 est proche de Fable 5 sur CursorBench 3.2 et le dépasse sur OSWorld 2.0 pour un coût inférieur. Fable 5 conserve néanmoins la désignation de modèle le plus performant largement disponible. Ces résultats n’étaient pas indépendamment reproduits au 25 juillet 2026.
Quelle est la fenêtre de contexte d’Opus 5 ?
1 000 000 de jetons, par défaut et au maximum, sans en-tête bêta ni surcharge de contexte long. La sortie maximale est de 128 000 jetons avec l’API Messages, ou 300 000 avec l’API Batch et l’en-tête output-300k-2026-03-24.
Dois-je modifier mon code en migrant depuis Opus 4.8 ?
Oui. La pensée est activée par défaut, ce qui impose de revoir max_tokens pour éviter les troncatures silencieuses. De plus, thinking: {type: "disabled"} combiné à xhigh ou max renvoie une erreur 400. Réévaluez aussi vos niveaux d’effort.
Quelle est la date limite de connaissance d’Opus 5 ?
Mai 2026, annoncée comme la date la plus récente parmi les modèles Claude actuels.

Top comments (0)