DEV Community

Cover image for Qu'est-ce que Claude Opus 5 ? Spécifications, Benchmarks et Prix
Antoine Laurent
Antoine Laurent

Posted on • Originally published at apidog.com

Qu'est-ce que Claude Opus 5 ? Spécifications, Benchmarks et Prix

Claude Opus 5 est le dernier modèle de la série Opus d’Anthropic, lancé le 24 juillet 2026. Anthropic le positionne pour le codage agentique complexe et les charges de travail d’entreprise, et le présente comme le point de départ par défaut si vous ne savez pas quel modèle choisir. Son tarif est de 5 $ par million de jetons d’entrée et 25 $ par million de jetons de sortie, soit le même prix qu’Opus 4.8 et la moitié du tarif annoncé pour Fable 5.

Essayez Apidog dès aujourd’hui

Ce guide détaille les spécifications, les coûts, les benchmarks annoncés par Anthropic, les changements d’API à prendre en compte lors d’une migration depuis Opus 4.8, les plateformes disponibles et les limites du modèle. Si vous appelez le modèle via HTTP, vous pouvez envoyer et inspecter vos requêtes dans Apidog.

Claude Opus 5 en un coup d’œil

Spécification Valeur
ID de modèle API claude-opus-5 — sans suffixe de date
Lancé le 24 juillet 2026
Fenêtre de contexte 1 000 000 de jetons, par défaut et maximum
Sortie maximale 128 000 jetons avec l’API Messages ; 300 000 avec l’API Batch et l’en-tête bêta output-300k-2026-03-24
Tarification de base 5 $ par M de jetons d’entrée ; 25 $ par M de jetons de sortie
Date limite de connaissance Mai 2026
Pensée adaptative Activée par défaut
Niveaux d’effort low, medium, high, xhigh, max ; valeur par défaut : high
Niveau de priorité Non pris en charge
Disponibilité API Claude, claude.ai, Claude Code, Claude Cowork, Amazon Bedrock, Plateforme Claude sur AWS, Google Cloud, Microsoft Foundry, GitHub Copilot

Points à retenir avant de l’intégrer :

  • La fenêtre de contexte de 1M de jetons est disponible sans en-tête bêta et sans surcharge de prix pour les longs contextes.
  • La date limite de connaissance de mai 2026 est plus récente que celle de Sonnet 5 et Fable 5, annoncée à janvier 2026.
  • Le Niveau de Priorité, disponible sur Opus 4.8, n’est pas pris en charge par Opus 5. Si votre planification de capacité en dépend, consultez le guide de migration.

Pour la liste complète des modèles et champs API, consultez l’aperçu des modèles d’Anthropic.

Identifier et sélectionner le modèle

Opus 5 succède à Claude Opus 4.8.

Utilisez l’ID correspondant à votre plateforme :

Plateforme ID
API Claude claude-opus-5
Amazon Bedrock anthropic.claude-opus-5
Google Cloud claude-opus-5
Plateforme Claude sur AWS ID propriétaire

Claude Opus 5

La gamme Opus se situe au-dessus de Sonnet et sous les modèles de recherche Fable et Mythos. Le changement important avec Opus 5 est son positionnement : Anthropic recommande désormais de commencer par ce modèle, alors que Sonnet était auparavant le choix par défaut et Opus l’option de montée en gamme.

Opus 5 est aussi le modèle par défaut pour les abonnés Max et le modèle le plus performant disponible sur Pro. Pour comparer les options d’accès, consultez les chemins gratuits et les moins chers.

Coût : calculez avant de migrer

Tarif Entrée, par M de jetons Sortie, par M de jetons
Standard 5,00 $ 25,00 $
API Batch, réduction de 50 % 2,50 $ 12,50 $
Mode rapide, aperçu de recherche 10,00 $ 50,00 $
Écriture cache, TTL 5 minutes 6,25 $ n/a
Écriture cache, TTL 1 heure 10,00 $ n/a
Lecture et rafraîchissement du cache 0,50 $ n/a

Claude Fable 5 est tarifé à 10 $ par M de jetons d’entrée et 50 $ par M de jetons de sortie. Anthropic affirme qu’Opus 5 se situe à moins de 0,5 % de Fable 5 sur le codage agentique, pour la moitié du prix.

Quelques optimisations pratiques :

  1. Activez le cache pour les prompts système réutilisés. Le minimum de mise en cache passe à 512 jetons, contre 1 024 sur Opus 4.8.
  2. Utilisez Batch pour les tâches non interactives. Le tarif est réduit de moitié.
  3. Évitez le mode rapide sans besoin explicite. Il double les prix et n’est disponible que sur l’API propriétaire.
  4. Évaluez l’impact de inference_geo: "us". Ce réglage ajoute un multiplicateur de 1.1x sur les jetons d’entrée, de sortie et de cache.
  5. Mesurez vos appels d’outils. Le surcoût de prompt système pour tool_choice: "auto" ou "none" est de 286 jetons, contre 290 sur Opus 4.8 et 675 sur Opus 4.7.

Pour des scénarios détaillés, consultez l’analyse de la tarification et le guide pour réduire votre facture API Claude. La page de tarification d’Anthropic reste la référence.

Benchmarks : traitez-les comme des affirmations fournisseur

Les résultats suivants ont été publiés par Anthropic au lancement. Au 25 juillet 2026, ils n’avaient pas été reproduits indépendamment. Utilisez-les pour orienter vos hypothèses, mais exécutez vos propres évaluations avant tout déploiement en production.

Benchmark Affirmation d’Anthropic
Frontier-Bench v0.1 Surpasse les autres modèles et plus que double le score d’Opus 4.8, à coût par tâche inférieur
ARC-AGI 3 Environ 3× le score du deuxième meilleur modèle
OSWorld 2.0 Surpasse Fable 5 pour un tiers du coût
CursorBench 3.2 À moins de 0,5 % de Fable 5, pour la moitié du prix
Zapier AutomationBench Taux de réussite environ 1,5× supérieur au deuxième meilleur modèle
Chimie organique +10,2 points par rapport à Opus 4.8
Analyse des protéines +7,7 points par rapport à Opus 4.8

Pour une décision d’implémentation, les résultats CursorBench et OSWorld sont les plus pertinents si vous développez des agents de code ou des workflows pilotés par outils. Mais un écart annoncé de 0,5 % peut être inférieur à l’impact de votre codebase, de vos prompts, de vos outils et de votre protocole d’évaluation.

L’analyse des benchmarks détaille ce que ces évaluations mesurent et les tests à reproduire dans votre environnement.

Limites : Opus 5 n’est pas le sommet de la gamme

Opus 5 n’est pas le modèle Claude le plus performant sur tous les cas d’usage.

Fable 5 conserve la désignation de « modèle le plus performant largement disponible ». Anthropic indique également que Mythos 5 reste devant sur deux domaines spécifiques :

  • l’exploitation de cybersécurité ;
  • la recherche autonome en biologie.

Pour le codage agentique et l’automatisation d’entreprise, cette limite ne sera généralement pas bloquante. En revanche, pour la recherche en sécurité ou le travail scientifique autonome, elle doit entrer dans votre choix de modèle.

Consultez l’explication du modèle de classe Mythos et Fable 5 vs Mythos 5.

Migrer depuis Opus 4.8 : deux changements qui cassent le code

Changer seulement l’ID du modèle n’est pas suffisant. Deux comportements peuvent casser vos appels dès la première requête.

1. La pensée est activée par défaut

Avec Opus 4.8, une requête sans champ thinking s’exécutait sans pensée. Avec Opus 5, cette même requête utilise la pensée adaptative.

max_tokens couvre toujours à la fois les jetons de pensée et la sortie visible. Si vous aviez fixé ce plafond au plus près de la taille de réponse attendue, votre réponse peut être tronquée sans erreur explicite.

Action recommandée : augmentez max_tokens, puis mesurez la consommation réelle dans vos tests.

{
  "model": "claude-opus-5",
  "max_tokens": 8192,
  "messages": [
    {
      "role": "user",
      "content": "Refactorise ce gestionnaire et explique les compromis."
    }
  ]
}
Enter fullscreen mode Exit fullscreen mode

2. Désactiver la pensée est incompatible avec certains efforts

Cette combinaison renvoie une erreur HTTP 400 :

{
  "thinking": { "type": "disabled" },
  "output_config": {
    "effort": "xhigh"
  }
}
Enter fullscreen mode Exit fullscreen mode

La désactivation de la pensée est limitée au niveau d’effort high. Les niveaux xhigh et max ne sont pas compatibles avec thinking: { "type": "disabled" }.

Autres points à vérifier pendant votre migration :

  • les niveaux d’effort ont été recalibrés ;
  • l’en-tête bêta de fenêtre de contexte a disparu ;
  • les messages système au cours d’une conversation sont acceptés, alors qu’Opus 4.8 les rejetait avec une erreur 400 ;
  • le Niveau de Priorité a disparu.

Utilisez le guide de migration Opus 4.8 vers Opus 5 pour les exemples avant/après, ainsi que le guide de migration d’Anthropic. Si vous maintenez encore l’ancienne intégration, consultez aussi la présentation de l’API Opus 4.8.

Configurer output_config.effort

Le paramètre output_config.effort contrôle la quantité de réflexion du modèle avant sa réponse, donc le coût et la capacité de raisonnement mobilisée.

Les valeurs disponibles sont :

low
medium
high
xhigh
max
Enter fullscreen mode Exit fullscreen mode

La valeur par défaut est high.

Exemple :

{
  "model": "claude-opus-5",
  "max_tokens": 8192,
  "output_config": {
    "effort": "xhigh"
  },
  "messages": [
    {
      "role": "user",
      "content": "Analyse ce diff, identifie les régressions potentielles et propose un patch minimal."
    }
  ]
}
Enter fullscreen mode Exit fullscreen mode

Approche pratique pour sélectionner un niveau :

Cas d’usage Point de départ
Classification, extraction, transformations simples low ou medium
Révision de code, analyse métier, génération structurée high
Codage agentique, débogage complexe, boucles avec outils xhigh
Cas nécessitant le maximum de capacité max

Ne réutilisez pas aveuglément vos paramètres Opus 4.8 : Anthropic indique que les niveaux ont été recalibrés. Testez au minimum low, high et xhigh sur un jeu d’évaluations représentatif.

Le guide du paramètre d’effort explique comment comparer les niveaux et leur interaction avec max_tokens.

Adapter vos prompts au comportement d’Opus 5

Le guide de prompting Opus 5 d’Anthropic décrit plusieurs changements de comportement utiles à prendre en compte.

  • Le modèle vérifie davantage son travail. Retirez les consignes héritées telles que « vérifie deux fois ta réponse » si elles ne sont pas nécessaires : elles peuvent entraîner une sur-vérification et augmenter les coûts.
  • Les réponses sont plus longues par défaut. Réduire l’effort diminue la pensée, pas forcément la taille de la sortie visible. Demandez explicitement une réponse concise si nécessaire.
  • Le modèle délègue plus facilement à des sous-agents. Délimitez cette délégation pour les workflows sensibles au coût.
  • Le modèle peut étendre la portée d’une tâche. Définissez clairement les fichiers, composants, contraintes et critères d’acceptation.

Exemple de prompt contraint :

Corrige uniquement la validation de l’entrée dans src/auth/login.ts.

Contraintes :
- Ne modifie aucun autre fichier.
- Ne change pas l’API publique.
- Retourne un patch unifié.
- Limite l’explication à cinq puces.
Enter fullscreen mode Exit fullscreen mode

Lorsque la pensée est désactivée, deux artefacts peuvent apparaître : des appels d’outils écrits en texte brut qui ne s’exécutent jamais et des balises XML internes dans la sortie. Dans une boucle agentique, ce texte peut corrompre les tours suivants.

L’atténuation recommandée par Anthropic consiste à laisser la pensée activée et à réduire plutôt le niveau d’effort. Pour des exemples prêts à copier, consultez l’analyse d’ingénierie des invites et le guide Claude Code.

Où exécuter Claude Opus 5

Plateforme Statut
API Claude Disponible, ID : claude-opus-5
claude.ai Disponible ; par défaut pour Max, modèle supérieur pour Pro
Claude Code Disponible
Claude Cowork Disponible
Amazon Bedrock Disponible sous anthropic.claude-opus-5
Plateforme Claude sur AWS Disponible, ID propriétaire
Google Cloud Disponible sous claude-opus-5
Microsoft Foundry Disponible
GitHub Copilot Disponible

Le mode rapide est l’exception : il est disponible uniquement via l’API propriétaire, et non sur Bedrock, Google Cloud, Microsoft Foundry ou l’API Batch.

Tester vos requêtes Opus 5 dans Apidog

Tester Opus 5 implique de valider des en-têtes d’authentification, un corps JSON, des réponses en streaming et des erreurs reproductibles. Avec Apidog, vous pouvez envoyer les requêtes, les enregistrer dans une collection, utiliser des variables d’environnement pour les secrets et inspecter chaque réponse.

Test de requête Claude Opus 5 dans Apidog

Configuration recommandée :

  1. Stockez ANTHROPIC_API_KEY dans une variable d’environnement.
  2. Créez une requête Messages de référence.
  3. Dupliquez-la pour comparer low, high et xhigh avec exactement le même prompt.
  4. Activez le streaming et inspectez le flux SSE pour identifier précisément les troncatures.
  5. Vérifiez le bloc usage sur chaque réponse pour suivre les jetons et les accès au cache.

Requête de référence :

curl https://api.anthropic.com/v1/messages \
  --header "x-api-key: $ANTHROPIC_API_KEY" \
  --header "anthropic-version: 2023-06-01" \
  --header "content-type: application/json" \
  --data '{
    "model": "claude-opus-5",
    "max_tokens": 8192,
    "messages": [
      {
        "role": "user",
        "content": "Refactor this handler and explain the tradeoffs."
      }
    ]
  }'
Enter fullscreen mode Exit fullscreen mode

Cette requête utilise la pensée adaptative puisque le champ thinking n’est pas défini. Ne réutilisez pas automatiquement une valeur de max_tokens faible qui fonctionnait avec Opus 4.8 : elle peut provoquer une troncature avec Opus 5.

Pour reproduire ce test, téléchargez Apidog et importez la requête. Le guide API étape par étape couvre le streaming, l’utilisation d’outils et l’analyse de usage.

Quand choisir Opus 5

Choisissez Opus 5 si :

  • Vous construisez des agents ou des workflows intensifs en outils. C’est le cas d’usage ciblé par Anthropic.
  • Vous utilisez Fable 5 et devez réduire les coûts. L’écart annoncé mérite une évaluation sur vos propres tâches. Consultez Opus 5 vs Fable 5.
  • Vous utilisez déjà Opus 4.8. Le tarif est identique, la date de connaissance est plus récente et les performances annoncées sont meilleures ; prévoyez toutefois le travail de migration.
  • Vous avez besoin de connaissances récentes. La date limite de mai 2026 est environ quatre mois plus récente que les autres modèles Claude actuels mentionnés ici.

Conservez votre modèle actuel si :

  • Le Niveau de Priorité est indispensable. Opus 4.8 le prend en charge ; Opus 5 non. Vérifiez la tarification et les niveaux d’Opus 4.8.
  • Votre charge est simple, massive et sensible au coût. Sonnet 5 peut être suffisant. Consultez Opus 5 vs Sonnet 5.
  • Vous réalisez de l’exploitation de cybersécurité ou de la recherche autonome en biologie. Mythos 5 reste devant sur ces capacités spécifiques.

FAQ

Quel est l’ID du modèle Claude Opus 5 ?

Utilisez claude-opus-5, sans suffixe de date. Sur Amazon Bedrock, utilisez anthropic.claude-opus-5.

Combien coûte Claude Opus 5 ?

5 $ par million de jetons d’entrée et 25 $ par million de jetons de sortie. L’API Batch réduit ces tarifs à 2,50 $ et 12,50 $. Le mode rapide les double à 10 $ et 50 $.

Claude Opus 5 est-il meilleur que Fable 5 ?

Selon les chiffres publiés par Anthropic, Opus 5 est proche de Fable 5 sur CursorBench 3.2 et le dépasse sur OSWorld 2.0 pour un coût inférieur. Fable 5 conserve néanmoins la désignation de modèle le plus performant largement disponible. Ces résultats n’étaient pas indépendamment reproduits au 25 juillet 2026.

Quelle est la fenêtre de contexte d’Opus 5 ?

1 000 000 de jetons, par défaut et au maximum, sans en-tête bêta ni surcharge de contexte long. La sortie maximale est de 128 000 jetons avec l’API Messages, ou 300 000 avec l’API Batch et l’en-tête output-300k-2026-03-24.

Dois-je modifier mon code en migrant depuis Opus 4.8 ?

Oui. La pensée est activée par défaut, ce qui impose de revoir max_tokens pour éviter les troncatures silencieuses. De plus, thinking: {type: "disabled"} combiné à xhigh ou max renvoie une erreur 400. Réévaluez aussi vos niveaux d’effort.

Quelle est la date limite de connaissance d’Opus 5 ?

Mai 2026, annoncée comme la date la plus récente parmi les modèles Claude actuels.

Top comments (0)