Claude Opus 5 est sorti le 24 juillet 2026 et a été intégré à Claude Code dès le premier jour. Pour les abonnés Max, il devient le modèle par défaut. Pour les abonnés Pro, c'est désormais le modèle le plus puissant accessible. Avec une clé API, son tarif est de 5 $ par million de jetons d'entrée et 25 $ par million de jetons de sortie, comme Opus 4.8.
Essayez Apidog dès aujourd'hui
Votre configuration actuelle peut toutefois dégrader l'expérience. Opus 5 vérifie spontanément son travail, produit des réponses plus longues par défaut et délègue plus volontiers à des sous-agents qu'Opus 4.8. Des règles CLAUDE.md conçues pour les modèles précédents peuvent donc amplifier ces comportements au lieu de les encadrer.
Ce guide explique comment sélectionner le modèle, adapter l'effort, mettre à jour vos invites et tester réellement les API générées. Pour une présentation complète, consultez l'aperçu de Claude Opus 5 et l'annonce de Claude Opus 5 d'Anthropic.
Ce qui change par niveau d'abonnement
L'accès à Opus 5 évolue selon votre offre.
Abonnés Max : Opus 5 devient le modèle par défaut. Aucune configuration n'est nécessaire, mais vos habitudes de coût et de verbosité doivent être recalibrées pour ce nouveau modèle.
Abonnés Pro : Opus 5 devient le modèle le plus performant disponible dans votre offre. Le niveau Pro donne donc accès au modèle par défaut recommandé par Anthropic dans sa documentation.
Utilisateurs de clés API : Opus 5 est disponible sur l'API Claude, Amazon Bedrock (anthropic.claude-opus-5), Google Cloud, Microsoft Foundry et GitHub Copilot. Son prix est de 5 $ en entrée et 25 $ en sortie par million de jetons, inchangé par rapport à Opus 4.8 et deux fois moins élevé que Fable 5 (10 $/50 $). Consultez l'analyse des prix d'Opus 5 pour les tarifs de cache et de traitement par lots.
Opus 5 a une date limite de connaissances en mai 2026, contre janvier 2026 pour Fable 5 et Sonnet 5. Pour un assistant qui travaille avec des bibliothèques et API récentes, ces cinq mois supplémentaires peuvent compter.
Sélectionner Opus 5 dans Claude Code
Dans une session Claude Code, ouvrez le sélecteur de modèle :
/model
Choisissez ensuite Claude Opus 5.
Pour sélectionner directement le modèle sans passer par le menu :
/model claude-opus-5
L'identifiant API exact est :
claude-opus-5
Utilisez cette chaîne telle quelle dans vos scripts, configurations de projet ou règles. Pour les identifiants propres à Bedrock ou Google Cloud, consultez la documentation Anthropic sur les modèles.
Opus 5 prend en charge jusqu'à 1 million de jetons de contexte par défaut et sans en-tête bêta, avec une sortie maximale de 128 k jetons sur l'API Messages. Ce contexte est utile pour les grands dépôts, mais n'envoyez pas tout le dépôt à chaque tour : vous augmentez inutilement le coût. L'aide-mémoire Claude Code couvre les autres commandes slash.
Configurer l'effort
Le paramètre API est output_config.effort. Il accepte cinq niveaux :
low
medium
high
xhigh
max
Les interfaces utilisateur l'exposent généralement sous forme de sélecteur d'effort.
1. Le niveau par défaut est high
Si vous ne précisez rien, Opus 5 utilise :
{
"output_config": {
"effort": "high"
}
}
Ne supposez pas un comportement medium ou adaptatif.
2. Réévaluez vos réglages Opus 4.8
Ne réutilisez pas vos paramètres sans test. Anthropic indique que low et medium sont plus capables sur Opus 5 que sur les versions Opus précédentes.
Procédez par évaluation :
- Préparez un jeu de tâches représentatif.
- Exécutez-les avec
medium. - Comparez qualité, temps et coût avec
high. - Réservez
xhighaux tâches de codage agentique ou complexes, conformément à la recommandation d'Anthropic.
Pour aller plus loin, consultez le guide des paramètres d'effort et le guide de migration depuis Opus 4.8.
3. Évitez l'erreur 400 avec xhigh et max
Cette combinaison échoue :
{
"thinking": {
"type": "disabled"
},
"output_config": {
"effort": "xhigh"
}
}
Avec thinking: {type: "disabled"}, les niveaux xhigh et max renvoient une erreur HTTP 400.
Choisissez l'une des approches suivantes :
- laissez la réflexion activée ;
- ou plafonnez l'effort à
high.
Dans Claude Code interactif, la requête est gérée pour vous. Ce problème apparaît surtout dans les scripts et intégrations SDK.
Gardez la réflexion activée. Lorsqu'elle est désactivée, Opus 5 peut produire des appels d'outils sous forme de texte brut qui ne seront jamais exécutés, ou exposer des balises XML internes dans la réponse visible. Réduisez plutôt le coût via l'effort.
Quatre modifications à appliquer dans CLAUDE.md
Ces changements réduisent les coûts, limitent la verbosité et gardent les tâches dans leur périmètre. Ils s'appuient sur le guide de prompting Opus 5 d'Anthropic.
1. Supprimez les consignes de vérification redondantes
Recherchez dans vos fichiers CLAUDE.md globaux et de projet les formulations telles que :
- « toujours vérifier votre travail » ;
- « vérifier le changement avant de rapporter » ;
- « confirmer que les tests réussissent puis confirmer à nouveau ».
Supprimez-les.
Opus 5 vérifie déjà son propre travail. Ajouter ces instructions provoque une sur-vérification : relecture des mêmes fichiers, relance de validations déjà effectuées et consommation de jetons pour confirmer plusieurs fois le même résultat.
2. Limitez les sous-agents
Opus 5 délègue plus volontiers qu'Opus 4.8. C'est utile pour les recherches parallélisables, mais coûteux si chaque petite tâche crée plusieurs agents.
Ajoutez une règle explicite dans votre CLAUDE.md :
## Délégation
Ne générez pas de sous-agents pour les tâches qu'un seul passage peut accomplir.
Utilisez au maximum deux sous-agents parallèles. Si une tâche semble en nécessiter
davantage, décrivez la répartition et demandez avant de générer.
L'objectif n'est pas de bloquer toute délégation, mais d'exiger qu'elle soit justifiée. Si vous construisez volontairement une architecture multi-agents, consultez le guide de création de sous-agents Claude Code.
3. Demandez des réponses concises
Opus 5 produit des réponses, résumés et documents plus longs par défaut qu'Opus 4.8.
Réduire l'effort ne raccourcit pas la sortie visible : l'effort règle la profondeur de réflexion, pas la longueur de réponse. Contrôlez donc la longueur dans l'invite ou dans CLAUDE.md :
## Style de réponse
Rendez les résultats en moins de 150 mots, sauf si je demande des détails.
Pas de résumé de ce que vous venez de faire si je peux voir le diff.
Passez l'introduction. Commencez par la réponse.
4. Délimitez les tâches étroites
Opus 5 peut étendre une tâche locale au module voisin et commenter ses corrections au fil de l'eau. Pour une modification ciblée, formulez une contrainte explicite.
Préférez :
Corrigez la vérification de nullité dans `parseConfig` et ne changez rien d'autre.
À :
Corrigez la vérification de nullité dans `parseConfig`.
L'article sur le prompting d'Opus 5 contient d'autres extraits prêts à copier-coller.
Construire une API, puis la tester réellement
Claude Code peut générer vos routes et votre logique métier. Il ne peut pas déterminer seul si une API en cours d'exécution respecte réellement son contrat.
Utilisez une boucle externe :
- Concevez les endpoints, schémas et réponses dans Apidog.
- Créez un serveur mock avec des données réalistes.
- Donnez à Opus 5 accès à la spécification via le serveur Apidog MCP.
- Faites implémenter l'API à Claude Code.
- Exécutez un scénario de test contre le service réel.
Exemple :
apidog run --access-token $APIDOG_TOKEN \
--project-id $PROJECT_ID \
--test-scenario "user-signup-flow"
Les assertions échouées reviennent dans la sortie de commande. Le modèle peut alors lire l'erreur, corriger l'implémentation et relancer le scénario. Cette vérification externe a plus de valeur qu'une auto-vérification, même avec un modèle qui vérifie déjà son raisonnement.
Cette configuration est également utile si vous appelez directement claude-opus-5 depuis votre code : vous pouvez envoyer des requêtes depuis Apidog, observer les événements SSE, inspecter les charges utiles des appels d'outils, stocker la clé API dans une variable d'environnement, comparer deux niveaux d'effort et consulter le bloc usage pour vérifier les hits de cache. Téléchargez Apidog pour configurer le projet localement.
Le plafond honnête
Opus 5 n'est pas le modèle Claude le plus haut placé dans tous les cas d'usage.
Fable 5 conserve la désignation de « modèle le plus performant largement diffusé » d'Anthropic. Opus 5 reste également en dessous de Mythos 5 pour l'exploitation en cybersécurité et la recherche autonome en biologie, selon Anthropic. Pour ces domaines, Opus 5 n'est donc pas le bon plafond. Consultez l'explication des modèles de classe Mythos pour comprendre ce positionnement.
Anthropic rapporte qu'Opus 5 :
- fait plus que doubler le score Frontier-Bench v0.1 d'Opus 4.8 ;
- atteint environ trois fois le score du meilleur modèle suivant sur ARC-AGI 3 ;
- se rapproche à 0,5 % du pic de Fable 5 sur CursorBench 3.2, pour la moitié du prix.
Ces résultats sont fournis par le fournisseur et, au 25 juillet 2026, ne sont pas reproduits indépendamment. Utilisez-les comme raison de lancer vos propres évaluations, pas comme verdict final.
Quand utiliser un autre modèle
Utilisez Opus 5 pour la plupart des tâches Claude Code :
- codage agentique ;
- refactorisations multi-fichiers ;
- tâches longues ;
- boucles où le modèle exécute des commandes et interprète leur sortie.
Orientez-vous vers un autre modèle si le coût domine, si Sonnet 5 suffit pour de l'édition standard, ou si votre problème relève des capacités de Fable 5 ou Mythos 5.
Le changement est immédiat :
/model claude-sonnet-5
Puis revenez à Opus 5 pour les tâches complexes :
/model claude-opus-5
Si vous utilisiez déjà Sonnet 5 dans Claude Code ou Fable 5 dans Claude Code, le flux de travail reste le même.
Conseils pratiques
-
Mettez à jour
CLAUDE.mden premier. Supprimez les règles de vérification, ajoutez une limite de longueur et un plafond de délégation. -
Réévaluez l'effort. Vos réglages Opus 4.8 ne sont plus forcément optimaux. Testez
lowetmedium. -
Laissez la réflexion activée. Réduisez le coût avec l'effort, pas en désactivant
thinking. - Délimitez le contexte. Un million de jetons est une capacité, pas une invitation à envoyer tout le dépôt à chaque requête.
- Vérifiez à l'extérieur. Une assertion échouée contre un contrat réel est plus utile qu'une confirmation générée par le modèle.
FAQ
Claude Opus 5 est-il disponible dans Claude Code ?
Oui, depuis sa sortie le 24 juillet 2026. Utilisez /model, choisissez Claude Opus 5 ou exécutez directement :
/model claude-opus-5
C'est le modèle par défaut pour Max et le modèle le plus performant accessible avec Pro.
Dois-je modifier mon CLAUDE.md pour Opus 5 ?
Probablement. Supprimez les instructions de vérification redondantes, car Opus 5 vérifie déjà son travail. Ajoutez aussi une règle de concision et une limite de sous-agents.
Pourquoi réduire l'effort ne raccourcit-il pas les réponses ?
L'effort contrôle la profondeur de réflexion, pas la longueur de la sortie visible. Pour obtenir une réponse plus courte, formulez une contrainte explicite dans l'invite ou dans CLAUDE.md.
Qu'est-ce qui provoque une erreur 400 avec l'effort xhigh ?
Sur Opus 5, thinking: {type: "disabled"} ne peut pas être combiné avec xhigh ou max. Activez la réflexion ou plafonnez l'effort à high. Consultez le guide de migration pour les autres changements depuis Opus 4.8.
Puis-je utiliser Opus 5 dans Claude Code avec un forfait gratuit ?
Opus 5 est disponible avec les abonnements Pro et Max, ainsi que via l'API. Pro y accède comme modèle le plus puissant de son niveau, tandis que Max l'utilise par défaut. Consultez le guide d'accès gratuit à Opus 5 pour les options disponibles.


Top comments (0)