DEV Community

Cover image for Comment utiliser Claude Haiku 5.5 dans Claude Code (et comme modèle de sous-agent)
Antoine Laurent
Antoine Laurent

Posted on Originally published at apidog.com

Comment utiliser Claude Haiku 5.5 dans Claude Code (et comme modèle de sous-agent)

Pour utiliser Claude Haiku 5.5 dans Claude Code, mettez à jour vers la version v2.1.293 ou ultérieure avec claude update, puis démarrez une session avec claude --model claude-haiku-5-5 ou exécutez /model claude-haiku-5-5 dans une session active. Pour la plupart des workflows, utilisez-le comme sous-agent : définissez model: haiku dans un fichier de sous-agent et déléguez-lui les recherches, les exécutions de tests et les résumés depuis Sonnet 5.5 ou Opus 5.5. Avec une clé API, le tarif est de 0,10 $/0,50 $ par million de jetons d'entrée/sortie pour les prompts jusqu'à 100K jetons, puis de 0,50 $/2,50 $ au-delà.

Essayez Apidog dès aujourd’hui

Ce guide couvre la configuration, le piège de l'alias haiku, les niveaux d'effort, les fichiers de sous-agent, le palier de prix à 100K jetons et les cas où Sonnet ou Opus doivent rester le modèle principal. Pour comprendre le modèle, lisez ce qu'est Claude Haiku 5.5. Si votre code appelle des API, Apidog contient les scénarios de test qu'un sous-agent Haiku peut exécuter.

Claude Haiku 5.5 dans Claude Code

Claude Haiku 5.5 dans Claude Code en un coup d'œil

Paramètre Haiku 5.5
Version minimale v2.1.293 (claude update)
ID du modèle claude-haiku-5-5
Alias haiku Haiku 5.5 sur l'API Anthropic uniquement
Contexte 1M natif sur chaque plan, sans suffixe [1m]
Auto-compaction Environ 967K jetons par défaut
Effort par défaut medium (niveaux de low à max)
Réflexion (Thinking) Toujours activée ; ne peut pas être désactivée
Prix API 0,10 $/0,50 $ jusqu'à 100K jetons ; 0,50 $/2,50 $ au-delà
Plans Pro, Max, Team, Enterprise ou clé API ; pas Gratuit

Étape 1 : mettre à jour Claude Code

Haiku 5.5 nécessite Claude Code v2.1.293 ou une version ultérieure. L'entrée du journal des modifications indique qu'il est désormais le modèle Haiku par défaut sur l'API Anthropic.

claude update
Enter fullscreen mode Exit fullscreen mode

Vérifiez ensuite votre version et démarrez une session :

claude --version
claude --model claude-haiku-5-5
Enter fullscreen mode Exit fullscreen mode

Claude Code n'est pas disponible avec le plan gratuit. Les utilisateurs gratuits peuvent sélectionner Haiku 5.5 dans les applications Claude.ai, mais Claude Code nécessite un plan Pro, Max, Team, Enterprise ou une clé API Anthropic. Selon claude.com/pricing, le plan Pro coûte 17 $ par mois facturé annuellement ou 20 $ par mois, tandis que Max commence à 100 $.

Étape 2 : sélectionner Haiku 5.5 comme modèle principal

Pour lancer directement une session avec Haiku 5.5 :

claude --model claude-haiku-5-5
Enter fullscreen mode Exit fullscreen mode

Dans une session existante, utilisez :

/model claude-haiku-5-5
Enter fullscreen mode Exit fullscreen mode

Si votre paramètre model enregistré vaut haiku, une session précédemment enregistrée sur Haiku 4.5 reprendra sur Haiku 5.5 uniquement via l'API Anthropic.

L'alias haiku ne signifie Haiku 5.5 que sur l'API Anthropic

Fournisseur haiku correspond à
API Anthropic Haiku 5.5
Plateforme Claude sur AWS Haiku 4.5
Amazon Bedrock, Agent Platform de Google Cloud Haiku 4.5
Microsoft Foundry Haiku 4.5

Sur les fournisseurs cloud, /model haiku et model: haiku dans un fichier de sous-agent sélectionnent Haiku 4.5.

Épinglez plutôt l'identifiant complet adapté à votre fournisseur :

  • Google Cloud et plateforme Claude sur AWS : claude-haiku-5-5
  • Microsoft Foundry : le nom de votre déploiement
  • Amazon Bedrock : un ID de profil d'inférence tel que us.anthropic.claude-haiku-5-5

Vous pouvez aussi rediriger l'alias avec ANTHROPIC_DEFAULT_HAIKU_MODEL, présenté à l'étape 5.

Étape 3 : choisir un niveau d'effort

Haiku 5.5 est le premier modèle Haiku avec contrôle de l'effort :

  • low
  • medium
  • high
  • xhigh
  • max

Claude Code démarre avec medium par défaut. Pour augmenter l'effort dès le démarrage :

claude --model claude-haiku-5-5 --effort high
Enter fullscreen mode Exit fullscreen mode

Dans une session active :

/effort low
Enter fullscreen mode Exit fullscreen mode

Choisissez le niveau selon la tâche :

  • low : appels d'outils courts, recherches simples, gros volumes.
  • medium : travail quotidien et automatisations standard.
  • high : tâches d'agent plus longues ou diagnostics plus complexes.
  • xhigh et max : uniquement si vos évaluations montrent un gain mesurable.

La réflexion (Thinking) reste activée dans Claude Code. Les paramètres suivants n'ont aucun effet sur Haiku 5.5 dans Claude Code :

alwaysThinkingEnabled: false
MAX_THINKING_TOKENS=0
Enter fullscreen mode Exit fullscreen mode

Pour réduire les jetons de réflexion, baissez l'effort. L'API Messages brute peut désactiver la réflexion avec un effort high ou inférieur.

Étape 4 : exécuter Haiku 5.5 en tant que sous-agent

Anthropic indique que Haiku 5.5 fonctionne bien avec Opus 5.5 et Sonnet 5.5 comme sous-agent pour les tâches de codage.

Les sous-agents sont des fichiers Markdown avec métadonnées YAML placés dans :

.claude/agents/     # pour le projet courant
~/.claude/agents/   # pour tous vos projets
Enter fullscreen mode Exit fullscreen mode

Seuls name et description sont requis. La documentation des sous-agents accepte sonnet, opus, haiku, fable, un ID complet ou inherit dans le champ model. Notre guide des sous-agents détaille les scopes et les outils.

Remplacer Explore par un explorateur économique

Le sous-agent Explore intégré s'exécute sur le modèle de la conversation principale, pas nécessairement sur Haiku. Dans une session Opus 5.5, chaque recherche Explore peut donc utiliser Opus.

Créez un sous-agent utilisateur ou projet nommé Explore pour le remplacer et conserver un modèle dédié :

---
name: Explore
description: Recherche rapide en lecture seule dans la base de code. Permet de trouver des fichiers, des symboles et des sites d'appel sans rien modifier.
tools: Read, Grep, Glob
model: haiku
effort: low
---

Vous recherchez dans la base de code et rapportez ce que vous trouvez. Retournez les chemins de fichiers avec les numéros de ligne et un court résumé de chaque correspondance. Ne modifiez jamais les fichiers.
Enter fullscreen mode Exit fullscreen mode

Enregistrez ce fichier sous :

.claude/agents/Explore.md
Enter fullscreen mode Exit fullscreen mode

Pendant son exécution, lancez /tasks pour confirmer le modèle utilisé. Sur un fournisseur cloud, remplacez haiku par l'ID complet de Haiku 5.5.

Forcer chaque sous-agent à utiliser Haiku

Pour exécuter tous les sous-agents sur Haiku, y compris Explore, ajoutez ces variables au bloc env de votre fichier de paramètres :

{
  "env": {
    "CLAUDE_CODE_SUBAGENT_MODEL": "haiku",
    "CLAUDE_CODE_SUBAGENT_MODEL_FORCE": "1"
  }
}
Enter fullscreen mode Exit fullscreen mode

CLAUDE_CODE_SUBAGENT_MODEL seul est une valeur par défaut : un champ model défini dans un sous-agent garde la priorité, et Explore ne change pas.

Étape 5 : diriger les tâches de fond vers Haiku 5.5

ANTHROPIC_DEFAULT_HAIKU_MODEL définit le modèle à utiliser pour haiku et les fonctionnalités d'arrière-plan, telles que la synthèse des sessions passées avec claude --resume.

L'ancienne variable ANTHROPIC_SMALL_FAST_MODEL est obsolète selon la référence des variables d'environnement. Remplacez-la si elle existe encore dans votre profil shell.

Sur l'API Anthropic, vous n'avez rien à définir. Sur Google Cloud, les tâches de fond utilisent Sonnet par défaut ; sur Foundry, le modèle principal ; sur Bedrock, Sonnet ou le modèle principal.

Après activation de Haiku 5.5 dans votre compte, épinglez-le explicitement :

# Plateforme d'agents de Google Cloud
export ANTHROPIC_DEFAULT_HAIKU_MODEL=claude-haiku-5-5

# Amazon Bedrock (ID de profil d'inférence)
export ANTHROPIC_DEFAULT_HAIKU_MODEL=us.anthropic.claude-haiku-5-5
Enter fullscreen mode Exit fullscreen mode

Le palier de prix de 100K dans les sessions longues

Le prix de Haiku 5.5 dépend de la longueur du prompt. Claude Code renvoie la conversation comme prompt à chaque tour.

Quand le contexte dépasse 100K jetons, chaque requête passe de :

0,10 $ / 0,50 $
Enter fullscreen mode Exit fullscreen mode

à :

0,50 $ / 2,50 $
Enter fullscreen mode Exit fullscreen mode

C'est cinq fois le tarif des prompts courts. La documentation ne précise pas si les jetons mis en cache comptent pour ce seuil : prévoyez votre budget comme s'ils étaient inclus.

L'auto-compaction ne suffit pas à éviter ce palier : Haiku 5.5 se compacte autour de 967K jetons par défaut. Adoptez plutôt ces deux pratiques :

  1. Compacter plus tôt. Utilisez /autocompact 100k pour rapprocher la compaction de la limite minimale acceptée par Claude Code.
  2. Déplacer le travail volumineux dans des sous-agents. Chaque sous-agent dispose de son propre contexte : les journaux de tests et résultats de recherche ne gonflent pas la conversation principale.

Même après 100K jetons, le tarif de 0,50 $/2,50 $ reste un quart des 2 $/10 $ de Sonnet 5.5. Sur un plan payant, les sessions consomment plutôt vos limites d'utilisation, et Anthropic n'a pas publié le mode de comptabilisation de Haiku 5.5 dans ces limites. Consultez notre répartition des prix de Haiku 5.5 pour l'arithmétique détaillée.

Pour les abonnés Max et Team, les nouveaux crédits API mensuels — 100 $ sur Max 5x, 200 $ sur Max 20x et jusqu'à 500 $ mutualisés sur Team — ne couvrent pas Claude Code interactif, selon la documentation des crédits API d'Anthropic.

Quand garder Sonnet 5.5 ou Opus 5.5 comme modèle principal

Anthropic indique que Sonnet 5.5 et Opus 5.5 restent de meilleurs choix pour les tâches complexes de codage agentique.

Sur Terminal-Bench 4.0, exécuté par Anthropic dans Claude Code avec effort maximal, Haiku 5.5 a obtenu 39,2 %, contre 70,6 % pour Sonnet 5.5.

Effort Haiku 5.5 Sonnet 5.5
medium 20,3 % à 0,68 $ 28,8 % à 0,68 $
high 24,8 % à 1,04 $ 43 % à 1,46 $
max 39,2 % à 2,64 $ 70,6 % à 10,44 $

À effort medium, les deux modèles coûtent environ le même prix par tentative, mais Sonnet obtient un meilleur score. Le faible prix par jeton de Haiku ne se traduit donc pas automatiquement par un meilleur choix pour les longues sessions de codage difficiles.

L'utilisation d'ordinateur donne un résultat différent. Sur OSWorld 2.1, Haiku 5.5 en medium a atteint 53,3 % à 0,13 $ par tentative, tandis que Sonnet 5.5 en low a atteint 57,9 % à 0,68 $.

Consultez notre analyse des benchmarks de Haiku 5.5 pour les résultats complets, ainsi que le guide Claude Code de Sonnet 5.5 pour configurer le modèle principal.

Une répartition pratique :

  • Sonnet 5.5 ou Opus 5.5 : modèle principal.
  • Haiku 5.5 : Explore, exécution de tests, lecture de journaux et récupération de documentation.

Exemple : un sous-agent Haiku qui exécute vos tests Apidog

Les exécutions de tests sont verbeuses et répétitives : c'est un bon cas d'usage pour Haiku. Le CLI Apidog exécute vos scénarios de test enregistrés depuis le terminal. Un sous-agent peut donc lancer ces tests et renvoyer un rapport court sans polluer le contexte du modèle principal.

---
name: api-test-runner
description: Exécute les scénarios de test Apidog du projet avec le CLI Apidog après la modification d'un point de terminaison API, puis rapporte les nombres de succès et d'échecs avec les requêtes en échec.
tools: Bash, Read
model: haiku
effort: low
---

Exécutez la commande de test CLI Apidog documentée dans le README de ce dépôt pour le
scénario qui couvre le point de terminaison modifié. Rapporter les nombres de succès et d'échecs.
Pour chaque échec, donnez le nom de la requête, le résultat attendu et le résultat réel.
Ne modifiez pas le code. Ne réessayez pas une exécution échouée plus d'une fois.
Enter fullscreen mode Exit fullscreen mode

Ajoutez ce fichier dans :

.claude/agents/api-test-runner.md
Enter fullscreen mode Exit fullscreen mode

La configuration du CLI, y compris l'authentification et la commande d'exécution, est disponible dans Apidog CLI dans Claude Code. Téléchargez Apidog pour créer les scénarios que le sous-agent exécutera.

Migrer une application de Haiku 4.5

Si votre application utilise Haiku 4.5 via l'API, demandez à Claude Code de démarrer la migration :

/claude-api migrate this project to claude-haiku-5-5
Enter fullscreen mode Exit fullscreen mode

Attendez-vous à des changements majeurs. Les éléments suivants renvoient une erreur HTTP 400 avec Haiku 5.5 :

  • réflexion manuelle avec budget_tokens ;
  • valeur non par défaut pour temperature ;
  • valeur non par défaut pour top_p ;
  • tout usage de top_k ;
  • préremplissage de l'assistant.

Le guide Haiku 5.5 vs Haiku 4.5 liste toutes les corrections à appliquer.

Après la migration :

  1. Enregistrez l'ancienne et la nouvelle requête comme paire dans Apidog.
  2. Stockez ANTHROPIC_API_KEY dans une variable d'environnement.
  3. Ajoutez des assertions sur stop_reason et usage.
  4. Faites échouer le test si un nouveau stop_reason: refusal apparaît ou si l'usage de jetons augmente brutalement.

Ainsi, une régression atteint votre pipeline de test plutôt que la production.

FAQ

Haiku 5.5 est-il le modèle par défaut dans Claude Code ?

Non. C'est le modèle Haiku par défaut sur l'API Anthropic, ce qui signifie que l'alias haiku pointe vers lui. Sélectionnez-le comme modèle principal avec --model ou /model.

Puis-je utiliser Haiku 5.5 dans Claude Code avec le plan gratuit ?

Non. Claude Code nécessite un plan payant ou une clé API. Les utilisateurs gratuits peuvent sélectionner Haiku 5.5 dans les applications Claude.ai. Consultez aussi comment utiliser Claude Haiku 5.5 gratuitement.

Pourquoi model: haiku me donne-t-il Haiku 4.5 ?

Vous utilisez Bedrock, Google Cloud, Foundry ou la plateforme Claude sur AWS, ou votre version de Claude Code est antérieure à v2.1.293. Épinglez l'ID complet ou définissez ANTHROPIC_DEFAULT_HAIKU_MODEL.

Puis-je désactiver la réflexion (thinking) pour économiser des jetons ?

Pas dans Claude Code. Réduisez plutôt l'effort : low est le paramètre le plus économique.

Votre prochaine étape

Exécutez :

claude update
Enter fullscreen mode Exit fullscreen mode

Ajoutez ensuite le remplacement Haiku de Explore et conservez votre modèle principal actuel pendant une semaine. Si votre projet possède des API, ajoutez ensuite le sous-agent d'exécution de tests.

Pour appeler le modèle depuis votre propre code, commencez par le guide API de Haiku 5.5. Apidog est gratuit pour commencer et fournit à ce sous-agent de vrais scénarios de test à exécuter.

Top comments (0)