Pour utiliser Claude Haiku 5.5 dans Claude Code, mettez à jour vers la version v2.1.293 ou ultérieure avec claude update, puis démarrez une session avec claude --model claude-haiku-5-5 ou exécutez /model claude-haiku-5-5 dans une session active. Pour la plupart des workflows, utilisez-le comme sous-agent : définissez model: haiku dans un fichier de sous-agent et déléguez-lui les recherches, les exécutions de tests et les résumés depuis Sonnet 5.5 ou Opus 5.5. Avec une clé API, le tarif est de 0,10 $/0,50 $ par million de jetons d'entrée/sortie pour les prompts jusqu'à 100K jetons, puis de 0,50 $/2,50 $ au-delà.
Essayez Apidog dès aujourd’hui
Ce guide couvre la configuration, le piège de l'alias haiku, les niveaux d'effort, les fichiers de sous-agent, le palier de prix à 100K jetons et les cas où Sonnet ou Opus doivent rester le modèle principal. Pour comprendre le modèle, lisez ce qu'est Claude Haiku 5.5. Si votre code appelle des API, Apidog contient les scénarios de test qu'un sous-agent Haiku peut exécuter.
Claude Haiku 5.5 dans Claude Code en un coup d'œil
| Paramètre | Haiku 5.5 |
|---|---|
| Version minimale | v2.1.293 (claude update) |
| ID du modèle | claude-haiku-5-5 |
Alias haiku
|
Haiku 5.5 sur l'API Anthropic uniquement |
| Contexte | 1M natif sur chaque plan, sans suffixe [1m]
|
| Auto-compaction | Environ 967K jetons par défaut |
| Effort par défaut |
medium (niveaux de low à max) |
| Réflexion (Thinking) | Toujours activée ; ne peut pas être désactivée |
| Prix API | 0,10 $/0,50 $ jusqu'à 100K jetons ; 0,50 $/2,50 $ au-delà |
| Plans | Pro, Max, Team, Enterprise ou clé API ; pas Gratuit |
Étape 1 : mettre à jour Claude Code
Haiku 5.5 nécessite Claude Code v2.1.293 ou une version ultérieure. L'entrée du journal des modifications indique qu'il est désormais le modèle Haiku par défaut sur l'API Anthropic.
claude update
Vérifiez ensuite votre version et démarrez une session :
claude --version
claude --model claude-haiku-5-5
Claude Code n'est pas disponible avec le plan gratuit. Les utilisateurs gratuits peuvent sélectionner Haiku 5.5 dans les applications Claude.ai, mais Claude Code nécessite un plan Pro, Max, Team, Enterprise ou une clé API Anthropic. Selon claude.com/pricing, le plan Pro coûte 17 $ par mois facturé annuellement ou 20 $ par mois, tandis que Max commence à 100 $.
Étape 2 : sélectionner Haiku 5.5 comme modèle principal
Pour lancer directement une session avec Haiku 5.5 :
claude --model claude-haiku-5-5
Dans une session existante, utilisez :
/model claude-haiku-5-5
Si votre paramètre model enregistré vaut haiku, une session précédemment enregistrée sur Haiku 4.5 reprendra sur Haiku 5.5 uniquement via l'API Anthropic.
L'alias haiku ne signifie Haiku 5.5 que sur l'API Anthropic
| Fournisseur |
haiku correspond à |
|---|---|
| API Anthropic | Haiku 5.5 |
| Plateforme Claude sur AWS | Haiku 4.5 |
| Amazon Bedrock, Agent Platform de Google Cloud | Haiku 4.5 |
| Microsoft Foundry | Haiku 4.5 |
Sur les fournisseurs cloud, /model haiku et model: haiku dans un fichier de sous-agent sélectionnent Haiku 4.5.
Épinglez plutôt l'identifiant complet adapté à votre fournisseur :
- Google Cloud et plateforme Claude sur AWS :
claude-haiku-5-5 - Microsoft Foundry : le nom de votre déploiement
- Amazon Bedrock : un ID de profil d'inférence tel que
us.anthropic.claude-haiku-5-5
Vous pouvez aussi rediriger l'alias avec ANTHROPIC_DEFAULT_HAIKU_MODEL, présenté à l'étape 5.
Étape 3 : choisir un niveau d'effort
Haiku 5.5 est le premier modèle Haiku avec contrôle de l'effort :
lowmediumhighxhighmax
Claude Code démarre avec medium par défaut. Pour augmenter l'effort dès le démarrage :
claude --model claude-haiku-5-5 --effort high
Dans une session active :
/effort low
Choisissez le niveau selon la tâche :
-
low: appels d'outils courts, recherches simples, gros volumes. -
medium: travail quotidien et automatisations standard. -
high: tâches d'agent plus longues ou diagnostics plus complexes. -
xhighetmax: uniquement si vos évaluations montrent un gain mesurable.
La réflexion (Thinking) reste activée dans Claude Code. Les paramètres suivants n'ont aucun effet sur Haiku 5.5 dans Claude Code :
alwaysThinkingEnabled: false
MAX_THINKING_TOKENS=0
Pour réduire les jetons de réflexion, baissez l'effort. L'API Messages brute peut désactiver la réflexion avec un effort high ou inférieur.
Étape 4 : exécuter Haiku 5.5 en tant que sous-agent
Anthropic indique que Haiku 5.5 fonctionne bien avec Opus 5.5 et Sonnet 5.5 comme sous-agent pour les tâches de codage.
Les sous-agents sont des fichiers Markdown avec métadonnées YAML placés dans :
.claude/agents/ # pour le projet courant
~/.claude/agents/ # pour tous vos projets
Seuls name et description sont requis. La documentation des sous-agents accepte sonnet, opus, haiku, fable, un ID complet ou inherit dans le champ model. Notre guide des sous-agents détaille les scopes et les outils.
Remplacer Explore par un explorateur économique
Le sous-agent Explore intégré s'exécute sur le modèle de la conversation principale, pas nécessairement sur Haiku. Dans une session Opus 5.5, chaque recherche Explore peut donc utiliser Opus.
Créez un sous-agent utilisateur ou projet nommé Explore pour le remplacer et conserver un modèle dédié :
---
name: Explore
description: Recherche rapide en lecture seule dans la base de code. Permet de trouver des fichiers, des symboles et des sites d'appel sans rien modifier.
tools: Read, Grep, Glob
model: haiku
effort: low
---
Vous recherchez dans la base de code et rapportez ce que vous trouvez. Retournez les chemins de fichiers avec les numéros de ligne et un court résumé de chaque correspondance. Ne modifiez jamais les fichiers.
Enregistrez ce fichier sous :
.claude/agents/Explore.md
Pendant son exécution, lancez /tasks pour confirmer le modèle utilisé. Sur un fournisseur cloud, remplacez haiku par l'ID complet de Haiku 5.5.
Forcer chaque sous-agent à utiliser Haiku
Pour exécuter tous les sous-agents sur Haiku, y compris Explore, ajoutez ces variables au bloc env de votre fichier de paramètres :
{
"env": {
"CLAUDE_CODE_SUBAGENT_MODEL": "haiku",
"CLAUDE_CODE_SUBAGENT_MODEL_FORCE": "1"
}
}
CLAUDE_CODE_SUBAGENT_MODEL seul est une valeur par défaut : un champ model défini dans un sous-agent garde la priorité, et Explore ne change pas.
Étape 5 : diriger les tâches de fond vers Haiku 5.5
ANTHROPIC_DEFAULT_HAIKU_MODEL définit le modèle à utiliser pour haiku et les fonctionnalités d'arrière-plan, telles que la synthèse des sessions passées avec claude --resume.
L'ancienne variable ANTHROPIC_SMALL_FAST_MODEL est obsolète selon la référence des variables d'environnement. Remplacez-la si elle existe encore dans votre profil shell.
Sur l'API Anthropic, vous n'avez rien à définir. Sur Google Cloud, les tâches de fond utilisent Sonnet par défaut ; sur Foundry, le modèle principal ; sur Bedrock, Sonnet ou le modèle principal.
Après activation de Haiku 5.5 dans votre compte, épinglez-le explicitement :
# Plateforme d'agents de Google Cloud
export ANTHROPIC_DEFAULT_HAIKU_MODEL=claude-haiku-5-5
# Amazon Bedrock (ID de profil d'inférence)
export ANTHROPIC_DEFAULT_HAIKU_MODEL=us.anthropic.claude-haiku-5-5
Le palier de prix de 100K dans les sessions longues
Le prix de Haiku 5.5 dépend de la longueur du prompt. Claude Code renvoie la conversation comme prompt à chaque tour.
Quand le contexte dépasse 100K jetons, chaque requête passe de :
0,10 $ / 0,50 $
à :
0,50 $ / 2,50 $
C'est cinq fois le tarif des prompts courts. La documentation ne précise pas si les jetons mis en cache comptent pour ce seuil : prévoyez votre budget comme s'ils étaient inclus.
L'auto-compaction ne suffit pas à éviter ce palier : Haiku 5.5 se compacte autour de 967K jetons par défaut. Adoptez plutôt ces deux pratiques :
-
Compacter plus tôt. Utilisez
/autocompact 100kpour rapprocher la compaction de la limite minimale acceptée par Claude Code. - Déplacer le travail volumineux dans des sous-agents. Chaque sous-agent dispose de son propre contexte : les journaux de tests et résultats de recherche ne gonflent pas la conversation principale.
Même après 100K jetons, le tarif de 0,50 $/2,50 $ reste un quart des 2 $/10 $ de Sonnet 5.5. Sur un plan payant, les sessions consomment plutôt vos limites d'utilisation, et Anthropic n'a pas publié le mode de comptabilisation de Haiku 5.5 dans ces limites. Consultez notre répartition des prix de Haiku 5.5 pour l'arithmétique détaillée.
Pour les abonnés Max et Team, les nouveaux crédits API mensuels — 100 $ sur Max 5x, 200 $ sur Max 20x et jusqu'à 500 $ mutualisés sur Team — ne couvrent pas Claude Code interactif, selon la documentation des crédits API d'Anthropic.
Quand garder Sonnet 5.5 ou Opus 5.5 comme modèle principal
Anthropic indique que Sonnet 5.5 et Opus 5.5 restent de meilleurs choix pour les tâches complexes de codage agentique.
Sur Terminal-Bench 4.0, exécuté par Anthropic dans Claude Code avec effort maximal, Haiku 5.5 a obtenu 39,2 %, contre 70,6 % pour Sonnet 5.5.
| Effort | Haiku 5.5 | Sonnet 5.5 |
|---|---|---|
medium |
20,3 % à 0,68 $ | 28,8 % à 0,68 $ |
high |
24,8 % à 1,04 $ | 43 % à 1,46 $ |
max |
39,2 % à 2,64 $ | 70,6 % à 10,44 $ |
À effort medium, les deux modèles coûtent environ le même prix par tentative, mais Sonnet obtient un meilleur score. Le faible prix par jeton de Haiku ne se traduit donc pas automatiquement par un meilleur choix pour les longues sessions de codage difficiles.
L'utilisation d'ordinateur donne un résultat différent. Sur OSWorld 2.1, Haiku 5.5 en medium a atteint 53,3 % à 0,13 $ par tentative, tandis que Sonnet 5.5 en low a atteint 57,9 % à 0,68 $.
Consultez notre analyse des benchmarks de Haiku 5.5 pour les résultats complets, ainsi que le guide Claude Code de Sonnet 5.5 pour configurer le modèle principal.
Une répartition pratique :
- Sonnet 5.5 ou Opus 5.5 : modèle principal.
- Haiku 5.5 : Explore, exécution de tests, lecture de journaux et récupération de documentation.
Exemple : un sous-agent Haiku qui exécute vos tests Apidog
Les exécutions de tests sont verbeuses et répétitives : c'est un bon cas d'usage pour Haiku. Le CLI Apidog exécute vos scénarios de test enregistrés depuis le terminal. Un sous-agent peut donc lancer ces tests et renvoyer un rapport court sans polluer le contexte du modèle principal.
---
name: api-test-runner
description: Exécute les scénarios de test Apidog du projet avec le CLI Apidog après la modification d'un point de terminaison API, puis rapporte les nombres de succès et d'échecs avec les requêtes en échec.
tools: Bash, Read
model: haiku
effort: low
---
Exécutez la commande de test CLI Apidog documentée dans le README de ce dépôt pour le
scénario qui couvre le point de terminaison modifié. Rapporter les nombres de succès et d'échecs.
Pour chaque échec, donnez le nom de la requête, le résultat attendu et le résultat réel.
Ne modifiez pas le code. Ne réessayez pas une exécution échouée plus d'une fois.
Ajoutez ce fichier dans :
.claude/agents/api-test-runner.md
La configuration du CLI, y compris l'authentification et la commande d'exécution, est disponible dans Apidog CLI dans Claude Code. Téléchargez Apidog pour créer les scénarios que le sous-agent exécutera.
Migrer une application de Haiku 4.5
Si votre application utilise Haiku 4.5 via l'API, demandez à Claude Code de démarrer la migration :
/claude-api migrate this project to claude-haiku-5-5
Attendez-vous à des changements majeurs. Les éléments suivants renvoient une erreur HTTP 400 avec Haiku 5.5 :
- réflexion manuelle avec
budget_tokens; - valeur non par défaut pour
temperature; - valeur non par défaut pour
top_p; - tout usage de
top_k; - préremplissage de l'assistant.
Le guide Haiku 5.5 vs Haiku 4.5 liste toutes les corrections à appliquer.
Après la migration :
- Enregistrez l'ancienne et la nouvelle requête comme paire dans Apidog.
- Stockez
ANTHROPIC_API_KEYdans une variable d'environnement. - Ajoutez des assertions sur
stop_reasonetusage. - Faites échouer le test si un nouveau
stop_reason: refusalapparaît ou si l'usage de jetons augmente brutalement.
Ainsi, une régression atteint votre pipeline de test plutôt que la production.
FAQ
Haiku 5.5 est-il le modèle par défaut dans Claude Code ?
Non. C'est le modèle Haiku par défaut sur l'API Anthropic, ce qui signifie que l'alias haiku pointe vers lui. Sélectionnez-le comme modèle principal avec --model ou /model.
Puis-je utiliser Haiku 5.5 dans Claude Code avec le plan gratuit ?
Non. Claude Code nécessite un plan payant ou une clé API. Les utilisateurs gratuits peuvent sélectionner Haiku 5.5 dans les applications Claude.ai. Consultez aussi comment utiliser Claude Haiku 5.5 gratuitement.
Pourquoi model: haiku me donne-t-il Haiku 4.5 ?
Vous utilisez Bedrock, Google Cloud, Foundry ou la plateforme Claude sur AWS, ou votre version de Claude Code est antérieure à v2.1.293. Épinglez l'ID complet ou définissez ANTHROPIC_DEFAULT_HAIKU_MODEL.
Puis-je désactiver la réflexion (thinking) pour économiser des jetons ?
Pas dans Claude Code. Réduisez plutôt l'effort : low est le paramètre le plus économique.
Votre prochaine étape
Exécutez :
claude update
Ajoutez ensuite le remplacement Haiku de Explore et conservez votre modèle principal actuel pendant une semaine. Si votre projet possède des API, ajoutez ensuite le sous-agent d'exécution de tests.
Pour appeler le modèle depuis votre propre code, commencez par le guide API de Haiku 5.5. Apidog est gratuit pour commencer et fournit à ce sous-agent de vrais scénarios de test à exécuter.

Top comments (0)