Claude Haiku 5.5 est le plus petit et le plus rapide des modèles Anthropic actuels. Lancé le 7 octobre 2026, il utilise l’ID d’API claude-haiku-5-5. Son prix est de 0,10 $ par million de jetons d’entrée et 0,50 $ par million de jetons de sortie pour les invites de moins de 100 000 jetons, puis de 0,50 $ / 2,50 $ au-delà. Dans son article de lancement, Anthropic indique qu’il est « environ 75 % moins cher à exécuter » que Haiku 4.5 en moyenne et le présente comme son modèle le plus rapide à ce jour. C’est également le premier Haiku à proposer un paramètre d’effort et une fenêtre contextuelle de 1 million de jetons.
Essayez Apidog dès aujourd’hui
Ce guide couvre les spécifications, la tarification à deux niveaux, la migration depuis Haiku 4.5, les benchmarks et le déploiement. Pour tester l’API pendant votre lecture, Apidog peut envoyer une requête Messages, stocker votre clé dans une variable d’environnement et afficher la réponse avec son utilisation de jetons.
Spécifications de Claude Haiku 5.5 en un coup d’œil
| Spécification | Claude Haiku 5.5 |
|---|---|
| Date de sortie | 7 octobre 2026 |
| ID du modèle — API Claude, Google Cloud, Microsoft Foundry, Plateforme Claude sur AWS |
claude-haiku-5-5 — ID fixe, sans suffixe de date |
| ID du modèle — Amazon Bedrock | anthropic.claude-haiku-5-5 |
| Fenêtre contextuelle | 1 million de jetons — Haiku 4.5 : 200 000 |
| Sortie maximale | 128 000 — Haiku 4.5 : 64 000 ; 300 000 avec l’API Batch et l’en-tête bêta output-300k-2026-03-24
|
| Réflexion | Adaptative uniquement |
| Niveaux d’effort |
low, medium (par défaut), high, xhigh, max
|
| Date limite de connaissance | Juin 2026 |
| Prix par MJetons — invites jusqu’à 100 000 jetons | 0,10 $ en entrée, 0,50 $ en sortie |
| Prix par MJetons — invites de plus de 100 000 jetons | 0,50 $ en entrée, 2,50 $ en sortie |
| Retrait | Pas avant le 7 octobre 2027 |
Place de Haiku 5.5 dans la gamme Claude
| Modèle | Entrée / sortie par MJetons | Effort par défaut | Latence |
|---|---|---|---|
| Claude Fable 5.1 | 10 $ / 50 $ | élevé | Plus lent |
| Claude Opus 5.5 | 4 $ / 20 $ | moyen | Modérée |
| Claude Sonnet 5.5 | 2 $ / 10 $ | élevé | Rapide |
| Claude Haiku 5.5 | 0,10 $ / 0,50 $ pour les invites jusqu’à 100 000 jetons | moyen | Le plus rapide |
Les quatre modèles partagent une fenêtre contextuelle de 1 million de jetons, une sortie maximale de 128 000 jetons et une date limite de connaissance en juin 2026.
Anthropic positionne Haiku 5.5 pour les charges à fort volume et sensibles à la latence :
- classification ;
- extraction structurée ;
- routage ;
- résumés ;
- support en direct ;
- utilisation du navigateur ;
- sous-agents pilotés par Opus 5.5 ou Sonnet 5.5.
La mention « le plus rapide » doit être nuancée : elle concerne la vitesse standard de chaque modèle. Haiku 5.5 peut être plus lent qu’Opus exécuté en mode Rapide. Anthropic ne publie pas de mesure en jetons par seconde.
Tarification de Claude Haiku 5.5
Le tarif dépend de la taille de l’invite. Dès qu’une invite dépasse 100 000 jetons, le tarif supérieur s’applique.
Source : Tarification de l’API Claude.
Le chiffre « environ 75 % moins cher » est une moyenne :
- 90 % moins cher que Haiku 4.5 pour les invites jusqu’à 100 000 jetons ;
- 50 % moins cher au-delà de ce seuil ;
- 90 % des requêtes Haiku 4.5 étaient sous ce seuil.
Ce calcul tient déjà compte du nouveau tokenizer, qui génère environ 30 % de jetons supplémentaires pour le même texte.
Points à intégrer dans votre estimation de coût :
- l’inférence US uniquement, via
inference_geo, coûte 1,1 fois le tarif standard pour chaque catégorie de jetons ; - l’invite minimale pouvant être mise en cache descend à 512 jetons, contre 4 096 pour Haiku 4.5 ;
- sous les 100 000 jetons, le prix catalogue est identique à GPT-6 Luna : 0,10 $ en entrée, 0,50 $ en sortie, 0,01 $ en lecture de cache et 0,125 $ en écriture de cache ;
- Luna ne facture son supplément qu’au-delà de 272 000 jetons d’entrée.
Consultez la comparaison Haiku 5.5 vs GPT-6 Luna et le guide de tarification Haiku 5.5 pour des exemples de coûts calculés.
Migrer depuis Haiku 4.5
La fenêtre contextuelle est multipliée par cinq, la sortie maximale double et Haiku dispose désormais d’un contrôle d’effort. Cependant, le guide de migration indique que certains appels conçus pour Haiku 4.5 échouent avec une erreur 400.
Corriger les cinq incompatibilités bloquantes
- Remplacez les budgets de réflexion manuels
Ceci échoue :
{
"thinking": {
"type": "enabled",
"budget_tokens": 4096
}
}
Utilisez plutôt la réflexion adaptative avec un niveau d’effort :
{
"thinking": {
"type": "adaptive"
},
"output_config": {
"effort": "medium"
}
}
- Supprimez les paramètres d’échantillonnage
Retirez temperature, top_p et top_k.
Les valeurs non par défaut de temperature ou top_p échouent, de même que tout top_k ou l’utilisation simultanée de temperature et top_p.
- Supprimez le préremplissage de l’assistant
Haiku 5.5 rejette les messages d’assistant préremplis, même lorsque la réflexion est désactivée.
- Mettez à jour l’outil d’utilisation d’ordinateur
Sur l’API Claude et Google Cloud, utilisez :
computer_toolset_20260801
L’ancien outil suivant échoue :
computer_20250124
- Conservez un historique en ajout uniquement
Après un bloc de réflexion renvoyé, ne modifiez pas les champs system, tools ou les messages précédents. Ajoutez uniquement de nouveaux messages à la conversation.
Changements qui ne produisent pas forcément d’erreur
-
Affichage de la réflexion : les blocs de réflexion sont vides par défaut et ne contiennent qu’une signature. Ajoutez
"display": "summarized"pour les lire. -
Comptage des jetons : le même texte peut produire environ 30 % de jetons en plus.
max_tokensinclut également la réflexion. -
Forçage d’outil :
tool_choiceavecanyou un outil nommé fonctionne, mais la réponse ne contient pas de bloc de réflexion. -
Refus : les classificateurs de sécurité peuvent répondre avec
stop_reason: "refusal". Aucun repli côté serveur n’est appliqué. - Niveau de priorité : il n’est pas pris en charge par Haiku 5.5.
La réflexion peut être désactivée jusqu’au niveau high. Avec xhigh ou max, la désactivation renvoie une erreur 400.
Haiku 4.5 reste actif. Pour des requêtes JSON avant/après, consultez le guide Haiku 5.5 vs Haiku 4.5.
Benchmarks de Claude Haiku 5.5
Les scores de Haiku 5.5 sont mesurés avec l’effort maximal, généralement sur une moyenne de cinq essais. Artificial Analysis a exécuté GDPval-AA et AA-Briefcase, Cognition a exécuté FrontierCode, et Anthropic a évalué Chartography avec sa propre implémentation.
Trois éléments sont particulièrement importants lors de la lecture des résultats :
- FrontierCode compare Haiku au niveau
maxavec Sonnet 5.5 au niveauxhigh. Au niveaumax, Sonnet a obtenu 46,2 %, contre 46,4 % pour Haiku. - Anthropic a exécuté le score OSWorld de Luna via l’API OpenAI.
- Le score Terminal-Bench de Luna provient du classement public Codex CLI.
Avec l’effort par défaut medium, Haiku 5.5 a obtenu :
- 1277 sur GDPval-AA ;
- 1372 sur AA-Briefcase.
Anthropic précise que Sonnet 5.5 et Opus 5.5 restent de meilleurs choix pour les tâches complexes de codage agentique. Au 8 octobre 2026, aucun classement indépendant ne listait Haiku 5.5. Cursor rapporte toutefois 48,4 % sur son propre CursorBench avec l’effort maximal.
L’analyse approfondie des benchmarks détaille les scores et coûts par niveau d’effort.
Où utiliser Claude Haiku 5.5
| Surface | Accès | Remarques |
|---|---|---|
| API Claude | claude-haiku-5-5 |
Paiement par jeton |
| Amazon Bedrock | anthropic.claude-haiku-5-5 |
Facturé via AWS Marketplace |
| Google Cloud, Microsoft Foundry, Plateforme Claude sur AWS | claude-haiku-5-5 |
Même ID que l’API Claude |
| Claude.ai — web, iOS, Android | Sélecteur de modèle | Les utilisateurs Free, Pro, Max, Team et Enterprise peuvent le sélectionner |
| Claude Code | /model claude-haiku-5-5 |
Version 2.1.293 ou ultérieure ; forfaits payants |
| Vercel AI Gateway | anthropic/claude-haiku-5.5 |
À partir de 0,10 $ / 0,50 $ |
| Cursor | claude-haiku-5-5 |
Pool Autres Modèles |
Au 8 octobre 2026, Haiku 5.5 n’était pas disponible sur OpenRouter et n’était pas annoncé pour GitHub Copilot.
L’accès au chat sur le forfait gratuit ne fournit pas de clé API. L’API est facturée à l’usage, au-delà du petit crédit gratuit proposé par Anthropic aux nouveaux utilisateurs pour les tests.
Les forfaits Max et Team incluent désormais des crédits API mensuels :
- 100 $ sur Max 5x ;
- 200 $ sur Max 20x ;
- jusqu’à 500 $ mutualisés sur Team.
Ces crédits ne couvrent pas Claude Code. Le guide d’accès gratuit détaille les options gratuites et payantes.
Dans Claude Code, l’alias haiku désigne Haiku 5.5 uniquement avec l’API Anthropic. Sur les autres surfaces, il désigne encore Haiku 4.5. Consultez Haiku 5.5 dans Claude Code pour les configurations de sous-agents.
Qui devrait passer à Haiku 5.5 ?
- Vous utilisez Haiku 4.5 : migrez après avoir corrigé les cinq incompatibilités. Haiku 5.5 dépasse Haiku 4.5 sur chaque ligne comparable du tableau de lancement, avec un prix catalogue inférieur.
- Vous utilisez Sonnet ou Opus pour des tâches simples et répétitives : testez Haiku 5.5 pour la classification, l’extraction, les résumés et les sous-agents. Gardez un modèle plus grand pour le codage agentique complexe.
- Vos invites dépassent régulièrement 100 000 jetons : calculez les deux niveaux tarifaires avant de migrer. Au-delà du seuil, le coût d’entrée par jeton est multiplié par cinq.
- Vous réalisez des tâches liées à la sécurité : les protections cyber de Haiku 5.5 bloquent toujours les tests d’intrusion.
Dans l’article de lancement, Asana indique une latence de réalisation des tâches réduite de plus de 30 %. Box rapporte un score supérieur de 11 points à Haiku 4.5 avec environ la moitié de la latence. Ce sont des déclarations de clients, et non des tests indépendants.
La fiche système indique aussi que le modèle a refusé davantage que tout autre modèle lors de l’audit automatisé d’Anthropic. Mesurez donc le taux de refus sur vos propres invites avant un déploiement en production.
Envoyez votre première requête Haiku 5.5
Utilisez cette requête curl minimale :
curl https://api.anthropic.com/v1/messages \
-H "x-api-key: $ANTHROPIC_API_KEY" \
-H "anthropic-version: 2023-06-01" \
-H "content-type: application/json" \
-d '{
"model": "claude-haiku-5-5",
"max_tokens": 4000,
"thinking": {"type": "adaptive", "display": "summarized"},
"output_config": {"effort": "low"},
"messages": [
{
"role": "user",
"content": "Classify this support ticket as billing, bug, or feature request: The export button returns a 500 error."
}
]
}'
Pour rendre cet appel robuste :
- N’envoyez pas de paramètres d’échantillonnage.
- N’utilisez pas de préremplissage de l’assistant.
- Parcourez les blocs
contentselon leur champtype, car la réponse peut commencer par un bloc de réflexion. - Vérifiez
stop_reasonavant de traiter la réponse comme un succès.
Dans Apidog, importez cette commande curl comme nouvelle requête et stockez la clé dans une variable d’environnement ANTHROPIC_API_KEY.
Ajoutez ensuite des assertions pour vérifier que stop_reason n’est ni refusal ni max_tokens. Dupliquez la requête, passez effort à medium, puis comparez l’objet usage pour mesurer le coût de chaque niveau d’effort.
Le guide de l’API Haiku 5.5 couvre la mise en cache, les traitements par lots et le streaming. Si nécessaire, consultez aussi le guide de la clé API Anthropic.
FAQ
Quand Claude Haiku 5.5 a-t-il été lancé ?
Le 7 octobre 2026, neuf jours après Sonnet 5.5.
Claude Haiku 5.5 est-il gratuit ?
Dans l’application de chat Claude.ai, les utilisateurs gratuits peuvent le sélectionner. L’API est payante, à l’exception de petits crédits de test pour les nouveaux utilisateurs. Consultez tous les accès gratuits.
Quelle est la fenêtre contextuelle de Claude Haiku 5.5 ?
1 million de jetons, avec une sortie maximale de 128 000 jetons sur l’API Messages.
Haiku 4.5 est-il retiré ?
Pas encore. Il est toujours listé comme actif, avec un retrait pas avant le 15 octobre 2026.
Étape suivante
Choisissez une tâche à fort volume que vous exécutez déjà, par exemple le triage de tickets ou le résumé de documents.
- Exécutez-la avec
claude-haiku-5-5eteffort: "low". - Répétez avec
effort: "medium". - Vérifiez la qualité de sortie, le taux de refus et
stop_reason. - Comparez
usageavec votre modèle actuel. - Convertissez les volumes de jetons en coût mensuel.
Téléchargez Apidog pour centraliser vos requêtes et assertions dans un projet, puis utilisez le guide de tarification pour estimer votre facture mensuelle.


Top comments (0)