DEV Community

Cover image for Qu'est-ce que Claude Haiku 5.5
Antoine Laurent
Antoine Laurent

Posted on Originally published at apidog.com

Qu'est-ce que Claude Haiku 5.5

Claude Haiku 5.5 est le plus petit et le plus rapide des modèles Anthropic actuels. Lancé le 7 octobre 2026, il utilise l’ID d’API claude-haiku-5-5. Son prix est de 0,10 $ par million de jetons d’entrée et 0,50 $ par million de jetons de sortie pour les invites de moins de 100 000 jetons, puis de 0,50 $ / 2,50 $ au-delà. Dans son article de lancement, Anthropic indique qu’il est « environ 75 % moins cher à exécuter » que Haiku 4.5 en moyenne et le présente comme son modèle le plus rapide à ce jour. C’est également le premier Haiku à proposer un paramètre d’effort et une fenêtre contextuelle de 1 million de jetons.

Essayez Apidog dès aujourd’hui

Ce guide couvre les spécifications, la tarification à deux niveaux, la migration depuis Haiku 4.5, les benchmarks et le déploiement. Pour tester l’API pendant votre lecture, Apidog peut envoyer une requête Messages, stocker votre clé dans une variable d’environnement et afficher la réponse avec son utilisation de jetons.

Spécifications de Claude Haiku 5.5 en un coup d’œil

Spécification Claude Haiku 5.5
Date de sortie 7 octobre 2026
ID du modèle — API Claude, Google Cloud, Microsoft Foundry, Plateforme Claude sur AWS claude-haiku-5-5 — ID fixe, sans suffixe de date
ID du modèle — Amazon Bedrock anthropic.claude-haiku-5-5
Fenêtre contextuelle 1 million de jetons — Haiku 4.5 : 200 000
Sortie maximale 128 000 — Haiku 4.5 : 64 000 ; 300 000 avec l’API Batch et l’en-tête bêta output-300k-2026-03-24
Réflexion Adaptative uniquement
Niveaux d’effort low, medium (par défaut), high, xhigh, max
Date limite de connaissance Juin 2026
Prix par MJetons — invites jusqu’à 100 000 jetons 0,10 $ en entrée, 0,50 $ en sortie
Prix par MJetons — invites de plus de 100 000 jetons 0,50 $ en entrée, 2,50 $ en sortie
Retrait Pas avant le 7 octobre 2027

Place de Haiku 5.5 dans la gamme Claude

Modèle Entrée / sortie par MJetons Effort par défaut Latence
Claude Fable 5.1 10 $ / 50 $ élevé Plus lent
Claude Opus 5.5 4 $ / 20 $ moyen Modérée
Claude Sonnet 5.5 2 $ / 10 $ élevé Rapide
Claude Haiku 5.5 0,10 $ / 0,50 $ pour les invites jusqu’à 100 000 jetons moyen Le plus rapide

Les quatre modèles partagent une fenêtre contextuelle de 1 million de jetons, une sortie maximale de 128 000 jetons et une date limite de connaissance en juin 2026.

Anthropic positionne Haiku 5.5 pour les charges à fort volume et sensibles à la latence :

  • classification ;
  • extraction structurée ;
  • routage ;
  • résumés ;
  • support en direct ;
  • utilisation du navigateur ;
  • sous-agents pilotés par Opus 5.5 ou Sonnet 5.5.

La mention « le plus rapide » doit être nuancée : elle concerne la vitesse standard de chaque modèle. Haiku 5.5 peut être plus lent qu’Opus exécuté en mode Rapide. Anthropic ne publie pas de mesure en jetons par seconde.

Tarification de Claude Haiku 5.5

Le tarif dépend de la taille de l’invite. Dès qu’une invite dépasse 100 000 jetons, le tarif supérieur s’applique.

Graphique des prix de Claude Haiku 5.5

Source : Tarification de l’API Claude.

Le chiffre « environ 75 % moins cher » est une moyenne :

  • 90 % moins cher que Haiku 4.5 pour les invites jusqu’à 100 000 jetons ;
  • 50 % moins cher au-delà de ce seuil ;
  • 90 % des requêtes Haiku 4.5 étaient sous ce seuil.

Ce calcul tient déjà compte du nouveau tokenizer, qui génère environ 30 % de jetons supplémentaires pour le même texte.

Points à intégrer dans votre estimation de coût :

  • l’inférence US uniquement, via inference_geo, coûte 1,1 fois le tarif standard pour chaque catégorie de jetons ;
  • l’invite minimale pouvant être mise en cache descend à 512 jetons, contre 4 096 pour Haiku 4.5 ;
  • sous les 100 000 jetons, le prix catalogue est identique à GPT-6 Luna : 0,10 $ en entrée, 0,50 $ en sortie, 0,01 $ en lecture de cache et 0,125 $ en écriture de cache ;
  • Luna ne facture son supplément qu’au-delà de 272 000 jetons d’entrée.

Consultez la comparaison Haiku 5.5 vs GPT-6 Luna et le guide de tarification Haiku 5.5 pour des exemples de coûts calculés.

Migrer depuis Haiku 4.5

La fenêtre contextuelle est multipliée par cinq, la sortie maximale double et Haiku dispose désormais d’un contrôle d’effort. Cependant, le guide de migration indique que certains appels conçus pour Haiku 4.5 échouent avec une erreur 400.

Corriger les cinq incompatibilités bloquantes

  1. Remplacez les budgets de réflexion manuels

Ceci échoue :

   {
     "thinking": {
       "type": "enabled",
       "budget_tokens": 4096
     }
   }
Enter fullscreen mode Exit fullscreen mode

Utilisez plutôt la réflexion adaptative avec un niveau d’effort :

   {
     "thinking": {
       "type": "adaptive"
     },
     "output_config": {
       "effort": "medium"
     }
   }
Enter fullscreen mode Exit fullscreen mode
  1. Supprimez les paramètres d’échantillonnage

Retirez temperature, top_p et top_k.

Les valeurs non par défaut de temperature ou top_p échouent, de même que tout top_k ou l’utilisation simultanée de temperature et top_p.

  1. Supprimez le préremplissage de l’assistant

Haiku 5.5 rejette les messages d’assistant préremplis, même lorsque la réflexion est désactivée.

  1. Mettez à jour l’outil d’utilisation d’ordinateur

Sur l’API Claude et Google Cloud, utilisez :

   computer_toolset_20260801
Enter fullscreen mode Exit fullscreen mode

L’ancien outil suivant échoue :

   computer_20250124
Enter fullscreen mode Exit fullscreen mode
  1. Conservez un historique en ajout uniquement

Après un bloc de réflexion renvoyé, ne modifiez pas les champs system, tools ou les messages précédents. Ajoutez uniquement de nouveaux messages à la conversation.

Changements qui ne produisent pas forcément d’erreur

  • Affichage de la réflexion : les blocs de réflexion sont vides par défaut et ne contiennent qu’une signature. Ajoutez "display": "summarized" pour les lire.
  • Comptage des jetons : le même texte peut produire environ 30 % de jetons en plus. max_tokens inclut également la réflexion.
  • Forçage d’outil : tool_choice avec any ou un outil nommé fonctionne, mais la réponse ne contient pas de bloc de réflexion.
  • Refus : les classificateurs de sécurité peuvent répondre avec stop_reason: "refusal". Aucun repli côté serveur n’est appliqué.
  • Niveau de priorité : il n’est pas pris en charge par Haiku 5.5.

La réflexion peut être désactivée jusqu’au niveau high. Avec xhigh ou max, la désactivation renvoie une erreur 400.

Haiku 4.5 reste actif. Pour des requêtes JSON avant/après, consultez le guide Haiku 5.5 vs Haiku 4.5.

Benchmarks de Claude Haiku 5.5

Les scores de Haiku 5.5 sont mesurés avec l’effort maximal, généralement sur une moyenne de cinq essais. Artificial Analysis a exécuté GDPval-AA et AA-Briefcase, Cognition a exécuté FrontierCode, et Anthropic a évalué Chartography avec sa propre implémentation.

Graphique des benchmarks de Claude Haiku 5.5

Trois éléments sont particulièrement importants lors de la lecture des résultats :

  • FrontierCode compare Haiku au niveau max avec Sonnet 5.5 au niveau xhigh. Au niveau max, Sonnet a obtenu 46,2 %, contre 46,4 % pour Haiku.
  • Anthropic a exécuté le score OSWorld de Luna via l’API OpenAI.
  • Le score Terminal-Bench de Luna provient du classement public Codex CLI.

Avec l’effort par défaut medium, Haiku 5.5 a obtenu :

  • 1277 sur GDPval-AA ;
  • 1372 sur AA-Briefcase.

Anthropic précise que Sonnet 5.5 et Opus 5.5 restent de meilleurs choix pour les tâches complexes de codage agentique. Au 8 octobre 2026, aucun classement indépendant ne listait Haiku 5.5. Cursor rapporte toutefois 48,4 % sur son propre CursorBench avec l’effort maximal.

L’analyse approfondie des benchmarks détaille les scores et coûts par niveau d’effort.

Où utiliser Claude Haiku 5.5

Surface Accès Remarques
API Claude claude-haiku-5-5 Paiement par jeton
Amazon Bedrock anthropic.claude-haiku-5-5 Facturé via AWS Marketplace
Google Cloud, Microsoft Foundry, Plateforme Claude sur AWS claude-haiku-5-5 Même ID que l’API Claude
Claude.ai — web, iOS, Android Sélecteur de modèle Les utilisateurs Free, Pro, Max, Team et Enterprise peuvent le sélectionner
Claude Code /model claude-haiku-5-5 Version 2.1.293 ou ultérieure ; forfaits payants
Vercel AI Gateway anthropic/claude-haiku-5.5 À partir de 0,10 $ / 0,50 $
Cursor claude-haiku-5-5 Pool Autres Modèles

Au 8 octobre 2026, Haiku 5.5 n’était pas disponible sur OpenRouter et n’était pas annoncé pour GitHub Copilot.

L’accès au chat sur le forfait gratuit ne fournit pas de clé API. L’API est facturée à l’usage, au-delà du petit crédit gratuit proposé par Anthropic aux nouveaux utilisateurs pour les tests.

Les forfaits Max et Team incluent désormais des crédits API mensuels :

  • 100 $ sur Max 5x ;
  • 200 $ sur Max 20x ;
  • jusqu’à 500 $ mutualisés sur Team.

Ces crédits ne couvrent pas Claude Code. Le guide d’accès gratuit détaille les options gratuites et payantes.

Dans Claude Code, l’alias haiku désigne Haiku 5.5 uniquement avec l’API Anthropic. Sur les autres surfaces, il désigne encore Haiku 4.5. Consultez Haiku 5.5 dans Claude Code pour les configurations de sous-agents.

Qui devrait passer à Haiku 5.5 ?

  • Vous utilisez Haiku 4.5 : migrez après avoir corrigé les cinq incompatibilités. Haiku 5.5 dépasse Haiku 4.5 sur chaque ligne comparable du tableau de lancement, avec un prix catalogue inférieur.
  • Vous utilisez Sonnet ou Opus pour des tâches simples et répétitives : testez Haiku 5.5 pour la classification, l’extraction, les résumés et les sous-agents. Gardez un modèle plus grand pour le codage agentique complexe.
  • Vos invites dépassent régulièrement 100 000 jetons : calculez les deux niveaux tarifaires avant de migrer. Au-delà du seuil, le coût d’entrée par jeton est multiplié par cinq.
  • Vous réalisez des tâches liées à la sécurité : les protections cyber de Haiku 5.5 bloquent toujours les tests d’intrusion.

Dans l’article de lancement, Asana indique une latence de réalisation des tâches réduite de plus de 30 %. Box rapporte un score supérieur de 11 points à Haiku 4.5 avec environ la moitié de la latence. Ce sont des déclarations de clients, et non des tests indépendants.

La fiche système indique aussi que le modèle a refusé davantage que tout autre modèle lors de l’audit automatisé d’Anthropic. Mesurez donc le taux de refus sur vos propres invites avant un déploiement en production.

Envoyez votre première requête Haiku 5.5

Utilisez cette requête curl minimale :

curl https://api.anthropic.com/v1/messages \
  -H "x-api-key: $ANTHROPIC_API_KEY" \
  -H "anthropic-version: 2023-06-01" \
  -H "content-type: application/json" \
  -d '{
    "model": "claude-haiku-5-5",
    "max_tokens": 4000,
    "thinking": {"type": "adaptive", "display": "summarized"},
    "output_config": {"effort": "low"},
    "messages": [
      {
        "role": "user",
        "content": "Classify this support ticket as billing, bug, or feature request: The export button returns a 500 error."
      }
    ]
  }'
Enter fullscreen mode Exit fullscreen mode

Pour rendre cet appel robuste :

  1. N’envoyez pas de paramètres d’échantillonnage.
  2. N’utilisez pas de préremplissage de l’assistant.
  3. Parcourez les blocs content selon leur champ type, car la réponse peut commencer par un bloc de réflexion.
  4. Vérifiez stop_reason avant de traiter la réponse comme un succès.

Dans Apidog, importez cette commande curl comme nouvelle requête et stockez la clé dans une variable d’environnement ANTHROPIC_API_KEY.

Ajoutez ensuite des assertions pour vérifier que stop_reason n’est ni refusal ni max_tokens. Dupliquez la requête, passez effort à medium, puis comparez l’objet usage pour mesurer le coût de chaque niveau d’effort.

Le guide de l’API Haiku 5.5 couvre la mise en cache, les traitements par lots et le streaming. Si nécessaire, consultez aussi le guide de la clé API Anthropic.

FAQ

Quand Claude Haiku 5.5 a-t-il été lancé ?

Le 7 octobre 2026, neuf jours après Sonnet 5.5.

Claude Haiku 5.5 est-il gratuit ?

Dans l’application de chat Claude.ai, les utilisateurs gratuits peuvent le sélectionner. L’API est payante, à l’exception de petits crédits de test pour les nouveaux utilisateurs. Consultez tous les accès gratuits.

Quelle est la fenêtre contextuelle de Claude Haiku 5.5 ?

1 million de jetons, avec une sortie maximale de 128 000 jetons sur l’API Messages.

Haiku 4.5 est-il retiré ?

Pas encore. Il est toujours listé comme actif, avec un retrait pas avant le 15 octobre 2026.

Étape suivante

Choisissez une tâche à fort volume que vous exécutez déjà, par exemple le triage de tickets ou le résumé de documents.

  1. Exécutez-la avec claude-haiku-5-5 et effort: "low".
  2. Répétez avec effort: "medium".
  3. Vérifiez la qualité de sortie, le taux de refus et stop_reason.
  4. Comparez usage avec votre modèle actuel.
  5. Convertissez les volumes de jetons en coût mensuel.

Téléchargez Apidog pour centraliser vos requêtes et assertions dans un projet, puis utilisez le guide de tarification pour estimer votre facture mensuelle.

Top comments (0)