DEV Community

Cover image for Claude Haiku 5.5 contre GPT-6 Luna
Antoine Laurent
Antoine Laurent

Posted on Originally published at apidog.com

Claude Haiku 5.5 contre GPT-6 Luna

Claude Haiku 5.5 et GPT-6 Luna affichent le même tarif catalogue pour les requêtes Haiku jusqu’à 100K jetons : 0,10 $ par million de jetons d’entrée et 0,50 $ par million de jetons de sortie. Les lectures de cache coûtent 0,01 $ et les écritures de cache 0,125 $ chez les deux fournisseurs. La différence apparaît au seuil tarifaire : Haiku 5.5 passe à 0,50 $/2,50 $ au-delà de 100K jetons, tandis que Luna conserve son tarif de base jusqu’à 272K jetons d’entrée, puis applique 2× sur l’entrée et 1,5× sur la sortie. Dans le tableau de lancement d’Anthropic, Haiku 5.5 obtient un meilleur score sur toutes les lignes partagées. En revanche, les graphiques de coûts d’Anthropic montrent que Luna est moins cher par tâche à chaque niveau d’effort sur GDPval-AA et à quatre niveaux sur cinq sur OSWorld.

Essayez Apidog dès aujourd’hui

Ce guide compare les prix, les spécifications, les benchmarks, le coût par niveau d’effort et le routage par charge de travail. Pour analyser chaque modèle séparément, consultez Claude Haiku 5.5 et GPT-6 Luna. La section pratique montre ensuite comment envoyer la même invite aux deux modèles dans Apidog.

Comparaison des prix

Par million de jetons Claude Haiku 5.5 GPT-6 Luna
Entrée, niveau de base 0,10 $ (invites jusqu’à 100K jetons) 0,10 $ (jusqu’à 272K jetons d’entrée)
Sortie, niveau de base 0,50 $ 0,50 $
Lecture de cache, niveau de base 0,01 $ 0,01 $
Écriture de cache, niveau de base 0,125 $ (5 minutes) 0,125 $
Niveau supérieur, entrée / sortie 0,50 $ / 2,50 $ (au-delà de 100K) 0,20 $ / 0,75 $ (au-delà de 272K)
Niveau supérieur, lecture / écriture de cache 0,05 $ / 0,625 $ Tarifs de cache 2×
Lot 0,05 $ / 0,25 $ jusqu’à 100K ; 0,25 $ / 1,25 $ au-delà 50 % des tarifs standards (Batch et Flex)

Sources : documentation tarifaire d’Anthropic et page du modèle GPT-6 Luna d’OpenAI.

OpenAI recalcule le prix de « l’ensemble de la requête » au-delà de 272K jetons. Anthropic indique qu’une invite de plus de 100 000 jetons est facturée au niveau supérieur, selon la longueur de l’invite.

Calculer le coût par requête

Sous 100K jetons, les deux modèles coûtent la même chose. Entre 100K et 272K, Haiku 5.5 est 5× plus cher que Luna pour les jetons d’entrée et de sortie. Au-delà de 272K, les deux passent au niveau supérieur, mais Luna reste moins cher.

Exemples avec les jetons comptés par chaque fournisseur :

  • Invite de 150K jetons, sortie de 2K jetons

    • Haiku 5.5 : 0,15 × 0,50 $ + 0,002 × 2,50 $ = 0,080 $
    • Luna : 0,15 × 0,10 $ + 0,002 × 0,50 $ = 0,016 $
  • Invite de 300K jetons, sortie de 2K jetons

    • Haiku 5.5 : 0,30 × 0,50 $ + 0,002 × 2,50 $ = 0,155 $
    • Luna : 0,30 × 0,20 $ + 0,002 × 0,75 $ = 0,0615 $

Anthropic indique que les invites jusqu’à 100K jetons représentaient environ 90 % des requêtes Haiku 4.5. Si votre trafic suit ce profil, la majorité des appels coûte donc le même prix chez les deux fournisseurs. Pour détailler les calculs, consultez la tarification de Claude Haiku 5.5.

Les tokeniseurs déplacent le seuil

Un jeton Claude n’est pas nécessairement un jeton GPT. Anthropic indique que le tokeniseur mis à jour de Haiku 5.5 produit environ 30 % de jetons de plus que Haiku 4.5 pour le même texte.

Dans le fil de lancement Hacker News, un commentateur estime que « 100K jetons de Claude moderne équivalent à environ 60-65K jetons GPT modernes ». C’est une estimation communautaire, pas une donnée fournie par les fournisseurs.

En pratique :

  1. Comptez les mêmes corpus et invites dans les deux API.
  2. Enregistrez l’objet usage de chaque réponse.
  3. Comparez les seuils tarifaires avec les volumes réellement tokenisés.
  4. Ne basez pas votre routage sur une conversion théorique entre tokeniseurs.

Spécifications

Claude Haiku 5.5 GPT-6 Luna
ID du modèle API claude-haiku-5-5 gpt-6-luna
Fenêtre de contexte 1M de jetons 1 050 000 jetons
Sortie maximale 128K jetons (300K en lot avec un en-tête bêta) 128 000 jetons
Date de connaissance limite Juin 2026 18 mai 2026
Niveaux d’effort bas, moyen, élevé, très élevé, max aucun, bas, moyen, élevé, très élevé, max
Réflexion désactivée thinking: {"type": "disabled"} à effort élevé ou inférieur effort de raisonnement none
Accès gratuit au chat Les utilisateurs gratuits de Claude.ai peuvent le sélectionner Utilisateurs Free et Go dans l’application de bureau ChatGPT

Les deux modèles utilisent le niveau medium par défaut.

  • Haiku 5.5 : output_config.effort
  • Luna : reasoning.effort

Les accès gratuits au chat ne fournissent pas de clé API : ils ne peuvent donc pas alimenter un script, une tâche CI ou un agent. Consultez Claude Haiku 5.5 gratuitement et GPT-6 Luna gratuitement.

Impact du cache dans les boucles

La mise en cache peut modifier fortement le coût des agents et des pipelines itératifs :

  • Avec Haiku 5.5, modifier le niveau d’effort supérieur entre deux requêtes invalide le cache des invites.
  • OpenAI indique que changer l’effort de raisonnement ne rompt plus le cache sur les modèles GPT-6.

Voir : mise en cache des invites GPT-6.

Benchmarks : scores et provenance des résultats

Les chiffres suivants proviennent du billet de lancement d’Anthropic et de sa carte système. Anthropic a compilé le tableau, mais chaque ligne ne provient pas nécessairement du même exécutant.

Les résultats Haiku 5.5 sont à l’effort maximal, majoritairement calculés comme moyenne sur cinq essais.

Benchmark Haiku 5.5 GPT-6 Luna Source de la cellule Luna
GDPval-AA v2.1 (Elo) 1620 1437 Exécuté indépendamment par Artificial Analysis
AA-Briefcase v1.1 (Elo) 1578 1336 Exécuté indépendamment par Artificial Analysis
OSWorld 2.1, sous-ensemble hors ligne 72,4 % 48,9 % Exécuté par Anthropic sur les mêmes 82 tâches via l’API OpenAI
Terminal-Bench 4.0 39,2 % 16,4 % Classement public, Codex CLI à effort maximal
FrontierCode 1.1 (Principal) 46,4 % 42,4 % Exécuté par Cognition
Cartographie, sans outils 46,4 % 29,1 % Rapporté publiquement par Surge AI

Ces lignes partagent un benchmark, mais pas nécessairement le même environnement d’exécution.

Par exemple :

  • Terminal-Bench compare Haiku 5.5 dans Claude Code à Luna dans le CLI Codex.
  • OSWorld est le comparatif le plus proche d’un contrôle : Anthropic a exécuté les deux modèles sur les mêmes tâches.
  • OSWorld reste toutefois un test exécuté par un fournisseur sur le modèle d’un concurrent.

Aucun comparatif indépendant complet n’existe encore. Au 8 octobre 2026, Artificial Analysis ne dispose pas de page Haiku 5.5, et aucun résultat Haiku 5.5 n’a été trouvé sur Vals, LMArena, SWE-bench ou Aider. Le classement d’Artificial Analysis indiquait alors GPT-6 Luna au niveau max avec un indice d’intelligence de 38 et 129 jetons de sortie par seconde.

Pour les données Haiku 5.5 détaillées, voir Benchmarks de Claude Haiku 5.5.

Coût par tentative selon le niveau d’effort

Le tableau de lancement affiche les modèles au niveau max, mais les courbes d’Anthropic permettent aussi de comparer les niveaux d’effort intermédiaires.

OSWorld 2.1 : score de crédit partiel / coût par tentative

Effort Haiku 5.5 GPT-6 Luna
Bas 42,0 % / 0,0695 $ 19,2 % / 0,038 $
Moyen 53,3 % / 0,1257 $ 37,5 % / 0,1261 $
Élevé 61,3 % / 0,1827 $ 42,3 % / 0,1435 $
Très élevé 67,6 % / 0,2792 $ 44,8 % / 0,1672 $
Max 72,4 % / 0,6111 $ 48,9 % / 0,205 $

GDPval-AA v2.1 : Elo / coût par tâche

Effort Haiku 5.5 GPT-6 Luna
Bas 1125 / 0,01167 $ 1036 / 0,0038 $
Moyen 1277 / 0,03042 $ 1262 / 0,02 $
Élevé 1420 / 0,08938 $ 1344 / 0,03 $
Très élevé 1513 / 0,26725 $ 1364 / 0,05 $
Max 1620 / 0,86593 $ 1437 / 0,09 $

Comment interpréter ces données

Luna coûte moins cher :

  • à chaque niveau d’effort sur GDPval-AA ;
  • aux niveaux bas, élevé, très élevé et max sur OSWorld.

Sur OSWorld au niveau moyen, Haiku 5.5 est marginalement moins cher : 0,1257 $ contre 0,1261 $.

À budget comparable :

  • OSWorld : Haiku 5.5 au niveau moyen coûte 0,1257 $ et atteint 53,3 %, contre 37,5 % pour Luna au même coût approximatif. Haiku moyen dépasse aussi Luna max (48,9 %) pour moins cher.
  • GDPval-AA : Luna max atteint 1437 Elo pour 0,09 $, tandis que Haiku 5.5 élevé atteint 1420 Elo pour 0,08938 $. L’écart est de 17 Elo pour une dépense comparable.

Pour les tâches d’automatisation informatique, Haiku 5.5 présente donc un meilleur score par dollar selon les tests d’Anthropic. Pour le travail de connaissance, les deux sont proches à budget équivalent, tandis que le coût plancher inférieur de Luna est intéressant lorsque « suffisamment bon » est l’objectif.

Routage : quel modèle utiliser selon la charge de travail ?

Anthropic positionne Haiku 5.5 pour les « tâches à portée limitée » et recommande Sonnet 5.5 ou Opus 5.5 pour le codage agentique complexe. Les deux modèles comparés ici sont orientés volume.

Charge de travail Commencer avec Pourquoi
Classification, routage, extraction sous 100K jetons L’un ou l’autre ; tester les deux Prix identique, la précision sur vos données décide
Questions/réponses sur documents de 100K à 272K jetons GPT-6 Luna Tarif de base jusqu’à 272K ; Haiku 5.5 est 5× plus cher après 100K
Automatisation navigateur et bureau Claude Haiku 5.5 Score OSWorld plus élevé à coût comparable
Sous-agents sous Opus 5.5 ou Sonnet 5.5 Claude Haiku 5.5 Frontmatter Claude Code model: haiku
Coût minimal par appel GPT-6 Luna Coût plancher inférieur sur les graphiques présentés
Rédaction de travaux de connaissance à effort élevé Tester les deux Environ 17 Elo d’écart à dépense comparable sur GDPval-AA

Pour aller plus loin :

Tester les deux côte à côte dans Apidog

Le meilleur comparatif utilise vos propres invites, vos formats de sortie et vos contraintes de latence. Dans Apidog, créez un projet avec une requête par fournisseur et conservez le même jeu de test.

Procédure recommandée

  1. Stockez ANTHROPIC_API_KEY et votre clé OpenAI comme variables d’environnement.
  2. Ajoutez une requête pour Haiku 5.5 et une requête pour Luna.
  3. Utilisez la même invite, le même schéma de sortie et un effort comparable.
  4. Exécutez les deux modèles aux niveaux bas, moyen et élevé.
  5. Enregistrez la latence, les jetons d’entrée, les jetons de sortie, les tokens de raisonnement et la qualité de sortie.
  6. Vérifiez que stop_reason pour Haiku n’est pas "refusal" : il n’existe pas de solution de repli côté serveur.
  7. Contrôlez l’objet usage pour vérifier que chaque exécution reste dans votre budget.

Exemple de requête Haiku 5.5 :

curl https://api.anthropic.com/v1/messages \
  -H "x-api-key: $ANTHROPIC_API_KEY" \
  -H "anthropic-version: 2023-06-01" \
  -H "content-type: application/json" \
  -d '{
    "model": "claude-haiku-5-5",
    "max_tokens": 2048,
    "thinking": {"type": "adaptive"},
    "output_config": {"effort": "medium"},
    "messages": [
      {
        "role": "user",
        "content": "Classify this support ticket as billing, bug, or feature request: The export button returns a 500 error since this morning."
      }
    ]
  }'
Enter fullscreen mode Exit fullscreen mode

N’ajoutez pas temperature, top_p ou top_k : des valeurs non par défaut renvoient une erreur 400 sur Haiku 5.5.

Pour une procédure API complète, consultez comment utiliser l’API Claude Haiku 5.5. Pour construire un jeu d’évaluation, consultez tester les applications LLM.

FAQ

Claude Haiku 5.5 et GPT-6 Luna ont-ils le même prix ?

Oui, pour les invites Haiku jusqu’à 100K jetons : 0,10 $/0,50 $, 0,01 $ pour les lectures de cache et 0,125 $ pour les écritures de cache. Au-delà de ce seuil, Haiku 5.5 passe à 0,50 $/2,50 $, alors que Luna maintient son tarif de base jusqu’à 272K jetons.

Quel modèle obtient les meilleurs scores ?

Haiku 5.5 obtient les meilleurs scores sur chaque ligne partagée du tableau de lancement d’Anthropic. Ce tableau a été compilé par Anthropic et aucun comparatif indépendant complet n’existe encore.

Quel modèle coûte le moins cher par tâche ?

Généralement Luna : à chaque niveau d’effort sur GDPval-AA et à quatre niveaux sur cinq sur OSWorld. Sur OSWorld moyen, Haiku 5.5 coûte 0,0004 $ de moins. À budget comparable, Haiku 5.5 est en tête sur OSWorld, tandis que GDPval-AA reste proche.

L’un des deux modèles est-il gratuit ?

Uniquement via les interfaces de chat :

  • les utilisateurs gratuits de Claude.ai peuvent sélectionner Haiku 5.5 ;
  • les utilisateurs Free et Go disposent de Luna dans l’application de bureau ChatGPT.

Aucun de ces accès ne fournit une clé API. Voir Claude Haiku 5.5 gratuitement.

Choisir selon la longueur d’invite, puis mesurer

Commencez par analyser la longueur réelle de vos invites :

  • Sous 100K jetons : prix identique ; choisissez selon la précision, la latence et le comportement sur vos cas réels.
  • Entre 100K et 272K jetons : Luna est plus économique à chaque appel grâce à son seuil plus élevé.
  • Au-delà de 272K jetons : Luna reste moins cher selon les tarifs présentés, mais comparez aussi la qualité obtenue et le nombre de tentatives nécessaires.

Ensuite, exécutez les deux modèles sur de vraies requêtes à deux ou trois niveaux d’effort. Téléchargez Apidog, placez les deux requêtes dans le même projet et utilisez les données usage, la latence et la qualité de sortie pour prendre votre décision.

Top comments (0)