Claude Haiku 5.5 et GPT-6 Luna affichent le même tarif catalogue pour les requêtes Haiku jusqu’à 100K jetons : 0,10 $ par million de jetons d’entrée et 0,50 $ par million de jetons de sortie. Les lectures de cache coûtent 0,01 $ et les écritures de cache 0,125 $ chez les deux fournisseurs. La différence apparaît au seuil tarifaire : Haiku 5.5 passe à 0,50 $/2,50 $ au-delà de 100K jetons, tandis que Luna conserve son tarif de base jusqu’à 272K jetons d’entrée, puis applique 2× sur l’entrée et 1,5× sur la sortie. Dans le tableau de lancement d’Anthropic, Haiku 5.5 obtient un meilleur score sur toutes les lignes partagées. En revanche, les graphiques de coûts d’Anthropic montrent que Luna est moins cher par tâche à chaque niveau d’effort sur GDPval-AA et à quatre niveaux sur cinq sur OSWorld.
Essayez Apidog dès aujourd’hui
Ce guide compare les prix, les spécifications, les benchmarks, le coût par niveau d’effort et le routage par charge de travail. Pour analyser chaque modèle séparément, consultez Claude Haiku 5.5 et GPT-6 Luna. La section pratique montre ensuite comment envoyer la même invite aux deux modèles dans Apidog.
Comparaison des prix
| Par million de jetons | Claude Haiku 5.5 | GPT-6 Luna |
|---|---|---|
| Entrée, niveau de base | 0,10 $ (invites jusqu’à 100K jetons) | 0,10 $ (jusqu’à 272K jetons d’entrée) |
| Sortie, niveau de base | 0,50 $ | 0,50 $ |
| Lecture de cache, niveau de base | 0,01 $ | 0,01 $ |
| Écriture de cache, niveau de base | 0,125 $ (5 minutes) | 0,125 $ |
| Niveau supérieur, entrée / sortie | 0,50 $ / 2,50 $ (au-delà de 100K) | 0,20 $ / 0,75 $ (au-delà de 272K) |
| Niveau supérieur, lecture / écriture de cache | 0,05 $ / 0,625 $ | Tarifs de cache 2× |
| Lot | 0,05 $ / 0,25 $ jusqu’à 100K ; 0,25 $ / 1,25 $ au-delà | 50 % des tarifs standards (Batch et Flex) |
Sources : documentation tarifaire d’Anthropic et page du modèle GPT-6 Luna d’OpenAI.
OpenAI recalcule le prix de « l’ensemble de la requête » au-delà de 272K jetons. Anthropic indique qu’une invite de plus de 100 000 jetons est facturée au niveau supérieur, selon la longueur de l’invite.
Calculer le coût par requête
Sous 100K jetons, les deux modèles coûtent la même chose. Entre 100K et 272K, Haiku 5.5 est 5× plus cher que Luna pour les jetons d’entrée et de sortie. Au-delà de 272K, les deux passent au niveau supérieur, mais Luna reste moins cher.
Exemples avec les jetons comptés par chaque fournisseur :
-
Invite de 150K jetons, sortie de 2K jetons
- Haiku 5.5 :
0,15 × 0,50 $ + 0,002 × 2,50 $ = 0,080 $ - Luna :
0,15 × 0,10 $ + 0,002 × 0,50 $ = 0,016 $
- Haiku 5.5 :
-
Invite de 300K jetons, sortie de 2K jetons
- Haiku 5.5 :
0,30 × 0,50 $ + 0,002 × 2,50 $ = 0,155 $ - Luna :
0,30 × 0,20 $ + 0,002 × 0,75 $ = 0,0615 $
- Haiku 5.5 :
Anthropic indique que les invites jusqu’à 100K jetons représentaient environ 90 % des requêtes Haiku 4.5. Si votre trafic suit ce profil, la majorité des appels coûte donc le même prix chez les deux fournisseurs. Pour détailler les calculs, consultez la tarification de Claude Haiku 5.5.
Les tokeniseurs déplacent le seuil
Un jeton Claude n’est pas nécessairement un jeton GPT. Anthropic indique que le tokeniseur mis à jour de Haiku 5.5 produit environ 30 % de jetons de plus que Haiku 4.5 pour le même texte.
Dans le fil de lancement Hacker News, un commentateur estime que « 100K jetons de Claude moderne équivalent à environ 60-65K jetons GPT modernes ». C’est une estimation communautaire, pas une donnée fournie par les fournisseurs.
En pratique :
- Comptez les mêmes corpus et invites dans les deux API.
- Enregistrez l’objet
usagede chaque réponse. - Comparez les seuils tarifaires avec les volumes réellement tokenisés.
- Ne basez pas votre routage sur une conversion théorique entre tokeniseurs.
Spécifications
| Claude Haiku 5.5 | GPT-6 Luna | |
|---|---|---|
| ID du modèle API | claude-haiku-5-5 |
gpt-6-luna |
| Fenêtre de contexte | 1M de jetons | 1 050 000 jetons |
| Sortie maximale | 128K jetons (300K en lot avec un en-tête bêta) | 128 000 jetons |
| Date de connaissance limite | Juin 2026 | 18 mai 2026 |
| Niveaux d’effort | bas, moyen, élevé, très élevé, max | aucun, bas, moyen, élevé, très élevé, max |
| Réflexion désactivée |
thinking: {"type": "disabled"} à effort élevé ou inférieur |
effort de raisonnement none
|
| Accès gratuit au chat | Les utilisateurs gratuits de Claude.ai peuvent le sélectionner | Utilisateurs Free et Go dans l’application de bureau ChatGPT |
Les deux modèles utilisent le niveau medium par défaut.
- Haiku 5.5 :
output_config.effort - Luna :
reasoning.effort
Les accès gratuits au chat ne fournissent pas de clé API : ils ne peuvent donc pas alimenter un script, une tâche CI ou un agent. Consultez Claude Haiku 5.5 gratuitement et GPT-6 Luna gratuitement.
Impact du cache dans les boucles
La mise en cache peut modifier fortement le coût des agents et des pipelines itératifs :
- Avec Haiku 5.5, modifier le niveau d’effort supérieur entre deux requêtes invalide le cache des invites.
- OpenAI indique que changer l’effort de raisonnement ne rompt plus le cache sur les modèles GPT-6.
Voir : mise en cache des invites GPT-6.
Benchmarks : scores et provenance des résultats
Les chiffres suivants proviennent du billet de lancement d’Anthropic et de sa carte système. Anthropic a compilé le tableau, mais chaque ligne ne provient pas nécessairement du même exécutant.
Les résultats Haiku 5.5 sont à l’effort maximal, majoritairement calculés comme moyenne sur cinq essais.
| Benchmark | Haiku 5.5 | GPT-6 Luna | Source de la cellule Luna |
|---|---|---|---|
| GDPval-AA v2.1 (Elo) | 1620 | 1437 | Exécuté indépendamment par Artificial Analysis |
| AA-Briefcase v1.1 (Elo) | 1578 | 1336 | Exécuté indépendamment par Artificial Analysis |
| OSWorld 2.1, sous-ensemble hors ligne | 72,4 % | 48,9 % | Exécuté par Anthropic sur les mêmes 82 tâches via l’API OpenAI |
| Terminal-Bench 4.0 | 39,2 % | 16,4 % | Classement public, Codex CLI à effort maximal |
| FrontierCode 1.1 (Principal) | 46,4 % | 42,4 % | Exécuté par Cognition |
| Cartographie, sans outils | 46,4 % | 29,1 % | Rapporté publiquement par Surge AI |
Ces lignes partagent un benchmark, mais pas nécessairement le même environnement d’exécution.
Par exemple :
- Terminal-Bench compare Haiku 5.5 dans Claude Code à Luna dans le CLI Codex.
- OSWorld est le comparatif le plus proche d’un contrôle : Anthropic a exécuté les deux modèles sur les mêmes tâches.
- OSWorld reste toutefois un test exécuté par un fournisseur sur le modèle d’un concurrent.
Aucun comparatif indépendant complet n’existe encore. Au 8 octobre 2026, Artificial Analysis ne dispose pas de page Haiku 5.5, et aucun résultat Haiku 5.5 n’a été trouvé sur Vals, LMArena, SWE-bench ou Aider. Le classement d’Artificial Analysis indiquait alors GPT-6 Luna au niveau max avec un indice d’intelligence de 38 et 129 jetons de sortie par seconde.
Pour les données Haiku 5.5 détaillées, voir Benchmarks de Claude Haiku 5.5.
Coût par tentative selon le niveau d’effort
Le tableau de lancement affiche les modèles au niveau max, mais les courbes d’Anthropic permettent aussi de comparer les niveaux d’effort intermédiaires.
OSWorld 2.1 : score de crédit partiel / coût par tentative
| Effort | Haiku 5.5 | GPT-6 Luna |
|---|---|---|
| Bas | 42,0 % / 0,0695 $ | 19,2 % / 0,038 $ |
| Moyen | 53,3 % / 0,1257 $ | 37,5 % / 0,1261 $ |
| Élevé | 61,3 % / 0,1827 $ | 42,3 % / 0,1435 $ |
| Très élevé | 67,6 % / 0,2792 $ | 44,8 % / 0,1672 $ |
| Max | 72,4 % / 0,6111 $ | 48,9 % / 0,205 $ |
GDPval-AA v2.1 : Elo / coût par tâche
| Effort | Haiku 5.5 | GPT-6 Luna |
|---|---|---|
| Bas | 1125 / 0,01167 $ | 1036 / 0,0038 $ |
| Moyen | 1277 / 0,03042 $ | 1262 / 0,02 $ |
| Élevé | 1420 / 0,08938 $ | 1344 / 0,03 $ |
| Très élevé | 1513 / 0,26725 $ | 1364 / 0,05 $ |
| Max | 1620 / 0,86593 $ | 1437 / 0,09 $ |
Comment interpréter ces données
Luna coûte moins cher :
- à chaque niveau d’effort sur GDPval-AA ;
- aux niveaux bas, élevé, très élevé et max sur OSWorld.
Sur OSWorld au niveau moyen, Haiku 5.5 est marginalement moins cher : 0,1257 $ contre 0,1261 $.
À budget comparable :
-
OSWorld : Haiku 5.5 au niveau moyen coûte
0,1257 $et atteint53,3 %, contre37,5 %pour Luna au même coût approximatif. Haiku moyen dépasse aussi Luna max (48,9 %) pour moins cher. -
GDPval-AA : Luna max atteint
1437 Elopour0,09 $, tandis que Haiku 5.5 élevé atteint1420 Elopour0,08938 $. L’écart est de 17 Elo pour une dépense comparable.
Pour les tâches d’automatisation informatique, Haiku 5.5 présente donc un meilleur score par dollar selon les tests d’Anthropic. Pour le travail de connaissance, les deux sont proches à budget équivalent, tandis que le coût plancher inférieur de Luna est intéressant lorsque « suffisamment bon » est l’objectif.
Routage : quel modèle utiliser selon la charge de travail ?
Anthropic positionne Haiku 5.5 pour les « tâches à portée limitée » et recommande Sonnet 5.5 ou Opus 5.5 pour le codage agentique complexe. Les deux modèles comparés ici sont orientés volume.
| Charge de travail | Commencer avec | Pourquoi |
|---|---|---|
| Classification, routage, extraction sous 100K jetons | L’un ou l’autre ; tester les deux | Prix identique, la précision sur vos données décide |
| Questions/réponses sur documents de 100K à 272K jetons | GPT-6 Luna | Tarif de base jusqu’à 272K ; Haiku 5.5 est 5× plus cher après 100K |
| Automatisation navigateur et bureau | Claude Haiku 5.5 | Score OSWorld plus élevé à coût comparable |
| Sous-agents sous Opus 5.5 ou Sonnet 5.5 | Claude Haiku 5.5 | Frontmatter Claude Code model: haiku
|
| Coût minimal par appel | GPT-6 Luna | Coût plancher inférieur sur les graphiques présentés |
| Rédaction de travaux de connaissance à effort élevé | Tester les deux | Environ 17 Elo d’écart à dépense comparable sur GDPval-AA |
Pour aller plus loin :
- Claude Haiku 5.5 dans Claude Code pour les sous-agents ;
- GPT-6 Luna pour les charges de travail API à fort volume pour les pipelines à QPS élevé ;
- Haiku 5.5 vs Haiku 4.5 si vous migrez depuis Haiku 4.5.
Tester les deux côte à côte dans Apidog
Le meilleur comparatif utilise vos propres invites, vos formats de sortie et vos contraintes de latence. Dans Apidog, créez un projet avec une requête par fournisseur et conservez le même jeu de test.
Procédure recommandée
- Stockez
ANTHROPIC_API_KEYet votre clé OpenAI comme variables d’environnement. - Ajoutez une requête pour Haiku 5.5 et une requête pour Luna.
- Utilisez la même invite, le même schéma de sortie et un effort comparable.
- Exécutez les deux modèles aux niveaux bas, moyen et élevé.
- Enregistrez la latence, les jetons d’entrée, les jetons de sortie, les tokens de raisonnement et la qualité de sortie.
- Vérifiez que
stop_reasonpour Haiku n’est pas"refusal": il n’existe pas de solution de repli côté serveur. - Contrôlez l’objet
usagepour vérifier que chaque exécution reste dans votre budget.
Exemple de requête Haiku 5.5 :
curl https://api.anthropic.com/v1/messages \
-H "x-api-key: $ANTHROPIC_API_KEY" \
-H "anthropic-version: 2023-06-01" \
-H "content-type: application/json" \
-d '{
"model": "claude-haiku-5-5",
"max_tokens": 2048,
"thinking": {"type": "adaptive"},
"output_config": {"effort": "medium"},
"messages": [
{
"role": "user",
"content": "Classify this support ticket as billing, bug, or feature request: The export button returns a 500 error since this morning."
}
]
}'
N’ajoutez pas temperature, top_p ou top_k : des valeurs non par défaut renvoient une erreur 400 sur Haiku 5.5.
Pour une procédure API complète, consultez comment utiliser l’API Claude Haiku 5.5. Pour construire un jeu d’évaluation, consultez tester les applications LLM.
FAQ
Claude Haiku 5.5 et GPT-6 Luna ont-ils le même prix ?
Oui, pour les invites Haiku jusqu’à 100K jetons : 0,10 $/0,50 $, 0,01 $ pour les lectures de cache et 0,125 $ pour les écritures de cache. Au-delà de ce seuil, Haiku 5.5 passe à 0,50 $/2,50 $, alors que Luna maintient son tarif de base jusqu’à 272K jetons.
Quel modèle obtient les meilleurs scores ?
Haiku 5.5 obtient les meilleurs scores sur chaque ligne partagée du tableau de lancement d’Anthropic. Ce tableau a été compilé par Anthropic et aucun comparatif indépendant complet n’existe encore.
Quel modèle coûte le moins cher par tâche ?
Généralement Luna : à chaque niveau d’effort sur GDPval-AA et à quatre niveaux sur cinq sur OSWorld. Sur OSWorld moyen, Haiku 5.5 coûte 0,0004 $ de moins. À budget comparable, Haiku 5.5 est en tête sur OSWorld, tandis que GDPval-AA reste proche.
L’un des deux modèles est-il gratuit ?
Uniquement via les interfaces de chat :
- les utilisateurs gratuits de Claude.ai peuvent sélectionner Haiku 5.5 ;
- les utilisateurs Free et Go disposent de Luna dans l’application de bureau ChatGPT.
Aucun de ces accès ne fournit une clé API. Voir Claude Haiku 5.5 gratuitement.
Choisir selon la longueur d’invite, puis mesurer
Commencez par analyser la longueur réelle de vos invites :
- Sous 100K jetons : prix identique ; choisissez selon la précision, la latence et le comportement sur vos cas réels.
- Entre 100K et 272K jetons : Luna est plus économique à chaque appel grâce à son seuil plus élevé.
- Au-delà de 272K jetons : Luna reste moins cher selon les tarifs présentés, mais comparez aussi la qualité obtenue et le nombre de tentatives nécessaires.
Ensuite, exécutez les deux modèles sur de vraies requêtes à deux ou trois niveaux d’effort. Téléchargez Apidog, placez les deux requêtes dans le même projet et utilisez les données usage, la latence et la qualité de sortie pour prendre votre décision.
Top comments (0)