DEV Community

Cover image for Qu'est-ce que Claude Fable 5.1 ? Spécifications, Benchmarks, Prix et Nouveautés
Antoine Laurent
Antoine Laurent

Posted on Originally published at apidog.com

Qu'est-ce que Claude Fable 5.1 ? Spécifications, Benchmarks, Prix et Nouveautés

Claude Fable 5.1 : guide pratique de l’API, des coûts et de la migration

Claude Fable 5.1 est le nouveau modèle de la gamme Fable d’Anthropic, lancé le 1er septembre 2026 avec son jumeau à accès restreint, Claude Mythos 5.1. Il remplace Fable 5 au même prix — 10 $ par million de tokens en entrée et 50 $ en sortie — mais la lecture du cache ne coûte plus que 0,25 $ par million de tokens. Anthropic le destine au « raisonnement exigeant et au travail d’agent à long terme ».

Essayez Apidog dès aujourd’hui

Ce guide couvre les spécifications, les coûts, les benchmarks, les changements incompatibles avec Fable 5, les nouvelles fonctionnalités, les limites de sécurité et les options de migration. Chaque requête est du HTTP avec JSON : vous pouvez donc la construire et l’inspecter dans Apidog avant de l’intégrer à votre application.

Les sources primaires sont le billet de lancement d’Anthropic et la page officielle du modèle Fable 5.1. Consultez aussi la visite guidée de l’API, le calcul des coûts et le guide de migration depuis Fable 5 et Opus 5.

Présentation de Claude Fable 5.1

Claude Fable 5.1 en un coup d’œil

Spécification Valeur
ID du modèle API claude-fable-5-1 — sans suffixe de date
Date de sortie 1er septembre 2026
Engagement de retrait Pas avant le 1er septembre 2027
Fenêtre de contexte 1 000 000 tokens, par défaut et maximum, au prix standard
Sortie maximale 128 000 tokens avec l’API Messages
Prix de base 10 $/million de tokens en entrée, 50 $/million en sortie
Lecture du cache 0,25 $/million de tokens, soit 0,025× le prix d’entrée
API Batch 5 $/million en entrée, 25 $/million en sortie
Date limite des connaissances Juin 2026
Réflexion Adaptive et toujours activée
Niveaux d’effort low, medium, high, xhigh, max ; high par défaut
Latence Plus élevée qu’Opus 5 et Sonnet 5
Niveau de priorité Non pris en charge, contrairement à Fable 5
Rétention des données 30 jours obligatoires ; pas de rétention nulle sans autorisation expresse
Disponibilité API Claude, Amazon Bedrock, Claude sur AWS, Google Cloud, Microsoft Foundry, Claude.ai et Claude Code 2.1.250+

Trois points demandent une attention particulière :

  • La date limite de juin 2026 est la plus récente des modèles Claude. Opus 5 s’arrête à mai 2026 et Sonnet 5 à janvier 2026.
  • Le niveau de priorité a disparu par rapport à Fable 5.
  • Une organisation sans rétention de 30 jours reçoit une erreur 400 invalid_request_error. Vérifiez ce paramètre avant d’analyser votre charge utile.

Ce qu’est Claude Fable 5.1

Fable 5.1 succède à Fable 5 dans la même catégorie, au même prix par token et avec le même tokenizer, introduit avec Opus 4.7. Ce tokenizer produit environ 30 % de tokens supplémentaires par texte par rapport aux modèles antérieurs à Opus 4.7.

Anthropic décrit Fable 5.1 et Mythos 5.1 comme le « même modèle, avec différents niveaux de garde-fous ». Fable 5.1 est généralement disponible. Mythos 5.1 est réservé aux clients approuvés du Project Glasswing, notamment via les programmes Cyber Verification Program et Life Sciences Verification Program. Il alimente également Claude Security. La comparaison Mythos 5.1 vs Fable 5.1 détaille ces différences.

Le contexte de Fable 5 reste important :

  • Fable 5 a été suspendu en juin 2026 en vertu des contrôles à l’exportation américains.
  • Il est revenu le 1er juillet avec un classificateur de sécurité réentraîné.
  • Fable 5.1 conserve cette architecture et les mêmes catégories de refus, mais Anthropic indique que les classificateurs se déclenchent beaucoup moins souvent sur les tâches bénignes.

La recommandation officielle est claire : commencez par Opus 5 pour la plupart des charges de travail. Utilisez Fable 5.1 pour les raisonnements exigeants, les agents de longue durée ou les cas où Opus 5 à effort élevé ne donne toujours pas des résultats suffisants. Consultez la comparaison Fable 5.1 vs Opus 5 selon votre charge de travail.

Le prix de la lecture du cache

Les prix de base restent inchangés. Seul le multiplicateur de lecture du cache évolue :

Modèle Entrée de base Lecture du cache Sortie
Claude Fable 5.1 10 $ 0,25 $ 50 $
Claude Fable 5 10 $ 1,00 $ 50 $
Claude Opus 5 5 $ 0,50 $ 25 $
Claude Sonnet 5 2 $ 0,20 $ 10 $

Une lecture du cache avec Fable 5.1 coûte donc moins cher qu’avec Opus 5, alors que son prix d’entrée est deux fois supérieur.

L’économie est particulièrement importante pour les agents qui relisent un préfixe mis en cache à chaque tour :

  • environ 25 % moins cher pour les charges de travail typiques ;
  • jusqu’à environ 45 % moins cher pour les charges très agentiques.

Ces estimations proviennent du mix d’Anthropic. Utilisez le calculateur de coûts avec votre propre taux de réussite du cache.

Les écritures du cache — 12,50 $ et 20 $ par million de tokens — ainsi que le minimum de 512 tokens ne changent pas. Une absence de cache coûte désormais 40 fois plus cher qu’une lecture réussie : gardez donc vos préfixes chauds lorsque cela est possible.

Ce que montrent les benchmarks

Les résultats ci-dessous sont rapportés par Anthropic et n’ont pas encore fait l’objet d’une reproduction indépendante.

Benchmark Fable 5.1 Fable 5 Opus 5 GPT-5.6 Sol
Terminal-Bench-Science 0.1 52,6 % 24,7 % 29,0 % 22,4 %
Terminal-Bench 4.0 55,8 % 42,0 % 52,3 % 37,3 %
GDPval-AA v2 — travail de connaissance 1853 1723 1824 1711
OSWorld 2.0 — crédit partiel 77,9 % 72,9 % 75,4 % non rapporté
OSWorld 2.0 — strict 41,7 % 36,1 % 39,6 % non rapporté
Humanity’s Last Exam — sans outils 60,9 % 57,8 % 56,6 % non rapporté
Humanity’s Last Exam — avec outils 65,0 % 63,8 % 63,6 % non rapporté
AutomationBench 31,4 % 17,1 % 26,9 % 19,6 %
CursorBench 3.2.0 73,4 % 70,5 % 70,0 % 67,2 %

Anthropic rapporte également 60,9 % pour Mythos 5.1 sur Terminal-Bench 4.0, soit cinq points de plus que Fable 5.1. Cela constitue le signal publié le plus clair d’un impact des garde-fous sur certaines capacités de codage agentique.

Le résultat de Terminal-Bench-Science, plus de deux fois supérieur à celui de Fable 5, explique la plupart des titres de presse. Sur CursorBench, l’avance sur Opus 5 est de 3,4 points : un gain réel, mais modeste pour un modèle deux fois plus cher par token. Le détail des benchmarks présente les résultats ligne par ligne.

Les trois changements qui cassent le code de Fable 5

La migration est majoritairement compatible, mais trois changements peuvent provoquer des erreurs 400. Ils sont documentés dans les nouveautés de Claude Fable 5.1.

1. Le choix forcé d’un outil n’est plus accepté

Ces valeurs sont rejetées :

{"type": "any"}
Enter fullscreen mode Exit fullscreen mode
{"type": "tool", "name": "..."}
Enter fullscreen mode Exit fullscreen mode

L’API renvoie notamment :

tool_choice: type "tool" and "any" are not supported for this model
Enter fullscreen mode Exit fullscreen mode

Utilisez auto et nommez l’outil dans l’instruction. Ajoutez strict: true à la définition de l’outil si vous avez besoin d’arguments conformes au schéma. Si l’appel forcé servait uniquement à obtenir du JSON, préférez les sorties structurées.

2. Les anciens modèles ne lisent pas les blocs de pensée de Fable 5.1

Fable 5.1 peut lire les blocs d’Opus 5, de Fable 5 et des modèles antérieurs. L’inverse n’est pas garanti.

Lorsqu’un routeur, une nouvelle tentative ou un repli après refus transfère une conversation Fable 5.1 vers Opus 5, l’API supprime les blocs de pensée sans les facturer. Le modèle cible replanifie alors sans ces blocs.

3. Modifier les tours précédents invalide la pensée

Un bloc de pensée Fable 5.1 dépend exactement :

  • du prompt système ;
  • du tableau d’outils ;
  • de l’historique précédent.

La modification de l’un de ces éléments peut provoquer une erreur 400 indiquant que le bloc est « lié à une conversation différente ». Cette validation s’applique aux comptes créés le 31 août 2026 ou après cette date. Anthropic la présente comme une mesure anti-distillation.

Si votre code reconstruit directement le tableau messages, prévoyez une migration dédiée. Le guide de la pensée préservée explique l’erreur, l’option drop_block et les modèles d’ajout uniquement qui préservent la pensée et le cache.

Le reste du comportement est inchangé :

  • la réflexion ne peut pas être désactivée ;
  • le préremplissage renvoie 400 ;
  • une temperature différente de la valeur par défaut renvoie 400 ;
  • thinking.display vaut omitted par défaut.

Le guide de migration fournit les extraits avant/après.

Les cinq fonctionnalités supplémentaires

  1. Effort par message — bêta Un message système vide avec output_config peut modifier l’effort à partir du prochain tour utilisateur sans invalider le cache :
   {
     "role": "system",
     "content": [],
     "output_config": {"effort": "low"}
   }
Enter fullscreen mode Exit fullscreen mode

En-tête requis : mid-conversation-output-config-2026-07-01.

  1. Messages système limités à un tour — bêta clear_at: "next_user_message" applique l’autorité d’un message système au tour en cours, puis le retire. Cette option remplace l’injection d’un rappel suivie de sa suppression à la requête suivante.

En-tête requis : mid-conversation-system-clear-at-2026-08-21.

  1. Mises à jour de progression entre les outils — bêta thinking.display: "updates" renvoie les notes du modèle entre les appels d’outils sous forme de texte, tout en gardant le raisonnement masqué.

En-tête requis : thinking-display-updates-2026-08-18.

  1. Lecture du cache moins chère

    Fable 5.1 et Mythos 5.1 paient seulement 0,25 $ par million de tokens lus depuis le cache.

  2. Provenance du contenu

    Le texte comporte le filigrane statistique d’Anthropic sur chaque plateforme. Les médias pris en charge depuis le bac à sable d’exécution de code incluent des informations d’identification C2PA via l’API Fichiers. Consultez l’explication du filigrane.

Fonctionnalités de Claude Fable 5.1

Comment Fable 5.1 se comporte différemment

Le guide officiel de prompting et le guide de prompting Apidog signalent plusieurs changements :

  • un seul appel d’outil par tour dans certaines longues boucles d’agents, là où Fable 5 en regroupait plusieurs ;
  • moins de messages de progression entre les appels d’outils ;
  • davantage de réponses mémorielles avec un effort low ;
  • une prose plus dense ;
  • moins de formatage conversationnel ;
  • des citations non marquées dans les résumés ;
  • la réécriture de fichiers entiers.

Commencez avec high, puis relancez vos évaluations. Anthropic estime que medium se rapproche de Fable 5 pour un coût inférieur.

Le plafond honnête : les garde-fous restent actifs

Fable 5.1 utilise toujours des classificateurs de sécurité. Un refus renvoie HTTP 200 avec :

{
  "stop_reason": "refusal",
  "stop_details": {
    "category": "cyber"
  }
}
Enter fullscreen mode Exit fullscreen mode

Les catégories possibles sont :

  • cyber
  • bio
  • frontier_llm
  • reasoning_extraction
  • general_harms

Testez stop_reason avant de lire content.

Anthropic rapporte :

  • 85 % de déclenchements en moins des classificateurs de biologie sur les questions bénignes, par rapport à Fable 5 lors de son lancement ;
  • environ 60 % d’interventions cyber en moins par session Claude Code.

Fable 5.1 peut identifier des vulnérabilités dans du code que vous possédez, mais il ne développera pas d’exploits. Ce niveau d’accès relève de Mythos 5.1.

Gérez les refus directement dans votre code. Les modèles de repli autorisés sont Opus 4.8 et Opus 5. La configuration la plus simple utilise fallbacks: "default" avec l’en-tête server-side-fallback-2026-07-01. Un refus avant toute sortie n’est pas facturé.

Le guide de gestion des refus reste applicable, avec une contrainte : le modèle de repli ne peut pas lire les blocs de pensée de Fable 5.1.

Deux autres limites subsistent :

  • Mythos 5.1 dépasse Fable 5.1 sur les benchmarks publiés pour les deux modèles ;
  • les classificateurs de Fable 5.1 couvrent davantage de catégories que l’ensemble uniquement cyber d’Opus 5.

Où exécuter Fable 5.1

Les identifiants disponibles sont les suivants :

  • API Claude : claude-fable-5-1
  • Amazon Bedrock : anthropic.claude-fable-5-1
  • Claude sur AWS, Google Cloud et Microsoft Foundry : claude-fable-5-1

La configuration est la même que pour Fable 5. Le guide de disponibilité cloud détaille chaque plateforme.

Dans les applications Claude, le modèle est disponible pour les plans Pro, Max, Team et Enterprise, mais pas Free. Max inclut les modèles Fable jusqu’à 50 % de la limite hebdomadaire ; Pro les décompte via des crédits d’utilisation. Claude.ai permet d’y accéder depuis l’application.

Claude Code nécessite la version 2.1.250 ou ultérieure. Consultez le guide Claude Code et le guide des accès gratuits et économiques.

Tester Fable 5.1 dans Apidog

Dans Apidog, créez une requête POST vers :

https://api.anthropic.com/v1/messages
Enter fullscreen mode Exit fullscreen mode

Ajoutez les en-têtes :

x-[REDACTED CREDENTIAL]
anthropic-version: 2023-06-01
Enter fullscreen mode Exit fullscreen mode

Utilisez ce corps JSON :

{
  "model": "claude-fable-5-1",
  "max_tokens": 16000,
  "output_config": {"effort": "high"},
  "messages": [
    {
      "role": "user",
      "content": "Review this pagination handler and list the edge cases it misses."
    }
  ]
}
Enter fullscreen mode Exit fullscreen mode

Aucun champ thinking n’est nécessaire. Donnez suffisamment de marge à max_tokens, car cette limite couvre à la fois la réflexion et la réponse.

Inspectez ensuite :

  • stop_reason, en traitant refusal avant de lire content ;
  • le bloc thinking vide ;
  • usage.cache_read_input_tokens lors du deuxième envoi, lorsque le tarif de 0,25 $ s’applique.

Vous pouvez télécharger Apidog pour conserver cette requête comme cas de test.

Qui devrait utiliser Claude Fable 5.1 ?

Choisissez Fable 5.1 lorsque :

  • vos agents s’exécutent pendant plusieurs heures ;
  • vous utilisez déjà Fable 5 : même prix, cache moins cher et meilleurs résultats publiés dans la comparaison Fable 5.1 vs Fable 5 ;
  • Opus 5 à xhigh échoue encore à vos évaluations ;
  • vous avez besoin de connaissances allant jusqu’à juin 2026.

Restez sur un autre modèle lorsque :

  • le niveau de priorité est indispensable ;
  • votre organisation exige une rétention nulle ;
  • votre harnais modifie l’historique de conversation ;
  • votre charge est peu coûteuse et très volumineuse, auquel cas Opus 5 ou Sonnet 5 peut suffire.

FAQ

Quel est l’ID du modèle Claude Fable 5.1 ?

L’ID exact est claude-fable-5-1. Sur Amazon Bedrock, utilisez anthropic.claude-fable-5-1.

Combien coûte Claude Fable 5.1 ?

L’entrée coûte 10 $ par million de tokens et la sortie 50 $, comme pour Fable 5. La lecture du cache coûte 0,25 $ par million, contre 1 $ pour Fable 5. Le traitement par lots coûte 5 $ en entrée et 25 $ en sortie. Il n’existe ni mode rapide ni niveau de priorité.

Fable 5.1 est-il meilleur que Fable 5 ?

Sur tous les benchmarks publiés par Anthropic, oui. Les gains les plus importants apparaissent sur Terminal-Bench-Science — 52,6 % contre 24,7 % — et AutomationBench — 31,4 % contre 17,1 %. Ces résultats proviennent toutefois du vendeur.

Qu’est-ce qui cesse de fonctionner lors de la migration depuis Fable 5 ?

Le tool_choice forcé renvoie 400, les modèles plus anciens ne peuvent pas lire les blocs de pensée de Fable 5.1, et la modification des tours précédents invalide les blocs ultérieurs pour les comptes créés le 31 août 2026 ou après cette date.

Fable 5.1 refuse-t-il toujours les requêtes de cybersécurité ?

Parfois. Anthropic signale environ 60 % d’interventions cyber en moins par session Claude Code et autorise la recherche de vulnérabilités dans le code. Le développement d’exploits reste refusé.

Puis-je utiliser Claude Fable 5.1 gratuitement ?

Pas avec le plan Free. Le plan Pro utilise des crédits d’utilisation et le plan Max inclut le modèle jusqu’à 50 % de la limite hebdomadaire. L’API ne propose pas de niveau gratuit au-delà du crédit d’inscription.

Top comments (0)