DEV Community

Cover image for Claude Fable 5.1 vs Fable 5 : Nouveautés et faut-il mettre à niveau ?
Antoine Laurent
Antoine Laurent

Posted on Originally published at apidog.com

Claude Fable 5.1 vs Fable 5 : Nouveautés et faut-il mettre à niveau ?

Claude Fable 5.1 vs Fable 5 : faut-il migrer ?

Claude Fable 5.1 a remplacé Fable 5 le 1er septembre 2026, aux mêmes tarifs de 10 $ et 50 $ par million de tokens. Les lectures de cache passent toutefois de 1 $ à 0,25 $ par million, tandis que les performances progressent sur tous les benchmarks publiés par Anthropic. Fable 5 reste disponible jusqu'au 9 juin 2027 au moins. La vraie question est donc de savoir si ces gains justifient le coût de migration pour votre charge de travail.

Essayez Apidog dès aujourd'hui

Cette comparaison résume les éléments inchangés, les améliorations, les incompatibilités et une règle de décision par type de charge de travail. Elle s'appuie sur le billet de lancement d'Anthropic, Quoi de neuf dans Claude Fable 5.1 et la fiche technique de Claude Fable 5.1.

Comparaison côte à côte

Caractéristique Claude Fable 5.1 Claude Fable 5
ID du modèle claude-fable-5-1 claude-fable-5
Publication 1er septembre 2026 9 juin 2026 — suspendu le 12 juin, rétabli le 1er juillet
Retrait Pas avant le 1er septembre 2027 Pas avant le 9 juin 2027
Contexte / sortie maximale 1M / 128K 1M / 128K
Date limite de connaissance Juin 2026 Janvier 2026
Prix entrée / sortie 10 $ / 50 $ par million 10 $ / 50 $ par million
Lecture du cache 0,25 $ par million 1,00 $ par million
Écriture du cache 12,50 $ (5 min), 20 $ (1 h) Identique
Traitement par lots 5 $ / 25 $ Identique
Tokeniseur Identique, génération Opus 4.7 Identique
Réflexion Adaptative, toujours active Adaptative, toujours active
tool_choice forcé Erreur 400 Accepté
Blocs de réflexion lisibles par les anciens modèles Non Oui
Vérification de l'édition de l'historique Oui, pour les comptes créés à partir du 31 août 2026 Non
Niveau de priorité Non pris en charge Pris en charge
Effort par message Oui, bêta Non
Messages système à portée de tour Oui, bêta Non
thinking.display: "updates" Oui, bêta Oui, bêta
Provenance du contenu Filigrane textuel + C2PA sur les médias Filigrane textuel
Rétention des données 30 jours requis, modèle couvert Identique
Catégories de refus Les cinq mêmes Les cinq mêmes

Comparaison des modèles Claude Fable 5.1 et Fable 5

Ce qui est identique

La compatibilité est plus importante qu'il n'y paraît. Les deux modèles conservent :

  • l'interface API ;
  • la fenêtre de contexte de 1M et la sortie maximale de 128K ;
  • les mêmes prix par token ;
  • le même tokeniseur ;
  • le minimum de 512 tokens pour le cache ;
  • la réflexion adaptative toujours active ;
  • le comportement par défaut "omitted" de thinking.display ;
  • l'interdiction du pré-remplissage ;
  • l'interdiction des paramètres d'échantillonnage ;
  • les messages système au milieu d'une conversation ;
  • les mêmes catégories de refus et mécanismes de repli.

Anthropic indique que les invites Fable 5 existantes devraient fonctionner sur Fable 5.1 sans modification. Les deux modèles partagent également un seul pool de limites de débit. Consultez le guide des limites de débit, l'explication des garde-fous et le guide de disponibilité dans le cloud.

Ce qui a été amélioré

Des gains surtout sur les tâches agentiques

Selon les chiffres publiés par Anthropic, Fable 5.1 progresse sur chaque benchmark :

Benchmark Fable 5.1 Fable 5 Écart
Terminal-Bench-Science 0.1 52,6 % 24,7 % +27,9
AutomationBench 31,4 % 17,1 % +14,3
Terminal-Bench 4.0 55,8 % 42,0 % +13,8
GDPval-AA v2 1853 1723 +130 Elo
OSWorld 2.0 — strict 41,7 % 36,1 % +5,6
OSWorld 2.0 — partiel 77,9 % 72,9 % +5,0
Humanity’s Last Exam — sans outils 60,9 % 57,8 % +3,1
CursorBench 3.2.0 73,4 % 70,5 % +2,9
Humanity’s Last Exam — avec outils 65,0 % 63,8 % +1,2

Les gains les plus importants concernent les workflows agentiques de longue durée : recherche scientifique dans un terminal, automatisation d'entreprise et codage agentique. Les écarts sont plus faibles pour les tâches de connaissance et le codage de type IDE.

Ces résultats restent gérés par le fournisseur et n'ont pas encore fait l'objet d'une reproduction indépendante. La répartition détaillée des benchmarks examine chaque ligne.

Les lectures de cache coûtent quatre fois moins cher

C'est probablement le changement financier le plus visible. Une session agentique qui relit un préfixe de 150 000 tokens à chaque tour coûtait :

  • Fable 5 : 0,15 $ par tour ;
  • Fable 5.1 : 0,0375 $ par tour.

D'après Anthropic, les charges de travail typiques coûtent environ 25 % moins cher, et jusqu'à 45 % moins cher pour les workflows agentiques. La page officielle des tarifs et la répartition des tarifs donnent les détails.

Moins de faux positifs des garde-fous

Anthropic rapporte :

  • 85 % de déclenchements en moins des classificateurs de biologie sur les demandes élémentaires et médicales bénignes ;
  • environ 60 % d'interventions cyber en moins par session Claude Code ;
  • la capacité à identifier des vulnérabilités dans du code source, alors que Fable 5 refusait ces demandes.

Le développement d'exploits reste refusé. Les catégories de refus n'ayant pas changé, conservez vos mécanismes de gestion des refus et vos replis.

Une meilleure marge sur le niveau d'effort

Anthropic indique que medium sur Fable 5.1 correspond approximativement à high sur Fable 5, pour un coût inférieur. Les gains de qualité les plus importants apparaissent avec xhigh et max.

En pratique, une charge de travail Fable 5 exécutée avec high peut souvent passer à Fable 5.1 avec medium :

  • qualité comparable ;
  • moins de tokens de sortie ;
  • coût inférieur.

Vous pouvez aussi conserver high pour privilégier la qualité. Validez toujours cette hypothèse avec vos propres évaluations.

Cinq mois supplémentaires de connaissances

La date limite de connaissance passe de janvier 2026 à juin 2026. Fable 5.1 connaît donc davantage de versions de frameworks, de changements d'API et de lancements de modèles sans nécessiter d'informations supplémentaires dans l'invite.

Trois améliorations du harnais

Fable 5.1 ajoute :

  1. la modification de l'effort par message sans réinitialiser le cache ;
  2. les messages système à portée de tour pour les rappels spécifiques à chaque tour ;
  3. les mises à jour de progression lisibles entre les appels d'outils.

thinking.display: "updates" était déjà disponible sur Fable 5. Les deux premières fonctionnalités sont nouvelles.

Évolution des performances et des coûts de Claude Fable 5.1

Ce qui est devenu plus difficile

tool_choice forcé n'est plus disponible

Sur Fable 5.1, tool_choice any et tool renvoient une erreur 400.

Si vous l'utilisiez pour garantir du JSON, migrez vers :

  • strict: true avec auto ;
  • les sorties structurées.

Si vous l'utilisiez pour imposer un appel d'outil à un tour précis, ajoutez un message système au milieu de la conversation pour l'indiquer explicitement.

Les blocs de réflexion ne sont pas bidirectionnels

Fable 5.1 peut lire les blocs de réflexion produits par Fable 5. Une conversation peut donc continuer sa progression lors d'une migration vers le nouveau modèle.

L'inverse ne fonctionne pas : Fable 5 ne peut pas lire les blocs de réflexion de Fable 5.1. Lors d'un routage progressif vers l'ancien modèle, l'API supprime ces blocs sans les facturer, puis Fable 5 replanifie le tour.

L'historique est désormais vérifié

Les blocs de réflexion de Fable 5.1 ne sont valides que dans la conversation exacte qui les a produits. La prochaine requête échoue sur les comptes créés à partir du 31 août 2026 si vous :

  • modifiez un tour précédent ;
  • reconstruisez l'invite système ;
  • échangez le tableau d'outils ;
  • injectez ou supprimez des rappels par tour ;
  • actualisez la date dans l'invite système ;
  • compactez côté client en conservant les tours récents.

Auditez cette logique avant la migration avec le guide de réflexion préservée, puis suivez la liste de contrôle de migration. Corrigez chaque erreur prefix_binding_mismatch avant le passage en production.

Le niveau de priorité disparaît

Fable 5.1 ne prend pas en charge le niveau de priorité, contrairement à Fable 5. Si vos garanties de capacité d'entreprise en dépendent, restez sur Fable 5 jusqu'à ce qu'Anthropic réintroduise cette fonctionnalité.

La boucle d'agent se comporte différemment

Trois changements peuvent affecter votre harnais :

  • Fable 5.1 peut émettre un seul appel d'outil par tour là où Fable 5 en regroupait plusieurs ;
  • il écrit moins de mises à jour de progression ;
  • avec un effort low, il répond plus souvent de mémoire au lieu de rechercher.

Ces comportements peuvent être ajustés avec l'invite. Le guide d'invite fournit une correction en une ligne pour chaque cas.

Règle de décision par charge de travail

Migrez maintenant si…

Votre travail consiste principalement en :

  • codage agentique de longue durée ;
  • recherche en plusieurs étapes ;
  • génération de documents ou de feuilles de calcul.

Ce sont les cas où les gains de benchmarks, les économies de cache et la réduction des faux positifs ont le plus d'impact. Cognition a déclaré avoir déplacé son trafic Devin vers Fable 5.1 dès le lancement.

Migrez après un audit du harnais si…

Votre code construit lui-même le tableau messages et modifie l'historique autrement qu'en ajoutant des tours.

Commencez par tester la vérification de l'édition de l'historique en trois étapes, corrigez chaque prefix_binding_mismatch, puis activez Fable 5.1. L'audit est peu coûteux ; découvrir le problème en production ne l'est pas.

Passez à medium si…

Fable 5 avec high suffit pour vos tâches courantes et vous cherchez à réduire le coût. Réexécutez le balayage des niveaux d'effort sur vos évaluations au lieu de supposer que les niveaux sont strictement équivalents.

Restez sur Fable 5 si…

  • le niveau de priorité est essentiel à votre capacité ;
  • votre charge de travail produit beaucoup de tokens mais réutilise peu de préfixes en cache ;
  • le faible volume de cache rend les économies négligeables ;
  • le coût de migration dépasse le gain attendu.

Fable 5 est garanti jusqu'au 9 juin 2027 au moins sur les plateformes exploitées par Anthropic. Bedrock et Google Cloud définissent leurs propres dates.

Envisagez Opus 5 si…

Fable 5 était déjà plus puissant que nécessaire. Anthropic recommande de commencer par Opus 5 et de passer à un modèle supérieur uniquement si Opus 5 ne suffit pas. Consultez la comparaison Fable 5.1 vs Opus 5.

Testez les deux modèles dans Apidog

La méthode la plus fiable consiste à comparer vos propres requêtes :

  1. Enregistrez vos dix invites de production les plus difficiles dans une collection Apidog.
  2. Définissez model comme variable d'environnement.
  3. Exécutez la collection avec claude-fable-5.
  4. Exécutez-la à nouveau avec claude-fable-5-1, en conservant le même niveau d'effort.
  5. Comparez, pour chaque requête :
    • le texte généré ;
    • usage.output_tokens ;
    • usage.cache_read_input_tokens lors de la deuxième exécution.
  6. Ajoutez une requête utilisant tool_choice forcé pour détecter l'erreur 400 avant vos utilisateurs.

Téléchargez Apidog pour configurer le test et consultez la procédure pas à pas de l'API pour les corps de requête.

FAQ

Claude Fable 5.1 est-il un nouveau modèle ou une mise à jour de Fable 5 ?

C'est un nouveau modèle avec son propre ID, claude-fable-5-1, et sa propre date de retrait. Il utilise le même tokeniseur et les mêmes tarifs par token que Fable 5, mais ses données d'entraînement vont jusqu'en juin 2026.

Fable 5.1 coûte-t-il plus cher que Fable 5 ?

Non. Les deux modèles coûtent 10 $ et 50 $ par million de tokens, avec les mêmes tarifs d'écriture de cache et de traitement par lots. Les lectures de cache coûtent 0,25 $ par million sur Fable 5.1 contre 1 $ sur Fable 5.

Mon code Fable 5 fonctionnera-t-il sur Fable 5.1 ?

Dans la plupart des cas. Le tool_choice forcé renvoie une erreur 400, et toute modification de l'historique entre deux requêtes peut invalider les blocs de réflexion sur les comptes créés à partir du 31 août 2026. Le reste du comportement est largement inchangé.

Fable 5 est-il en cours de retrait ?

Pas encore. Anthropic ne prévoit pas son retrait avant le 9 juin 2027 sur ses propres plateformes. Bedrock et Google Cloud fixent leurs propres calendriers.

Quel modèle est le meilleur pour le codage ?

Selon les chiffres d'Anthropic, Fable 5.1 :

  • Terminal-Bench 4.0 : 55,8 % contre 42,0 % ;
  • CursorBench 3.2.0 : 73,4 % contre 70,5 %.

L'écart est important pour le codage agentique en terminal et plus limité pour le codage de type IDE. Ces résultats sont gérés par le fournisseur.

Fable 5.1 refuse-t-il moins de requêtes que Fable 5 ?

Anthropic rapporte 85 % de faux positifs en moins en biologie et environ 60 % d'interventions cyber en moins par session Claude Code. Les catégories de refus restent identiques : conservez vos contrôles et vos mécanismes de repli.

Références

Top comments (0)