DEV Community

Cover image for Claude Fable 5.1 Preise: Detaillierte Kostenübersicht (2026)
Emre Demir
Emre Demir

Posted on Originally published at apidog.com

Claude Fable 5.1 Preise: Detaillierte Kostenübersicht (2026)

Claude Fable 5.1: Preise, Prompt-Caching und reale Kosten

Claude Fable 5.1 kostet 10 $ pro Million Eingabe-Tokens und 50 $ pro Million Ausgabe-Tokens – genauso viel wie Fable 5. Geändert wurde der Preis für Prompt-Cache-Lesevorgänge: 0,25 $ pro Million Tokens statt 1 $ bei Fable 5 und 0,50 $ bei Opus 5. Anthropic schätzt dadurch typische Arbeitslasten um etwa 25 % und stark agentische Arbeitslasten um bis zu 45 % günstiger ein.

Apidog heute testen

Dieser Leitfaden fasst die offizielle Preisgestaltung zusammen, rekonstruiert die 25-%- und 45-%-Schätzungen und zeigt drei konkrete Kostenbeispiele. Wenn Sie zuerst einen Modellüberblick benötigen, lesen Sie Was ist Claude Fable 5.1?.

Claude Fable 5.1 Preisübersicht

Claude Fable 5.1: Preistabelle

Tarif Preis
Basiseingabe 10 $ pro Million Tokens
Ausgabe 50 $ pro Million Tokens
5-Minuten-Cache-Schreibvorgang 12,50 $ pro Million (1,25× Eingabe)
1-Stunden-Cache-Schreibvorgang 20 $ pro Million (2× Eingabe)
Cache-Lesevorgang (Treffer oder Aktualisierung) 0,25 $ pro Million (0,025× Eingabe)
Batch-API-Eingabe 5 $ pro Million
Batch-API-Ausgabe 25 $ pro Million
Long-Context-Premium Keine; das gesamte 1M-Fenster wird zum Standardtarif abgerechnet
inference_geo: "us" 1,1× auf jede Token-Kategorie
Schnellmodus Nicht verfügbar; nur Opus 5 und Opus 4.8
Prioritätsstufe Nicht unterstützt
Websuche 10 $ pro 1.000 Suchen plus Tokens

Claude Mythos 5.1 verwendet dieselben Tarife. Batch-Rabatt und Cache-Multiplikatoren addieren sich: Ein Batch-Cache-Lesevorgang kostet 0,125 $ pro Million Tokens.

Cache-Lesevorgänge im Vergleich

Modell Basiseingabe pro Million Cache-Lesevorgang pro Million Anteil der Eingabe
Claude Fable 5.1 10 $ 0,25 $ 2,5 %
Claude Fable 5 10 $ 1,00 $ 10 %
Claude Opus 5 5 $ 0,50 $ 10 %
Claude Opus 4.8 5 $ 0,50 $ 10 %
Claude Sonnet 5 2 $ 0,20 $ 10 %
Claude Haiku 4.5 1 $ 0,10 $ 10 %

Alle anderen Claude-Modelle berechnen einen Cache-Treffer mit 10 % des Basiseingabepreises. Fable 5.1 liegt bei 2,5 %. Ein Fable-5.1-Cache-Treffer ist damit günstiger als ein Opus-5-Treffer, obwohl nicht gecachte Eingaben bei Fable 5.1 doppelt so teuer sind.

Bei präfixlastigen Arbeitslasten kann der effektive Eingabepreis von Fable 5.1 deshalb unter den von Opus 5 fallen.

Eine Anmerkung zu Sonnet 5: Die angekündigte Preiserhöhung im September wurde abgesagt. Sonnet 5 bleibt bei 2 $ Eingabe und 10 $ Ausgabe.

Die 25-%- und 45-%-Schätzungen nachvollziehen

Anthropic hat die genaue Zusammensetzung der Arbeitslasten nicht veröffentlicht. Die folgende Rekonstruktion zeigt daher, welche Cache-Hit-Rate die Schätzungen voraussetzen.

Für eine Anfrage gelten:

  • U: nicht gecachte Eingabe-Tokens
  • C: gecachte Eingabe-Tokens
  • O: Ausgabe-Tokens
Fable 5:   10U + 1.0C  + 50O
Fable 5.1: 10U + 0.25C + 50O

Ersparnis:       0.75C
Prozentuale Ersparnis: 0.75C / (10U + C + 50O)
Enter fullscreen mode Exit fullscreen mode

Typische Chat-Arbeitslast

Annahmen:

  • 20.000 gecachte Eingabe-Tokens
  • 2.000 nicht gecachte Eingabe-Tokens
  • 1.500 Ausgabe-Tokens
Fable 5:
10(0.002) + 1.0(0.02) + 50(0.0015)
= 0,02 $ + 0,02 $ + 0,075 $
= 0,115 $

Fable 5.1:
0,02 $ + 0,005 $ + 0,075 $
= 0,100 $
Enter fullscreen mode Exit fullscreen mode

Ersparnis: 13 %. Für Anthropic’s Schätzung von 25 % muss der gecachte Anteil relativ zur Ausgabe größer sein. Bei 60.000 gecachten Tokens und denselben 1.500 Ausgabe-Tokens ergeben sich 0,155 $ gegenüber 0,110 $ – eine Ersparnis von 29 %.

Agentischer Loop

Ein Agent verarbeitet 40 Tool-Call-Runden. Pro Runde werden gelesen:

  • 150.000 gecachte Präfix-Tokens
  • 1.000 nicht gecachte Eingabe-Tokens
  • 800 Ausgabe-Tokens
Fable 5:
10(0.001) + 1.0(0.15) + 50(0.0008)
= 0,01 $ + 0,15 $ + 0,04 $
= 0,20 $

Fable 5.1:
0,01 $ + 0,0375 $ + 0,04 $
= 0,0875 $
Enter fullscreen mode Exit fullscreen mode

Das entspricht einer Ersparnis von 56 % pro Runde – vor dem einmaligen Cache-Schreibvorgang. Über 40 Runden sind das 8,00 $ gegenüber 3,50 $. Anthropic’s „bis zu 45 %“ liegt in diesem Bereich, sobald Cache-Schreibvorgänge und nicht gecachte Runden berücksichtigt werden.

Faustregel: Die Ersparnis steigt mit dem Verhältnis von gecachtem Input zu Output. Output-lastige Arbeitslasten – etwa lange Generierungen aus kurzen Prompts – profitieren kaum. Präfixlastige Arbeitslasten wie Agenten, RAG mit großem stabilem Kontext und mehrstufige Support-Bots profitieren am stärksten.

Drei Kostenbeispiele pro Aufgabe

Alle Beispiele verwenden Fable 5.1 zu Standardtarifen. Der 5-Minuten-Cache-Schreibvorgang wird jeweils einmalig berechnet.

1. Einzelne Code-Überprüfung

  • 30.000 Eingabe-Tokens für Diff und System-Prompt
  • 4.000 Ausgabe-Tokens
  • Kein Cache
Eingabe: 0,30 $
Ausgabe: 0,20 $
Gesamt: 0,50 $
Enter fullscreen mode Exit fullscreen mode

Dieselbe Überprüfung kostet mit Opus 5 0,25 $. Ohne Caching ist Fable 5.1 somit doppelt so teuer.

2. Support-Gespräch mit 25 Runden

  • Stabiler System-[REDACTED PROMPT]
  • Einmaliger Cache-Schreibvorgang: 0,15 $
  • Pro Runde: 300 nicht gecachte Eingabe-Tokens
  • Pro Runde: 250 Ausgabe-Tokens
  • Das Präfix wird aus dem Cache gelesen
Nicht gecachte Eingabe:
25 × 300 = 7.500 Tokens = 0,075 $

Cache-Lesevorgänge:
25 × 12.000 = 300.000 Tokens = 0,075 $

Ausgabe:
25 × 250 = 6.250 Tokens = 0,3125 $

Gesamt: ca. 0,61 $
Enter fullscreen mode Exit fullscreen mode

Bei Fable 5 würden allein die Cache-Lesevorgänge 0,30 $ kosten. Die Gesamtkosten lägen damit bei fast 0,84 $.

3. Zweistündiger agentischer Build

  • 120 Tool-Call-Runden
  • Präfix wächst von 20.000 auf 200.000 Tokens
  • Durchschnittlich 110.000 gecachte Tokens pro Runde
  • 1.500 nicht gecachte Eingabe-Tokens pro Runde
  • 1.200 Ausgabe-Tokens pro Runde
  • Etwa sechs Cache-Aktualisierungen
Cache-Lesevorgänge:
120 × 110.000 = 13,2 Mio. Tokens = 3,30 $

Nicht gecachte Eingabe:
180.000 Tokens = 1,80 $

Ausgabe:
144.000 Tokens = 7,20 $

Cache-Schreibvorgänge:
ca. 660.000 Tokens × 12,50 $ = 8,25 $

Gesamt: ungefähr 20,55 $
Enter fullscreen mode Exit fullscreen mode

Mit Fable 5 würden die Cache-Lesevorgänge 13,20 $ statt 3,30 $ kosten. Die Gesamtkosten lägen bei fast 30,45 $, also 33 % höher. Obwohl die Ausgabe weiterhin den größten Posten darstellt, sind Cache-Schreibvorgänge hier bereits die zweitgrößte Kostenposition.

Das ist die Kehrseite günstiger Cache-Lesevorgänge: Ein Schreibvorgang kostet 40-mal so viel wie ein Treffer. Alles, was den Cache mitten in einer Sitzung zurücksetzt – etwa der Neuaufbau von System-Prompt oder Tool-Array oder die Bearbeitung einer früheren Runde – ist daher deutlich teurer als ein stabiler Cache-Zustand.

Die wichtigsten Kostenhebel

Aufwand konfigurieren

output_config.effort ist der größte einzelne Hebel für Ausgabe-Tokens. Ausgaben kosten 50 $ pro Million Tokens.

Anthropic empfiehlt, bei Fable 5.1 mit high zu beginnen. medium soll ungefähr die Qualität von Fable 5 zu geringeren Kosten erreichen, während low bei den Kosten pro Aufgabe oft mit Opus und Sonnet konkurrieren kann. Führen Sie einen Sweep mit Ihren eigenen Evals durch.

Die Beta-Funktion für Aufwand pro Nachricht (per-message effort beta) ermöglicht, routinemäßige Runden mit low und schwierige Runden mit höherem Aufwand auszuführen, ohne den Cache zurückzusetzen.

Den Cache warm halten

Prompt-Caching ist der wichtigste Rabatt. Bei 0,25 $ pro Cache-Lesevorgang und 12,50 $ pro 5-Minuten-Schreibvorgang liegt der Break-even-Punkt bereits bei einem Treffer.

Für Leerlaufzeiten zwischen fünf und sechzig Minuten ist ein Keep-Alive mit max_tokens: 0 und der 5-Minuten-TTL in der Regel günstiger, als den doppelten Schreibpreis für eine 1-Stunden-TTL zu zahlen.

Die Dokumentation zum Prompt-Caching empfiehlt außerdem eine „append-only“-Struktur:

  • system und tools nicht mitten in der Sitzung neu aufbauen
  • Änderungen über Systemnachrichten einbringen
  • rundenbezogene Erinnerungen in rundenbezogenen Nachrichten halten

Diese Struktur bewahrt sowohl Denkblöcke als auch den Cache.

Batch-Verarbeitung nutzen

Die Batch-API halbiert alle Preise. Eine Fable-5.1-Batch-Anfrage kostet 5 $ Eingabe und 25 $ Ausgabe – genauso viel wie der synchrone Opus-5-Preis.

Evals, Backfills und nächtliche Dokumentenverarbeitung eignen sich besonders gut für Batches. Fallbacks werden bei Batches abgelehnt; fehlgeschlagene Elemente müssen manuell erneut eingereicht werden.

Das Modell pro Route wählen

Anthropic empfiehlt, mit Opus 5 zu beginnen und zu Fable 5.1 zu wechseln, wenn Opus 5 selbst bei höherem Aufwand nicht ausreicht. Wenn Opus 5 Ihre Evals besteht, zahlen Sie für Fable 5.1 das Doppelte, ohne einen Vorteil zu erhalten.

Der Vergleich von Fable 5.1 und Opus 5 hilft bei der Entscheidung pro Arbeitslast.

Tool-Overhead messen

Jede Anfrage mit Tools enthält einen zusätzlichen System-Prompt für die Tool-Nutzung. Anthropic veröffentlicht für Opus 5 einen Wert von 286 Tokens, aber noch keinen Wert für Fable 5.1. Messen Sie den Overhead daher mit dem Token-Zähl-Endpunkt.

Als Richtwerte gelten:

  • Browser-Toolset: etwa 6.600 Tokens pro Anfrage
  • Computer-Toolset: etwa 4.500 Tokens pro Anfrage

Nach dem ersten Senden werden diese Tokens gecacht.

Ablehnungen und Wiederholungen erfassen

Eine Klassifizierer-Ablehnung vor der Ausgabe wird nicht berechnet. Ein serverseitiger Fallback berechnet dagegen die Tarife des Fallback-Modells für den erneuten Versuch. Anthropic’s Fallback-Guthaben erstattet die Cache-Kosten des Modellwechsels.

Erfassen Sie Ablehnungen als eigene Metrik, damit sichtbar wird, wie viel Ihrer Fable-5.1-Ausgabe tatsächlich von Opus 5 bedient wird.

Die allgemeinen Empfehlungen aus dem Leitfaden zur Reduzierung einer Claude-API-Rechnung gelten weiterhin. Nur die Cache-Lesevorgänge verschieben die Rechnung deutlich zugunsten von Fable 5.1.

Was Sie bei Fable 5.1 nicht kaufen können

  • Schnellmodus: Nur Opus 5 und Opus 4.8 bieten ihn zu 10 $ Eingabe und 50 $ Ausgabe an. Für schnellere Fable-5.1-Ausgaben gibt es keinen kostenpflichtigen Modus.
  • Prioritätsstufe: Für Fable 5.1 und Mythos 5.1 nicht unterstützt. Fable 5 unterstützt sie weiterhin. Unternehmen müssen daher bei Fable 5 bleiben oder zu Opus 5 wechseln, wenn sie diese Kapazitätsplanung benötigen.
  • Zero Data Retention: Nicht verfügbar, außer Anthropic genehmigt sie ausdrücklich. Eine ZDR-Organisation erhält andernfalls bei jeder Anfrage einen 400-Fehler.

Tatsächliche Ausgaben mit Apidog überprüfen

Die zuverlässigste Quelle für die Kosten einer Anfrage ist das usage-Objekt. Am schnellsten lässt es sich mit einer Testsammlung prüfen:

  1. Speichern Sie Ihren Produktions-System-Prompt in Apidog als Anfrage mit cache_control.
  2. Senden Sie die Anfrage zweimal.
  3. Fügen Sie für das erste Senden eine Assertion für usage.cache_creation_input_tokens hinzu.
  4. Fügen Sie für das zweite Senden eine Assertion für usage.cache_read_input_tokens hinzu.
  5. Ergänzen Sie ein Post-Response-Skript, das jedes Feld mit dem jeweiligen Tarif multipliziert und die Kosten pro Anfrage protokolliert.

Führen Sie die Sammlung nach jeder Änderung an Prompt oder Tool-Definition aus. So erkennen Sie Cache-invalidierende Änderungen, bevor sie die Rechnung erhöhen.

Apidog herunterladen und die API-Anleitung für Claude Fable 5.1 enthalten die dafür nötigen Beispielanfragen.

Fable-5.1-Preise in den Claude-Apps

API-Preise werden pro Token berechnet. In den Claude-Apps hängt die Abrechnung vom Tarif ab:

  • Max-Tarife enthalten Fable-Modelle bis zu 50 % des wöchentlichen Nutzungslimits ohne Zusatzkosten. Danach werden Nutzungsguthaben verwendet.
  • Pro- und Standard-Team-Plätze rechnen Fable 5.1 ab der ersten Nachricht über Nutzungsguthaben ab.
  • Bei Enterprise-Standard-Plätzen müssen Nutzungsguthaben für die Nutzung über den Plan-Limits aktiviert werden.
  • Nutzungsbasierte Enterprise-Rechnungen verwenden die Standard-API-Tarife.
  • Anfragen, die Schutzmaßnahmen an ein anderes Modell weiterleiten, werden nicht zu Fable-Preisen berechnet.

Der Leitfaden zu kostenlosen und günstigen Optionen erklärt die Unterschiede im Detail.

FAQ

Wie viel kostet Claude Fable 5.1 pro Million Tokens?

Die Eingabe kostet 10 $, die Ausgabe 50 $. Cache-Lesevorgänge kosten 0,25 $, Cache-Schreibvorgänge 12,50 $ für fünf Minuten oder 20 $ für eine Stunde. Die Batch-API kostet 5 $ Eingabe und 25 $ Ausgabe.

Ist Claude Fable 5.1 günstiger als Fable 5?

Pro nicht gecachtem Token nicht. Für Arbeitslasten mit Prompt-Caching in der Praxis oft schon: Cache-Lesevorgänge sanken von 1 $ auf 0,25 $ pro Million Tokens. Anthropic schätzt typische Arbeitslasten als 25 % und agentische Arbeitslasten als bis zu 45 % günstiger ein. Output-lastige Arbeitslasten ändern sich kaum.

Ist Claude Fable 5.1 günstiger als Opus 5?

Ohne Cache nicht – Fable 5.1 ist genau doppelt so teuer. Mit Cache kostet ein Fable-5.1-Treffer 0,25 $ und damit die Hälfte eines Opus-5-Treffers mit 0,50 $.

Die Ausgabe bleibt mit 50 $ gegenüber 25 $ doppelt so teuer. Opus 5 gewinnt daher bei output-lastigen Routen.

Hat Claude Fable 5.1 einen Schnellmodus oder eine Prioritätsstufe?

Nein. Der Schnellmodus ist nur für Opus 5 und Opus 4.8 verfügbar. Die Prioritätsstufe wird bei Fable 5, nicht aber bei Fable 5.1 unterstützt.

Gibt es eine Long-Context-Premium?

Nein. Das vollständige 1M-Token-Fenster wird zum Standardtarif abgerechnet. Cache- und Batch-Rabatte gelten auch dafür.

Was kostet Claude Fable 5.1 auf Bedrock oder Google Cloud?

AWS Bedrock und Google Cloud legen eigene Preise fest und berechnen für regionale Endpunkte einen Aufschlag von 10 %. Claude Platform auf AWS und Microsoft Foundry rechnen über Claude Consumption Units zu den Standard-API-Tarifen ab.

Der Leitfaden zur Cloud-Verfügbarkeit beschreibt die Einrichtung auf den einzelnen Plattformen.

Top comments (0)