DEV Community

Cover image for Claude Fable 5.1 vs Opus 5: Wann lohnt sich der doppelte Preis?
Emre Demir
Emre Demir

Posted on Originally published at apidog.com

Claude Fable 5.1 vs Opus 5: Wann lohnt sich der doppelte Preis?

Claude Fable 5.1 vs. Claude Opus 5: Welches Modell passt zu Ihrer Aufgabe?

Claude Fable 5.1 kostet 10 $ pro Million Eingabe-Tokens und 50 $ pro Million Ausgabe-Tokens. Claude Opus 5 kostet 5 $ beziehungsweise 25 $. Anthropic empfiehlt, mit Opus 5 zu beginnen und erst zu Fable 5.1 zu wechseln, „wenn Ihre Evaluierungen auf Claude Opus 5 bei höherem Aufwand immer noch unzureichend sind“. Dieser Vergleich zeigt, wo Fable 5.1 Opus 5 deutlich übertrifft, welche Unterschiede sich möglicherweise durch Prompt-Tuning ausgleichen lassen und wann Fable 5.1 dank günstigerer Cache-Reads sogar weniger kostet.

Apidog heute ausprobieren

Die Quellen sind der Launch-Post von Anthropic, die Fable-5.1-Modellseite und die Preisseite. Eine allgemeine Einführung finden Sie in den Artikeln Was ist Claude Fable 5.1? und Was ist Claude Opus 5?.

Vergleich von Claude Fable 5.1 und Claude Opus 5

Claude Fable 5.1 und Opus 5 im Vergleich

Merkmal Claude Fable 5.1 Claude Opus 5
Modell-ID claude-fable-5-1 claude-opus-5
Veröffentlicht 1. September 2026 24. Juli 2026
Positionierung Anspruchsvolle Argumentation und agentische Arbeit mit langem Zeithorizont Komplexe agentische Kodierung und Unternehmensarbeit; die empfohlene Standardeinstellung
Eingabe / Ausgabe 10 $ / 50 $ 5 $ / 25 $
Cache-Read 0,25 $ 0,50 $
Cache-Write, 5 Minuten / 1 Stunde 12,50 $ / 20 $ 6,25 $ / 10 $
Batch 5 $ / 25 $ 2,50 $ / 12,50 $
Schnellmodus Nein Ja, 10 $ / 50 $
Prioritätsstufe Nein Nein
Kontext / maximale Ausgabe 1 Mio. / 128K 1 Mio. / 128K; 300K im Batch mit Beta
Wissensstand Juni 2026 Mai 2026
Vergleichbare Latenz Langsamer Mäßig
Denken Immer aktiviert; disabled gibt HTTP 400 zurück Standardmäßig aktiviert; disabled bei high oder niedriger erlaubt
Erzwungene tool_choice HTTP 400 Akzeptiert
Sicherheitsklassifikatoren Cyber, Bio, Frontier-LLM, Reasoning-Extraktion, allgemeine Schäden Nur Cyber
Zero Data Retention Nicht verfügbar, sofern nicht ausdrücklich autorisiert Verfügbar
Aufwand pro Nachricht, Beta Ja Ja
Prüfung nach Verlaufsbearbeitung Ja Nein

Was die Benchmarks zeigen

Alle folgenden Zahlen stammen von Anthropic und wurden von Anthropic erhoben. Eine unabhängige Reproduktion liegt noch nicht vor.

Benchmark Fable 5.1 Opus 5 Unterschied
Terminal-Bench-Science 0.1 52,6 % 29,0 % +23,6
AutomationBench 31,4 % 26,9 % +4,5
Humanity’s Last Exam, ohne Tools 60,9 % 56,6 % +4,3
Terminal-Bench 4.0 55,8 % 52,3 % +3,5
CursorBench 3.2.0 73,4 % 70,0 % +3,4
OSWorld 2.0, teilweise 77,9 % 75,4 % +2,5
OSWorld 2.0, streng 41,7 % 39 erzählen zwei unterschiedliche Geschichten:
  • Bei Terminal-Bench-Science erreicht Fable 5.1 fast doppelt so viele Punkte wie Opus 5. Dieser Forschungs-Benchmark verlangt, dass ein Modell über längere Zeit Experimente in einem Terminal ausführt.
  • Bei den übrigen Benchmarks liegt der Vorsprung zwischen 1 und 5 Punkten. Die Lücke von 4,5 Punkten bei AutomationBench ist relevant. 1,4 Punkte bei „Humanity’s Last Exam mit Tools“ oder 29 Elo bei GDPval können jedoch innerhalb des Bereichs liegen, in dem Prompt und Aufwandseinstellung die Modellwahl übertreffen.

Auch die Entwicklung bei der agentischen Kodierung ist wichtig: Opus 5 startete im Juli bei Terminal-Bench 4.0 mit 52,3 %, während Fable 5 zunächst 42,0 % erreichte. Fable 5.1 übernahm mit 55,8 % wieder die Führung. Der aktuelle Vorsprung beträgt aber 3,5 statt 13,8 Punkte. Der Vergleich zwischen Opus 5 und Fable 5 beschreibt den früheren Stand dieses Vergleichs.

Die Kosten sind nicht einfach doppelt so hoch

Ohne Cache kostet jede Zeile bei Fable 5.1 genau doppelt so viel wie bei Opus 5. Bei Cache-Reads ist es umgekehrt:

  • Fable 5.1: 0,25 $
  • Opus 5: 0,50 $

Der effektive Multiplikator hängt daher davon ab, wie viel Ihres Inputs aus einem gecachten Präfix besteht.

Beispiel 1: Präfix-lastiger Agenten-Loop

Angenommen, ein Agenten-Zug verwendet:

  • 150.000 gecachte Eingabe-Tokens
  • 1.000 ungecachte Eingabe-Tokens
  • 800 Ausgabe-Tokens

Opus 5:

5(0,001) + 0,5(0,15) + 25(0,0008)
= 0,005 $ + 0,075 $ + 0,02 $
= 0,10 $
Enter fullscreen mode Exit fullscreen mode

Fable 5.1:

10(0,001) + 0,25(0,15) + 50(0,0008)
= 0,01 $ + 0,0375 $ + 0,04 $
= 0,0875 $
Enter fullscreen mode Exit fullscreen mode

Bei diesem Zug ist Fable 5.1 günstiger.

Beispiel 2: Ausgabeintensive Code-Review

Eine Code-Review mit 30.000 ungecachten Eingabe-Tokens und 4.000 Ausgabe-Tokens kostet:

Opus 5:    0,15 $ + 0,10 $ = 0,25 $
Fable 5.1: 0,30 $ + 0,20 $ = 0,50 $
Enter fullscreen mode Exit fullscreen mode

Hier kostet Fable 5.1 genau das Doppelte.

Die Break-even-Regel

Die Kosten pro Zug von Fable 5.1 liegen unter denen von Opus 5, wenn die Zahl der gecachten Eingabe-Tokens ungefähr das 20-Fache der folgenden Summe übersteigt:

ungecachete Eingabe-Tokens + 5 × Ausgabe-Tokens
Enter fullscreen mode Exit fullscreen mode

Für Agenten-Loops mit einem großen, unveränderten Präfix ist diese Bedingung häufig erfüllt. Bei stark ausgabeintensiven Aufgaben tritt sie dagegen nie ein. Cache-Writes sind bei Fable 5.1 ebenfalls doppelt so teuer. Sitzungen, die ihren Cache häufig zurücksetzen, verlieren daher den Kostenvorteil.

Die vollständigen Tabellen finden Sie in der Fable-5.1-Preisübersicht und der Opus-5-Preisübersicht.

Wo Opus 5 eindeutig gewinnt

Ausgeschaltetes Denken

Opus 5 akzeptiert:

{
  "thinking": {
    "type": "disabled"
  }
}
Enter fullscreen mode Exit fullscreen mode

Das ist bei high oder niedrigerem Aufwand möglich. Fable 5.1 kann Denken nicht deaktivieren und gibt in diesem Fall HTTP 400 zurück.

Für Klassifizierung, Extraktion und kurze Antworten ist Opus 5 mit deaktiviertem Denken oder bei low daher günstiger und schneller.

Schnellmodus

Opus 5 bietet für Forschungsvorschauen einen Schnellmodus mit bis zu 2,5-facher Ausgabegeschwindigkeit für 10 $ / 50 $. Fable 5.1 hat kein entsprechendes Angebot. Wenn Latenz wichtiger ist als die letzten Benchmark-Punkte, ist Opus 5 die bessere Wahl.

Latenz

Anthropic beschreibt Fable 5.1 als „langsamer“ und Opus 5 als „moderat“. Einzelne Fable-5.1-Züge bei schwierigen Aufgaben und hohem Aufwand können mehrere Minuten dauern.

Zero Data Retention

Opus 5 ist unter Zero Data Retention (ZDR) verfügbar. Fable 5.1 ist ein „Covered Model“ und gibt HTTP 400 zurück, sofern Anthropic den ZDR-Zugriff nicht ausdrücklich autorisiert.

Weniger Sicherheitsablehnungen

Opus 5 verwendet ausschließlich Cybersicherheits-Klassifikatoren. Fable 5.1 nutzt zusätzlich Klassifikatoren für:

  • Biologie
  • Frontier-LLM-Entwicklung
  • Reasoning-Extraktion
  • allgemeine Schäden

Eine harmlose Biowissenschafts- oder ML-Arbeitslast, die Opus 5 akzeptiert, kann bei Fable 5.1 eine Ablehnung auslösen. In diesem Fall ist Opus 5 eines der zulässigen Fallback-Ziele.

Erzwungene tool_choice

Opus 5 akzeptiert weiterhin tool_choice: "any" und tool_choice: "tool". Fable 5.1 gibt dafür HTTP 400 zurück. Integrationen mit erzwungenen Tool-Aufrufen müssen für Fable 5.1 angepasst werden.

Verlaufsbearbeitung

Opus 5 ist unempfindlich gegenüber der Bearbeitung früherer Züge. Fable 5.1 invalidiert bei solchen Änderungen nachfolgende Denkblöcke. Ein clientseitig komprimierendes Harness oder ein System, das pro Zug Erinnerungen einfügt, sollte vor der Migration zu Fable 5.1 überprüft werden.

Wo Fable 5.1 eindeutig gewinnt

Langfristige Forschung und Terminal-Agenten

Der Vorsprung von 52,6 % gegenüber 29,0 % bei Terminal-Bench-Science ist die größte einzelne Lücke in Anthropic’s Tabelle. Wenn Ihre Agenten Experimente durchführen, mehrstufige Webrecherche betreiben oder stundenlang autonom arbeiten, entspricht diese Arbeitslast genau der Positionierung von Fable 5.1.

Geschäftsautomatisierung

Bei AutomationBench erreicht Fable 5.1 31,4 % gegenüber 26,9 % für Opus 5. Das ist ein relevanter Unterschied bei einem Benchmark für End-to-End-Aufgaben über mehrere Anwendungen hinweg.

Cache-intensive Agenten

Das Cache-Read von 0,25 $ kann Fable 5.1 in präfixdominierten Agenten-Loops pro Zug günstiger machen als Opus 5.

Aktueller Wissensstand

Fable 5.1 verfügt über einen Wissensstand von Juni 2026, Opus 5 über Mai 2026. Der Unterschied beträgt nur einen Monat, Fable 5.1 ist aber das aktuellere Modell.

Dichte Dokumente und Vision

Anthropic nennt eine bessere Lesbarkeit von Diagrammen, Einreichungen und Tabellen in PDFs als Vorteil von Fable 5.1, insbesondere in Kombination mit Zuschneide- und Zoom-Tools. Für Opus 5 gibt es keinen veröffentlichten Vision-Benchmark. Diese Behauptung sollte daher mit eigenen Dokumenten getestet werden.

Aufgaben, die Opus 5 bei xhigh nicht löst

Anthropic’s empfohlene Regel ist sinnvoll: Wenn eine Aufgabe in Ihrer Evaluierung selbst bei Opus 5 mit xhigh fehlschlägt, testen Sie Fable 5.1 mit high, bevor Sie andere Änderungen vornehmen.

Der Aufwand verändert den Vergleich

Beide Modelle bieten fünf Aufwandsstufen. Anthropic weist bei Fable 5.1 besonders auf die niedrigste Stufe hin: Bei low sei das Modell hinsichtlich der Kosten pro Aufgabe oft konkurrenzfähig mit Claude Opus und Claude Sonnet, während es bessere Ergebnisse erreiche.

Der faire Vergleich für Routineaufgaben ist daher nicht immer:

Opus 5 bei high vs. Fable 5.1 bei high
Enter fullscreen mode Exit fullscreen mode

Testen Sie stattdessen auch:

Opus 5 bei high vs. Fable 5.1 bei low oder medium
Enter fullscreen mode Exit fullscreen mode

Bei geringerem Aufwand erzeugt das Modell weniger Ausgabe-Tokens. Dadurch kann sich der doppelte Tokenpreis teilweise oder vollständig ausgleichen.

Umgekehrt sind die Verbesserungen von Fable 5.1 gegenüber Fable 5 bei xhigh und max am größten. Die maximale Leistung gegenüber Opus 5 ist also gerade bei den Einstellungen am höchsten, die auch die meiste Zeit und die höchsten Kosten verursachen.

Vergleichen Sie beide Modelle über alle Aufwandsstufen hinweg mit Ihren eigenen Evaluierungen. Der Opus-5-Aufwandsleitfaden beschreibt die fünf Stufen; ihre Semantik ist bei Fable 5.1 identisch.

Ein praktischer Entscheidungsrahmen

  1. Starten Sie mit Opus 5 bei high.

    Das entspricht Anthropic’s Standardempfehlung: halber Preis, weniger Sicherheitsklassifikatoren und ZDR-Unterstützung.

  2. Erhöhen Sie bei fehlschlagenden Aufgaben auf xhigh.

    Das ist günstiger als ein sofortiger Modellwechsel.

  3. Verschieben Sie weiterhin fehlschlagende Aufgaben zu Fable 5.1 bei high.

    Wechseln Sie pro Route statt global. Behalten Sie Opus 5 für alle funktionierenden Aufgaben.

  4. Prüfen Sie das Cache-Profil der migrierten Routen.

    Bei präfixlastigen Loops kann Fable 5.1 pro Zug günstiger sein.

  5. Prüfen Sie Ihr Harness vor der Migration.

    Erzwungene tool_choice und Verlaufsbearbeitungen funktionieren bei Fable 5.1 nicht. Der Migrationsleitfaden enthält die vollständige Checkliste.

Den Vergleich in Apidog durchführen

Mit Apidog können Sie Produktions-Prompts reproduzierbar über mehrere Modelle und Aufwandsstufen testen:

  1. Erstellen Sie eine Sammlung mit Ihren Produktions-Prompts.
  2. Legen Sie model als Umgebungsvariable an.
  3. Führen Sie die Sammlung nacheinander mit folgenden Konfigurationen aus:
    • claude-opus-5 bei high
    • claude-opus-5 bei xhigh
    • claude-fable-5-1 bei high
    • claude-fable-5-1 bei low
  4. Speichern Sie pro Lauf die Antwort, usage.output_tokens und bei wiederholten Anfragen usage.cache_read_input_tokens.
  5. Berechnen Sie die Kosten in einem Post-Response-Skript anhand der jeweiligen Modellpreise.
  6. Vergleichen Sie Antwortqualität, Tokenverbrauch, Cache-Nutzung, Latenz und Kosten pro Aufgabe.

Apidog speichert jeden Lauf als Verlauf. So bleibt Ihre Evaluierung auch bei der nächsten Modelleinführung nachvollziehbar. Laden Sie Apidog herunter, um den Vergleich einzurichten.

FAQ

Ist Claude Fable 5.1 besser als Opus 5?

Bei jedem von Anthropic veröffentlichten Benchmark erzielt Fable 5.1 bessere Werte. Die Abstände reichen von 1,4 bis 23,6 Punkten. Die größte Lücke besteht bei Terminal-Bench-Science; die meisten anderen Unterschiede liegen unter fünf Punkten. Die Ergebnisse wurden vom Anbieter selbst erhoben.

Ist Fable 5.1 den doppelten Preis von Opus 5 wert?

Für langfristige Forschung, Terminal-Agenten, Geschäftsautomatisierung und präfixlastige Agenten-Loops kann sich Fable 5.1 lohnen. Bei präfixlastigen Loops können die günstigeren Cache-Reads die Kosten pro Zug sogar senken.

Für ausgabeintensive, latenzempfindliche oder klassische Klassifizierungsaufgaben ist Opus 5 meist die bessere Wahl. Anthropic’s Regel lautet: Wechseln Sie erst dann, wenn Opus 5 auch bei höherem Aufwand Ihre Evaluierungen nicht besteht.

Welches Modell ist schneller?

Opus 5. Anthropic beschreibt seine Latenz als „moderat“, verglichen mit „langsamer“ bei Fable 5.1. Zusätzlich bietet Opus 5 einen Schnellmodus mit bis zu 2,5-facher Ausgabegeschwindigkeit. Fable 5.1 hat keinen Schnellmodus.

Hat Opus 5 dieselben Sicherheitsklassifikatoren wie Fable 5.1?

Nein. Opus 5 verwendet nur Cybersicherheits-Klassifikatoren. Fable 5.1 deckt zusätzlich Biologie, Frontier-LLM-Entwicklung, Reasoning-Extraktion und allgemeine Schäden ab. Wenn Fable 5.1 eine Anfrage ablehnt, ist Opus 5 eines der zulässigen Fallback-Ziele.

Kann ich Fable 5.1 wie Opus 5 mit Zero Data Retention verwenden?

Nein. Fable 5.1 ist ein „Covered Model“ und erfordert eine 30-tägige Aufbewahrung, sofern keine ausdrückliche ZDR-Autorisierung von Anthropic vorliegt. Opus 5 ist unter ZDR verfügbar.

Kann eine Konversation zwischen Opus 5 und Fable 5.1 wechseln?

Ja, ein Wechsel zu Fable 5.1 ist möglich: Fable 5.1 kann die Denkblöcke von Opus 5 lesen.

Beim Wechsel zurück zu Opus 5 verwirft die API die Denkblöcke von Fable 5.1, bevor Opus 5 sie unberechnet sieht. Opus 5 plant diesen Zug anschließend neu.

Top comments (0)