Claude Fable 5.1: API, Preise, Benchmarks und Migration
Claude Fable 5.1 ist Anthropics neuestes Modell der Fable-Klasse. Es wurde am 1. September 2026 zusammen mit dem zugangsgeschützten Claude Mythos 5.1 veröffentlicht und ersetzt Claude Fable 5 zum gleichen Preis: 10 US-Dollar pro Million Input-Token und 50 US-Dollar pro Million Output-Token. Die wichtigste Änderung für Agenten ist der Cache-Lese-Preis von nur 0,25 US-Dollar pro Million Token. Anthropic positioniert Fable 5.1 für anspruchsvolle Denkprozesse und langfristige Agentenarbeit, empfiehlt für die meisten Workloads aber weiterhin Opus 5 als Ausgangspunkt.
Dieser Leitfaden fasst die Spezifikationen, Preise, Benchmarks, API-Änderungen, neuen Funktionen, Zugriffsmöglichkeiten und Grenzen zusammen. Da alle Beispiele über HTTP und JSON funktionieren, können Sie sie in Apidog testen, bevor Sie Anwendungscode ändern.
Die primären Quellen sind Anthropics Startbeitrag und die Modellseite von Fable 5.1.
Claude Fable 5.1 auf einen Blick
| Spezifikation | Wert |
|---|---|
| API-Modell-ID |
claude-fable-5-1 ohne Datumssuffix |
| Veröffentlichung | 1. September 2026 |
| Zusage zur Außerbetriebnahme | Nicht vor dem 1. September 2027 |
| Kontextfenster | 1.000.000 Token, Standard und Maximum |
| Max. Output | 128.000 Token über die Messages API |
| Basispreise | 10 US-Dollar pro Million Input-Token, 50 US-Dollar pro Million Output-Token |
| Cache-Lesevorgänge | 0,25 US-Dollar pro Million Token, also das 0,025-Fache des Basis-Inputs |
| Batch-API | 5 US-Dollar Input und 25 US-Dollar Output pro Million Token |
| Wissensstand | Juni 2026 |
| Denken | Adaptiv und immer aktiv; kann nicht deaktiviert werden |
| Anstrengungsgrade |
low, medium, high, xhigh, max; Standard ist high
|
| Vergleichbare Latenz | Langsamer als Opus 5 und Sonnet 5 |
| Prioritäts-Tier | Nicht unterstützt; Fable 5 unterstützte es |
| Datenaufbewahrung | 30-tägige Aufbewahrung erforderlich; keine Zero Data Retention ohne ausdrückliche Autorisierung durch Anthropic |
| Verfügbarkeit | Claude API, Amazon Bedrock, Claude Platform auf AWS, Google Cloud, Microsoft Foundry, Claude.ai und Claude Code 2.1.250+ |
Drei Angaben sind für Integrationen besonders wichtig:
- Der Wissensstand von Juni 2026 ist aktueller als bei Opus 5 (Mai 2026) und Sonnet 5 (Januar 2026).
- Das Prioritäts-Tier aus Fable 5 ist in Fable 5.1 nicht verfügbar.
- Organisationen ohne 30-tägige Datenaufbewahrung erhalten bereits beim Request einen
400 invalid_request_error. Prüfen Sie diese Einstellung, bevor Sie eine Payload debuggen.
Was ist Claude Fable 5.1?
Fable 5.1 folgt auf Fable 5, verwendet denselben Tokenizer und kostet pro Token gleich viel. Der Tokenizer wurde mit Opus 4.7 eingeführt und erzeugt ungefähr 30 % mehr Token pro Text als Modelle vor Version 4.7.
Anthropic beschreibt Fable 5.1 und Mythos 5.1 als dasselbe Modell mit unterschiedlichen Sicherheitsstufen:
- Fable 5.1 ist allgemein verfügbar.
- Mythos 5.1 ist zugelassenen Kunden in Project Glasswing sowie im Cyber Verification Program und Life Sciences Verification Program vorbehalten.
- Mythos 5.1 bildet die Grundlage für Anthropics Claude-Security-Produkt.
Die Unterschiede behandelt der Vergleich Mythos 5.1 vs. Fable 5.1.
Fable 5 wurde im Juni 2026 aufgrund von US-Exportkontrollen ausgesetzt und am 1. Juli mit einem neu trainierten Sicherheitsklassifikator wieder eingeführt. Fable 5.1 behält diese Klassifikatorarchitektur und dieselben Ablehnungskategorien. Laut Anthropic lösen die Klassifikatoren bei harmloser Arbeit jedoch deutlich seltener aus.
Anthropics Empfehlung ist eindeutig:
- Beginnen Sie für die meisten Workloads mit Opus 5.
- Wechseln Sie zu Fable 5.1, wenn Sie anspruchsvollere Denkprozesse oder lang laufende Agenten benötigen.
- Verwenden Sie Fable 5.1 auch dann, wenn Opus 5 mit
xhighnicht die erforderliche Leistung erreicht.
Der Vergleich Fable 5.1 vs. Opus 5 ordnet diese Entscheidung nach Workload ein.
Die Geschichte der Cache-Lese-Preise
Die Token-Preise haben sich nicht geändert, der Cache-Lese-Multiplikator dagegen schon. Die meisten Claude-Modelle berechnen Cache-Hits mit dem 0,1-Fachen des Basis-Inputs. Fable 5.1 und Mythos 5.1 verwenden nur das 0,025-Fache.
| Modell | Basis-Input | Cache-Lesen | Output |
|---|---|---|---|
| Claude Fable 5.1 | 10 $ | 0,25 $ | 50 $ |
| Claude Fable 5 | 10 $ | 1,00 $ | 50 $ |
| Claude Opus 5 | 5 $ | 0,50 $ | 25 $ |
| Claude Sonnet 5 | 2 $ | 0,20 $ | 10 $ |
Das hat zwei praktische Folgen:
- Ein Cache-Hit bei Fable 5.1 ist günstiger als bei Opus 5, obwohl der Basis-Input doppelt so teuer ist.
- Lange Agenten-Sitzungen profitieren besonders, wenn sie in jeder Runde dasselbe Präfix erneut lesen.
Anthropic schätzt Fable 5.1 für typische Workloads als etwa 25 % günstiger ein, bei stark agentischen Workloads als bis zu etwa 45 % günstiger. Das sind Schätzungen für Anthropics eigenen Workload-Mix. Die Kostenberechnung zeigt, wie Sie die Rechnung mit Ihrer eigenen Cache-Hit-Rate durchführen.
Cache-Schreibvorgänge von 12,50 beziehungsweise 20 US-Dollar pro Million Token und das Cache-Minimum von 512 Token bleiben unverändert. Ein Cache-Miss kostet jetzt das 40-Fache eines Hits. Halten Sie den Cache daher insbesondere in langen Agentenschleifen warm.
Was Anthropic über die Benchmarks berichtet
Die folgenden Ergebnisse stammen von Anthropic; unabhängige Reproduktionen stehen noch aus.
| Benchmark | Fable 5.1 | Fable 5 | Opus 5 | GPT-5.6 Sol |
|---|---|---|---|---|
| Terminal-Bench-Science 0.1 | 52,6 % | 24,7 % | 29,0 % | 22,4 % |
| Terminal-Bench 4.0 | 55,8 % | 42,0 % | 52,3 % | 37,3 % |
| GDPval-AA v2 (Wissensarbeit) | 1853 | 1723 | 1824 | 1711 |
| OSWorld 2.0 (Teilpunkte) | 77,9 % | 72,9 % | 75,4 % | nicht berichtet |
| OSWorld 2.0 (streng) | 41,7 % | 36,1 % | 39,6 % | nicht berichtet |
| Humanity’s Last Exam (ohne Tools) | 60,9 % | 57,8 % | 56,6 % | nicht berichtet |
| Humanity’s Last Exam (mit Tools) | 65,0 % | 63,8 % | 63,6 % | nicht berichtet |
| AutomationBench | 31,4 % | 17,1 % | 26,9 % | 19,6 % |
| CursorBench 3.2.0 | 73,4 % | 70,5 % | 70,0 % | 67,2 % |
Anthropic berichtet außerdem, dass Mythos 5.1 bei Terminal-Bench 4.0 60,9 % erreicht und damit fünf Punkte über Fable 5.1 liegt. Das ist der deutlichste veröffentlichte Hinweis darauf, dass die Sicherheitsvorkehrungen bei agentischer Codierung Leistung kosten.
Der größte Sprung gegenüber Fable 5 zeigt sich bei Terminal-Bench-Science. Der Vorsprung bei CursorBench gegenüber Opus 5 beträgt 3,4 Prozentpunkte. Das ist ein realer, aber moderater Vorteil für ein Modell, dessen Token-Grundpreis doppelt so hoch ist. Die vollständige Benchmark-Aufschlüsselung geht jede Zeile durch.
Die drei Breaking Changes gegenüber Fable 5
Die Migration ist größtenteils ein Drop-in-Upgrade. Drei bisher gültige Muster führen mit Fable 5.1 jedoch zu Fehlern.
1. Erzwungene Tool-Nutzung wird abgelehnt
Diese Werte liefern einen HTTP-400-Fehler:
{
"tool_choice": {
"type": "any"
}
}
und:
{
"tool_choice": {
"type": "tool",
"name": "..."
}
}
Die Fehlermeldung lautet:
tool_choice: type "tool" and "any" are not supported for this model
Verwenden Sie stattdessen auto und nennen Sie das gewünschte Tool ausdrücklich in der Anweisung. Benötigen Sie schemagültige Argumente, setzen Sie am Tool strict: true. Wenn der erzwungene Tool-Aufruf nur dazu diente, JSON zu erhalten, verwenden Sie strukturierte Ausgaben.
2. Ältere Modelle können Fable-5.1-Denkblöcke nicht lesen
Fable 5.1 kann Denkblöcke von Opus 5, Fable 5 und früheren Modellen lesen. Der umgekehrte Weg funktioniert nicht.
Wenn ein Router, Retry oder Ablehnungs-Fallback eine Fable-5.1-Konversation zu Opus 5 verschiebt, verwirft die API die Denkblöcke ohne Berechnung. Das Zielmodell plant anschließend ohne diese Informationen neu.
3. Änderungen an früheren Turns invalidieren Denkblöcke
Ein Denkblock ist an den exakten System-Prompt, das Tool-Array und die bisherige Historie gebunden. Ändern Sie einen dieser Bestandteile, schlägt der nächste Request mit einem 400er-Fehler fehl, der besagt, dass der Block an eine andere Konversation gebunden ist.
Die Prüfung gilt für Konten, die am oder nach dem 31. August 2026 erstellt wurden. Anthropic beschreibt sie als Anti-Destillationsmaßnahme.
Wenn Ihr Code das messages-Array selbst erzeugt:
- Verwenden Sie ein Nur-Anhängen-Muster.
- Ändern Sie keine bereits gesendeten Turns.
- Planen Sie die
drop_block-Fluchtklausel ein. - Testen Sie Router- und Retry-Pfade ausdrücklich.
Der Leitfaden zu bewahrtem Denken enthält die genaue Fehlerbehandlung.
Weitere übernommene Einschränkungen:
- Denken kann nicht deaktiviert werden.
- Prefill führt zu einem 400er-Fehler.
- Eine nicht standardmäßige
temperatureführt zu einem 400er-Fehler. -
thinking.displayist standardmäßig auf"omitted"gesetzt.
Die Vorher-Nachher-Beispiele finden Sie im Migrationsleitfaden für Fable 5 und Opus 5.
Die fünf zusätzlichen Funktionen
Aufwand pro Nachricht (Beta)
Eine leere system-Nachricht mit output_config ändert den Aufwand ab dem nächsten Benutzer-Turn, ohne den Cache zu invalidieren:
{
"role": "system",
"content": "",
"output_config": {
"effort": "low"
}
}
Benötigter Header:
mid-conversation-output-config-2026-07-01
Turn-bezogene Systemnachrichten (Beta)
Mit clear_at: "next_user_message" gilt eine Systemnachricht mitten in der Konversation nur für einen Turn. Danach wird sie nicht mehr gerendert.
Benötigter Header:
mid-conversation-system-clear-at-2026-08-21
Das ersetzt das Einfügen einer Erinnerung und deren manuelles Löschen im nächsten Request.
Fortschrittsaktualisierungen zwischen Tool-Aufrufen (Beta)
thinking.display: "updates" gibt Modellnotizen zwischen Tool-Aufrufen als Text zurück, während das eigentliche Reasoning verborgen bleibt.
Benötigter Header:
thinking-display-updates-2026-08-18
Niedrigerer Cache-Lese-Preis
Cache-Lesevorgänge kosten 0,25 US-Dollar pro Million Token. Die Auswirkungen hängen von der Cache-Hit-Rate Ihrer Agenten ab.
Inhaltsherkunft
Text erhält auf jeder Plattform Anthropics statistisches Wasserzeichen. Unterstützte Medien aus der Code-Ausführungsumgebung erhalten über die Files API C2PA-Anmeldeinformationen. Der Wasserzeichen-Erklärer beschreibt den Mechanismus.
So verhält sich Fable 5.1 anders
Anthropics Prompting-Leitfaden nennt mehrere Änderungen, die ohne Codeänderung sichtbar werden können:
- In langen Agentenschleifen erfolgt häufiger nur ein Tool-Aufruf pro Runde, während Fable 5 mehrere Aufrufe bündeln konnte.
- Zwischen Tool-Aufrufen erscheinen weniger Fortschrittsnachrichten.
- Bei
low effortgibt das Modell häufiger Antworten aus dem Speicher zurück. - Die Prosa ist dichter.
- Die Antworten verwenden weniger Chat-Formatierung.
- Zitate in Zusammenfassungen werden teilweise nicht markiert.
- Dateien werden häufiger vollständig neu geschrieben.
Starten Sie Ihre Tests zunächst mit high und wiederholen Sie den Lauf. Laut Anthropic entspricht medium ungefähr Fable 5, verursacht aber geringere Kosten. Weitere konkrete Muster enthält der Prompting-Leitfaden für Fable 5.1.
Die ehrliche Obergrenze
Fable 5.1 verwendet weiterhin Sicherheitsklassifikatoren. Eine abgelehnte Anfrage liefert HTTP 200 mit:
{
"stop_reason": "refusal",
"stop_details": {
"category": "cyber"
}
}
Mögliche Kategorien sind:
cyberbiofrontier_llmreasoning_extractiongeneral_harms
Anthropic berichtet folgende Verbesserungen:
- Biologie-Klassifikatoren lösen bei harmlosen Fragen 85 % seltener aus als bei Fable 5 zum Start.
- Cyber-Sicherheitsvorkehrungen verursachen pro Claude-Code-Sitzung etwa 60 % weniger Interventionen.
- Fable 5.1 kann Schwachstellen im eigenen Code identifizieren.
- Die Entwicklung von Exploits wird weiterhin abgelehnt und bleibt Mythos 5.1 vorbehalten.
Behandeln Sie Ablehnungen explizit in Ihrem Code. Als Fallback-Ziele sind Opus 4.8 und Opus 5 zulässig. Die einfachste Konfiguration verwendet:
{
"fallbacks": "default"
}
Zusätzlich benötigen Sie den Header:
server-side-fallback-2026-07-01
Eine Ablehnung vor jeglichem Output wird nicht berechnet. Beachten Sie aber, dass das Fallback-Modell die Denkblöcke von Fable 5.1 nicht lesen kann. Lassen Sie das Fallback daher ohne diese Blöcke neu planen.
Der Leitfaden zur Ablehnungsbehandlung beschreibt die vollständige Implementierung.
Wo kann Fable 5.1 ausgeführt werden?
Fable 5.1 ist verfügbar als:
-
claude-fable-5-1in der Claude API -
anthropic.claude-fable-5-1auf Amazon Bedrock -
claude-fable-5-1auf der Claude Platform für AWS, Google Cloud und Microsoft Foundry - Modell in Claude.ai für Pro, Max, Team und Enterprise
- Modell in Claude Code ab Version 2.1.250
Der Free-Tarif von Claude.ai enthält Fable 5.1 nicht. Max umfasst Fable-Modelle für bis zu 50 % des wöchentlichen Limits, während Pro die Nutzung über Nutzungsguthaben misst.
Die Einrichtung auf den Cloud-Plattformen entspricht der von Fable 5. Details enthält der Leitfaden zur Cloud-Verfügbarkeit. Für Claude Code siehe den Claude-Code-Leitfaden.
Fable-5.1-Anfragen in Apidog testen
Erstellen Sie in Apidog einen POST-Request an:
https://api.anthropic.com/v1/messages
Verwenden Sie diese Header:
x-[REDACTED CREDENTIAL]
anthropic-version: 2023-06-01
content-type: application/json
Request-Body:
{
"model": "claude-fable-5-1",
"max_tokens": 16000,
"output_config": {
"effort": "high"
},
"messages": [
{
"role": "user",
"content": "Review this pagination handler and list the edge cases it misses."
}
]
}
Ein thinking-Feld ist nicht erforderlich. Setzen Sie max_tokens ausreichend hoch, da dieser Wert Denkprozess und Antwort gemeinsam begrenzt.
Prüfen Sie in der Antwort:
-
stop_reason, bevor Siecontentlesen. - Den Fall
refusalals eigenen Kontrollpfad. - Den leeren Thinking-Block.
-
usage.cache_read_input_tokensbeim zweiten Senden. - Ob der zweite Request den Cache tatsächlich verwendet.
Speichern Sie den Request als Testfall oder laden Sie Apidog herunter, um die Anfrage lokal weiterzuverwenden.
Wer sollte Claude Fable 5.1 verwenden?
Fable 5.1 passt besonders gut, wenn:
- Ihre Agenten über Stunden laufen.
- Sie aktuell Fable 5 einsetzen und vom günstigeren Cache profitieren.
- Opus 5 selbst mit
xhighnicht ausreicht. - Sie den Wissensstand von Juni 2026 benötigen.
- Ihre Workloads viele wiederverwendete Präfixe enthalten.
Bleiben Sie bei einem anderen Modell, wenn:
- Ihr System auf dem Prioritäts-Tier basiert.
- Ihre Organisation Zero Data Retention benötigt.
- Ihr Harness die Konversationshistorie bearbeitet.
- Opus 5 oder Sonnet 5 für eine günstige, volumenstarke Workload genügt.
FAQ
Wie lautet die Modell-ID für Claude Fable 5.1?
Die genaue Modell-ID lautet:
claude-fable-5-1
Auf Amazon Bedrock verwenden Sie:
anthropic.claude-fable-5-1
Wie viel kostet Claude Fable 5.1?
Der Preis beträgt 10 US-Dollar pro Million Input-Token und 50 US-Dollar pro Million Output-Token. Cache-Lesevorgänge kosten 0,25 US-Dollar pro Million Token. Batch kostet 5 US-Dollar für Input und 25 US-Dollar für Output. Einen schnellen Modus und ein Prioritäts-Tier gibt es nicht.
Ist Claude Fable 5.1 besser als Fable 5?
In jedem von Anthropic veröffentlichten Benchmark liegt Fable 5.1 vor Fable 5. Die größten Zuwächse zeigen Terminal-Bench-Science mit 52,6 % gegenüber 24,7 % und AutomationBench mit 31,4 % gegenüber 17,1 %. Es handelt sich um Anbieter-Benchmarks.
Was geht beim Wechsel von Fable 5 kaputt?
Drei Muster müssen angepasst werden:
- Erzwungenes
tool_choiceliefert HTTP 400. - Ältere Modelle können Denkblöcke von Fable 5.1 nicht lesen.
- Das Bearbeiten früherer Turns invalidiert spätere Denkblöcke bei Konten, die am oder nach dem 31. August 2026 erstellt wurden.
Lehnt Fable 5.1 weiterhin Cybersicherheitsanfragen ab?
Teilweise. Anthropic berichtet von etwa 60 % weniger Cyber-Interventionen pro Claude-Code-Sitzung. Das Identifizieren von Schwachstellen im eigenen Code ist möglich; die Entwicklung von Exploits wird weiterhin abgelehnt.
Kann ich Claude Fable 5.1 kostenlos nutzen?
Nicht im Free-Plan von Claude.ai. Pro nutzt Nutzungsguthaben, Max enthält Fable-Modelle für bis zu 50 % des wöchentlichen Limits. Für die API gibt es über das anfängliche Anmeldeguthaben hinaus keinen Free-Tier.
Weiterführende Links
- Apidog
- Anthropics Startbeitrag
- Fable-5.1-Modellseite
- API-Walkthrough
- Kostenberechnung
- Migration von Fable 5 und Opus 5
- Claude.ai
- Mythos 5.1 vs. Fable 5.1
- Fable 5 im Juni 2026
- Fable 5 ab 1. Juli
- Fable 5.1 vs. Opus 5
- Benchmark-Aufschlüsselung
- Was ist neu in Claude Fable 5.1?
- Leitfaden für bewahrtes Denken
- Wasserzeichen-Erklärer
- Anthropics Prompting-Leitfaden
- Prompting-Leitfaden für Fable 5.1
- Leitfaden zur Ablehnungsbehandlung
- Leitfaden zur Cloud-Verfügbarkeit
- Claude-Code-Leitfaden
- Kostenlose und günstigste Pfade
- Apidog herunterladen
- Fable 5.1 vs. Fable 5
- Sonnet 5
- Bild 1
- Bild 2


Top comments (0)