DEV Community

Cover image for Prompts für Claude Fable 5.1: Jede Verhaltensänderung und die korrigierende Zeile
Emre Demir
Emre Demir

Posted on Originally published at apidog.com

Prompts für Claude Fable 5.1: Jede Verhaltensänderung und die korrigierende Zeile

Claude Fable 5.1: Prompt-Anpassungen für zuverlässige Agenten

Anthropic sagt, dass bestehende Fable-5-Prompts auf Claude Fable 5.1 ohne Änderungen funktionieren sollten. Das gilt vor allem für die Antworten – nicht unbedingt für das Verhalten rundherum: Tool-Batching, Fortschrittsmeldungen, Prosa-Dichte, Chat-Formatierung, Dateiänderungen und Rückfragen vor bereits angeforderter Arbeit. Dieser Leitfaden zeigt die wichtigsten Unterschiede und die passenden Anpassungen aus der Anleitung zur Prompt-Erstellung für Claude Fable 5.1. Eine allgemeine Einführung finden Sie unter Was Claude Fable 5.1 ist.

Apidog heute testen

Die wichtigsten Änderungen im Überblick

  • Beginnen Sie mit high und testen Sie alle fünf Aufwandstufen neu.
  • Platzieren Sie rundenbezogene Anweisungen korrekt, ohne frühere Nachrichten zu löschen.
  • Prüfen Sie Tool-Batching, Fortschrittsmeldungen und vorzeitige Rundenenden anhand von Messwerten.
  • Begrenzen Sie ungefragte Korrekturen, zusätzliche Tests und vollständige Datei-Neuschreibungen.
  • Erlauben Sie Formatierung dort, wo sie die Verständlichkeit verbessert.
  • Erzwingen Sie aktuelle Recherche bei Namen aus schnelllebigen Bereichen.
  • Verwenden Sie high statt xhigh oder max, wenn lange Antworten unnötig lange dauern.

1. Aufwand zuerst abstimmen

Der Aufwand ist auf Fable 5.1 die wichtigste Stellschraube für Intelligenz, Latenz und Kosten. Beginnen Sie mit high und vergleichen Sie anschließend low, medium, xhigh und max anhand Ihrer eigenen Evaluierungen.

Wiederholen Sie diese Testreihe auch dann, wenn Sie bereits Fable 5 getestet haben: Die Bezeichnungen der Aufwandstufen entsprechen nicht in jedem Modell derselben Denkmenge.

Anthropics Angaben:

  • medium liefert ungefähr Fable-5-Qualität zu geringeren Kosten.
  • low kann bei den Kosten pro Aufgabe mit Opus und Sonnet konkurrieren und dabei besser abschneiden.
  • Die größten Verbesserungen gegenüber Fable 5 treten bei xhigh und max auf.

Während eines Gesprächs können Sie den Aufwand ohne Cache-Reset ändern. Verwenden Sie dafür eine leere role: "system"-Nachricht mit output_config und dem Beta-Header mid-conversation-output-config-2026-07-01. Das genaue Anfrageformat finden Sie in der API-Anleitung. Weitere Details enthält die offizielle Dokumentation zu Aufwand.

Claude Fable 5.1 Prompting

2. Platzierung ist wichtiger als Formulierung

Fable-5.1-Denkblöcke sind nur in der exakten Konversation gültig, in der sie erzeugt wurden. Wenn Sie eine Erinnerung in einer früheren Runde einfügen und sie in der nächsten Anfrage wieder löschen, bearbeiten Sie den Verlauf. Dadurch startet der Prompt-Cache neu und – bei Konten, die am oder nach dem 31. August 2026 erstellt wurden – werden spätere Denkblöcke ungültig.

Rundenbezogene Anweisungen gehören deshalb an eine von zwei Stellen:

Mit der Beta für Systemnachrichten

Hängen Sie sie nach der Tool-Ergebnisnachricht als rundenbezogene Systemnachricht an:

{
  "role": "system",
  "clear_at": "next_user_message",
  "content": "Ihre rundenbezogene Anweisung"
}
Enter fullscreen mode Exit fullscreen mode

Verwenden Sie dafür die Beta mid-conversation-system-clear-at-2026-08-21. Lassen Sie frühere Kopien im Nachrichten-Array. Sobald eine neue Benutzernachricht existiert, löscht die API die alten Kopien automatisch. Sie werden nicht mehr gelesen und verursachen keine Token-Kosten.

Ohne die Beta

Fügen Sie die Anweisung in derselben Benutzernachricht nach den tool_result-Blöcken ein. Auch hier gilt: Behalten Sie frühere Kopien bei. Löschen oder überschreiben Sie keine bereits gesendete Nachricht.

Weitere Hintergründe finden Sie in der Dokumentation zu gespeichertem Denken, zu rundenbezogenen Systemnachrichten und in der Anleitung zum gespeicherten Denken.

Anweisungen auf Sitzungsebene gehören in den System-Prompt oder in die erste Benutzerrunde. Anthropic weist außerdem darauf hin, dass Stilvorgaben in der ersten Benutzerrunde oft besser erhalten bleiben als im System-Prompt.

3. Agentenschleifen: ein Tool-Aufruf pro Runde

Wenn eine Anfrage mehrere unabhängige Dinge nennt, ruft Fable 5.1 Tools häufig parallel auf. In Programmier- und Computer-Use-Schleifen, bei denen weitere unabhängige Lesezugriffe nur impliziert sind, kann das Modell dagegen einen Tool-Aufruf pro Runde ausgeben, während Fable 5 mehrere gebündelt hätte.

Die Antworten bleiben korrekt, aber jede zusätzliche Runde kostet Tokens, einen Roundtrip und Echtzeit.

Zuerst messen

Erfassen Sie den Anteil der Assistentenrunden mit mehr als einem Tool-Aufruf. Fügen Sie die folgende Anweisung nur hinzu, wenn dieser Anteil tatsächlich gesunken ist:

Listen Sie zuerst privat auf, was Sie als Nächstes benötigen; fordern Sie dann in dieser einen Antwort jeden Eintrag an, der nicht vom Ergebnis eines anderen abhängt.

Behalten Sie das Wort „privat“ bei. Ohne diese Einschränkung antwortet das Modell gelegentlich auf die Erinnerung statt auf die Benutzernachricht. Eine Platzierung nahe dem Ende der aktuellen Anfrage wirkt deutlich stärker als derselbe Text im System-Prompt.

4. Weniger Text zwischen Tool-Aufrufen

Fable 5.1 schreibt während langer Tool-Runden weniger benutzergerichtete Updates als Fable 5 – besonders bei höherem Aufwand. Das kann dazu führen, dass der Agent minutenlang still bleibt oder nur eine abschließende Nachricht sendet.

Gehen Sie in dieser Reihenfolge vor:

  1. Prüfen Sie, ob Updates bereits vorhanden sind. Zwischen-Tool-Notizen werden als Denkblöcke zurückgegeben und sind mit display: "omitted" standardmäßig leer. Setzen Sie display: "updates" mit dem Beta-Header thinking-display-updates-2026-08-18 und zeigen Sie jeden nicht leeren Denkblock als Statuszeile an.
  2. Entfernen Sie alte Anti-Update-Regeln, etwa: „Halten Sie alle Ergebnisse für die endgültige Antwort zurück.“
  3. Fügen Sie bei Bedarf eine kurze Systemvorgabe hinzu:

Bevor Sie beginnen, sagen Sie in einer Zeile, was Sie tun werden; kurze Updates während Ihrer Arbeit helfen dem Benutzer, dem Geschehen zu folgen. Schließen Sie mit einer kurzen, eigenständigen Zusammenfassung ab, die abdeckt, was Sie gefunden, was Sie getan haben und was als Nächstes kommt.

Wenn Ihr Produkt Tool-Ausgaben verbirgt, muss das Modell dies wissen:

Nur Sie sehen die Ausgabe dieses Befehls. Wenn der Benutzer etwas davon lesen muss, fügen Sie es Ihrer Antwort hinzu.

Andernfalls könnte der Agent zusätzliche Befehle ausführen, nur um Ausgaben sichtbar zu machen, die der Benutzer weiterhin nicht sehen kann.

5. Die Runde endet, bevor die Arbeit erledigt ist

Bei komplexen asynchronen Aufgaben beschreibt Fable 5.1 manchmal nur den nächsten Schritt oder bittet um Erlaubnis für Arbeit, die bereits in der Anfrage enthalten ist. Der Benutzer muss dann mit „fortfahren“ antworten.

Verwenden Sie einen System-Prompt-Block wie diesen:

Sie agieren autonom. Der Benutzer schaut nicht in Echtzeit zu und kann während der Aufgabe keine Fragen beantworten, daher blockieren Fragen wie „Soll ich …?“ oder „Möchten Sie, dass ich …?“ die Arbeit. Bei umkehrbaren Aktionen, die aus der ursprünglichen Anfrage folgen, fahren Sie ohne Nachfrage fort. Halten Sie nur bei destruktiven Aktionen oder echten Umfangsänderungen an, über die der Benutzer entscheiden muss. Nach Abschluss der Aufgabe dürfen Sie Folgeaktionen anbieten; bitten Sie jedoch nicht vorher um Erlaubnis.

Ergänzen Sie eine Abschlussprüfung:

Bevor Sie Ihre Runde beenden, überprüfen Sie Ihren letzten Absatz. Wenn er einen Plan, eine Analyse, eine Frage, eine Liste nächster Schritte oder ein Versprechen über unerledigte Arbeit enthält, erledigen Sie diese Arbeit jetzt mit Tool-Aufrufen. Beenden Sie die Runde nur, wenn die Aufgabe abgeschlossen ist oder Sie auf eine Eingabe warten, die nur der Benutzer bereitstellen kann.

Definieren Sie außerdem die Benutzeranfrage als vollständigen Umfang des Lieferobjekts:

  • nichts eigenmächtig eingrenzen, erweitern oder austauschen;
  • jeden nicht blockierten Teil fertigstellen;
  • Ausgelassenes ausdrücklich nennen;
  • Beobachtungen außerhalb des Auftrags nur als Vorschlag behandeln.

Da diese Kombination das Modell weniger geneigt machen kann, Rückfragen zu stellen, sollten Sie zusätzlich festlegen, welche Bestätigungen Sie weiterhin ausdrücklich wünschen.

Im Unterschied zum Opus-5-Ratschlag, Verifikationsanweisungen zu löschen sollten Sie eine Aufforderung wie „Überprüfen Sie Ihre Arbeit“ auf Fable 5.1 beibehalten.

6. Ungefragte Korrekturen und zusätzliche Tests

Bei offenen Funktionsaufgaben liefert Fable 5.1 gelegentlich nahegelegene Fehlerbehebungen, erweitertes Verhalten oder mehr Testdateien als erforderlich.

Diese Vorgabe reduziert laut Anthropic die Extras, ohne den Aufgabenerfolg zu beeinträchtigen:

Wenn Sie während der Arbeit oder des Testens einen bestehenden Fehler, ein Leistungsproblem oder ein Verhalten feststellen, das die Aufgabe nicht erwähnt, beheben, optimieren oder erweitern Sie es in dieser Änderung nicht, es sei denn, das angeforderte Verhalten kann ohne diese Änderung nicht funktionieren. Melden Sie es stattdessen als Follow-up. Überprüfen Sie Ihre Arbeit nach Belieben; Entwurfsskripte und Schnellprüfungen müssen nicht aufbewahrt werden. Führen Sie Tests nur dort durch, wo die Aufgabe dies verlangt oder dieses Repository bereits Tests für diese Art von Änderung enthält, die in ihrer Größe den benachbarten Testdateien entsprechen. Implementieren Sie jedes angeforderte Verhalten vollständig.

Die Regel begrenzt nur Extras. Sie ersetzt keine vollständige Implementierung des eigentlichen Auftrags.

7. Ganze Dateien bei kleinen Änderungen

Fable 5.1 schreibt eher eine komplette Datei neu, anstatt eine einzelne Zeile gezielt zu ändern. Das Ergebnis kann gleich sein, benötigt aber mehr Ausgabe-Tokens.

Platzieren Sie diese Anweisung im System-Prompt oder in der ersten Benutzernachricht:

Minimieren Sie die Anzahl der Tokens, die für die Bearbeitung von Dateien verwendet werden, wenn alles andere gleich bleibt. Bearbeiten Sie eine Datei daher chirurgisch, anstatt sie vollständig neu zu schreiben, sofern dies das Endergebnis nicht beeinflusst.

8. Dichte, lange Prosa

Der Schreibstil von Fable 5.1 ist häufig besser und enthält weniger Standardphrasen. In manchen Fällen entstehen jedoch längere Sätze und weniger Absätze als bei Fable 5.

Definieren Sie das Anti-Muster ausdrücklich:

Verwenden Sie keine manierierte Prosa. Sagen Sie direkt, was Sie meinen, und verwenden Sie den wörtlichen Ausdruck, wenn einer verfügbar ist.

Anthropics Definition von „manierierter Prosa“ umfasst Metaphern und Ausschmückungen, die eine direkte Aussage ersetzen und eher den Autor als die Idee präsentieren. Die Kurzform funktioniert ebenfalls:

Bitte entfernen Sie alle manierierte Prosa.

9. Chat-Antworten brauchen wieder mehr Struktur

Frühere Modelle verwendeten häufig zu viele Aufzählungen und Fettdruck. Deshalb enthalten viele ältere Prompts Anti-Formatierungsregeln. Auf Fable 5.1 können diese Regeln nun die benötigte Struktur unterdrücken.

Ersetzen Sie sie durch eine kontextabhängige Vorgabe:

  • Verwenden Sie Listen, wenn sie angefordert wurden oder die Verständlichkeit bei vielschichtigem Inhalt verbessern.
  • Respektieren Sie explizite Wünsche nach minimaler Formatierung.
  • Verwenden Sie in konversationellen oder emotionalen Gesprächen einfache Prosa.

10. Zusammenfassungen müssen Zitate kennzeichnen

Beim Zusammenfassen von Dokumenten reproduziert Fable 5.1 eher Passagen der Quelle, ohne sie als Zitate zu markieren.

Fügen Sie dem System-Prompt ein vollständiges Beispiel hinzu, bestehend aus:

  1. der Benutzeranfrage;
  2. einer korrekten Antwort;
  3. einer Wiedergabe der Quelle in indirekter Rede des Assistenten;
  4. höchstens einem kurzen, gekennzeichneten Zitat;
  5. einer einzeiligen Begründung, warum die Antwort korrekt ist.

Ersetzen Sie Platzhalter für Tool-Aufrufe in Anthropics Beispiel durch den Namen Ihres eigenen Tools.

11. Bei geringem Aufwand wird seltener gesucht

Bei low effort ruft Fable 5.1 Such- und Abruf-Tools seltener auf als Fable 5. Das betrifft besonders namentlich genannte Produkte und Modelle, deren Namen das Modell erkennt, deren aktueller Zustand aber veraltet sein kann.

Nutzen Sie eine der beiden Lösungen:

  1. Erhöhen Sie den Aufwand für die betroffenen Runden mit anfragespezifischem Aufwand.
  2. Ergänzen Sie im System-[REDACTED PROMPT]ens aus einem sich schnell entwickelnden Bereich bedeutet nicht, dass Sie dessen aktuellen Zustand kennen. Suchen Sie vor der Antwort nach aktuellen Informationen und verwenden Sie den Namen genau so, wie der Benutzer ihn geschrieben hat, in mindestens einer Suchanfrage.

12. Lange Lieferobjekte bei xhigh und max

Bei xhigh und besonders bei max entwirft Fable 5.1 einen großen Teil eines langen Lieferobjekts im Denkprozess und schreibt es anschließend noch einmal als Antwort. Dadurch können sich Wartezeit und Ausgabe-Tokens nahezu verdoppeln.

Empfehlungen:

  • Führen Sie lange Lieferobjekte zunächst mit high aus.
  • Erhöhen Sie den Aufwand nur nach einer gemessenen Qualitätsverbesserung.
  • Wenn Sie bei xhigh oder max bleiben, setzen Sie max_tokens so, dass Denkprozess und Antwort gemeinsam Platz haben.
  • Informieren Sie das Modell, dass alle in einer Antwort erzeugten Tokens – einschließlich Begründung – einem gemeinsamen Limit unterliegen. Das vollständige Lieferobjekt zuerst als Begründung und anschließend erneut als Antwort zu schreiben, verdoppelt die Runde ohne Qualitätsgewinn.

Belassen Sie frühere Kopien dieser Anweisung in späteren Anfragen.

Prompt- und Ausführungsoptionen

13. Harmlose Coding-Anfragen werden abgelehnt

Die Klassifikatoren von Fable 5.1 erzeugen bei der Einführung weniger Fehlalarme als Fable 5. Dennoch treten Ablehnungen bei harmlosen Coding-Aufgaben weiterhin auf.

Drei Anpassungen helfen:

  • Fragen Sie: „Gibt es Fehler in diesem Programm?“ statt „Kompiliert dieses Programm fehlerfrei?“
  • Stellen Sie Dokumentation für weniger bekannte Programmiersprachen bereit.
  • Entfernen Sie Tools, die Base64-kodierte Daten in den Kontext zurückgeben.

Konfigurieren Sie trotzdem Fallbacks. Die Anleitung zur Ablehnungsbehandlung beschreibt geeignete Strategien.

14. Client-seitige Kompaktierung bewahrt wichtige Details

Fable 5.1 reagiert gut auf eine genaue Vorgabe für Kompaktierungszusammenfassungen. Die serverseitige Kompaktierung berücksichtigt dies bereits. Wenn Sie clientseitig komprimieren, fordern Sie eine Zusammenfassung innerhalb von <summary>-Tags und bewahren Sie die Informationen in dieser Reihenfolge:

  1. aufgetretene Schwierigkeiten und ihre Lösungen;
  2. aufgegriffene oder verworfene Ansätze und die Gründe;
  3. alle angefragten oder getroffenen Entscheidungen in ihrer genauen Formulierung;
  4. der aktuelle Stand;
  5. offene Punkte;
  6. schwer rekonstruierbare Details wie Namen, Zahlen und Links.

Beenden Sie die Anweisung mit:

Rufen Sie keine Tools auf, während Sie diese Zusammenfassung schreiben; antworten Sie nur mit Text.

Das ist wichtig, wenn die Zusammenfassungsanfrage weiterhin Zugriff auf die Tools der Unterhaltung hat.

15. Subagenten und Vision: architektonische Lösungen

Nicht jedes Verhalten lässt sich durch Prompting lösen.

Subagenten

Bei Programmieraufgaben sollte der leitende Agent weiterarbeiten können, während Subagenten laufen:

  • Das Start-Tool für einen Subagenten kehrt sofort zurück.
  • Jedes Ergebnis wird in einer späteren Benutzernachricht geliefert.
  • Der leitende Agent erhält ein separates Tool, das er bei Bedarf zum Warten auf Ergebnisse aufrufen kann.

Dichte Diagramme und verschachtelte Tabellen

Geben Sie dem Modell ein Zuschneidewerkzeug, das ausgewählte Bildbereiche vergrößert zurückgibt, oder einen Container mit grundlegenden Bildbibliotheken. Bei low effort kann das Modell das Zuschneiden überspringen. Prüfen Sie deshalb die Tool-Aufrufprotokolle.

16. Prompt-Änderungen in Apidog testen

Jede Anpassung sollte als Vorher-Nachher-Test überprüft werden:

  1. Speichern Sie die ersten drei Runden Ihrer Agentenschleife als Anforderungssequenz in Apidog.
  2. Parametrisieren Sie den System-Prompt.
  3. Führen Sie dieselbe Sequenz mit und ohne den jeweiligen Prompt-Schnipsel aus.
  4. Verwenden Sie denselben Aufwand für beide Varianten.
  5. Vergleichen Sie die Ergebnisse anhand konkreter Metriken.

Geeignete Prüfpunkte:

  • Tool-Batching: Anzahl der tool_use-Blöcke pro Assistentenrunde.
  • Gezielte Bearbeitung und Prosa-Dichte: usage.output_tokens.
  • Autonomie: kein letzter Absatz, der mit „Als Nächstes werde ich“ beginnt.
  • Fortschritt: Anzahl und Inhalt der ausgegebenen Denkblöcke.
  • Scope-Kontrolle: ungefragte Dateien, Tests oder Korrekturen.

Laden Sie Apidog herunter, um die Sequenzen zu erstellen. Die Claude-Code-Anleitung zeigt außerdem, welche dieser Vorgaben in eine CLAUDE.md gehören.

FAQ

Funktionieren meine Fable-5-Prompts auf Fable 5.1?

Laut Anthropic sollten sie ohne Änderungen funktionieren. Die Unterschiede betreffen vor allem das Verhalten: weniger gebündelte Tool-Aufrufe, weniger Fortschrittsmeldungen, dichtere Prosa, weniger Chat-Formatierung, vollständige Datei-Neuschreibungen und Scope Creep bei offenen Aufgaben.

Mit welchem Aufwand-Level sollte ich Fable 5.1 verwenden?

Beginnen Sie mit high und führen Sie eine neue Testreihe durch. medium entspricht laut Anthropic ungefähr Fable 5 zu geringeren Kosten. low kann bei den Kosten pro Aufgabe mit Opus und Sonnet konkurrieren.

Wo platziere ich eine rundenbezogene Anweisung?

Verwenden Sie nach den Tool-Ergebnissen eine Systemnachricht mit:

{
  "clear_at": "next_user_message"
}
Enter fullscreen mode Exit fullscreen mode

Lassen Sie frühere Kopien unverändert. Das Einfügen und anschließende Löschen von Text aus früheren Runden macht spätere Denkblöcke ungültig und startet den Cache neu.

Sollte ich „Überprüfen Sie Ihre Arbeit“ wie bei Opus 5 entfernen?

Nein. Die Empfehlung, Verifikationsanweisungen zu entfernen, bezog sich auf die übermäßige Verifikation von Opus 5. Auf Fable 5.1 sollten Sie diese Anweisung beibehalten.

Wie verhindere ich vollständige Datei-Neuschreibungen?

Fügen Sie dem System-Prompt oder der ersten Benutzernachricht diese Vorgabe hinzu:

Minimieren Sie die zum Bearbeiten von Dateien verwendeten Tokens und bearbeiten Sie Dateien gezielt, anstatt sie neu zu schreiben, sofern dies das Ergebnis nicht beeinflusst.

Weiterführende Links

Top comments (0)