DEV Community

Cover image for Was ist Claude Opus 5? Spezifikationen, Benchmarks und Preise
Emre Demir
Emre Demir

Posted on • Originally published at apidog.com

Was ist Claude Opus 5? Spezifikationen, Benchmarks und Preise

Claude Opus 5 ist Anthropics neuestes Modell der Opus-Tier-Klasse, das am 24. Juli 2026 veröffentlicht wurde. Anthropic positioniert es für komplexes agentisches Coding und Unternehmensaufgaben. Die Dokumentation nennt es nun den Standard-Startpunkt: Wenn Sie unsicher sind, welches Modell Sie verwenden sollen, beginnen Sie mit Claude Opus 5. Die entscheidende Zahl ist der Preis: Opus 5 kostet 5 US-Dollar pro Million Input-Tokens und 25 US-Dollar pro Million Output-Tokens – derselbe Tarif wie Opus 4.8 und die Hälfte dessen, was Fable 5 verlangt.

Apidog noch heute testen

Dieser Leitfaden behandelt Spezifikationen, Preis-Leistungs-Verhältnis, die Launch-Benchmarks von Anthropic, zwei API-Änderungen mit Auswirkungen auf bestehenden Opus-4.8-Code, verfügbare Plattformen und bekannte Grenzen. Wenn Sie das Modell über HTTP aufrufen, können Sie Anfragen in Apidog senden, speichern und prüfen.

Claude Opus 5 auf einen Blick

Spezifikation Wert
API-Modell-ID claude-opus-5 (ohne Datumssuffix)
Veröffentlicht 24. Juli 2026
Kontextfenster 1.000.000 Tokens, Standard und Maximum
Maximale Ausgabe 128.000 Tokens über die Messages API; 300.000 über die Batch API mit dem Beta-Header output-300k-2026-03-24
Basispreise 5 $ pro Million Input-Tokens, 25 $ pro Million Output-Tokens
Wissensstichtag Mai 2026
Adaptives Denken Standardmäßig aktiviert
Aufwandsstufen low, medium, high, xhigh, max; Standard ist high
Priority Tier Nicht unterstützt
Verfügbarkeit Claude API, claude.ai, Claude Code, Claude Cowork, Amazon Bedrock, Claude Platform auf AWS, Google Cloud, Microsoft Foundry, GitHub Copilot

Drei Punkte sind besonders relevant:

  • 1M Kontextfenster: Das Kontextfenster ist Standard und Maximum zugleich. Sie benötigen keinen Beta-Header. Ein Prompt mit 900.000 Tokens wird zum gleichen Token-Tarif abgerechnet wie ein Prompt mit 900 Tokens.
  • Wissensstichtag Mai 2026: Opus 5 kennt etwa vier Monate mehr Bibliotheken, Releases und API-Änderungen als Fable 5 und Sonnet 5, die beide bei Januar 2026 liegen.
  • Kein Priority Tier: Opus 4.8 unterstützt Priority Tier, Opus 5 nicht. Wenn Ihre Kapazitätsplanung darauf basiert, behandeln Sie dies als Migrationsblocker. Details finden Sie im Migrationsleitfaden.

Für alle Modellfelder ist Anthropics Modellübersicht die primäre Quelle.

Was Claude Opus 5 ist

Opus 5 ist der Nachfolger von Claude Opus 4.8. Verwenden Sie diese Modell-IDs:

  • Claude API / Google Cloud: claude-opus-5
  • Amazon Bedrock: anthropic.claude-opus-5
  • Claude Platform auf AWS: eigene Plattform-ID

Visualisierung von Claude Opus 5

Die Opus-Klasse ist Anthropics leistungsstarke Reihe über Sonnet und unter den Forschungs-Frontier-Modellen Fable und Mythos. Neu ist die Positionierung: Anthropic empfiehlt Opus 5 als Ausgangspunkt, während in der 4.x-Generation Sonnet meist der Standard und Opus das Upgrade war.

Opus 5 ist außerdem das Standardmodell für Max-Abonnenten und das leistungsstärkste Modell für Pro-Nutzer. Der Artikel „Kostenlose und günstigste kostenpflichtige Wege“ erklärt die verfügbaren Zugänge.

Das Preis-Leistungs-Verhältnis

Tarif Input (pro M Tokens) Output (pro M Tokens)
Standard 5,00 $ 25,00 $
Batch API (50 % Rabatt) 2,50 $ 12,50 $
Fast mode (Forschungsvorschau) 10,00 $ 50,00 $
Cache-Schreiben, 5 Minuten TTL 6,25 $ n.a.
Cache-Schreiben, 1 Stunde TTL 10,00 $ n.a.
Cache-Treffer und Aktualisierungen 0,50 $ n.a.

Claude Fable 5 berechnet 10 $ pro Million Input-Tokens und 50 $ pro Million Output-Tokens. Opus 5 kostet die Hälfte. Anthropic gibt an, dass Opus 5 beim agentischen Coding bis auf 0,5 % an Fable 5 heranreicht.

Nutzen Sie diese Kostenhebel gezielt:

  1. Prompt-Caching aktivieren: Das Minimum wurde von 1.024 bei Opus 4.8 auf 512 Tokens gesenkt. Kürzere System-Prompts können damit ohne Codeänderung cachebar sein.
  2. Cache-Treffer auswerten: Cache-Treffer kosten 0,50 $ pro Million Tokens, also ein Zehntel des Basis-Input-Tarifs.
  3. Batch API für asynchrone Arbeit: Wenn Ergebnisse warten können, halbiert die Batch API die Preise.
  4. Tool-Overhead berücksichtigen: Bei Tool-Wahl auto oder none liegt der System-Prompt-Overhead bei 286 Tokens, gegenüber 290 bei Opus 4.8 und 675 bei Opus 4.7.

Zwei weitere Details beeinflussen die Abrechnung:

  • Fast mode: Verdoppelt die Preise auf 10 $ Input und 50 $ Output pro Million Tokens. Dafür liefert er laut Angabe etwa die 2,5-fache Ausgabegeschwindigkeit. Er ist nur in der hauseigenen API verfügbar, nicht über Bedrock, Google Cloud, Microsoft Foundry oder die Batch API.
  • US-Inferenz: inference_geo: "us" wendet einen Faktor von 1,1 auf alle Token-Kategorien an. Das entspricht 10 % Aufschlag auf Input, Output, Cache-Schreiben und Cache-Treffer.

Die vollständige Preisübersicht enthält Kosten-pro-Aufgabe-Beispiele. Bestehende Optimierungen aus „Ihre Claude API-Rechnung reduzieren“ bleiben relevant. Die maßgebliche Tabelle ist Anthropics Preisseite.

Was Anthropic über die Benchmarks sagt

Die folgenden Werte stammen von Anthropic und wurden mit dem Launch veröffentlicht. Stand 25. Juli 2026 wurden sie nicht unabhängig reproduziert. Behandeln Sie sie als Anbieterangaben und führen Sie vor einem Produktionsrollout eigene Evaluierungen durch.

Benchmark Anspruch von Anthropic
Frontier-Bench v0.1 Übertrifft alle anderen Modelle und verdoppelt die Punktzahl von Opus 4.8 bei geringeren Kosten pro Aufgabe
ARC-AGI 3 Etwa 3× die Punktzahl des nächstbesten Modells
OSWorld 2.0 (Computernutzung) Übertrifft Fable 5 zu einem Drittel der Kosten
CursorBench 3.2 (agentisches Coding) Innerhalb von 0,5 % des Höchstwertes von Fable 5, zum halben Preis
Zapier AutomationBench Erfolgsrate etwa 1,5× höher als beim nächstbesten Modell
Organische Chemie +10,2 Punkte gegenüber Opus 4.8
Proteinanalyse +7,7 Punkte gegenüber Opus 4.8

Die relevantesten Angaben für Entwickler sind CursorBench und OSWorld. Beide legen nahe, dass ein Wechsel von Fable 5 zu Opus 5 bei geringerem Preis möglich sein kann.

Prüfen Sie das jedoch mit Ihrer eigenen Codebasis:

  • Verwenden Sie reale Repositories statt nur öffentliche Benchmarks.
  • Testen Sie Ihre echten Tool-Schemas und System-Prompts.
  • Messen Sie Erfolgsrate, Token-Verbrauch, Latenz und Zahl der Agenten-Schritte.
  • Vergleichen Sie mindestens high und xhigh für jede wichtige Aufgabe.

Die detaillierte Benchmark-Analyse erläutert, was die einzelnen Evaluierungen messen.

Die ehrliche Obergrenze

Opus 5 ist nicht die Spitze des Claude-Stacks. Anthropic behauptet das auch nicht.

Fable 5 behält die Bezeichnung „leistungsfähigstes, breit veröffentlichtes Modell“. Bei zwei Forschungsfähigkeiten – Cybersicherheitsausbeutung und autonome Biologieforschung – liegt Opus 5 laut Anthropic weiter hinter Mythos 5.

Die praktische Einordnung lautet:

  • Für agentisches Coding und Unternehmensautomatisierung ist Opus 5 laut Anbieter auf Spitzenleistungsniveau bei halben Spitzenpreisen.
  • Für Sicherheitsforschung oder autonome wissenschaftliche Arbeit können Fable 5 oder Mythos 5 die passendere Wahl sein.

Weitere Einordnung liefern der Mythos-Klasse-Modell-Erklärer und Fable 5 vs. Mythos 5.

Zwei Änderungen, die den Opus-4.8-Code unterbrechen

Das Ersetzen der Modell-ID reicht nicht aus. Prüfen Sie insbesondere diese zwei Änderungen.

1. Denken ist standardmäßig aktiviert

Bei Opus 4.8 lief eine Anfrage ohne thinking-Feld ohne Denkprozess. Bei Opus 5 führt dieselbe Anfrage adaptives Denken aus.

Da max_tokens weiterhin Denk-Tokens und Antworttext zusammen begrenzt, kann eine bisher knapp konfigurierte Anfrage jetzt mitten in der Antwort abgeschnitten werden. Die API liefert dabei keinen Fehler – die Ausgabe endet einfach früher.

Maßnahme: Erhöhen Sie max_tokens und testen Sie Antworten mit realistischen Prompts erneut.

2. Denken kann bei xhigh und max nicht deaktiviert werden

Diese Kombination führt zu einem HTTP-400-Fehler:

{
  "thinking": { "type": "disabled" },
  "output_config": {
    "effort": "xhigh"
  }
}
Enter fullscreen mode Exit fullscreen mode

Dasselbe gilt für effort: "max".

Maßnahme: Entfernen Sie die Deaktivierung des Denkens oder verwenden Sie einen kompatiblen Aufwand. Prüfen Sie insbesondere gemeinsame Default-Konfigurationen in SDK-Wrappern und Agenten-Frameworks.

Weitere Migrationspunkte:

  • Die Aufwandsstufen wurden neu kalibriert; alte Sweep-Ergebnisse sind nicht direkt übertragbar.
  • Der Kontextfenster-Beta-Header entfällt.
  • Systemnachrichten mitten im Gespräch werden akzeptiert, während Opus 4.8 dafür einen 400er-Fehler lieferte.
  • Priority Tier ist nicht verfügbar.

Der Migrationsleitfaden von Opus 4.8 zu Opus 5 enthält Vorher-Nachher-Beispiele. Anthropics Migrationsleitfaden ist die primäre Referenz. Für den Ausgangspunkt siehe auch die Opus-4.8-API-Anleitung.

Der Aufwandsparameter: kein Schalter, sondern ein Tuning-Regler

Der relevante API-Parameter lautet output_config.effort.

Verfügbare Stufen:

low → medium → high → xhigh → max
Enter fullscreen mode Exit fullscreen mode

Der Standard ist high. Der Parameter steuert, wie viel das Modell vor der Antwort denkt, und beeinflusst damit Qualität, Laufzeit und Token-Verbrauch.

Anthropic empfiehlt für diese Generation einen neuen Aufwandssweep, weil die Stufen neu kalibriert wurden. low und medium sollen bei Opus 5 deutlich leistungsfähiger als bei früheren Opus-Modellen sein. Für Coding und Agenten-Schleifen bleibt xhigh der empfohlene Ausgangspunkt.

Testen Sie Aufwand nicht nur anhand eines einzelnen Prompts. Verwenden Sie eine kleine Evaluierungssuite mit repräsentativen Aufgaben:

{
  "model": "claude-opus-5",
  "max_tokens": 8192,
  "output_config": {
    "effort": "xhigh"
  },
  "messages": [
    {
      "role": "user",
      "content": "Refaktorieren Sie diesen Handler und erläutern Sie die Kompromisse."
    }
  ]
}
Enter fullscreen mode Exit fullscreen mode

Messen Sie pro Stufe mindestens:

  • Erfolgsrate
  • Antwortqualität
  • Anzahl Tool-Aufrufe
  • Input-, Output- und Denk-Tokens
  • Latenz
  • Kosten pro erfolgreich abgeschlossener Aufgabe

Der Leitfaden zum Aufwandsparameter behandelt alle fünf Stufen und ihre Interaktion mit max_tokens.

Wie sich Opus 5 anders verhält

Anthropics Prompting-Leitfaden für Opus 5 dokumentiert Verhaltensänderungen, die Ergebnisse selbst bei unverändertem Code beeinflussen.

  • Eigenständige Prüfung: Anweisungen wie „Überprüfen Sie Ihre Antwort doppelt“ können zu übermäßiger Prüfung und zusätzlichem Token-Verbrauch führen. Entfernen Sie solche Formulierungen, wenn sie nicht zwingend benötigt werden.
  • Längere sichtbare Antworten: Geringerer Aufwand reduziert Denken, nicht zwingend die sichtbare Textlänge. Fordern Sie Prägnanz explizit an.
  • Mehr Subagenten-Delegierung: Begrenzen oder definieren Sie Delegierung in kostensensiblen Workloads.
  • Größerer Aufgabenbereich: Begrenzen Sie den Scope präzise, damit das Modell nicht zusätzliche Änderungen vornimmt oder umfangreiche Korrekturberichte erzeugt.

Beispiel für einen engeren Coding-Prompt:

Ändere ausschließlich die Funktion parseUserInput.
Keine Änderungen an anderen Dateien.
Gib nur den Patch und maximal drei Stichpunkte zu den Kompromissen aus.
Führe keine zusätzlichen Refactorings durch.
Enter fullscreen mode Exit fullscreen mode

Ein bekannter Fehlermodus tritt bei deaktiviertem Denken auf:

  • Tool-Aufrufe können als Klartext erscheinen, aber nicht ausgeführt werden.
  • Interne XML-Tags können in der sichtbaren Ausgabe auftauchen.

In Agenten-Schleifen kann dieser Text nachfolgende Schritte stören. Anthropics empfohlene Gegenmaßnahme ist, Denken aktiviert zu lassen und Kosten über eine niedrigere Aufwandsstufe zu steuern.

Die detaillierte Prompting-Analyse enthält Copy-Paste-Beispiele. Der Claude-Code-Leitfaden überträgt diese Hinweise auf Editor-Workflows.

Wo Sie es ausführen können

Plattform Status
Claude API Verfügbar, Modell-ID claude-opus-5
claude.ai Verfügbar; Standard für Max, Top-Modell für Pro
Claude Code Verfügbar
Claude Cowork Verfügbar
Amazon Bedrock Verfügbar als anthropic.claude-opus-5
Claude Platform auf AWS Verfügbar, eigene ID
Google Cloud Verfügbar als claude-opus-5
Microsoft Foundry Verfügbar
GitHub Copilot Verfügbar

Der Fast mode ist die Ausnahme: Er ist ausschließlich über die hauseigene Claude API verfügbar. Bedrock- und Google-Cloud-Bereitstellungen können ihn nicht verwenden.

Opus-5-Anfragen in Apidog testen

Beim Aufruf von Opus 5 müssen Sie HTTP-Endpoint, Authentifizierungs-Header, JSON-Body, Streaming-Antworten und reproduzierbare Fehler behandeln. Apidog hilft dabei, Anfragen zu senden, in Sammlungen abzulegen, API-Schlüssel per Umgebungsvariable zu verwalten und Antworten Feld für Feld zu prüfen.

Apidog-Schnittstelle zur Visualisierung von API-Anfragen und -Antworten

Praktisches Setup:

  1. Speichern Sie ANTHROPIC_API_KEY als Umgebungsvariable. So landet der Schlüssel nicht in einer geteilten Sammlung.
  2. Erstellen Sie eine Baseline-Messages-Anfrage.
  3. Duplizieren Sie sie für low, high und xhigh, damit alle Varianten denselben Prompt verwenden.
  4. Beobachten Sie bei aktivem Streaming den SSE-Stream direkt. So erkennen Sie, wo eine abgeschnittene Antwort endet.
  5. Prüfen Sie in jeder Antwort den Block usage, um Cache-Treffer und Token-Verbrauch des Denkprozesses auszuwerten.

Baseline-Anfrage:

curl https://api.anthropic.com/v1/messages \
  --header "x-api-key: $ANTHROPIC_API_KEY" \
  --header "anthropic-version: 2023-06-01" \
  --header "content-type: application/json" \
  --data '{
    "model": "claude-opus-5",
    "max_tokens": 8192,
    "messages": [
      {
        "role": "user",
        "content": "Refaktorieren Sie diesen Handler und erläutern Sie die Kompromisse."
      }
    ]
  }'
Enter fullscreen mode Exit fullscreen mode

Diese Anfrage führt adaptives Denken aus, weil kein thinking-Feld gesetzt ist. Planen Sie für max_tokens ausreichend Reserve ein: Ein Wert, der bei Opus 4.8 für die sichtbare Antwort ausreichte, kann bei Opus 5 zu einer stillen Kürzung führen.

Sie können Apidog herunterladen und die Anfrage importieren. Der Schritt-für-Schritt-API-Leitfaden behandelt Streaming, Werkzeugnutzung und das vollständige Auslesen von usage.

Wer sollte Claude Opus 5 verwenden?

Verwenden Sie Opus 5, wenn:

  • Sie Agenten oder werkzeugintensive Workflows erstellen. Das ist die Workload, für die Anthropic optimiert hat und bei der die Benchmark-Angaben am stärksten ausfallen.
  • Sie Fable 5 nutzen und Kosten senken möchten. Die behauptete geringe Lücke beim agentischen Coding bei halben Kosten ist eine eigene Evaluierung wert. Siehe Opus 5 vs. Fable 5.
  • Sie heute Opus 4.8 verwenden. Preisgleichheit, aktuellerer Wissensstichtag und bessere beanspruchte Werte sprechen für eine Migration – sofern Sie den Anpassungsaufwand einplanen.
  • Sie aktuelles Wissen benötigen. Mai 2026 liegt etwa vier Monate vor den anderen aktuellen Claude-Modellen.

Bleiben Sie bei einer Alternative, wenn:

  • Priority Tier geschäftskritisch ist. Opus 4.8 behält es, Opus 5 nicht. Prüfen Sie die Preise und Tarife von Opus 4.8.
  • Ihre Workload günstig und volumenstark ist. Sonnet 5 kostet weniger und kann ausreichen. Der Vergleich von Opus 5 vs. Sonnet 5 zeigt, wann sich die 2,5-fache Prämie bezahlt macht.
  • Sie Cybersicherheitsausbeutung oder autonome Biologieforschung betreiben. Mythos 5 bleibt dort führend.

Häufig gestellte Fragen (FAQ)

Wie lautet die Modell-ID für Claude Opus 5?

Verwenden Sie claude-opus-5 ohne Datumssuffix. Für Amazon Bedrock lautet die ID anthropic.claude-opus-5. Google Cloud verwendet claude-opus-5; Claude Platform auf AWS verwendet eine eigene ID.

Wie viel kostet Claude Opus 5?

5 $ pro Million Input-Tokens und 25 $ pro Million Output-Tokens. Das entspricht Opus 4.8 und der Hälfte der Preise von Fable 5 mit 10 $ und 50 $. Die Batch API senkt die Preise auf 2,50 $ und 12,50 $. Fast mode kostet 10 $ und 50 $.

Ist Claude Opus 5 besser als Fable 5?

Laut Anthropics eigenen Zahlen liegt Opus 5 nah an Fable 5, aber nicht darüber. Anthropic berichtet einen Abstand von 0,5 % bei CursorBench 3.2 und ein besseres Ergebnis bei OSWorld 2.0 zu einem Drittel der Kosten. Fable 5 behält jedoch die Bezeichnung „leistungsfähigstes, breit veröffentlichtes Modell“. Diese Ergebnisse wurden bisher nicht unabhängig reproduziert.

Wie groß ist das Kontextfenster von Claude Opus 5?

1.000.000 Tokens – als Standard und Maximum, ohne Beta-Header und ohne Preisaufschlag für lange Kontexte. Die maximale Ausgabe liegt bei 128.000 Tokens über die Messages API beziehungsweise 300.000 Tokens über die Batch API mit dem Beta-Header output-300k-2026-03-24.

Muss ich Code ändern, um von Opus 4.8 zu aktualisieren?

Ja. Denken ist jetzt standardmäßig aktiv, daher müssen Sie max_tokens überprüfen, um stille Kürzungen zu vermeiden. Außerdem erzeugt thinking: {type: "disabled"} zusammen mit xhigh oder max einen 400er-Fehler. Wiederholen Sie auch Ihren Aufwandssweep, weil die Stufen neu kalibriert wurden.

Wie ist der Wissensstand von Claude Opus 5?

Der Wissensstichtag liegt bei Mai 2026. Damit hat Opus 5 den aktuellsten Wissensstand unter den aktuellen Claude-Modellen.

Top comments (0)