Anthropic hat Claude Opus 5 am 24. Juli 2026 veröffentlicht. Auf die Frage „Kann ich es kostenlos nutzen?“ gibt es zwei Antworten: In den Claude-Apps ja, wenn Sie ein kostenpflichtiges Abonnement haben. Opus 5 ist das Standardmodell für Max-Abonnenten und das leistungsstärkste Modell im Pro-Tarif. Über die API lautet die Antwort nein: Für claude-opus-5 gibt es keinen kostenlosen, unbegrenzten Zugang.
Apidog noch heute ausprobieren
Die gute Nachricht: Sie können die API-Kosten deutlich reduzieren. Opus 5 kostet 5 $ pro Million Eingabe-Tokens und 25 $ pro Million Ausgabe-Tokens – wie Opus 4.8 und halb so viel wie Fable 5 mit 10 $ / 50 $. Mit Batch-Verarbeitung, Prompt-Caching und passenden Aufwandseinstellungen lässt sich die tatsächliche Rechnung oft mehr als halbieren. Wenn Sie API-Aufrufe testen, speichern und vergleichen möchten, eignet sich Apidog dafür.
Für den vollständigen Überblick lesen Sie Was ist Claude Opus 5?. Der Launch-Beitrag von Anthropic zu Opus 5 enthält die Ankündigung, während die Modellübersicht Modell-IDs und Verfügbarkeiten dokumentiert.
Wichtig ist diese Unterscheidung:
- Kostenlos in Claude-Apps: Ein kostenpflichtiges Abonnement deckt die Nutzung ab, allerdings mit Verbrauchslimits.
- Kostenlos über die API: Sie verwenden begrenzte Test- oder Aktionsguthaben. Sobald das Guthaben verbraucht ist, endet der kostenlose Zugriff.
Kostenloser Pfad 1: Claude-Abonnementstufen
Die Launch-Materialien von Anthropic nennen zwei Tarife für Opus 5:
- Max: Opus 5 ist das Standardmodell. Sie müssen keine Einstellung ändern.
- Pro: Opus 5 ist das leistungsstärkste Modell im Tarif. Das ist neu, da die höchste Opus-Stufe zuvor oberhalb von Pro lag.
Der kostenlose Claude-Plan wird in den Launch-Materialien nicht als Opus-5-Zugang genannt. Planen Sie daher nicht damit, bevor Sie den Modellwähler in Ihrem Konto geprüft haben.
Opus 5 ist außerdem in Claude Code, Claude Cowork und GitHub Copilot verfügbar. Falls Sie dort bereits ein kostenpflichtiges Abonnement nutzen, kann der Zugriff enthalten sein. Beachten Sie aber den Verbrauch:
- Denken ist standardmäßig aktiviert.
- Antworten fallen tendenziell länger aus.
- Das Modell delegiert häufiger an Sub-Agents.
Dadurch können Nutzungslimits schneller erreicht werden als mit Opus 4.8. Eine praktische Anleitung zum Begrenzen des Verbrauchs finden Sie unter Claude Opus 5 in Claude Code verwenden. Für die vorherige Generation siehe Claude Opus 4.8 kostenlos nutzen.
Kostenloser Pfad 2: API-Test- und Cloud-Aktionsguthaben
Die Modell-ID in der Claude API lautet:
claude-opus-5
Die API ist Pay-as-you-go. Zwei legitime Möglichkeiten erlauben trotzdem einen Einstieg ohne unmittelbare Zahlung:
Guthaben für neue Anthropic-API-Konten
Neue Konten erhalten in der Regel ein kleines Guthaben. Nutzen Sie es, um die Integration zu validieren und den Token-Verbrauch realer Prompts zu messen.Aktionsguthaben von Cloud-Plattformen
Opus 5 ist auf Amazon Bedrock alsanthropic.claude-opus-5, auf Claude Platform on AWS, Google Cloud und Microsoft Foundry verfügbar. Neue Cloud-Konten enthalten häufig Aktionsguthaben, die sich für Claude-Nutzung einsetzen lassen.
Prüfen Sie die aktuellen Bedingungen direkt bei der jeweiligen Plattform. Guthaben, Laufzeiten und Einschränkungen ändern sich häufig.
Verwenden Sie diese Guthaben nicht für Produktionsverkehr. Führen Sie stattdessen echte Testprompts aus und protokollieren Sie den usage-Block jeder Antwort. So erhalten Sie belastbare Kosten pro Aufgabe, bevor Sie eine Karte hinterlegen. Die aktuelle Liste der Preise steht in der Preisdokumentation von Anthropic.
Achtung: Denken ist bei Opus 5 standardmäßig aktiv
Bei Opus 4.8 lief eine Anfrage ohne thinking-Feld ohne Denken. Bei Opus 5 aktiviert dieselbe Anfrage adaptives Denken. Denk-Tokens werden als Ausgabe-Tokens abgerechnet, also mit 25 $ pro Million Tokens.
Eine unveränderte Testsuite aus Opus 4.8 kann deshalb Testguthaben deutlich schneller verbrauchen. Die wichtigsten Migrationsfallen beschreibt Migration von Opus 4.8 zu Opus 5.
Es gibt keinen kostenlosen unbegrenzten API-Pfad
Keine kostenlose Stufe der Claude API bietet unbegrenzte Aufrufe von claude-opus-5.
Vermeiden Sie Proxys, Schlüssel-Pools oder Wiederverkäufer, die kostenlosen Frontier-Modellzugriff versprechen. Solche Angebote können gegen die Bedingungen von Anthropic verstoßen, werden häufig widerrufen und leiten Ihre Prompts durch Infrastruktur, die Sie nicht kontrollieren.
Sobald Test- oder Aktionsguthaben aufgebraucht sind, zahlen Sie pro Token. Der Rest dieses Artikels zeigt, wie Sie diese Kosten minimieren.
Der günstigste kostenpflichtige Pfad
Der Standardtarif beträgt:
- Eingabe: 5 $ pro Million Tokens
- Ausgabe: 25 $ pro Million Tokens
Die folgenden Hebel haben den größten Einfluss auf die Rechnung.
Hebel 1: Batch API verwenden – 50 % Rabatt
Alles, was keine Antwort innerhalb weniger Sekunden benötigt, sollte über die Batch API laufen.
| Tarif | Eingabe / MTok | Ausgabe / MTok |
|---|---|---|
| Standard API | 5,00 $ | 25,00 $ |
| Batch API | 2,50 $ | 12,50 $ |
Die Batch API verarbeitet Anfragen asynchron, nutzt aber dasselbe Modell und liefert keine geringere Qualität.
Geeignete Anwendungsfälle:
- Nächtliche Evaluierungen
- Massenverarbeitung von Dokumenten
- Nachträgliche Klassifizierungen
- Regressionstests
- Content-Pipelines
Batch unterstützt mit dem Beta-Header output-300k-2026-03-24 bis zu 300.000 Ausgabe-Tokens pro Anfrage. Die Standard-Messages-API erlaubt dagegen 128.000. Für lange Generierungen ist Batch daher günstiger und weniger eingeschränkt.
Der Nachteil ist Latenz. Außerdem ist der schnelle Modus nicht mit der Batch API kompatibel.
Hebel 2: output_config.effort auf low oder medium setzen
Opus 5 bietet output_config.effort. Diese Einstellung steuert, wie viel Denkaufwand das Modell verwendet.
{
"output_config": {
"effort": "low"
}
}
Standardmäßig ist der Aufwand auf high eingestellt. Ein niedrigerer Aufwand erzeugt weniger Denk-Tokens. Da Denk-Tokens als Ausgabe berechnet werden, sinken damit in der Regel die Kosten.
Anthropic gibt an, dass low und medium bei Opus 5 stärker kalibriert sind als bei früheren Opus-Modellen. Übernehmen Sie deshalb Einstellungen aus Opus 4.8 nicht blind. Testen Sie Ihre eigenen Evaluierungen neu.
Praktische Regeln:
Niedrigerer Aufwand verkürzt nicht automatisch die sichtbare Antwort.
Wenn Sie kürzere Antworten benötigen, fordern Sie sie explizit im Prompt an.Deaktivieren Sie Denken nicht als Sparmaßnahme.
thinking: {"type": "disabled"}zusammen mitxhighodermaxführt zu einem 400-Fehler.
Die Prompting-Anleitung von Anthropic für Opus 5 empfiehlt, Denken aktiviert zu lassen und die Kosten über den Aufwand zu steuern. Deaktiviertes Denken kann Tool-Aufrufe als Klartext und interne XML-Tags in der sichtbaren Ausgabe erzeugen.
Eine detaillierte Übersicht der fünf Stufen finden Sie unter Claude Opus 5 Aufwandsparameter.
Hebel 3: Prompt-Caching ab 512 Tokens nutzen
Cache-Treffer kosten 0,50 $ pro Million Tokens – nur ein Zehntel des normalen Eingabetarifs.
| Cache-Vorgang | Preis pro MTok |
|---|---|
| Standard-Eingabe | 5,00 $ |
| Cache-Schreiben, 5 Minuten | 6,25 $ |
| Cache-Schreiben, 1 Stunde | 10,00 $ |
| Cache-Treffer | 0,50 $ |
Bei Opus 5 beträgt der minimale cache-fähige Präfix 512 Tokens. Bei Opus 4.8 waren es 1.024 Tokens. Dadurch können auch kürzere System-Prompts oder Referenzkontexte gecacht werden.
Beispiel mit 40.000 Tokens stabilem Präfix und 10.000 Tokens variabler Eingabe:
Ohne Cache:
50.000 Eingabe-Tokens × 5 $ / MTok = 0,25 $Erster Cache-Schreibvorgang:
40.000 gecachte Präfix-Tokens × 6,25 $ / MTok = 0,25 $
Das sind einmalig 0,05 $ mehr als die ungecachte Eingabe.Jeder weitere Cache-Treffer:
40.000 Cache-Tokens × 0,50 $ / MTok = 0,02 $
10.000 neue Tokens × 5 $ / MTok = 0,05 $
Gesamt: 0,07 $ statt 0,25 $.
Der erste Wiederholungsaufruf amortisiert den Cache-Schreibvorgang bereits. Prüfen Sie den Erfolg im Antwortfeld:
{
"usage": {
"cache_read_input_tokens": 40000
}
}
Hebel 4: Schnellen Modus überspringen
Der schnelle Modus kostet:
- 10 $ pro Million Eingabe-Tokens
- 50 $ pro Million Ausgabe-Tokens
Das ist doppelt so teuer wie der Standardtarif. Im Gegenzug liefert er ungefähr die 2,5-fache Ausgabegeschwindigkeit.
Der schnelle Modus ist eine Forschungsvorschau, nur über die Erstanbieter-API verfügbar und nicht mit Batch kompatibel. Für kostenoptimierte Workloads sollte er deaktiviert bleiben.
Setzen Sie ihn nur ein, wenn Nutzer aktiv auf die Antwort warten und die Latenz den doppelten Tokenpreis rechtfertigt.
Hebel 5: inference_geo nicht unnötig setzen
Wenn Sie Folgendes setzen:
{
"inference_geo": "us"
}
wird ein 1,1-facher Multiplikator auf jede Token-Kategorie angewendet. Das entspricht 10 % Aufschlag auf die gesamte Rechnung.
Nutzen Sie diese Option nur bei Anforderungen an Datenresidenz.
Ein kleiner zusätzlicher Vorteil bei Opus 5: Der System-Prompt-Overhead für Tool-Nutzung beträgt bei tool_choice: "auto" oder tool_choice: "none" nur 286 Tokens. Bei Opus 4.8 waren es 290, bei Opus 4.7 noch 675 Tokens.
Weitere modellübergreifende Optimierungen finden Sie unter Claude API-Rechnung reduzieren.
Kostenvergleich auf einen Blick
| Konfiguration | Eingabe / MTok | Ausgabe / MTok | Am besten für |
|---|---|---|---|
Standard, Aufwand high
|
5,00 $ | 25,00 $ | Interaktive Standardanfragen |
| Batch API | 2,50 $ | 12,50 $ | Asynchrone Verarbeitung |
| Cache-Treffer auf stabilem Präfix | 0,50 $ | n. v. | Wiederholte Aufrufe mit langem Kontext |
| Schneller Modus | 10,00 $ | 50,00 $ | Latenzkritische Anwendungen |
inference_geo: "us" |
1,1× alle Kategorien | 1,1× alle Kategorien | Datenresidenz-Anforderungen |
Der Batch-Rabatt gilt für Standard-Token-Tarife. Prüfen Sie Ihre eigene Rechnung, bevor Sie kombinierte Einsparungen mit Cache-Tarifen modellieren. Weitere Rechenbeispiele enthält Claude Opus 5 Preise.
Die günstigen Pfade in Apidog testen
Jeder Kostenhebel lässt sich direkt über den HTTP-Response prüfen. Beginnen Sie mit einer gespeicherten Basisanfrage:
curl https://api.anthropic.com/v1/messages \
--header "x-api-key: $ANTHROPIC_API_KEY" \
--header "anthropic-version: 2023-06-01" \
--header "content-type: application/json" \
--data '{
"model": "claude-opus-5",
"max_tokens": 4096,
"output_config": {"effort": "low"},
"messages": [
{"role": "user", "content": "Summarize this OpenAPI spec in three sentences."}
]
}'
Erstellen Sie in Apidog eine gespeicherte POST-Anfrage. Speichern Sie den API-Schlüssel als Umgebungsvariable statt im Request-Body oder Repository.
Testen Sie anschließend systematisch:
Aufwandsstufen vergleichen
Duplizieren Sie die Anfrage und setzen Sieeffortauflow,mediumundhigh. Vergleichen Sie anschließendusage.output_tokens.Cache-Treffer bestätigen
Senden Sie denselben Request mit langem, stabilem Präfix zweimal. Beim zweiten Request solltecache_read_input_tokensgrößer als null sein.max_tokens-Abschneidung überwachen
Denken und sichtbare Antwort teilen sich dasmax_tokens-Budget. Bei folgendem Wert haben Sie möglicherweise für unbrauchbare Ausgabe bezahlt:
{
"stop_reason": "max_tokens"
}
Legen Sie dafür eine Assertion an.
- Streaming- und Tool-Aufrufe prüfen Prüfen Sie SSE-Responses und Tool-Call-Payloads vollständig. Das ist besonders wichtig, wenn agentische Schleifen mehr Ausgabe erzeugen als erwartet.
Laden Sie Apidog herunter, um die Requests nachzubauen. Die vollständige Integration beschreibt Claude Opus 5 API verwenden.
Ist Opus 5 überhaupt das richtige Modell zum Optimieren?
Manchmal ist der günstigste Weg ein anderes Modell.
Sonnet 5 kostet zu Einführungspreisen 2 $ / 10 $ pro Million Tokens und steigt am 1. September 2026 auf 3 $ / 15 $. Es teilt sich das 1M-Token-Kontextfenster mit Opus 5.
Wenn Ihre Anwendung kein agentisches Coding oder komplexes mehrstufiges Denken erfordert, vergleichen Sie Sonnet 5 zuerst mit Opus 5. Claude Opus 5 vs. Sonnet 5 zeigt, wann der Aufpreis sinnvoll ist. Für kostenlose Optionen siehe Claude Sonnet 5 kostenlos nutzen.
Berücksichtigen Sie außerdem, was der Premiumpreis laut Anthropic liefern soll:
- Opus 5 übertrifft den Frontier-Bench-Score von Opus 4.8 laut Anthropic um mehr als das Doppelte.
- Bei CursorBench 3.2 liegt Opus 5 laut Anthropic innerhalb von 0,5 % von Fable 5 – zum halben Preis.
- Bei OSWorld 2.0 liegt Opus 5 laut Anthropic vor Fable 5 – zu einem Drittel der Kosten.
Das sind von Anthropic veröffentlichte Anbieterangaben, die mit Stand vom 25. Juli 2026 nicht unabhängig reproduziert wurden. Behandeln Sie sie als Hypothesen für Ihre eigenen Benchmarks.
Opus 5 ist außerdem nicht die Spitze des Claude-Stacks. Fable 5 bleibt Anthropic’s leistungsfähigstes weit verbreitetes Modell. Mythos 5 liegt bei Cyber-Sicherheitsausnutzung und autonomer Biologieforschung weiterhin vor Opus 5. Wenn Ihre Workload an diese Grenze reicht, lesen Sie Was ist Claude Fable 5?.
Welcher Pfad passt zu Ihnen?
| Ziel | Pfad | Der Haken |
|---|---|---|
| Chat, Schreiben, Recherche | Claude Pro- oder Max-Abonnement | Verbrauchsabhängige Limits; Opus 5 verbraucht sie schneller als 4.8 |
| Agentisches Coding | Claude Code mit kostenpflichtigem Plan | Längere Standardantworten und Sub-Agent-Delegation verbrauchen Guthaben |
| Integration prototypisieren | API-Test- oder Cloud-Aktionsguthaben | Guthaben läuft ab; danach Abrechnung pro Token |
| Günstigste Produktions-API | Batch + Caching + Aufwand low
|
Batch erhöht die Latenz; Caching braucht einen stabilen Präfix |
| Günstigste interaktive API | Standardtarif + Caching + aufgabenspezifischer Aufwand | Kein Batch-Rabatt verfügbar |
FAQ
Ist Claude Opus 5 kostenlos?
Nicht über die API. In den Claude-Apps ist es in kostenpflichtigen Abonnements enthalten: als Standardmodell für Max und als leistungsstärkstes Modell für Pro. Die Launch-Materialien nennen den kostenlosen Claude-Plan nicht als Opus-5-Oberfläche.
Kann ich kostenlosen Claude Opus 5 API-Zugang erhalten?
Nur über begrenzte Testguthaben für neue Konten oder Aktionsguthaben auf Amazon Bedrock, Google Cloud oder Microsoft Foundry. Es gibt keine kostenlose unbegrenzte API-Stufe.
Was ist der günstigste legitime Weg, Opus 5 in großem Umfang zu betreiben?
Nutzen Sie die Batch API mit 2,50 $ / 12,50 $, aktivieren Sie Prompt-Caching für stabile Präfixe über 512 Tokens und wählen Sie effort: "low" oder medium, sofern Ihre Evaluierungen die Qualität bestätigen. Lassen Sie den schnellen Modus aus und setzen Sie inference_geo nur bei tatsächlichen Residenzanforderungen.
Sollte ich Denken deaktivieren, um Tokens zu sparen?
Nein. Deaktiviertes Denken kombiniert mit xhigh oder max erzeugt einen 400-Fehler. Anthropic empfiehlt, Denken aktiviert zu lassen und stattdessen den Aufwand zu reduzieren. Prüfen Sie reale Kosten anhand des usage-Blocks und hinterlegen Sie in Apidog Assertions für relevante Felder, damit Kostenregressionen automatisch auffallen.
Top comments (0)