Sie rufen Gemini 3.6 Flash über die Google Gemini API mit der Modell-ID gemini-3.6-flash auf. Google hat das Flash-Update am 21. Juli 2026 veröffentlicht. Gemini 3.6 Flash ist die leistungsstarke Stufe: mit niedrigerem Ausgabepreis als 3.5 Flash, einem Kontextfenster von 1 Mio. Tokens sowie Eingaben für Text, Bilder, Videos, Audio und PDFs. In diesem Leitfaden richten Sie einen API-Schlüssel ein, senden Anfragen mit curl und Python und bauen einen Regressionstest für den Endpunkt.
Apidog noch heute ausprobieren
Was Sie vor dem Start benötigen
Sie benötigen nur drei Dinge:
- Ein Google-Konto, um sich bei Google AI Studio anzumelden.
- Einen Gemini API-Schlüssel, den Sie in Google AI Studio erstellen.
-
Ein HTTP-Tool:
curl, Python oder einen API-Client wie Apidog.
Für erste Tests ist keine Abrechnungseinrichtung nötig. Die kostenlose Stufe von AI Studio ist ratenbegrenzt, ermöglicht aber Tests ohne hinterlegte Karte.
Einen Gemini API-Schlüssel erhalten
- Öffnen Sie Google AI Studio.
- Melden Sie sich mit Ihrem Google-Konto an.
- Klicken Sie auf „API-Schlüssel erhalten“.
- Klicken Sie auf „API-Schlüssel erstellen“.
- Kopieren Sie den Schlüssel und speichern Sie ihn sicher.
Behandeln Sie den Schlüssel wie ein Passwort. Jeder mit Zugriff auf den Schlüssel kann Anfragen über Ihr Konto senden.
Speichern Sie ihn als Umgebungsvariable, statt ihn in den Quellcode zu schreiben:
export GEMINI_API_KEY="your_key_here"
Committen Sie den Schlüssel nicht in ein Repository und verwenden Sie ihn nicht im clientseitigen Code. Das offizielle Python-SDK liest GEMINI_API_KEY automatisch aus der Umgebung. Weitere Einrichtungsdetails finden Sie in den Gemini API-Dokumenten von Google.
Ihren ersten API-Aufruf mit curl senden
Der REST-Aufruf verwendet die Methode generateContent. Ersetzen Sie YOUR_API_KEY durch Ihren Schlüssel oder verwenden Sie direkt die Umgebungsvariable:
curl "https://generativelanguage.googleapis.com/v1beta/models/gemini-3.6-flash:generateContent" \
-H "x-goog-api-key: $GEMINI_API_KEY" \
-H "Content-Type: application/json" \
-X POST \
-d '{
"contents": [
{
"parts": [
{
"text": "Explain how APIs work"
}
]
}
]
}'
Wichtige Bestandteile der Anfrage:
- Der Header
x-goog-api-keyenthält Ihren API-Schlüssel. -
contentsist ein Array von Nachrichten. - Jede Nachricht enthält ein
parts-Array. - Ein Text-Prompt wird als Objekt mit dem Feld
textübergeben.
Diese Struktur ist auch für multimodale Anfragen relevant: Später können Sie zusätzliche Teile für Bilder oder Dateien in dasselbe parts-Array einfügen.
Die Antwort ist JSON. Der generierte Text befindet sich unter:
candidates[0].content.parts[0].text
Prüfen Sie dieses Feld in Ihrer Anwendung oder in automatisierten API-Tests.
Dieselbe Anfrage mit Python ausführen
Installieren Sie zuerst das SDK:
pip install google-genai
Erstellen Sie dann eine Datei, etwa gemini.py:
from google import genai
client = genai.Client() # liest GEMINI_API_KEY aus der Umgebung
resp = client.models.generate_content(
model="gemini-3.6-flash",
contents="Explain how APIs work",
)
print(resp.text)
Führen Sie das Skript aus:
python gemini.py
Der API-Schlüssel bleibt dabei außerhalb Ihres Codes, weil der Client GEMINI_API_KEY aus der Umgebung liest. resp.text enthält den generierten Antworttext.
Wichtige Parameter für produktive Anfragen
Die Minimalanfrage funktioniert, für zuverlässige Integrationen sollten Sie aber diese Einstellungen kennen:
- Systemanweisung: Definieren Sie globale Regeln für die Konversation, etwa „Antworten Sie nur in JSON“ oder „Sie sind ein knapper Code-Reviewer“. Das ist zuverlässiger, als dieselben Regeln in jeden Benutzerprompt zu schreiben.
- Maximale Ausgabe-Tokens: Begrenzen Sie die Antwortlänge. Gemini 3.6 Flash kann bis zu 64k Ausgabe-Tokens erzeugen. Verwenden Sie niedrigere Limits, wenn Sie Kosten und Latenz begrenzen möchten.
-
Multimodale Eingaben: Das Modell akzeptiert Text, Bilder, Videos, Audio und PDFs in einem Aufruf. Fügen Sie diese als weitere Einträge im
parts-Array hinzu. - Kontextfenster: Das Modell unterstützt bis zu 1 Mio. Eingabe-Tokens. Damit können Sie beispielsweise lange PDFs oder umfangreiche Transkripte verarbeiten.
- Denken und Argumentation: Bei komplexen Prompts argumentiert Gemini 3.6 Flash vor der Antwort. Der Argumentationsaufwand lässt sich gegen Geschwindigkeit und Kosten abwägen.
Verwenden Sie für konkrete Feldnamen und aktuelle Konfigurationsoptionen immer die Gemini API-Dokumentation. Raten Sie keine JSON-Felder.
Preise und kostenlose Stufe
Gemini 3.6 Flash kostet:
| Typ | Preis |
|---|---|
| Eingabe | 1,50 $ pro 1 Mio. Tokens |
| Ausgabe | 7,50 $ pro 1 Mio. Tokens |
Der Ausgabepreis liegt unter den 9,00 $ von Gemini 3.5 Flash. Außerdem erzeugt Gemini 3.6 Flash bei derselben Aufgabe tendenziell etwa 17 % weniger Ausgabe-Tokens.
Beachten Sie: Die Ausgabeabrechnung enthält auch Denk-Tokens. Ein Prompt mit intensiver Argumentation kann daher mehr kosten, als die sichtbare Länge der Antwort vermuten lässt. Eine detaillierte Aufschlüsselung finden Sie im Gemini 3.6 Flash Preisleitfaden.
Die kostenlose Stufe in AI Studio ist für Prototyping und Lernen geeignet, aber ratenbegrenzt. Google darf Daten aus der kostenlosen Stufe zur Produktverbesserung verwenden. Für Produktionsworkloads aktivieren Sie die Abrechnung. Mehr dazu lesen Sie unter Gemini 3.6 Flash kostenlos nutzen.
Die Gemini API mit Apidog testen und debuggen
Ein erfolgreicher curl-Aufruf zeigt nur, dass die Anfrage einmal funktioniert hat. Für Deployments benötigen Sie einen wiederholbaren Test, der Fehler wie abgelaufene Schlüssel, geänderte Antwortfelder oder defekte Request-Bodies erkennt.
Dafür können Sie Apidog verwenden:
- POST-Anfrage anlegen Erstellen Sie eine Anfrage mit dieser URL:
https://generativelanguage.googleapis.com/v1beta/models/gemini-3.6-flash:generateContent
Fügen Sie den JSON-Body aus dem curl-Beispiel ein.
-
API-Schlüssel als Umgebungsvariable speichern
Legen Sie in Ihrer Apidog-Umgebung die Variable
GEMINI_API_KEYan. Verwenden Sie im Header:
x-goog-api-key: {{GEMINI_API_KEY}}
So bleibt das Geheimnis außerhalb der geteilten Anfrage. Außerdem können Sie unterschiedliche Schlüssel für dev, staging und prod verwenden.
- Assertionen hinzufügen Prüfen Sie mindestens:
- Der HTTP-Status ist
200. -
candidates[0].content.parts[0].textexistiert. - Der Antworttext ist nicht leer.
- Test speichern und planen Speichern Sie die Anfrage in einer Sammlung und planen Sie sie als Regressionstest. Sie können den Test zeitgesteuert oder in Ihrer CI-Pipeline ausführen.
Laden Sie Apidog herunter, um den Test einzurichten. Apidog führt das Modell nicht aus, sondern prüft, ob die API weiterhin so reagiert, wie Ihre Anwendung es erwartet.
Häufige Fehler und Lösungen
401 Unauthorized: ungültiger Schlüssel
Der Schlüssel fehlt, ist ungültig oder wurde widerrufen.
Prüfen Sie:
- Ist
x-goog-api-keygesetzt? - Enthält die Umgebungsvariable den korrekten Schlüssel?
- Wird
{{GEMINI_API_KEY}}in Apidog tatsächlich aufgelöst? - Enthält der Schlüssel versehentliche Leerzeichen?
429 Too Many Requests: Ratenbegrenzung
Sie haben das Anfragenlimit pro Minute oder Tag erreicht.
Mögliche Maßnahmen:
- Reduzieren Sie die Anfragerate.
- Verwenden Sie Wiederholungen mit Backoff.
- Vermeiden Sie enge Testschleifen.
- Aktivieren Sie die Abrechnung, wenn Sie höhere Limits benötigen.
404 Not Found: Modell nicht gefunden
Prüfen Sie die Modell-ID exakt:
gemini-3.6-flash
Verwechseln Sie sie nicht mit:
gemini-3.5-flash
gemini-flash-3.6
gemini-3.5-flash-lite
gemini-3.5-flash-lite ist ein anderes Modell aus der 3.5-Linie.
FAQ
Was ist die genaue Modell-ID für Gemini 3.6 Flash?
Verwenden Sie gemini-3.6-flash sowohl im SDK als auch im REST-Pfad direkt vor :generateContent.
Ist die Gemini 3.6 Flash API kostenlos nutzbar?
Ja, über die kostenlose und ratenbegrenzte Stufe in AI Studio. Sie eignet sich für Lernen und Prototyping. Für Produktion aktivieren Sie die Abrechnung. Details finden Sie unter Gemini 3.6 Flash kostenlos nutzen.
Welche Eingaben kann ich senden?
Text, Bilder, Videos, Audio und PDFs. Das Kontextfenster umfasst bis zu 1 Mio. Eingabe-Tokens. Die Ausgabe besteht ausschließlich aus Text.
Warum ist meine Rechnung höher als die sichtbare Antwort?
Die Ausgabeabrechnung von 7,50 $ pro 1 Mio. Tokens enthält Denk-Tokens. Komplexe Prompts mit intensivem Argumentieren können daher höhere Kosten verursachen.
Ist das dieselbe API wie bei Gemini 3.5 Flash?
Die Aufrufform ist gleich. Wenn Sie bereits die Gemini 3.5 API verwendet haben, ersetzen Sie vor allem die Modell-ID. Gemini 3.6 Flash reduziert den Ausgabepreis und verwendet bei gleichen Aufgaben tendenziell weniger Ausgabe-Tokens.
Kann ich denselben Schlüssel für curl, Python und Apidog verwenden?
Ja. Ein Schlüssel aus AI Studio funktioniert in allen drei Werkzeugen. Speichern Sie ihn jeweils als Umgebungsvariable, damit Sie ihn zentral rotieren oder widerrufen können.
Wie geht es weiter?
Sie haben jetzt:
- einen Gemini API-Schlüssel,
- einen funktionierenden curl-Aufruf,
- ein Python-Beispiel,
- wichtige Konfigurationsparameter,
- und einen Ansatz für Regressionstests.
Starten Sie mit der kostenlosen Stufe, halten Sie Ihren Schlüssel in einer Umgebungsvariable und prüfen Sie die offiziellen Gemini API-Dokumente, sobald Sie über die Grundlagen hinausgehen. Wenn Ihre Anwendung von diesem Endpunkt abhängt, integrieren Sie den Aufruf in einen Apidog-Test, damit API-Änderungen nicht zuerst bei Ihren Nutzern auffallen.


Top comments (0)