DEV Community

Cover image for Wie benutzt man die Gemini 3.6 Flash API?
Emre Demir
Emre Demir

Posted on • Originally published at apidog.com

Wie benutzt man die Gemini 3.6 Flash API?

Sie rufen Gemini 3.6 Flash über die Google Gemini API mit der Modell-ID gemini-3.6-flash auf. Google hat das Flash-Update am 21. Juli 2026 veröffentlicht. Gemini 3.6 Flash ist die leistungsstarke Stufe: mit niedrigerem Ausgabepreis als 3.5 Flash, einem Kontextfenster von 1 Mio. Tokens sowie Eingaben für Text, Bilder, Videos, Audio und PDFs. In diesem Leitfaden richten Sie einen API-Schlüssel ein, senden Anfragen mit curl und Python und bauen einen Regressionstest für den Endpunkt.

Apidog noch heute ausprobieren

Was Sie vor dem Start benötigen

Sie benötigen nur drei Dinge:

  • Ein Google-Konto, um sich bei Google AI Studio anzumelden.
  • Einen Gemini API-Schlüssel, den Sie in Google AI Studio erstellen.
  • Ein HTTP-Tool: curl, Python oder einen API-Client wie Apidog.

Für erste Tests ist keine Abrechnungseinrichtung nötig. Die kostenlose Stufe von AI Studio ist ratenbegrenzt, ermöglicht aber Tests ohne hinterlegte Karte.

Einen Gemini API-Schlüssel erhalten

  1. Öffnen Sie Google AI Studio.
  2. Melden Sie sich mit Ihrem Google-Konto an.
  3. Klicken Sie auf „API-Schlüssel erhalten“.
  4. Klicken Sie auf „API-Schlüssel erstellen“.
  5. Kopieren Sie den Schlüssel und speichern Sie ihn sicher.

Behandeln Sie den Schlüssel wie ein Passwort. Jeder mit Zugriff auf den Schlüssel kann Anfragen über Ihr Konto senden.

Speichern Sie ihn als Umgebungsvariable, statt ihn in den Quellcode zu schreiben:

export GEMINI_API_KEY="your_key_here"
Enter fullscreen mode Exit fullscreen mode

Committen Sie den Schlüssel nicht in ein Repository und verwenden Sie ihn nicht im clientseitigen Code. Das offizielle Python-SDK liest GEMINI_API_KEY automatisch aus der Umgebung. Weitere Einrichtungsdetails finden Sie in den Gemini API-Dokumenten von Google.

Ihren ersten API-Aufruf mit curl senden

Der REST-Aufruf verwendet die Methode generateContent. Ersetzen Sie YOUR_API_KEY durch Ihren Schlüssel oder verwenden Sie direkt die Umgebungsvariable:

curl "https://generativelanguage.googleapis.com/v1beta/models/gemini-3.6-flash:generateContent" \
  -H "x-goog-api-key: $GEMINI_API_KEY" \
  -H "Content-Type: application/json" \
  -X POST \
  -d '{
    "contents": [
      {
        "parts": [
          {
            "text": "Explain how APIs work"
          }
        ]
      }
    ]
  }'
Enter fullscreen mode Exit fullscreen mode

Wichtige Bestandteile der Anfrage:

  • Der Header x-goog-api-key enthält Ihren API-Schlüssel.
  • contents ist ein Array von Nachrichten.
  • Jede Nachricht enthält ein parts-Array.
  • Ein Text-Prompt wird als Objekt mit dem Feld text übergeben.

Diese Struktur ist auch für multimodale Anfragen relevant: Später können Sie zusätzliche Teile für Bilder oder Dateien in dasselbe parts-Array einfügen.

Die Antwort ist JSON. Der generierte Text befindet sich unter:

candidates[0].content.parts[0].text
Enter fullscreen mode Exit fullscreen mode

Prüfen Sie dieses Feld in Ihrer Anwendung oder in automatisierten API-Tests.

Dieselbe Anfrage mit Python ausführen

Installieren Sie zuerst das SDK:

pip install google-genai
Enter fullscreen mode Exit fullscreen mode

Erstellen Sie dann eine Datei, etwa gemini.py:

from google import genai

client = genai.Client()  # liest GEMINI_API_KEY aus der Umgebung

resp = client.models.generate_content(
    model="gemini-3.6-flash",
    contents="Explain how APIs work",
)

print(resp.text)
Enter fullscreen mode Exit fullscreen mode

Führen Sie das Skript aus:

python gemini.py
Enter fullscreen mode Exit fullscreen mode

Der API-Schlüssel bleibt dabei außerhalb Ihres Codes, weil der Client GEMINI_API_KEY aus der Umgebung liest. resp.text enthält den generierten Antworttext.

Wichtige Parameter für produktive Anfragen

Die Minimalanfrage funktioniert, für zuverlässige Integrationen sollten Sie aber diese Einstellungen kennen:

  • Systemanweisung: Definieren Sie globale Regeln für die Konversation, etwa „Antworten Sie nur in JSON“ oder „Sie sind ein knapper Code-Reviewer“. Das ist zuverlässiger, als dieselben Regeln in jeden Benutzerprompt zu schreiben.
  • Maximale Ausgabe-Tokens: Begrenzen Sie die Antwortlänge. Gemini 3.6 Flash kann bis zu 64k Ausgabe-Tokens erzeugen. Verwenden Sie niedrigere Limits, wenn Sie Kosten und Latenz begrenzen möchten.
  • Multimodale Eingaben: Das Modell akzeptiert Text, Bilder, Videos, Audio und PDFs in einem Aufruf. Fügen Sie diese als weitere Einträge im parts-Array hinzu.
  • Kontextfenster: Das Modell unterstützt bis zu 1 Mio. Eingabe-Tokens. Damit können Sie beispielsweise lange PDFs oder umfangreiche Transkripte verarbeiten.
  • Denken und Argumentation: Bei komplexen Prompts argumentiert Gemini 3.6 Flash vor der Antwort. Der Argumentationsaufwand lässt sich gegen Geschwindigkeit und Kosten abwägen.

Verwenden Sie für konkrete Feldnamen und aktuelle Konfigurationsoptionen immer die Gemini API-Dokumentation. Raten Sie keine JSON-Felder.

Preise und kostenlose Stufe

Gemini 3.6 Flash kostet:

Typ Preis
Eingabe 1,50 $ pro 1 Mio. Tokens
Ausgabe 7,50 $ pro 1 Mio. Tokens

Der Ausgabepreis liegt unter den 9,00 $ von Gemini 3.5 Flash. Außerdem erzeugt Gemini 3.6 Flash bei derselben Aufgabe tendenziell etwa 17 % weniger Ausgabe-Tokens.

Beachten Sie: Die Ausgabeabrechnung enthält auch Denk-Tokens. Ein Prompt mit intensiver Argumentation kann daher mehr kosten, als die sichtbare Länge der Antwort vermuten lässt. Eine detaillierte Aufschlüsselung finden Sie im Gemini 3.6 Flash Preisleitfaden.

Die kostenlose Stufe in AI Studio ist für Prototyping und Lernen geeignet, aber ratenbegrenzt. Google darf Daten aus der kostenlosen Stufe zur Produktverbesserung verwenden. Für Produktionsworkloads aktivieren Sie die Abrechnung. Mehr dazu lesen Sie unter Gemini 3.6 Flash kostenlos nutzen.

Die Gemini API mit Apidog testen und debuggen

Ein erfolgreicher curl-Aufruf zeigt nur, dass die Anfrage einmal funktioniert hat. Für Deployments benötigen Sie einen wiederholbaren Test, der Fehler wie abgelaufene Schlüssel, geänderte Antwortfelder oder defekte Request-Bodies erkennt.

Dafür können Sie Apidog verwenden:

  1. POST-Anfrage anlegen Erstellen Sie eine Anfrage mit dieser URL:
   https://generativelanguage.googleapis.com/v1beta/models/gemini-3.6-flash:generateContent
Enter fullscreen mode Exit fullscreen mode

Fügen Sie den JSON-Body aus dem curl-Beispiel ein.

  1. API-Schlüssel als Umgebungsvariable speichern Legen Sie in Ihrer Apidog-Umgebung die Variable GEMINI_API_KEY an. Verwenden Sie im Header:
   x-goog-api-key: {{GEMINI_API_KEY}}
Enter fullscreen mode Exit fullscreen mode

So bleibt das Geheimnis außerhalb der geteilten Anfrage. Außerdem können Sie unterschiedliche Schlüssel für dev, staging und prod verwenden.

  1. Assertionen hinzufügen Prüfen Sie mindestens:
  • Der HTTP-Status ist 200.
  • candidates[0].content.parts[0].text existiert.
  • Der Antworttext ist nicht leer.
  1. Test speichern und planen Speichern Sie die Anfrage in einer Sammlung und planen Sie sie als Regressionstest. Sie können den Test zeitgesteuert oder in Ihrer CI-Pipeline ausführen.

Laden Sie Apidog herunter, um den Test einzurichten. Apidog führt das Modell nicht aus, sondern prüft, ob die API weiterhin so reagiert, wie Ihre Anwendung es erwartet.

Häufige Fehler und Lösungen

401 Unauthorized: ungültiger Schlüssel

Der Schlüssel fehlt, ist ungültig oder wurde widerrufen.

Prüfen Sie:

  • Ist x-goog-api-key gesetzt?
  • Enthält die Umgebungsvariable den korrekten Schlüssel?
  • Wird {{GEMINI_API_KEY}} in Apidog tatsächlich aufgelöst?
  • Enthält der Schlüssel versehentliche Leerzeichen?

429 Too Many Requests: Ratenbegrenzung

Sie haben das Anfragenlimit pro Minute oder Tag erreicht.

Mögliche Maßnahmen:

  • Reduzieren Sie die Anfragerate.
  • Verwenden Sie Wiederholungen mit Backoff.
  • Vermeiden Sie enge Testschleifen.
  • Aktivieren Sie die Abrechnung, wenn Sie höhere Limits benötigen.

404 Not Found: Modell nicht gefunden

Prüfen Sie die Modell-ID exakt:

gemini-3.6-flash
Enter fullscreen mode Exit fullscreen mode

Verwechseln Sie sie nicht mit:

gemini-3.5-flash
gemini-flash-3.6
gemini-3.5-flash-lite
Enter fullscreen mode Exit fullscreen mode

gemini-3.5-flash-lite ist ein anderes Modell aus der 3.5-Linie.

FAQ

Was ist die genaue Modell-ID für Gemini 3.6 Flash?

Verwenden Sie gemini-3.6-flash sowohl im SDK als auch im REST-Pfad direkt vor :generateContent.

Ist die Gemini 3.6 Flash API kostenlos nutzbar?

Ja, über die kostenlose und ratenbegrenzte Stufe in AI Studio. Sie eignet sich für Lernen und Prototyping. Für Produktion aktivieren Sie die Abrechnung. Details finden Sie unter Gemini 3.6 Flash kostenlos nutzen.

Welche Eingaben kann ich senden?

Text, Bilder, Videos, Audio und PDFs. Das Kontextfenster umfasst bis zu 1 Mio. Eingabe-Tokens. Die Ausgabe besteht ausschließlich aus Text.

Warum ist meine Rechnung höher als die sichtbare Antwort?

Die Ausgabeabrechnung von 7,50 $ pro 1 Mio. Tokens enthält Denk-Tokens. Komplexe Prompts mit intensivem Argumentieren können daher höhere Kosten verursachen.

Ist das dieselbe API wie bei Gemini 3.5 Flash?

Die Aufrufform ist gleich. Wenn Sie bereits die Gemini 3.5 API verwendet haben, ersetzen Sie vor allem die Modell-ID. Gemini 3.6 Flash reduziert den Ausgabepreis und verwendet bei gleichen Aufgaben tendenziell weniger Ausgabe-Tokens.

Kann ich denselben Schlüssel für curl, Python und Apidog verwenden?

Ja. Ein Schlüssel aus AI Studio funktioniert in allen drei Werkzeugen. Speichern Sie ihn jeweils als Umgebungsvariable, damit Sie ihn zentral rotieren oder widerrufen können.

Wie geht es weiter?

Sie haben jetzt:

  • einen Gemini API-Schlüssel,
  • einen funktionierenden curl-Aufruf,
  • ein Python-Beispiel,
  • wichtige Konfigurationsparameter,
  • und einen Ansatz für Regressionstests.

Starten Sie mit der kostenlosen Stufe, halten Sie Ihren Schlüssel in einer Umgebungsvariable und prüfen Sie die offiziellen Gemini API-Dokumente, sobald Sie über die Grundlagen hinausgehen. Wenn Ihre Anwendung von diesem Endpunkt abhängt, integrieren Sie den Aufruf in einen Apidog-Test, damit API-Änderungen nicht zuerst bei Ihren Nutzern auffallen.

Top comments (0)