DEV Community

Cover image for Comment utiliser l'API Gemini 3.6 Flash ?
Antoine Laurent
Antoine Laurent

Posted on • Originally published at apidog.com

Comment utiliser l'API Gemini 3.6 Flash ?

Vous appelez Gemini 3.6 Flash avec l’ID de modèle gemini-3.6-flash via l’API Gemini de Google. Google a lancé le rafraîchissement de Flash le 21 juillet 2026, et 3.6 Flash est le niveau « cheval de trait » : un coût de sortie inférieur à 3.5 Flash, une fenêtre contextuelle d’1 million de tokens et des entrées texte, image, vidéo, audio et PDF. Ce guide vous permet d’obtenir une clé, d’effectuer un appel avec curl et Python, de régler les paramètres essentiels et de mettre en place un test de régression.

Essayez Apidog dès aujourd’hui

Illustration de Gemini 3.6 Flash

Ce dont vous avez besoin avant de commencer

Préparez ces trois éléments :

  • Un compte Google, nécessaire pour créer une clé API.
  • Une clé API Gemini, disponible depuis Google AI Studio.
  • Un client HTTP :
    • curl pour tester depuis un terminal ;
    • Python pour intégrer l’appel dans votre code ;
    • un client API tel qu’Apidog pour enregistrer et automatiser vos tests.

Aucune configuration de facturation n’est requise pour commencer. Le niveau gratuit d’AI Studio permet de tester l’API, sous réserve de limites de débit.

Obtenir une clé API Gemini

Rendez-vous sur Google AI Studio, connectez-vous, puis :

  1. Cliquez sur Obtenir une clé API.
  2. Cliquez sur Créer une clé API.
  3. Copiez la clé générée et stockez-la dans un gestionnaire de secrets.

Traitez cette clé comme un mot de passe : toute personne qui y accède peut l’utiliser pour effectuer des requêtes associées à votre compte.

Création d’une clé API dans Google AI Studio

Ne placez jamais la clé dans du code côté client et ne la committez pas dans un dépôt Git. Définissez plutôt une variable d’environnement :

export GEMINI_API_KEY="votre_clé_ici"
Enter fullscreen mode Exit fullscreen mode

Le SDK Python officiel peut lire cette variable directement. Consultez la documentation de l’API Gemini pour les étapes de configuration de référence.

Effectuer votre premier appel API

L’API REST utilise une requête POST vers la méthode generateContent du modèle.

Tester avec curl

curl "https://generativelanguage.googleapis.com/v1beta/models/gemini-3.6-flash:generateContent" \
  -H "x-goog-api-key: $GEMINI_API_KEY" \
  -H "Content-Type: application/json" \
  -X POST \
  -d '{
    "contents": [
      {
        "parts": [
          {"text": "Expliquez comment fonctionnent les API"}
        ]
      }
    ]
  }'
Enter fullscreen mode Exit fullscreen mode

Points à vérifier :

  • La clé est envoyée dans l’en-tête x-goog-api-key.
  • Le corps contient un tableau contents.
  • Chaque contenu possède un tableau parts.
  • Une partie texte utilise la propriété text.

Cette structure est également celle à utiliser pour combiner ultérieurement du texte, des images ou des fichiers dans une même requête.

Tester avec Python

Installez le SDK :

pip install google-genai
Enter fullscreen mode Exit fullscreen mode

Puis créez un fichier gemini_test.py :

from google import genai

client = genai.Client()  # Lit GEMINI_API_KEY depuis l'environnement

resp = client.models.generate_content(
    model="gemini-3.6-flash",
    contents="Expliquez comment fonctionnent les API",
)

print(resp.text)
Enter fullscreen mode Exit fullscreen mode

Exécutez-le :

python gemini_test.py
Enter fullscreen mode Exit fullscreen mode

Le texte généré est accessible via resp.text. Dans la réponse JSON brute, il se trouve à l’emplacement :

candidates[0].content.parts[0].text
Enter fullscreen mode Exit fullscreen mode

Conservez ce chemin : il sera utile pour écrire des assertions dans vos tests API.

Paramètres clés à connaître

La requête minimale suffit pour démarrer, mais ces paramètres influencent directement la sortie.

  • Instruction système

    Utilisez-la pour fixer des règles globales, par exemple : « Répondre uniquement en JSON » ou « Vous êtes un réviseur de code concis ». Cela évite de répéter les mêmes contraintes dans chaque prompt utilisateur.

  • Tokens de sortie maximum

    Limitez la longueur des réponses pour maîtriser la latence et le coût. Gemini 3.6 Flash peut produire jusqu’à 64k tokens de sortie.

  • Entrées multimodales

    Le modèle accepte du texte, des images, de la vidéo, de l’audio et des PDF dans le tableau parts. La sortie reste uniquement textuelle.

  • Réflexion et raisonnement

    Gemini 3.6 Flash raisonne avant de répondre aux requêtes complexes. Vous pouvez ajuster l’effort de raisonnement afin d’arbitrer entre profondeur d’analyse et vitesse de réponse.

Référez-vous à la documentation de l’API Gemini pour les noms de champs et les paramètres disponibles. Elle reste la source de vérité lorsque l’API évolue.

Tarification et niveau gratuit

Gemini 3.6 Flash coûte :

  • 1,50 $ par million de tokens d’entrée ;
  • 7,50 $ par million de tokens de sortie.

Le tarif de sortie est inférieur aux 9,00 $ facturés par Gemini 3.5 Flash. Gemini 3.6 Flash tend également à générer environ 17 % de tokens de sortie en moins pour une même tâche.

Attention : le tarif de sortie inclut les tokens de réflexion. Une requête qui exige un raisonnement important peut donc coûter davantage que ne le laisse penser la longueur visible de la réponse. Consultez le guide de tarification de Gemini 3.6 Flash pour détailler ces calculs.

Le niveau gratuit via AI Studio est adapté au prototypage et aux tests, mais il comporte des limites de débit par minute et par jour. Google peut également utiliser les données du niveau gratuit pour améliorer ses produits.

Pour tester sans facturation, consultez comment utiliser Gemini 3.6 Flash gratuitement. Lorsque vos besoins dépassent ces limites, activez la facturation : votre code et votre clé peuvent continuer à fonctionner sans modification.

Tester et déboguer l’API Gemini dans Apidog

curl valide un appel ponctuel, mais ne détecte pas les régressions : changement de structure de réponse, clé expirée ou requête cassée après un déploiement.

Un test enregistré dans Apidog permet de vérifier régulièrement que votre intégration fonctionne toujours.

Configurer le test

  1. Créez une requête POST

Utilisez cette URL :

   https://generativelanguage.googleapis.com/v1beta/models/gemini-3.6-flash:generateContent
Enter fullscreen mode Exit fullscreen mode

Ajoutez le corps JSON utilisé dans l’exemple curl.

  1. Ajoutez la clé comme variable d’environnement

Créez une variable GEMINI_API_KEY dans votre environnement Apidog, puis configurez l’en-tête :

   x-goog-api-key: {{GEMINI_API_KEY}}
Enter fullscreen mode Exit fullscreen mode

Vous pouvez ainsi utiliser des clés distinctes pour les environnements de développement, de staging et de production sans modifier la requête.

  1. Ajoutez des assertions

Vérifiez au minimum :

  • le code HTTP est 200 ;
  • candidates[0].content.parts[0].text existe ;
  • ce champ n’est pas vide.
  1. Enregistrez et planifiez le test

Ajoutez la requête à une collection, puis planifiez-la comme test de régression.

Exécutez-la à intervalles réguliers ou dans votre CI afin d’être alerté dès que l’appel Gemini ne répond plus comme prévu.

Téléchargez Apidog pour créer et exécuter ce test rapidement. Apidog n’exécute pas le modèle : il vérifie que l’API dont dépend votre application reste disponible et conforme à vos attentes.

Erreurs courantes et correctifs

401 Non autorisé : clé invalide

Cause probable : la clé est incorrecte, révoquée ou absente de l’en-tête.

À vérifier :

x-goog-api-key: VOTRE_CLE
Enter fullscreen mode Exit fullscreen mode

Si vous utilisez une variable, assurez-vous que {{GEMINI_API_KEY}} est bien résolue. Un espace superflu ou une variable non chargée est souvent à l’origine du problème.

429 Trop de requêtes : limite de débit atteinte

Vous avez atteint la limite de requêtes par minute ou par jour du niveau gratuit.

Correctifs :

  • réduisez la fréquence des requêtes ;
  • ajoutez des tentatives avec délai exponentiel ;
  • évitez les boucles de test trop serrées ;
  • activez la facturation si votre volume le nécessite.

404 Introuvable : modèle introuvable

Vérifiez l’ID du modèle :

gemini-3.6-flash
Enter fullscreen mode Exit fullscreen mode

N’utilisez pas :

gemini-3.5-flash
gemini-flash-3.6
Enter fullscreen mode Exit fullscreen mode

Le niveau Lite associé est gemini-3.5-flash-lite, qui est un modèle distinct de la ligne 3.5.

FAQ

Quel est l’ID exact du modèle Gemini 3.6 Flash ?

Utilisez :

gemini-3.6-flash
Enter fullscreen mode Exit fullscreen mode

Placez-le dans le SDK comme nom de modèle et dans l’URL REST, juste avant :generateContent.

L’API Gemini 3.6 Flash est-elle gratuite ?

Un niveau gratuit est disponible via AI Studio, avec des limites de débit. Il est adapté à l’apprentissage et au prototypage. Pour le trafic de production, activez la facturation. Consultez comment l’utiliser gratuitement pour plus de détails.

Que puis-je envoyer au modèle ?

Vous pouvez envoyer du texte, des images, de la vidéo, de l’audio et des PDF, dans une fenêtre contextuelle allant jusqu’à 1 million de tokens. La sortie est uniquement textuelle.

Pourquoi ma facture est-elle plus élevée que la longueur des réponses visibles ?

Le prix de sortie de 7,50 $ par million de tokens inclut les tokens de réflexion. Les prompts demandant un raisonnement intensif consomment donc davantage de tokens facturables.

Est-ce identique à l’ancienne API Gemini 3.5 Flash ?

La forme de l’appel est la même. Si vous utilisiez déjà l’API Gemini 3.5, remplacez l’ID du modèle par gemini-3.6-flash. Gemini 3.6 Flash réduit le prix de sortie et utilise moins de tokens de sortie pour une tâche équivalente.

Puis-je utiliser la même clé avec curl, Python et Apidog ?

Oui. Une clé créée dans AI Studio fonctionne avec les trois outils. Stockez-la dans une variable d’environnement ou un gestionnaire de secrets plutôt que de la coder en dur.

Où aller à partir d’ici

Vous disposez maintenant :

  • d’une clé API ;
  • d’un appel fonctionnel en curl ;
  • d’un exemple Python ;
  • des paramètres essentiels ;
  • d’un test de régression pour surveiller le point de terminaison.

Commencez avec le niveau gratuit, gardez votre clé hors du code source et utilisez la documentation officielle pour les fonctionnalités avancées. Lorsque cet appel devient critique pour votre application, encapsulez-le dans un test Apidog afin de détecter les changements d’API avant vos utilisateurs.

Top comments (0)