Vous appelez Gemini 3.6 Flash avec l’ID de modèle gemini-3.6-flash via l’API Gemini de Google. Google a lancé le rafraîchissement de Flash le 21 juillet 2026, et 3.6 Flash est le niveau « cheval de trait » : un coût de sortie inférieur à 3.5 Flash, une fenêtre contextuelle d’1 million de tokens et des entrées texte, image, vidéo, audio et PDF. Ce guide vous permet d’obtenir une clé, d’effectuer un appel avec curl et Python, de régler les paramètres essentiels et de mettre en place un test de régression.
Essayez Apidog dès aujourd’hui
Ce dont vous avez besoin avant de commencer
Préparez ces trois éléments :
- Un compte Google, nécessaire pour créer une clé API.
- Une clé API Gemini, disponible depuis Google AI Studio.
- Un client HTTP :
-
curlpour tester depuis un terminal ; - Python pour intégrer l’appel dans votre code ;
- un client API tel qu’Apidog pour enregistrer et automatiser vos tests.
-
Aucune configuration de facturation n’est requise pour commencer. Le niveau gratuit d’AI Studio permet de tester l’API, sous réserve de limites de débit.
Obtenir une clé API Gemini
Rendez-vous sur Google AI Studio, connectez-vous, puis :
- Cliquez sur Obtenir une clé API.
- Cliquez sur Créer une clé API.
- Copiez la clé générée et stockez-la dans un gestionnaire de secrets.
Traitez cette clé comme un mot de passe : toute personne qui y accède peut l’utiliser pour effectuer des requêtes associées à votre compte.
Ne placez jamais la clé dans du code côté client et ne la committez pas dans un dépôt Git. Définissez plutôt une variable d’environnement :
export GEMINI_API_KEY="votre_clé_ici"
Le SDK Python officiel peut lire cette variable directement. Consultez la documentation de l’API Gemini pour les étapes de configuration de référence.
Effectuer votre premier appel API
L’API REST utilise une requête POST vers la méthode generateContent du modèle.
Tester avec curl
curl "https://generativelanguage.googleapis.com/v1beta/models/gemini-3.6-flash:generateContent" \
-H "x-goog-api-key: $GEMINI_API_KEY" \
-H "Content-Type: application/json" \
-X POST \
-d '{
"contents": [
{
"parts": [
{"text": "Expliquez comment fonctionnent les API"}
]
}
]
}'
Points à vérifier :
- La clé est envoyée dans l’en-tête
x-goog-api-key. - Le corps contient un tableau
contents. - Chaque contenu possède un tableau
parts. - Une partie texte utilise la propriété
text.
Cette structure est également celle à utiliser pour combiner ultérieurement du texte, des images ou des fichiers dans une même requête.
Tester avec Python
Installez le SDK :
pip install google-genai
Puis créez un fichier gemini_test.py :
from google import genai
client = genai.Client() # Lit GEMINI_API_KEY depuis l'environnement
resp = client.models.generate_content(
model="gemini-3.6-flash",
contents="Expliquez comment fonctionnent les API",
)
print(resp.text)
Exécutez-le :
python gemini_test.py
Le texte généré est accessible via resp.text. Dans la réponse JSON brute, il se trouve à l’emplacement :
candidates[0].content.parts[0].text
Conservez ce chemin : il sera utile pour écrire des assertions dans vos tests API.
Paramètres clés à connaître
La requête minimale suffit pour démarrer, mais ces paramètres influencent directement la sortie.
Instruction système
Utilisez-la pour fixer des règles globales, par exemple : « Répondre uniquement en JSON » ou « Vous êtes un réviseur de code concis ». Cela évite de répéter les mêmes contraintes dans chaque prompt utilisateur.Tokens de sortie maximum
Limitez la longueur des réponses pour maîtriser la latence et le coût. Gemini 3.6 Flash peut produire jusqu’à 64k tokens de sortie.Entrées multimodales
Le modèle accepte du texte, des images, de la vidéo, de l’audio et des PDF dans le tableauparts. La sortie reste uniquement textuelle.Réflexion et raisonnement
Gemini 3.6 Flash raisonne avant de répondre aux requêtes complexes. Vous pouvez ajuster l’effort de raisonnement afin d’arbitrer entre profondeur d’analyse et vitesse de réponse.
Référez-vous à la documentation de l’API Gemini pour les noms de champs et les paramètres disponibles. Elle reste la source de vérité lorsque l’API évolue.
Tarification et niveau gratuit
Gemini 3.6 Flash coûte :
- 1,50 $ par million de tokens d’entrée ;
- 7,50 $ par million de tokens de sortie.
Le tarif de sortie est inférieur aux 9,00 $ facturés par Gemini 3.5 Flash. Gemini 3.6 Flash tend également à générer environ 17 % de tokens de sortie en moins pour une même tâche.
Attention : le tarif de sortie inclut les tokens de réflexion. Une requête qui exige un raisonnement important peut donc coûter davantage que ne le laisse penser la longueur visible de la réponse. Consultez le guide de tarification de Gemini 3.6 Flash pour détailler ces calculs.
Le niveau gratuit via AI Studio est adapté au prototypage et aux tests, mais il comporte des limites de débit par minute et par jour. Google peut également utiliser les données du niveau gratuit pour améliorer ses produits.
Pour tester sans facturation, consultez comment utiliser Gemini 3.6 Flash gratuitement. Lorsque vos besoins dépassent ces limites, activez la facturation : votre code et votre clé peuvent continuer à fonctionner sans modification.
Tester et déboguer l’API Gemini dans Apidog
curl valide un appel ponctuel, mais ne détecte pas les régressions : changement de structure de réponse, clé expirée ou requête cassée après un déploiement.
Un test enregistré dans Apidog permet de vérifier régulièrement que votre intégration fonctionne toujours.
Configurer le test
- Créez une requête
POST
Utilisez cette URL :
https://generativelanguage.googleapis.com/v1beta/models/gemini-3.6-flash:generateContent
Ajoutez le corps JSON utilisé dans l’exemple curl.
- Ajoutez la clé comme variable d’environnement
Créez une variable GEMINI_API_KEY dans votre environnement Apidog, puis configurez l’en-tête :
x-goog-api-key: {{GEMINI_API_KEY}}
Vous pouvez ainsi utiliser des clés distinctes pour les environnements de développement, de staging et de production sans modifier la requête.
- Ajoutez des assertions
Vérifiez au minimum :
- le code HTTP est
200; -
candidates[0].content.parts[0].textexiste ; - ce champ n’est pas vide.
- Enregistrez et planifiez le test
Ajoutez la requête à une collection, puis planifiez-la comme test de régression.
Exécutez-la à intervalles réguliers ou dans votre CI afin d’être alerté dès que l’appel Gemini ne répond plus comme prévu.
Téléchargez Apidog pour créer et exécuter ce test rapidement. Apidog n’exécute pas le modèle : il vérifie que l’API dont dépend votre application reste disponible et conforme à vos attentes.
Erreurs courantes et correctifs
401 Non autorisé : clé invalide
Cause probable : la clé est incorrecte, révoquée ou absente de l’en-tête.
À vérifier :
x-goog-api-key: VOTRE_CLE
Si vous utilisez une variable, assurez-vous que {{GEMINI_API_KEY}} est bien résolue. Un espace superflu ou une variable non chargée est souvent à l’origine du problème.
429 Trop de requêtes : limite de débit atteinte
Vous avez atteint la limite de requêtes par minute ou par jour du niveau gratuit.
Correctifs :
- réduisez la fréquence des requêtes ;
- ajoutez des tentatives avec délai exponentiel ;
- évitez les boucles de test trop serrées ;
- activez la facturation si votre volume le nécessite.
404 Introuvable : modèle introuvable
Vérifiez l’ID du modèle :
gemini-3.6-flash
N’utilisez pas :
gemini-3.5-flash
gemini-flash-3.6
Le niveau Lite associé est gemini-3.5-flash-lite, qui est un modèle distinct de la ligne 3.5.
FAQ
Quel est l’ID exact du modèle Gemini 3.6 Flash ?
Utilisez :
gemini-3.6-flash
Placez-le dans le SDK comme nom de modèle et dans l’URL REST, juste avant :generateContent.
L’API Gemini 3.6 Flash est-elle gratuite ?
Un niveau gratuit est disponible via AI Studio, avec des limites de débit. Il est adapté à l’apprentissage et au prototypage. Pour le trafic de production, activez la facturation. Consultez comment l’utiliser gratuitement pour plus de détails.
Que puis-je envoyer au modèle ?
Vous pouvez envoyer du texte, des images, de la vidéo, de l’audio et des PDF, dans une fenêtre contextuelle allant jusqu’à 1 million de tokens. La sortie est uniquement textuelle.
Pourquoi ma facture est-elle plus élevée que la longueur des réponses visibles ?
Le prix de sortie de 7,50 $ par million de tokens inclut les tokens de réflexion. Les prompts demandant un raisonnement intensif consomment donc davantage de tokens facturables.
Est-ce identique à l’ancienne API Gemini 3.5 Flash ?
La forme de l’appel est la même. Si vous utilisiez déjà l’API Gemini 3.5, remplacez l’ID du modèle par gemini-3.6-flash. Gemini 3.6 Flash réduit le prix de sortie et utilise moins de tokens de sortie pour une tâche équivalente.
Puis-je utiliser la même clé avec curl, Python et Apidog ?
Oui. Une clé créée dans AI Studio fonctionne avec les trois outils. Stockez-la dans une variable d’environnement ou un gestionnaire de secrets plutôt que de la coder en dur.
Où aller à partir d’ici
Vous disposez maintenant :
- d’une clé API ;
- d’un appel fonctionnel en curl ;
- d’un exemple Python ;
- des paramètres essentiels ;
- d’un test de régression pour surveiller le point de terminaison.
Commencez avec le niveau gratuit, gardez votre clé hors du code source et utilisez la documentation officielle pour les fonctionnalités avancées. Lorsque cet appel devient critique pour votre application, encapsulez-le dans un test Apidog afin de détecter les changements d’API avant vos utilisateurs.


Top comments (0)