Google a mis à jour sa gamme Flash le 21 juillet 2026 avec Gemini 3.6 Flash. Si vous utilisez Gemini 3.5 Flash en production, la conclusion est simple : Gemini 3.6 Flash est un remplacement direct, moins cher en sortie et plus efficace en jetons. La famille de modèles, la fenêtre de contexte de 1 million de jetons et le prix d’entrée restent identiques. Pour une présentation complète, consultez Qu’est-ce que Gemini 3.6 Flash ?.
Essayez Apidog dès aujourd’hui
La réponse courte
Mettez à niveau vers Gemini 3.6 Flash si vous pouvez relancer vos évaluations.
- Le prix d’entrée reste à 1,50 $ par million de jetons.
- Le prix de sortie passe de 9,00 $ à 7,50 $ par million de jetons.
- Le modèle produit environ 17 % de jetons de sortie en moins pour les mêmes tâches.
- Il atteint 83,0 sur OSWorld-Verified, contre 78,4 pour Gemini 3.5 Flash.
- Il nécessite moins d’étapes de raisonnement et moins d’appels d’outils dans les workflows multi-étapes.
La seule raison de rester sur gemini-3.5-flash est opérationnelle : votre version actuelle est validée en production et vous n’avez pas encore de fenêtre pour refaire vos tests.
Gemini 3.6 Flash vs 3.5 Flash
Les chiffres ci-dessous proviennent des annonces de Google. Consultez le billet de blog Google et la page DeepMind Flash pour les détails.
| Attribut | Gemini 3.6 Flash | Gemini 3.5 Flash |
|---|---|---|
| ID du modèle | gemini-3.6-flash |
gemini-3.5-flash |
| Prix d’entrée, par 1M de jetons | 1,50 $ | 1,50 $ |
| Prix de sortie, par 1M de jetons | 7,50 $ | 9,00 $ |
| Efficacité des jetons de sortie | ~17 % de jetons en moins | Référence |
| Utilisation informatique, OSWorld-Verified | 83,0 | 78,4 |
| Fenêtre de contexte | 1M de jetons d’entrée | 1M de jetons d’entrée |
Le contrat d’intégration reste le même : mêmes modalités d’entrée — texte, image, vidéo, audio et PDF — et sortie texte. Les gains concernent surtout le coût de sortie, l’efficacité du raisonnement et les tâches agentiques.
Ce qui s’est amélioré
Moins de jetons de sortie
Gemini 3.6 Flash produit environ 17 % de jetons de sortie en moins que 3.5 Flash pour une tâche équivalente.
Cela inclut les jetons de réflexion : un modèle qui atteint la réponse avec moins de raisonnement facturable réduit directement votre coût. Ce n’est pas seulement une métrique de benchmark, c’est une réduction sur votre ligne de facturation de sortie.
Prix de sortie inférieur
Le tarif de sortie passe de 9,00 $ à 7,50 $ par million de jetons, soit une réduction de 17 % du prix unitaire.
Cette baisse s’ajoute à la réduction du volume de jetons générés.
Meilleure utilisation informatique
Sur OSWorld-Verified, benchmark qui évalue le pilotage d’interfaces informatiques réelles :
- Gemini 3.6 Flash : 83,0
- Gemini 3.5 Flash : 78,4
Si vos agents remplissent des formulaires, cliquent dans une interface ou exécutent des outils, ce gain peut réduire le nombre d’étapes en échec.
Moins d’étapes de raisonnement et d’appels d’outils
Dans les workflows multi-étapes, Gemini 3.6 Flash atteint l’objectif avec moins d’étapes de raisonnement et moins d’appels d’outils.
Concrètement, cela réduit :
- les allers-retours vers vos outils ;
- la latence cumulée ;
- les jetons consommés pendant l’exécution ;
- les points de défaillance dans un workflow agentique.
La précision de codage s’améliore également, un point important si le modèle génère des fichiers, modifie du code ou produit des diffs.
Estimer la baisse de coût
Les gains se multiplient : vous payez moins par jeton de sortie et vous achetez moins de jetons de sortie.
Supposons une charge de travail qui génère 10 millions de jetons de sortie par jour avec Gemini 3.5 Flash.
Gemini 3.5 Flash
10M × 9,00 $ / 1M = 90,00 $ par jourGemini 3.6 Flash
8,3M × 7,50 $ / 1M = 62,25 $ par jour
Dans cet exemple, le coût de sortie baisse d’environ 31 %.
Le résultat réel dépend de votre ratio entrée/sortie. Les tâches qui écrivent beaucoup — génération de code, rédaction, longues traces d’agents — bénéficient le plus de la migration. Les charges de travail dominées par l’entrée, comme la classification ou l’extraction, verront une réduction totale plus faible.
Pour analyser les tarifs, la mise en cache et les jetons de réflexion, consultez les tarifs de Gemini 3.6 Flash et la documentation officielle des tarifs Gemini.
Quand rester sur Gemini 3.5 Flash
Restez temporairement sur gemini-3.5-flash uniquement si vous ne pouvez pas revalider votre intégration.
Exemples courants :
- votre suite d’évaluation est liée à une approbation de conformité ;
- un parseur en aval dépend du format ou du phrasé exact de la sortie ;
- vous n’avez pas de fenêtre de régression dans le sprint en cours ;
- vos prompts ont été ajustés autour du comportement précis de 3.5 Flash.
Un nouveau modèle peut modifier subtilement les réponses, même si le format de requête ne change pas. Un tarif inférieur ne justifie pas une régression silencieuse en production.
Gemini 3.5 Flash reste disponible via l’API. Le blocage sur cette version est donc un choix acceptable à court terme, mais planifiez la migration dès que vous pouvez exécuter vos évaluations.
Migrer vers Gemini 3.6 Flash
La modification de code tient en une ligne : remplacez l’ID de modèle.
- gemini-3.5-flash
+ gemini-3.6-flash
Par exemple, dans une requête API :
{
"model": "gemini-3.6-flash",
"contents": [
{
"role": "user",
"parts": [
{
"text": "Résume ce document en trois points."
}
]
}
]
}
Le corps de requête, l’authentification et les endpoints restent identiques. Pour un guide requête par requête, consultez Comment utiliser l’API Gemini 3.6 Flash ainsi que la documentation de l’API Gemini.
Checklist avant le déploiement
Ne déployez pas uniquement après avoir remplacé l’ID du modèle. Validez le changement comme une mise à niveau de dépendance :
- Relancez votre suite d’évaluation avec
gemini-3.6-flash. - Comparez les scores de qualité à votre référence
gemini-3.5-flash. - Exécutez vos tests de régression sur les réponses structurées.
- Vérifiez les clés JSON, les schémas, les expressions régulières et les parseurs en aval.
- Mesurez la latence et la consommation de jetons sur un échantillon de trafic réel.
- Déployez progressivement avec un feature flag ou un routage canari.
Tester la migration avec Apidog
Apidog est utile pour comparer les deux versions avant de modifier votre trafic de production. Il n’exécute pas le modèle : il envoie vos requêtes API et vérifie les réponses.
Voici un workflow simple pour tester gemini-3.5-flash contre gemini-3.6-flash.
Enregistrez votre requête Gemini actuelle
Créez votre requêtePOSTvers l’API Gemini dans Apidog. Stockez la clé API dans une variable d’environnement plutôt que dans le corps de la requête.Dupliquez la requête
Modifiez uniquement l’ID du modèle :
- gemini-3.5-flash
+ gemini-3.6-flash
Gardez le prompt, les paramètres et les entrées identiques.
-
Ajoutez des assertions utiles
Vérifiez au minimum :- le code HTTP ;
- la présence des champs JSON utilisés par votre application ;
- la conformité au schéma attendu ;
- les contraintes métier importantes pour votre cas d’usage.
Comparez les réponses, la latence et les jetons
Exécutez les deux requêtes avec les mêmes entrées. Vérifiez que la réponse Gemini 3.6 Flash satisfait toutes les assertions qui passaient avec Gemini 3.5 Flash.Transformez la comparaison en test de régression
Enregistrez les scénarios et planifiez-les comme tests de régression. Vous détecterez ainsi les changements de comportement liés à une évolution de modèle ou de prompt.
Vous pouvez télécharger Apidog pour exécuter cette comparaison avec vos propres requêtes Gemini.
FAQ
Gemini 3.6 Flash est-il un remplacement direct de 3.5 Flash ?
Oui, mécaniquement. Remplacez gemini-3.5-flash par gemini-3.6-flash et conservez le reste de votre requête. Relancez toutefois vos évaluations et tests de régression, car le phrasé et la structure des sorties peuvent varier.
Le prix d’entrée a-t-il changé ?
Non. Le prix d’entrée reste de 1,50 $ par million de jetons pour les deux modèles. Le prix de sortie passe de 9,00 $ à 7,50 $ par million.
Pourquoi Gemini Flash est-il en version 3.6 alors que Lite et Cyber sont en 3.5 ?
Google a mis à jour le modèle Flash principal vers la version 3.6 lors de cette révision. Flash-Lite et Flash Cyber ont été livrés en versions 3.5. Vérifiez donc toujours l’ID du modèle exact, pas seulement le numéro de famille.
Ma facture baissera-t-elle forcément de 31 % ?
Non. Les 31 % correspondent à un exemple de charge de travail avec beaucoup de sorties. Vos économies dépendent du ratio entre jetons d’entrée et de sortie. Les tâches qui génèrent beaucoup de texte, de code ou de traces d’agents bénéficieront davantage du changement.
Gemini 3.5 Flash est-il toujours utilisable ?
Oui. Le modèle reste disponible via l’API. Si votre version actuelle est validée et que vous ne pouvez pas encore refaire les tests, conservez temporairement gemini-3.5-flash et planifiez la migration pour votre prochaine fenêtre de validation.
Pour la génération précédente, consultez Qu’est-ce que Gemini 3.5 ?.
Pour la plupart des équipes, la marche à suivre est claire : passez à gemini-3.6-flash, exécutez vos évaluations, vérifiez les sorties structurées et déployez progressivement. Gardez Gemini 3.5 Flash uniquement lorsque vos contraintes de validation vous empêchent encore de tester la migration.

Top comments (0)