DEV Community

Cover image for GPT-6.1 est-il sans Sol ?
Antoine Laurent
Antoine Laurent

Posted on Originally published at apidog.com

GPT-6.1 est-il sans Sol ?

Non, GPT-6.1 Sol n’est pas gratuit. OpenAI l’a lancé le 29 septembre 2026 pour les utilisateurs Plus, Pro, Business, Enterprise et Edu dans ChatGPT Work et Codex. Il n’est pas encore disponible dans Chat, les plans Gratuit et Go ne l’incluent pas, et le modèle API gpt-6.1-sol ne propose pas de niveau gratuit. La tarification API Standard est de 2 $ par million de tokens d’entrée, 0,10 $ par million de tokens d’entrée mis en cache et 10 $ par million de tokens de sortie.

Essayez Apidog dès aujourd’hui

Le point positif : les itinéraires économiques sont encore moins chers. GPT-6.1 Sol conserve les tarifs affichés de GPT-6 Sol (2 $/10 $) tout en divisant par deux le prix des entrées mises en cache. Ce guide vous aide à choisir l’itinéraire adapté, à estimer le coût réel de vos appels et à tester votre consommation de tokens. Pour le modèle lui-même, consultez ce qu’est GPT-6.1 Sol ; pour son prédécesseur, voir GPT-6 Sol est-il gratuit. Avant de choisir, mesurez vos requêtes réelles dans Apidog.

Chaque itinéraire vers GPT-6.1 Sol, comparé

Itinéraire Coût Ce que vous obtenez Limite principale
Alternative gratuite : GPT-6 Luna dans l’application de bureau ChatGPT 0 $ avec le plan Gratuit Luna, pas Sol, dans Work et Codex Modèle différent ; pas dans Chat ; pas de clé API
ChatGPT Plus dans Codex ou ChatGPT Work Abonnement Plus GPT-6.1 Sol pour les tâches de code et de travail Limites d’utilisation ; pas dans Chat ; pas de clé API
Connexion avec ChatGPT dans des applications partenaires Utilisation de votre plan Plus ou Pro Votre plan dans Devin, Notion, Vercel, T3, OpenClaw, Dactyl, etc. Plus/Pro uniquement ; limite hebdomadaire par application
API Batch ou Flex 1 $ entrée, 0,05 $ cache, 5 $ sortie La moitié du tarif Standard Batch est asynchrone ; Flex est plus lent et peut renvoyer des 429
API Standard avec cache 2 $ entrée, 0,10 $ cache, 10 $ sortie Le modèle depuis votre propre code Chaque token est facturé ; le cache exige un préfixe stable
OpenRouter openai/gpt-6.1-sol 2 $ entrée, 0,10 $ cache, 10 $ sortie Une clé pour plusieurs fournisseurs Même tarif affiché ; non gratuit

Tous les prix API sont exprimés par million de tokens, pour les requêtes allant jusqu’à 272K tokens d’entrée. Référez-vous à la page de tarification OpenAI et à la page du modèle OpenRouter.

ChatGPT Plus : le point d’entrée pour un usage interactif

Pour utiliser GPT-6.1 Sol vous-même dans Codex ou ChatGPT Work, Plus est le plan minimal.

Le billet de lancement OpenAI indique que le modèle est disponible pour les utilisateurs Plus, Pro, Business, Enterprise et Edu dans ChatGPT Work et Codex, mais qu’il « n’est pas encore disponible dans Chat ».

Selon la documentation des modèles OpenAI, GPT-6.1 Sol reste désactivé pour Enterprise et Edu jusqu’à son activation par un administrateur.

Vous ne payez pas par token dans ChatGPT, mais vous restez soumis aux limites de votre plan. Consultez notre guide sur les limites d’utilisation de Codex pour les comprendre. Le guide gratuit de Codex couvre les options sans coût, mais GPT-6.1 Sol commence au plan Plus.

Connexion avec ChatGPT : utiliser votre plan dans d’autres applications

DevDay a ajouté la connexion avec ChatGPT. La partie identité, basée sur OAuth/OIDC, est disponible mondialement. Les abonnés Plus et Pro peuvent également utiliser leur plan dans des outils partenaires.

OpenAI a lancé cette fonctionnalité avec 16 partenaires. Son récapitulatif DevDay cite notamment Devin de Cognition, Notion, Vercel, T3, OpenClaw et Dactyl.

Selon l’article d’aide OpenAI sur l’utilisation du plan dans d’autres applications :

  • Les requêtes éligibles sont décomptées de votre utilisation ChatGPT Work et Codex.
  • Chaque application reçoit une limite hebdomadaire calculée comme un pourcentage de votre utilisation hebdomadaire globale.
  • Cette limite est un plafond, pas un quota réservé.
  • Le paiement par crédits après atteinte de la limite est facultatif et désactivé par défaut.
  • Les crédits ne s’appliquent qu’après utilisation à 100 % de la limite de l’application.
  • L’application reçoit votre nom, votre adresse e-mail et votre photo de profil, mais pas vos conversations, vos souvenirs ou votre clé API.

Vérifiez toujours quel modèle est réellement utilisé par l’application avant de supposer qu’il s’agit de GPT-6.1 Sol. Pour OpenClaw, voir OpenClaw est-il gratuit. Pour implémenter OAuth côté développeur, consultez le guide Se connecter avec ChatGPT.

Un plan ChatGPT n’est pas une clé API

C’est le point qui crée le plus de confusion dans les recherches sur un « GPT gratuit ».

Un abonnement Plus ou Pro donne accès à GPT-6.1 Sol dans ChatGPT Work et Codex. Il ne fournit pas une clé API gratuite.

Tout script, job CI ou agent qui appelle l’API avec :

Authorization: Bearer $OPENAI_API_KEY
Enter fullscreen mode Exit fullscreen mode

vers :

https://api.openai.com/v1
Enter fullscreen mode Exit fullscreen mode

est facturé par token, quel que soit votre abonnement ChatGPT.

La seule manière pour du code d’utiliser un plan ChatGPT est d’intégrer le flux OAuth de connexion avec ChatGPT. La documentation OpenAI sur l’utilisation du plan l’ouvre aux applications open source et hébergées localement, avec des limites de prévisualisation :

  • streaming uniquement ;
  • store: false obligatoire ;
  • pas de paramètre temperature ;
  • pas d’outils hébergés, comme la recherche de fichiers.

Ces requêtes comptent toujours dans votre utilisation Plus ou Pro et dans la limite attribuée à l’application.

L’itinéraire API le moins cher : Batch, Flex et cache

Pour réduire votre coût par token, combinez ces trois leviers.

1. Utiliser Batch pour les traitements différés

Batch exécute les tâches de manière asynchrone à la moitié du tarif Standard :

  • 1 $ par million de tokens d’entrée ;
  • 0,05 $ par million de tokens d’entrée mis en cache ;
  • 5 $ par million de tokens de sortie.

Utilisez Batch pour les migrations, classifications massives, enrichissements de données ou évaluations qui n’exigent pas une réponse immédiate. Le guide API Batch présente un job complet.

2. Utiliser Flex pour réduire le coût des requêtes ordinaires

Avec :

{
  "service_tier": "flex"
}
Enter fullscreen mode Exit fullscreen mode

Flex applique les tarifs Batch aux requêtes ordinaires.

Attention : le guide de traitement Flex indique que les réponses peuvent être plus lentes et que des erreurs 429 Resource Unavailable peuvent survenir. Ces erreurs ne sont pas facturées.

3. Stabiliser le préfixe pour exploiter le cache

La mise en cache des requêtes est activée par défaut.

Pour GPT-6.1 Sol :

  • entrée standard : 2 $ / million ;
  • entrée mise en cache : 0,10 $ / million ;
  • écriture dans le cache : 2,50 $ / million.

L’entrée mise en cache coûte 95 % de moins que l’entrée standard et deux fois moins que le cache de GPT-6 Sol, facturé 0,20 $ / million.

Le guide OpenAI sur le cache d’invite précise :

  • un minimum de 1 024 tokens est requis ;
  • les écritures de cache sont facturées à 1,25× le tarif d’entrée non mis en cache ;
  • un préfixe réutilisable est conservé pendant 30 minutes après sa dernière écriture ou réutilisation.

Gardez vos requêtes sous 272K tokens d’entrée. Au-delà, la page du modèle GPT-6.1 Sol indique que la requête entière est facturée à :

  • 2× les tarifs d’entrée et de cache ;
  • 1,5× le tarif de sortie.

Exemple détaillé : coût d’un appel d’agent

Supposons un agent avec :

  • un préfixe stable de 100 000 tokens : invite système, schémas d’outils et contexte de dépôt ;
  • 8 000 nouveaux tokens d’entrée ;
  • 2 000 tokens de sortie, raisonnement inclus ;
  • un préfixe déjà présent dans le cache.

Les nouveaux tokens restent facturés comme une entrée ordinaire.

Calcul en Standard avec accès au cache

  • Entrée mise en cache : 100 000 × 0,10 $ / 1 000 000 = 0,0100 $
  • Nouvelle entrée : 8 000 × 2,00 $ / 1 000 000 = 0,0160 $
  • Sortie : 2 000 × 10,00 $ / 1 000 000 = 0,0200 $

Total : 0,0460 $ par appel

Sur Batch ou Flex, tous les tarifs sont divisés par deux :

0,0050 $ + 0,0080 $ + 0,0100 $ = 0,0230 $
Enter fullscreen mode Exit fullscreen mode

Sur GPT-6 Sol, la ligne mise en cache passe à 0,0200 $, donc l’appel coûte 0,0560 $.

Sans accès au cache sur GPT-6.1 Sol, les 108 000 tokens d’entrée sont facturés au tarif standard :

108 000 × 2,00 $ / 1 000 000 + 2 000 × 10,00 $ / 1 000 000
= 0,2360 $
Enter fullscreen mode Exit fullscreen mode
Scénario Par appel 1 000 appels
GPT-6.1 Sol Standard, accès cache 0,046 $ 46 $
GPT-6.1 Sol Batch ou Flex, accès cache 0,023 $ 23 $
GPT-6 Sol Standard, accès cache 0,056 $ 56 $
GPT-6.1 Sol Standard, sans accès cache 0,236 $ 236 $

Le premier appel écrit le préfixe dans le cache :

100 000 × 2,50 $ / 1 000 000 = 0,25 $
Enter fullscreen mode Exit fullscreen mode

Après cette première écriture :

  • l’accès au cache réduit fortement la facture ;
  • Batch ou Flex divisent le coût par deux ;
  • passer de GPT-6 Sol à GPT-6.1 Sol économise 0,01 $ par appel dans cet exemple, car seule la ligne du cache change.

Pour approfondir, consultez la mise en cache des requêtes GPT-6.

Ce qui n’est pas gratuit

  • ChatGPT Gratuit et Go : pas de GPT-6.1 Sol.
  • ChatGPT Chat : GPT-6.1 Sol n’y est pas encore disponible, quel que soit le plan.
  • API : aucun niveau gratuit.
  • Connexion avec ChatGPT sur un compte Gratuit : l’utilisation du plan est réservée aux abonnements Plus et Pro.
  • OpenRouter : même prix affiché, sans réduction.
  • Ultrafast : GPT-6.1 Sol est annoncé comme « bientôt disponible » ; sur GPT-6 Astra, le tarif est 6× supérieur au Standard.

L’alternative gratuite : GPT-6 Luna

Si vous cherchez une option sans coût, GPT-6 Luna est disponible avec le plan Gratuit dans ChatGPT Work et Codex, via l’application de bureau ChatGPT. Le plan Go, qui est payant, l’inclut également.

À retenir :

  • Luna n’est pas Sol ;
  • Luna n’est pas disponible dans Chat ;
  • un siège de plan ne fournit pas de clé API ;
  • Luna ne peut donc pas alimenter directement votre script ou agent API.

Le guide gratuit GPT-6 Luna couvre la configuration.

Dans l’API, Luna est listé à :

  • 0,10 $ / million de tokens d’entrée ;
  • 0,50 $ / million de tokens de sortie.

Cela représente un vingtième des tarifs d’entrée et de sortie de GPT-6.1 Sol, ce qui en fait une option adaptée à la classification et à l’extraction à grand volume.

Mesurez l’utilisation réelle des tokens dans Apidog avant de choisir

Les calculs précédents utilisent des volumes fictifs. Pour choisir entre Standard, Flex, Batch ou Luna, mesurez votre trafic réel dans Apidog.

  1. Créez un environnement avec OPENAI_API_KEY et MODEL_ID.
  2. Définissez MODEL_ID sur gpt-6.1-sol.
  3. Enregistrez une requête POST vers :
   https://api.openai.com/v1/responses
Enter fullscreen mode Exit fullscreen mode
  1. Ajoutez l’en-tête :
   Authorization: Bearer {{OPENAI_API_KEY}}
Enter fullscreen mode Exit fullscreen mode
  1. Utilisez un corps similaire à celui-ci :
   {
     "model": "{{MODEL_ID}}",
     "reasoning": {
       "effort": "low"
     },
     "input": "Votre invite réelle de production"
   }
Enter fullscreen mode Exit fullscreen mode
  1. Envoyez la requête deux fois.
  2. Vérifiez que $.usage.input_tokens_details.cached_tokens est supérieur à 0 lors de la seconde exécution.
  3. Comparez usage.output_tokens et usage.output_tokens_details.reasoning_tokens entre low et medium.

Le guide OpenAI sur le raisonnement précise que les tokens de raisonnement sont facturés comme des tokens de sortie.

Ajoutez ensuite ce script post-réponse pour calculer le prix Standard de chaque appel :

const u = pm.response.json().usage;
const d = u.input_tokens_details || {};
const cached = d.cached_tokens || 0;
const written = d.cache_write_tokens || 0;
const fresh = u.input_tokens - cached - written;

const usd =
  (fresh * 2 + cached * 0.1 + written * 2.5 + u.output_tokens * 10) / 1e6;

console.log(`gpt-6.1-sol Standard: $${usd.toFixed(4)} per call`);
Enter fullscreen mode Exit fullscreen mode

Multipliez ensuite ce résultat par votre volume quotidien. Pour Batch ou Flex, divisez le coût par deux.

Enregistrez la requête dans un scénario de test : l’interface de ligne de commande Apidog peut la réexécuter dans votre CI. Une modification d’invite qui réduit le taux d’accès au cache devient alors visible avant la réception de votre facture.

FAQ

GPT-6.1 Sol est-il gratuit dans ChatGPT ?

Non. Il est disponible dans ChatGPT Work et Codex pour les plans Plus, Pro, Business, Enterprise et Edu. Il n’est pas encore disponible dans Chat et n’est pas inclus dans les plans Gratuit ou Go.

Puis-je utiliser mon plan ChatGPT Plus pour appeler l’API GPT-6.1 Sol ?

Pas avec une clé API. Un abonnement ChatGPT n’est pas une clé API, et chaque appel utilisant une clé est facturé par token. La connexion avec ChatGPT permet aux applications intégrant OAuth de compter les requêtes éligibles sur l’utilisation Plus ou Pro, dans les limites de la prévisualisation.

Existe-t-il une API GPT-6.1 Sol gratuite ?

Non. L’option officielle la moins chère est Batch ou Flex : 1 $ d’entrée, 0,05 $ d’entrée mise en cache et 5 $ de sortie par million de tokens.

GPT-6.1 Sol est-il gratuit sur OpenRouter ?

Non. OpenRouter liste openai/gpt-6.1-sol à 2 $/10 $ sur son point de terminaison OpenAI, soit le même tarif affiché qu’OpenAI.

GPT-6.1 Sol est-il moins cher que GPT-6 Sol ?

Les tarifs affichés sont identiques : 2 $ d’entrée et 10 $ de sortie. L’entrée mise en cache est toutefois deux fois moins chère : 0,10 $ contre 0,20 $. Les charges de travail avec un fort taux d’accès au cache coûtent donc moins cher.

Étape suivante

Choisissez l’itinéraire à partir de vos propres métriques.

Téléchargez Apidog, enregistrez une requête réelle, exécutez-la deux fois et inspectez usage.

  • Besoin de GPT-6.1 Sol en mode interactif : utilisez Plus dans Codex.
  • Besoin de GPT-6.1 Sol depuis votre code : utilisez l’API avec un préfixe stable pour profiter du cache.
  • Tâches non urgentes : basculez-les vers Batch ou Flex.

Le guide de l’API GPT-6.1 Sol couvre la première requête et la migration depuis gpt-6-sol.

Top comments (0)