Moonshot AI a lancé Kimi K3 le 16 juillet 2026. Il s’agit d’un modèle ouvert de classe 3T basé sur un mélange d’experts : 2,8 billions de paramètres et une fenêtre de contexte d’un million de tokens. La question pratique reste simple : peut-on l’utiliser gratuitement ? Oui, via plusieurs options, chacune avec des quotas, des contraintes de débit ou des coûts indirects à connaître.
Essayez Apidog dès aujourd’hui
Ce guide détaille les accès gratuits à Kimi K3, ce que chaque option couvre réellement et comment tester l’API sans gaspiller votre quota. Si vous avez déjà suivi notre guide sur l’utilisation gratuite de Kimi K2.7 Code, le flux vous sera familier : Moonshot a conservé des portes d’accès similaires, même si le modèle a changé.
TL;DR
- Le moyen le plus rapide est le niveau gratuit de l’application Kimi ou de Kimi.com. Connectez-vous, utilisez le chat, Kimi Code ou Kimi Work, puis surveillez les limites affichées dans votre compte.
-
OpenRouter expose
moonshotai/kimi-k3avec une API compatible OpenAI. Vérifiez la page du modèle pour les routes gratuites, promotionnelles ou à faible coût. - L’auto-hébergement ne devient possible qu’après la publication des poids. Moonshot indique une disponibilité d’ici le 27 juillet 2026. Un MoE de 2,8T exige toutefois une infrastructure GPU importante.
- Des crédits d’essai ou promotionnels peuvent être proposés sur l’API Kimi. Vérifiez directement le solde dans la console développeur.
- Dès que vous avez une clé, testez vos requêtes dans Apidog afin de versionner les appels, stocker les secrets dans des variables et éviter les essais manuels dans l’application.
Note : selon le communiqué de lancement de Moonshot, K3 reste derrière Claude Fable 5 et GPT-5.6 Sol sur leur suite d’évaluation. Artificial Analysis lui attribue un indice d’intelligence de 57, soit la quatrième place sur 189 modèles suivis. C’est un résultat solide pour un modèle ouvert, mais pas une garantie qu’il soit le meilleur choix pour toutes vos tâches.
Ce que « gratuit » signifie réellement
Pour un LLM de cette taille, « gratuit » signifie rarement « illimité ». Vous rencontrerez généralement l’un de ces cas :
- Quota ou limite de débit : nombre de messages, de tokens ou de requêtes limité par heure ou par jour.
- Routage subventionné : un agrégateur propose temporairement une route gratuite ou applique un tarif promotionnel.
- Exécution sur votre matériel : pas de facturation par token, mais vous payez les GPU, l’électricité ou le cloud.
- Crédits d’essai : un solde initial utilisable jusqu’à expiration ou épuisement.
Pour du code propriétaire, des secrets ou des données clients, vérifiez également les conditions de traitement des données. Les interfaces grand public peuvent avoir des politiques différentes des API. Pour le contexte technique, consultez notre présentation de ce qu’est Kimi K3.
Méthode 1 : utiliser l’application Kimi ou Kimi.com
C’est le point d’entrée le plus simple pour évaluer K3 sans intégrer d’API.
Étapes
- Installez ou mettez à jour l’application Kimi sur iOS, Android ou HarmonyOS.
- Ou ouvrez kimi.com.
- Connectez-vous avec un compte Kimi.
- Lancez un chat et vérifiez que K3 est sélectionné si l’interface vous propose plusieurs modèles.
- Consultez l’indicateur d’utilisation de votre compte avant de lancer des tâches longues.
Ce que couvre le niveau gratuit
Le niveau gratuit peut inclure :
- Le chat général pour tester les capacités de raisonnement, rédaction ou analyse.
-
Kimi Code, l’outil terminal destiné aux workflows de développement. Utilisez
/modeldans l’outil pour sélectionner le modèle. - Kimi Work, l’application de productivité de bureau, disponible sur Windows et Mac Apple Silicon à partir de la version 3.1.0.
Pour un workflow terminal, la logique est proche de celle présentée dans notre guide Kimi CLI.
Limites à anticiper
Moonshot ne publie pas nécessairement un quota fixe et permanent pour les comptes gratuits. Ne vous basez donc pas sur un nombre de messages trouvé dans un article tiers.
Faites plutôt ceci :
- Ouvrez l’application.
- Vérifiez le quota ou le statut d’utilisation affiché.
- Réservez les requêtes longues, agentiques ou avec beaucoup de contexte pour les tests nécessaires.
- Utilisez une API pour les workflows automatisés et reproductibles.
Cette option convient au chat, au prototypage rapide et au codage léger. Elle est moins adaptée à des tests systématiques ou à une intégration de production.
Méthode 2 : appeler Kimi K3 via OpenRouter
Si vous voulez intégrer K3 dans un outil, un script ou une application, OpenRouter est une option directe. Le modèle est exposé sous le slug :
moonshotai/kimi-k3
L’API est compatible avec le format OpenAI, ce qui simplifie la migration depuis un SDK ou un client existant.
Étapes
- Créez un compte OpenRouter.
- Générez une clé API.
- Vérifiez la page du modèle pour connaître les fournisseurs, les limites et les éventuelles routes gratuites.
- Configurez votre client avec
https://openrouter.ai/api/v1comme URL de base. - Envoyez vos requêtes avec le modèle
moonshotai/kimi-k3.
Appel minimal avec cURL
curl https://openrouter.ai/api/v1/chat/completions \
-H "Authorization: Bearer $OPENROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "moonshotai/kimi-k3",
"messages": [
{
"role": "user",
"content": "Refactor this function for readability."
}
]
}'
Réduire le coût des tests
Même si aucune route gratuite n’est disponible, vous pouvez limiter vos dépenses :
- Testez d’abord avec des prompts courts.
- Réutilisez un préfixe de prompt stable lorsque la mise en cache est disponible.
- Définissez un plafond de dépense dans votre compte.
- Ajoutez une gestion explicite des erreurs
429et des délais d’attente. - Ne considérez pas une route gratuite comme une dépendance de production.
Les routes gratuites ou promotionnelles peuvent être limitées, retirées ou mises en file d’attente sans préavis. Pour une intégration durable, prévoyez une route payante ou l’API de première partie.
Pour les détails sur l’authentification et les requêtes directes, consultez notre guide API Kimi K3.
Méthode 3 : auto-héberger Kimi K3 après la publication des poids
Kimi K3 est annoncé comme un modèle ouvert de classe 3T, mais les poids n’étaient pas téléchargeables au lancement du 16 juillet. Moonshot indique qu’ils seront publiés d’ici le 27 juillet 2026.
L’auto-hébergement est donc une option à préparer, pas une solution disponible immédiatement au lancement.
Où suivre la publication
Surveillez :
- la page Moonshot AI sur Hugging Face ;
- le blog officiel Kimi ;
- les annonces de Moonshot concernant les formats de poids et les recommandations d’inférence.
Évitez de télécharger des fichiers présentés comme des « poids K3 » depuis des sources non officielles avant la publication.
Réalité matérielle
K3 est un MoE de 2,8 billions de paramètres. Même si seuls 16 experts sur 896 sont activés par token, l’infrastructure doit pouvoir héberger l’ensemble des paramètres.
En pratique :
- l’inférence en précision complète nécessite plusieurs GPU haut de gamme ou un cluster ;
- l’exécution locale sur une machine personnelle est irréaliste pour la plupart des développeurs ;
- les versions quantifiées communautaires seront probablement l’option la plus accessible après la sortie officielle ;
- la quantification réduit l’empreinte mémoire, avec un compromis potentiel sur la qualité ou les performances.
Si vous avez déjà exécuté des modèles Kimi localement, notre guide sur l’exécution locale de Kimi K2.5 couvre les principaux outils et compromis.
Quand choisir cette option
L’auto-hébergement est pertinent si vous avez :
- des contraintes strictes de confidentialité ;
- des GPU déjà disponibles ;
- une équipe capable d’opérer l’infrastructure ;
- un volume suffisamment élevé pour justifier le coût fixe.
Il supprime les frais par token, mais remplace ce coût par le matériel, la configuration, le monitoring et l’exploitation.
Méthode 4 : vérifier les crédits d’essai de l’API Kimi
L’API Kimi de première partie est un service payant. Les tarifs de référence indiqués sont :
| Type de token | Tarif |
|---|---|
| Entrée avec succès de cache | 0,30 $ par million de tokens |
| Entrée sans succès de cache | 3,00 $ par million de tokens |
| Sortie | 15,00 $ par million de tokens |
Des crédits d’essai ou des promotions de lancement peuvent toutefois être proposés pour les nouveaux comptes.
Étapes
- Créez un compte dans la console développeur Kimi.
- Générez une clé API.
- Consultez le solde du compte.
- Vérifiez les promotions ou crédits actifs.
- Utilisez les crédits pour mesurer la latence, la qualité et le comportement du point de terminaison de première partie.
Ne basez pas votre budget sur un montant annoncé par un article : le seul solde fiable est celui visible dans votre console au moment de l’inscription.
Les crédits d’essai sont utiles pour une évaluation sérieuse, mais ils expirent ou s’épuisent. Pour estimer un budget après cette phase, lisez notre analyse des prix de Kimi K3.
Comparaison des voies gratuites
| Méthode | Coût réel | Configuration | Stabilité | Idéal pour |
|---|---|---|---|---|
| Application Kimi / Kimi.com | Gratuit, limité par quota | Aucune | Fiable dans les limites du compte | Chat, découverte, codage léger |
OpenRouter moonshotai/kimi-k3
|
Gratuit ou faible coût selon la route | Faible | Les routes gratuites peuvent changer | Prototypage API |
| Auto-hébergement | Pas de coût par token, matériel coûteux | Élevée | Vous contrôlez l’infrastructure | Confidentialité, équipes équipées en GPU |
| Crédits d’essai API Kimi | Gratuit jusqu’à épuisement | Faible | Limité et expirant | Évaluation ponctuelle |
Le compromis est simple : les options les plus faciles atteignent généralement leurs plafonds le plus vite. Les options qui donnent le plus de contrôle demandent davantage de temps, de matériel ou de budget.
Tester une clé Kimi K3 dans Apidog
Une fois votre clé obtenue — via OpenRouter ou l’API Kimi — évitez de faire tous vos essais dans une interface de chat. Un client API vous permet de reproduire les requêtes, comparer les réponses et isoler les paramètres qui consomment votre quota.
Dans Apidog, configurez une requête réutilisable.
Exemple OpenRouter
-
Méthode :
POST -
URL :
https://openrouter.ai/api/v1/chat/completions - En-têtes :
Authorization: Bearer {{OPENROUTER_API_KEY}}
Content-Type: application/json
- Corps JSON :
{
"model": "moonshotai/kimi-k3",
"messages": [
{
"role": "system",
"content": "You are a concise senior developer."
},
{
"role": "user",
"content": "Explain how to add retry handling to this HTTP client."
}
]
}
Bonnes pratiques
- Stockez la clé dans une variable d’environnement, jamais directement dans le corps ou les en-têtes enregistrés.
- Créez une requête par cas d’usage : résumé, génération de code, classification, extraction structurée, etc.
- Enregistrez des exemples de réponse pour comparer les changements de prompts.
- Ajoutez des assertions de test sur le statut HTTP et la structure JSON.
- Exportez la documentation ou partagez la collection avec votre équipe.
Apidog peut ensuite transformer votre requête en documentation et en cas de test réutilisable. La même configuration est disponible via l’extension Apidog pour VS Code.
Téléchargez Apidog pour tester un appel K3 avec des variables, des collections et des assertions.
Conclusion
Kimi K3 propose plusieurs chemins d’accès gratuits ou quasi gratuits :
- utilisez l’application Kimi pour évaluer rapidement le modèle ;
- utilisez OpenRouter pour le prototypage API ;
- vérifiez les crédits de la console Kimi pour tester le point de terminaison de première partie ;
- préparez l’auto-hébergement si le contrôle des données justifie l’infrastructure GPU.
Aucune option n’est à la fois gratuite, illimitée et adaptée à la production. Adaptez donc la voie au besoin : chat ponctuel, prototype, intégration applicative ou déploiement contrôlé.
Utilisez Apidog pour rendre chaque appel reproductible et éviter de dépenser votre quota gratuit sur des essais manuels. Vous pouvez aussi télécharger Apidog pour configurer votre premier appel K3.
FAQ
Kimi K3 est-il gratuit ?
Kimi propose un niveau gratuit via l’application et Kimi.com, avec des limites d’utilisation susceptibles d’évoluer. L’accès API de première partie est payant, mais des crédits d’essai peuvent être disponibles sur les nouveaux comptes.
Puis-je télécharger les poids de Kimi K3 et l’exécuter moi-même immédiatement ?
Non, pas au lancement. Moonshot indique que les poids complets seront publiés d’ici le 27 juillet 2026. Lorsqu’ils seront disponibles, surveillez la page Moonshot sur Hugging Face et le blog officiel Kimi. Prévoyez une infrastructure GPU importante ou attendez des versions quantifiées communautaires.
Combien coûte l’API Kimi K3 après les crédits gratuits ?
Les tarifs indiqués sont de 0,30 $ par million de tokens d’entrée avec succès de cache, 3,00 $ par million pour l’entrée sans succès de cache et 15,00 $ par million de tokens de sortie. La mise en cache des prompts peut réduire le coût effectif.
Comment Kimi K3 se compare-t-il aux meilleurs modèles propriétaires ?
K3 est performant, mais le communiqué de Moonshot le place derrière Claude Fable 5 et GPT-5.6 Sol sur sa suite d’évaluation. Il obtient un indice de 57 sur Artificial Analysis. Testez-le sur vos données et vos tâches réelles avant de choisir un modèle pour la production.
Quelle différence avec l’accès gratuit à Kimi K2.7 ?
Les voies d’accès restent largement similaires. Si vous avez suivi notre guide pour utiliser Kimi K2.7 Code gratuitement, remplacez l’identifiant de modèle par kimi-k3 et anticipez des compromis comparables : quotas, limites de débit et routes API variables.



Top comments (0)