Kimi K3 face à Claude Fable 5 pour le code : ce que montre un vrai test
Kimi K3 coûte une fraction du prix de Claude Fable 5 et le bat sur certains benchmarks de code. Un test en direct montre où cet écart de prix se joue vraiment.

Claude Fable 5 coûte plus de trois fois le prix de Kimi K3 pour le même million de tokens, et sur au moins un classement de code indépendant, c’est le modèle le moins cher qui arrive actuellement en tête. Ça ne veut pas dire que Kimi K3 est simplement meilleur. Ça veut dire que les deux modèles méritent d’être comparés sur la même tâche, avant de supposer que le plus cher gagne par défaut.
Kimi K3, lancé le 16 juillet 2026 par le laboratoire chinois Moonshot AI, et Claude Fable 5, le modèle phare d’Anthropic, incarnent deux logiques opposées de construction et de vente d’un modèle d’IA. L’un publie sa taille et laisse les développeurs finir par le télécharger. L’autre garde ses entrailles privées et ne vend que l’accès. Ce que chaque choix vous coûte, en argent et en résultat obtenu, est la vraie question à trancher.
Ce qu’est réellement chaque modèle
Kimi K3 est un modèle mixture-of-experts de 2 800 milliards de paramètres, les valeurs internes qu’un modèle apprend pendant son entraînement, mais seuls 16 de ses 896 composants spécialisés s’activent pour chaque mot qu’il génère, ce qui permet à un modèle de cette taille de rester assez rapide pour être utilisable. Il tient un million de tokens de contexte, lit les images nativement, et ses poids complets, les paramètres entraînés que d’autres développeurs pourront télécharger et faire tourner eux-mêmes, doivent être publiés d’ici le 27 juillet 2026, ce qui en fait un modèle open-weight et non open source, une distinction qui compte plus que le nombre de paramètres. En attendant, il est accessible via l’application de chat de Moonshot, son outil de code Kimi Code, et une API payante.
Source : kimi.com/blog/kimi-k3
Claude Fable 5 garde ses poids fermés. Anthropic n’a jamais publié de nombre de paramètres pour ce modèle, donc tout chiffre précis qui circule en ligne est une supposition, pas un fait. Il égale la fenêtre de contexte d’un million de tokens de Kimi K3 mais plafonne une réponse unique à 128 000 tokens, et son raisonnement, le travail étape par étape que le modèle effectue avant de répondre, tourne sur chaque requête et ne peut pas être désactivé. Kimi K3 a actuellement la même limite dans l’autre sens : au lancement, il ne proposait que son réglage de raisonnement le plus poussé, et des modes plus rapides et moins chers ne commencent à arriver que progressivement, de façon inégale selon les outils.
L’écart de prix, en chiffres réels
Le tarif officiel de l’API Kimi K3 chez Moonshot est de 0,30 dollar par million de tokens pour une requête mise en cache, celle que le modèle a déjà traitée et peut réutiliser pour répondre, 3 dollars par million pour une nouvelle requête, et 15 dollars par million de tokens générés. Anthropic facture 10 dollars par million de tokens en entrée et 50 dollars par million de tokens en sortie pour Claude Fable 5. Sur les tokens générés, la partie qui coûte généralement le plus cher sur une vraie tâche de code, Fable 5 tourne à plus de trois fois le prix de Kimi K3.
Source : docs.claude.com
Moonshot vend aussi Kimi Code, son propre outil de code, sur un forfait mensuel qui démarre autour de 19 dollars, une alternative à la facturation au token pour qui préfère budgéter un montant fixe plutôt que de surveiller un compteur qui tourne. Sur une session de construction longue et complexe menée sur ce forfait d’entrée, le suivi d’usage montrait environ 15 % de la fenêtre de contexte disponible utilisée, 12 % d’une limite d’usage glissante de cinq heures, et 2 % du plafond hebdomadaire, pour une session qui a pris plus d’une heure à se terminer. C’est une marge confortable avant que le forfait fixe commence à devenir juste, même si des limites de ce genre sont fixées par l’éditeur et peuvent changer sans grand préavis, donc à vérifier dans les conditions actuelles avant d’y adosser tout un flux de travail.
Un test de construction en direct
Un test publié peu après le lancement de Kimi K3 a soumis Fable 5, Kimi K3 et un troisième modèle chinois en accès ouvert, GLM 5.2, exactement au même prompt : une page web autonome simulant l’activité quotidienne d’une centrale à béton, camions, gâchage, livraisons, avec un onglet de vérification obligatoire où le modèle devait faire tourner ses propres assertions pour prouver que la simulation fonctionnait vraiment, pas seulement qu’elle avait l’air terminée.
Les trois modèles ont produit un résultat fonctionnel. La version de GLM 5.2 avait besoin d’un rechargement de page avant que son animation ne démarre. Celle de Fable 5 était la plus aboutie visuellement des trois, avec toutes les vérifications passées au vert. Celle de Kimi K3 est allée plus loin, avec une visualisation en direct plus riche et un onglet d’auto-vérification plus détaillé que les deux autres, avec même une logique que le prompt ne demandait pas explicitement. Rien de tout ça ne tranche définitivement lequel est le meilleur en général. Ça montre que sur une tâche de construction exigeante et réaliste, le modèle bien moins cher a tenu la comparaison face au modèle bien plus cher, pas seulement en prenant un raccourci.
Ce résultat rejoint un signal indépendant plus large : sur un classement spécifique au code où des internautes jugent deux réponses d’IA anonymes l’une contre l’autre sans savoir quel modèle a écrit laquelle, Kimi K3 se classe actuellement premier, devant Fable 5, un bond de 17 places par rapport au modèle précédent de Moonshot en quelques mois.
Là où Kimi K3 reste en retrait
Les propres notes de lancement de Moonshot sont étonnamment franches sur l’endroit où l’écart persiste : sur les benchmarks de raisonnement plus profond, Fable 5 et GPT 5.6 Sol d’OpenAI restent tous les deux devant Kimi K3. Un modèle qui remporte un duel de code n’est pas automatiquement le meilleur choix pour une tâche qui repose sur un raisonnement long et prudent plutôt que sur la production rapide de code.
Il y a un second piège, plus technique. Parce que Kimi K3 reste réglé par défaut sur son effort de raisonnement maximal dans la plupart de ses outils, et parce que Moonshot l’a entraîné en s’attendant à ce que tout son historique de raisonnement interne soit renvoyé à chaque étape, le modèle peut se comporter de façon imprévisible dans un outil de code qui ne préserve pas correctement cet historique. Le raisonnement de Fable 5 tourne toujours, par conception, ce qui est un compromis différent : prévisible mais jamais optionnel, et facturé en conséquence.
Il y a aussi un coût plus terre à terre : Kimi K3 a tendance à répondre plus lentement que Fable 5 à l’usage, et son habitude de revérifier son propre travail peut encore allonger ça. Sur au moins une construction exigeante, cette boucle de vérification a tourné assez longtemps pour que la tâche ne se termine jamais vraiment. Une lenteur de ce genre mérite d’être chronométrée sur votre propre flux de travail, pas supposée à partir du seul prix affiché.
Lequel choisir
Pour une équipe qui construit des outils de code ou des flux d’agents où le coût grimpe avec l’usage, un prototype qui bouge vite, un agent de code qui enchaîne des centaines de requêtes par jour, une startup qui surveille sa facture d’API, Kimi K3 mérite d’être testé en premier. Il remporte plusieurs benchmarks de code sans partage, se classe devant Fable 5 sur un classement de code indépendant, et coûte une fraction du prix au token, si bien que le même budget achète plusieurs fois plus d’usage, à condition que le temps de réponse ne soit pas le facteur limitant.
Pour un travail qui repose sur un raisonnement long et multi-étapes plutôt que sur la production rapide de code, un gros refactor sur une base de code peu familière, une tâche où une mauvaise réponse coûte cher à rattraper plus tard, Fable 5 reste le choix le plus sûr, à un prix qui le reflète. Le même raisonnement s’applique si l’outil qui fait tourner le modèle ne prend pas encore correctement en charge l’historique de raisonnement complet que Kimi K3 attend actuellement : une réponse imprévisible d’un modèle moins cher n’est pas vraiment moins chère une fois qu’il faut la rattraper et la corriger.
Aucun des deux modèles n’est la réponse universelle. Le verdict honnête, c’est que le prix achète désormais un modèle de code réellement compétitif, pas un modèle au rabais, ce qui n’était pas fiable il y a un an encore, et ça seul mérite d’être testé sur votre propre charge de travail avant de renouveler un abonnement par habitude.
FAQ
Kimi K3 est-il moins cher que Claude Fable 5 ? Oui, nettement. Le tarif officiel de Moonshot est de 15 dollars par million de tokens en sortie contre 50 dollars pour Fable 5 chez Anthropic, et l’écart est encore plus marqué en entrée une fois les requêtes en cache prises en compte.
Kimi K3 bat-il Claude Fable 5 sur le code ? Sur plusieurs benchmarks publiés et sur un classement de code indépendant jugé par des humains, oui. Sur les tâches de raisonnement plus profond, les propres chiffres de Moonshot placent Fable 5 devant. Le vainqueur dépend de ce que la tâche demande vraiment.
Peut-on utiliser Kimi K3 sans payer au token ? Oui. Moonshot vend son outil Kimi Code sur un forfait mensuel qui démarre autour de 19 dollars, séparé du tarif à l’usage utilisé pour les intégrations directes.
Le raisonnement toujours actif de Claude Fable 5 est-il un désavantage ? C’est un compromis, pas un défaut. Le raisonnement de Fable 5 tourne en permanence, ce qui coûte plus cher par requête mais garde son comportement prévisible. Kimi K3 a actuellement la même limite dans l’autre sens : il ne proposait au lancement que son mode le plus poussé, et des options moins chères ne commencent à arriver que progressivement selon les outils.
Faut-il basculer tout son flux de travail de Claude vers Kimi K3 ? Pas sur le seul critère du prix. Testez les deux sur votre vraie charge de travail d’abord, en particulier tout ce qui repose sur de longues chaînes de raisonnement plutôt que sur la production rapide de code, puisque c’est justement là que les propres benchmarks de Moonshot avantagent encore Fable 5.
Kimi K3 ne remplace pas Claude Fable 5 purement et simplement, et les propres chiffres de Moonshot le disent. Ce qu’il fait, c’est retirer l’idée toute faite que le modèle le plus cher gagne automatiquement une tâche de code. Cette idée était raisonnable il y a un an. La tester sur votre propre charge de travail, plutôt que sur un classement, est la seule façon de savoir si elle tient encore.
Photo : cottonbro studio / Pexels