IA & Machine Learning

Claude Fable 5 vs Opus 4.8 : quand une IA plus chère vaut le coup

Fable 5 coûte deux fois plus cher qu'Opus 4.8 à faire tourner. La vraie question pour décider de changer, et celle qui tranche tout.

Editorial Team / /8 min de lecture
Le site Claude d'Anthropic, avec Claude Fable 5 mis en avant comme nouveau modèle haut de gamme

En juin 2026, Anthropic a sorti une nouvelle IA haut de gamme, et la première chose que la plupart des équipes ont remarquée n’était pas un score sur un test. C’était le prix : le nouveau modèle coûte deux fois plus cher à faire tourner que celui qu’elles utilisaient déjà. C’est tout l’enjeu derrière Claude Fable 5 vs Opus 4.8. Pas de savoir quel modèle est le meilleur sur le papier, mais de savoir si le meilleur vaut le coup de payer le double pour le travail que vous faites vraiment.

Une précision avant de commencer. Cet article décrit Fable 5 tel qu’il est arrivé le 9 juin 2026. Trois jours plus tard, une décision américaine sur le contrôle des exportations a forcé Anthropic à le couper dans le monde entier ; ce modèle précis n’est donc plus disponible. On garde quand même la comparaison, parce que la question qu’elle soulève — une IA plus chère et plus douée vaut-elle qu’on bascule ? — revient à chaque nouvelle sortie. L’histoire complète est ici : pourquoi Anthropic a désactivé Fable 5 partout dans le monde.

Deux modèles, l’un deux fois plus cher que l’autre

Anthropic vend ses IA par paliers, du modèle léger et bon marché au modèle lourd et performant. Pendant des mois, le lourd que faisaient tourner la plupart des entreprises, c’était Claude Opus 4.8. Fable 5 se situe un cran au-dessus : c’est la version publique d’une nouvelle famille qu’Anthropic appelle Mythos. Pour la plupart des équipes, il ne s’agit donc pas de choisir entre deux nouveaux modèles, mais de décider s’il faut quitter celui en qui elles ont déjà confiance.

L’écart qui compte, c’est le coût. Une IA se facture au token — un token étant un morceau de texte un peu plus court qu’un mot — et vous payez séparément ce que vous envoyez et ce que le modèle vous renvoie. Opus 4.8 tourne autour de cinq dollars le million de tokens en entrée et vingt-cinq le million en sortie. Fable 5 affiche exactement le double des deux côtés : avant même de comparer quoi que ce soit d’autre, passer au nouveau modèle fait déjà démarrer chaque conversation à un tarif doublé.

Page tarifs d'Anthropic — coût au token pour chaque palier de modèle Claude Page tarifs d’Anthropic — coût au token pour chaque palier de modèle Claude

C’est le cadre que la couverture du lancement passe sous silence. Qu’un modèle récent batte un plus ancien sur un test, c’est attendu. La vraie question, c’est de savoir s’il le bat d’assez pour justifier le prix. Et la réponse dépend presque entièrement du genre de travail que vous lui confiez.

Là où payer le double rapporte vraiment

L’avantage de Fable 5 n’est pas réparti uniformément. Il se concentre sur les tâches longues et difficiles, et devient presque invisible partout ailleurs.

Le cas le plus net, c’est ce que le secteur appelle un agent : quand vous laissez l’IA travailler seule sur une longue durée, en enchaînant les étapes les unes après les autres sans qu’une personne ne vérifie entre chacune. C’est exactement là que les modèles plus faibles dérapent. Une erreur tôt dans une longue séquence corrompt en silence toutes les étapes qui suivent, donc plus la tâche dure, plus les ratés s’accumulent. Le vrai atout de Fable 5, c’est de garder le cap sur ces longues séquences sans surveillance, le moment précis où les anciens modèles perdent le fil.

L’exemple phare mis en avant par Anthropic est une tâche de code : selon l’entreprise, Fable 5 a réécrit une partie d’une base de code de cinquante millions de lignes en une seule journée, un travail qu’une équipe avait estimé à plus de deux mois à la main. Le modèle décroche aussi le meilleur score sur un test de code indépendant, mené par la société Cognition. Prenez les chiffres du fabricant comme une direction plutôt que comme une promesse, le temps que des résultats extérieurs les confirment — mais la direction, elle, ne fait pas vraiment débat : c’est sur les tâches grosses, longues et complexes que le modèle premium gagne son écot.

Pour avoir une idée de la machine qui fait tourner tout ça, notre tour d’horizon du matériel pour l’IA en local en 2026 regarde ce qu’il y a sous le capot.

Là où l’ancien modèle tient encore

Passons à l’autre moitié, celle qui décide la facture pour la plupart des gens. Sur le travail de tous les jours, l’écart entre les deux modèles disparaît presque.

Poser une question simple, résumer un document, extraire quelques champs d’un formulaire, écrire un petit bout de code : dans des comparaisons à l’aveugle, où les relecteurs ignorent quel modèle a produit quelle réponse, la plupart des gens n’arrivent pas à les distinguer de façon fiable. Et Opus 4.8 fait ce travail à moitié prix. Il y a aussi une valeur plus discrète dans le modèle que vous connaissez déjà. Un système que vous faites tourner depuis des mois se comporte de façon prévisible, et une prévisibilité que vous avez mesurée vaut plus qu’un score que vous n’avez pas. Un modèle qui vous surprend en production coûte cher même quand il est plus performant, et surtout quand il coûte deux fois plus.

Donc si l’essentiel de votre travail est ordinaire et à gros volume, basculer revient à payer le double pour améliorer les rares cas difficiles que vous croisez à peine. Vous obtenez là le seul chiffre sur lequel repose toute la décision. La taille de votre gain égale la part de votre travail qui est vraiment difficile. Mesurez cette part avant de bouger, parce que c’est elle qui vous dit si doubler le prix en vaut la peine.

Les coûts qui ne sont pas sur l’étiquette

Le prix affiché sous-estime la hausse réelle, de trois manières qu’il vaut mieux connaître avant de s’engager.

D’abord, la facture grimpe de plus du double. Un modèle qui réfléchit plus longtemps écrit aussi davantage en chemin, et vous payez chaque morceau qu’il écrit. Donc la hausse réelle, c’est le double du tarif multiplié par le surplus de texte que produit cette réflexion plus poussée, pas un simple « fois deux ». Sur une charge bavarde, ce second multiplicateur peut écraser le premier.

Ensuite, basculer est en soi un chantier. Les consignes et réglages que vous aviez affinés pour l’ancien modèle ne se transposent pas proprement, et tout ce sur quoi vous comptez en production doit être retesté avant que le nouveau modèle ne traite du vrai trafic. C’est une vraie tranche de temps d’ingénierie, et elle tombe une fois, en plus du coût de fonctionnement déjà doublé.

Enfin, la vitesse. Un modèle qui réfléchit plus longtemps répond aussi avec un temps de retard. C’est sans gravité pour une tâche qui tourne en arrière-plan, et agaçant dans un chat en direct où quelqu’un attend. C’est précisément pour cette raison qu’Anthropic vend une version plus rapide de l’ancien Opus 4.8 — la même qualité livrée plus vite — pour les équipes où l’attente pèse plus que le surcroît de capacité. Une meilleure réponse qui arrive une seconde trop tard peut perdre face à une réponse correcte qui arrive maintenant.

La bizarrerie à connaître : il passe parfois la main

Voici un comportement que les équipes découvrent plutôt en production qu’à la planification. Fable 5 ne refuse pas les requêtes sensibles ; il les transmet discrètement à l’ancien Opus 4.8, qui répond à sa place. Vous obtenez bien une réponse, mais d’un autre modèle que celui que vous payez.

Ce passage de relais se déclenche sur quelques domaines signalés : le piratage offensif, la biologie et la chimie, et les tentatives de recopier les capacités du modèle dans un autre système. Anthropic indique que ça arrive dans moins de cinq pour cent des sessions et que le filtre est volontairement prudent — il attrapera donc parfois des requêtes inoffensives. Le hic est réel pour une frange précise d’utilisateurs : si votre travail flirte avec ces sujets, comme la recherche en sécurité ou la modération de contenu, vous pouvez payer le tarif premium et recevoir la réponse du modèle moins cher sur les requêtes qui comptent le plus, justement. Si c’est votre cas, testez le taux de passage de relais sur vos propres requêtes avant de basculer.

Comment décider, cas par cas

Choisissez Fable 5 si votre travail principal est long, autonome et complexe, le genre de tâche qui tourne pendant des heures sur de nombreuses étapes ou qui tient une grosse base de code d’un seul tenant. C’est le travail pour lequel le premium est conçu, et là, le prix plus élevé vous rachète les heures que vous passeriez sinon à surveiller et à corriger.

Lequel choisir, en un coup d'œil Lequel choisir, en un coup d’œil

Restez sur Opus 4.8 si votre travail est à gros volume et ordinaire. Chats, classification, résumés, réponses courtes : la qualité est difficile à distinguer, le prix est divisé par deux, et les économies se cumulent sur des millions de requêtes.

Pour la plupart des équipes, la réponse honnête est d’utiliser les deux. Envoyez les tâches longues et difficiles au modèle plus cher, et gardez le flot quotidien sur le moins cher. Vous n’avez pas à choisir un camp ; vous avez à aiguiller le travail.

Questions fréquentes

Claude Fable 5 est-il meilleur qu’Opus 4.8 ?

Sur les tâches longues et difficiles, oui, nettement. Fable 5 garde le cap sur les longues séquences sans surveillance et les gros travaux de code, là où l’ancien modèle perd le fil, et il domine un test de code indépendant. Sur les questions simples et les tâches courtes du quotidien, l’écart est assez petit pour que les relecteurs peinent à distinguer les réponses, et Opus 4.8 coûte deux fois moins cher. Donc « meilleur » dépend entièrement du genre de travail qui compose l’essentiel du vôtre.

Faut-il passer d’Opus 4.8 à Fable 5 ?

Commencez par mesurer quelle part de votre travail est vraiment difficile, parce que Fable 5 coûte exactement deux fois plus cher au token. Si les longues tâches autonomes et les gros travaux de code sont au cœur de votre produit, le changement se rentabilise en temps gagné. Si l’essentiel de votre travail est ordinaire et à gros volume, le prix doublé plus le coût ponctuel de la bascule se rentabilisent rarement. Dans tous les cas, testez le modèle sur une tranche de votre vrai travail avant de tout engager.

Pourquoi Fable 5 est-il plus cher qu’Opus 4.8 ?

Sur deux fronts. Son prix affiché est le double de celui d’Opus 4.8, autant sur ce que vous envoyez que sur ce qu’il renvoie. Et comme il réfléchit plus longtemps, il écrit aussi davantage par tâche, et vous payez chaque morceau. Votre hausse réelle dépasse donc le simple « fois deux ». Modélisez-la sur votre propre trafic plutôt que sur le tarif d’affiche.

Fable 5 refuse-t-il plus de requêtes qu’Opus 4.8 ?

Il ne refuse pas franchement ; il passe la main. Quand une requête touche un domaine signalé — piratage offensif, biologie et chimie, ou copie des capacités du modèle —, Fable 5 la renvoie discrètement à Opus 4.8, qui répond à sa place. Anthropic indique que ça arrive dans moins de cinq pour cent des sessions. Si votre travail flirte avec ces sujets, vous pouvez finir par payer le tarif premium pour la réponse du modèle moins cher ; testez donc le taux de passage de relais sur vos propres requêtes d’abord.

Peut-on faire tourner Fable 5 et Opus 4.8 côte à côte ?

Oui, et pour la plupart des équipes c’est la bonne réponse, plutôt qu’une bascule nette. Aiguillez les tâches longues et complexes vers le modèle plus cher, et gardez le travail quotidien à gros volume sur le moins cher. Laissez les résultats de chaque voie vous dire quand, et s’il faut, déplacer plus de travail. Les équipes qui font leur propre personnalisation devraient lire notre guide pratique du fine-tuning avant de décider si un changement de modèle ou un réglage plus léger est le chemin le moins cher vers la qualité dont elles ont besoin.

En résumé

Le choix entre Fable 5 et Opus 4.8 n’est pas une montée en gamme qu’on adopte par principe. C’est un pari sur votre propre charge de travail, face à un modèle qui coûte deux fois plus cher à faire tourner. Le modèle premium gagne les tâches longues et difficiles d’assez pour se payer lui-même quand ces tâches sont au cœur de votre produit. L’ancien tient le travail de tous les jours à moitié prix, et il répond même aux requêtes sensibles que le nouveau lui renvoie. Mesurez quelle part de votre travail est vraiment difficile, essayez le nouveau modèle sur une tranche de vrai trafic, et décidez sur vos propres chiffres. Le modèle précis qui a fait naître la question a déjà disparu. La question lui survit, et la réponse aussi : une IA plus puissante vaut le coût uniquement là où vous avez vraiment besoin de la puissance.

#claude#anthropic#llm