Anthropic a renouvelé deux modèles en quelques semaines. Claude Opus 5 a remplacé Opus 4.8 au même prix et Claude Fable 5.1 reste le modèle haut de gamme, tout en devenant plus économe à l’usage. Sur ChatX, Fable coûte désormais environ deux fois et demie le prix d’Opus. Cet article remet les chiffres en ordre et résume les retours des utilisateurs après les premières semaines. À la fin, tu sauras quand chaque modèle vaut le coup.
Opus 5, plus performant au même prix
Claude Opus 5 coûte le même prix qu’Opus 4.8 et le dépasse nettement dans les tests d’Anthropic. Sur Frontier-Bench, un test de programmation exigeante, Opus 5 double le résultat de son prédécesseur pour un coût plus faible par tâche résolue. Sur ARC-AGI 3, un test de résolution abstraite, il atteint le triple du deuxième meilleur modèle. Dans les tests à nombreuses étapes intermédiaires, il bat aussi l’ancien Fable 5 avec environ un tiers de l’effort.
Au quotidien, cela veut dire :
- Chasse aux bugs dans du gros code : Opus 5 vérifie et reprend ses propres étapes au lieu de deviner après le premier échec. Des tâches sur lesquelles Opus 4.8 abandonnait vont maintenant au bout.
- Analyses longues : sur de nombreux tours, le modèle garde le cap et ne perd pas de vue la question de départ.
- Rapport qualité-prix : pour la plupart des tâches exigeantes, Opus est sur ChatX le modèle au meilleur rapport entre résultat et tokens, devant Sol et devant Fable.
Fable 5.1 coûte plus cher, mais sert rarement
Claude Fable 5.1 est sorti trois mois après Fable 5. Le prix de base reste identique, mais relire une entrée déjà traitée coûte 75 pour cent de moins. Sur les longues conversations, où le même contexte est relu en permanence, cela réduit sensiblement la facture.
Les performances montent aussi. Sur Terminal-Bench-Science, un test de tâches scientifiques à nombreuses étapes, le résultat double, de 24,7 à 52,6 pour cent. Sur le test de programmation Terminal-Bench 4.0, il passe de 42,0 à 55,8 pour cent. Anthropic cite l’exemple d’un plantage rare dont ni les développeurs ni d’autres modèles n’avaient trouvé la cause en plusieurs années. Fable 5.1 l’a trouvée. La variante Mythos 5.1, aux garde-fous assouplis, n’est accessible qu’à des organisations américaines vérifiées.
Sur ChatX, Fable 5.1 est disponible pour les utilisateurs inscrits et fait désormais partie de l’abonnement. Contrairement à Opus, il fonctionne sans recherche web.
Ce que disent les utilisateurs après les premières semaines
Les retours sur Opus 5 sont partagés, même si les testeurs le classent presque unanimement parmi les meilleurs modèles disponibles. On salue sa force sur des tâches bien délimitées. On critique le ton, long, prudent et parfois trop enclin à poser des questions, ainsi que l’attente plus longue avant la première réponse en profondeur élevée. Certains développeurs trouvent Opus 5 moins agréable qu’Opus 4.8 dans l’échange, même quand les résultats sont meilleurs.
Cela rejoint ce que nous observons sur ChatX. Sur des questions courtes en profondeur élevée, la première réponse met plusieurs secondes sans être meilleure pour autant. Sur des tâches de travail bien cadrées, l’écart avec Opus 4.8 saute aux yeux.
Bien régler la profondeur de la pensée
Sur ChatX, le réglage s’appelle « Profondeur de la pensée » avec les niveaux Désactivé, Basse, Moyenne et Haute. Mise à jour du 24 septembre 2026 : Opus 5 a depuis été remplacé par Claude Opus 5.5. Sur ce modèle, la réflexion ne peut plus être coupée du tout. Restent Basse, Moyenne et Haute, avec Basse comme point de départ. Fable 5.1 n’a pas non plus de « Désactivé ».
- Conversation, textes, questions : prends le niveau le plus bas disponible. Plus rapide et moins cher. Le ton devient plus direct.
- Code et analyses : Opus en « Basse » ou « Moyenne ». « Haute » seulement si la tâche admet plusieurs solutions.
- Quand Opus bloque : refais la même tâche avec Fable 5.1 en « Moyenne ». C’est le cas où le prix nettement plus élevé se justifie. Comme modèle par défaut, Fable est surdimensionné.
- Textes du quotidien : Haiku 4.5 et Sonnet 5 restent le choix le plus rapide et le moins cher.
Les tests donnent la direction. Pour savoir si l’écart compte dans ton cas, un essai sur une vraie tâche est plus parlant que n’importe quel tableau.
