Claude Opus 5 remplace Claude Opus 4.8 comme modèle phare de la gamme Opus chez Anthropic, et l'argument de la semaine est inhabituellement précis : des scores de tout premier plan à un coût inférieur à celui de son propre modèle Fable 5. Pour qui standardise son infrastructure sur un modèle de pointe, il ne s'agit pas d'un achat ponctuel. Le choix du modèle verrouille une dépense récurrente au jeton, sur chaque requête émise par votre produit. Reste à savoir si l'avance d'Opus 5 sur les benchmarks et son coût par jeton plus bas justifient un changement.
L'argument tarifaire
Selon MarkTechPost, Opus 5 conserve la tarification de la gamme Opus, inchangée à 5 dollars par million de jetons en entrée et 25 dollars par million de jetons en sortie. The Decoder et The Register rapportent tous deux qu'Opus 5 coûte jusqu'à deux fois moins cher que Fable 5. The Register ajoute qu'Opus 5 n'impose pas de conservation des données.
Ce positionnement inverse le schéma habituel, où un nouveau modèle phare arrive avec une prime tarifaire. Ici, le modèle de plus haut niveau passerait sous le prix d'un modèle qui lui est supérieur sur ce plan. Si votre charge de travail tourne aujourd'hui sur Fable 5, cela laisse entrevoir une facture plus légère pour un rendu comparable ou meilleur — à condition que l'avance sur les benchmarks se confirme dans votre cas d'usage.
Ce que disent les benchmarks
The Decoder indique qu'Opus 5 mène l'Artificial Analysis Intelligence Index avec 61 points, devançant à la fois Claude Fable 5 et GPT-5.6 Sol. Sur ARC-AGI-3, un benchmark orienté vers la résolution de problèmes inédits, Opus 5 obtiendrait 30,2 %.
Deux réserves s'imposent. D'abord, les écarts sont minces. Devancer n'est pas une avance décisive, et un ou deux points de différence sur un indice agrégé résistent rarement à une charge de production précise. Ensuite, les indices agrégés font la moyenne de plusieurs types de tâches. Un modèle en tête globalement peut être à la traîne sur la portion précise du travail que vous exécutez réellement. La position au benchmark est un premier filtre, pas un verdict.
À qui il s'adresse
ZDNet décrit Opus 5 comme destiné aux développeurs et aux entreprises, mettant en avant un codage plus solide, un raisonnement plus efficace et des ajustements favorables au cache de prompts, le tout à la tarification Opus. MarkTechPost le positionne pour le codage agentique de pointe et le pilotage d'ordinateur (computer use). Anthropic a livré le modèle accompagné d'un rapport de 194 pages, selon 01net.
Le détail sur le cache de prompts mérite une lecture attentive. Pour les charges agentiques et de codage qui renvoient à chaque étape un contexte volumineux et stable, l'efficacité du cache pèse davantage sur le coût réel au jeton que les tarifs affichés. Si le comportement du cache d'Opus 5 est réellement plus favorable aux appels d'outils répétés, l'économie effective pourrait dépasser la comparaison de façade. À vérifier sur votre propre trafic, et non sur la note de lancement.
Le contexte du lancement
Le marché, plus largement, situe Opus 5 face aux modèles phares concurrents, pas seulement à Fable 5. Par ailleurs, Sakana AI affirme que son routeur Fugu Ultra, mis à jour en v1.1, dépasse désormais Fable 5. The Decoder note qu'aucune vérification indépendante de cette affirmation n'existe encore. Les revendications de benchmark au niveau de la couche de routage méritent la même méfiance que celles portant sur les modèles, tant que des tiers ne les ont pas confirmées.
Faut-il changer ?
L'argument en faveur d'un passage depuis Fable 5 est simple : si Opus 5 égale ou devance sur les benchmarks pertinents pour votre travail, tout en coûtant jusqu'à deux fois moins cher, le changement se rembourse sur la dépense récurrente. L'argument pour attendre tient au fait que les avances rapportées sont minces et tirées d'indices agrégés, et que la migration a son propre coût — réglage des prompts, tests de non-régression et revalidation des flux agentiques.
Quelques étapes concrètes avant de vous engager :
- Testez sur vos propres tâches. Faites tourner des prompts et des traces d'agent représentatifs sur Opus 5 et sur votre modèle actuel, côte à côte. La position sur un indice agrégé ne prédit pas les résultats par charge de travail.
- Mesurez le coût effectif, pas le coût affiché. Intégrez le cache de prompts et votre répartition réelle des jetons entrée/sortie. Les charges gourmandes en sortie sont plus sensibles au tarif de 25 dollars que celles gourmandes en entrée.
- Confirmez les conditions de conservation des données si cette distinction compte pour votre conformité.
- Chiffrez la migration. Un tarif au jeton plus bas ne se traduit par un gain que si les coûts de bascule restent modestes pour votre pile.
Sur les chiffres rapportés cette semaine, Opus 5 est une montée en gamme crédible du type « plus pour moins cher » pour les équipes déjà sur Fable 5, et un candidat raisonnable pour celles qui comparent les modèles de pointe. L'avance sur les benchmarks est réelle mais fine : la décision doit reposer sur vos propres tests plutôt que sur le récit du lancement. Pour comparer les modèles entre eux, consultez nos comparatifs de modèles d'IA et notre suivi de l'actualité IA. Les termes employés ici sont définis dans le glossaire.