Claude Opus 5 : presque Fable 5, mais à moitié prix

Claude Opus 5 : presque Fable 5, mais à moitié prix

Le modèle le plus intéressant d’une gamme n’est pas toujours celui qui obtient le meilleur score absolu. C’est souvent celui qui conserve l’essentiel des capacités du sommet tout en faisant tomber le coût suffisamment bas pour être utilisé chaque jour.

Anthropic joue précisément cette carte avec Claude Opus 5, lancé le 24 juillet 2026. Le nouveau modèle est facturé 5 dollars par million de tokens en entrée et 25 dollars en sortie, contre 10 et 50 dollars pour Claude Fable 5. Le prix catalogue est donc exactement divisé par deux.

La promesse ne s’arrête pas au tarif. Anthropic affirme qu’Opus 5 s’approche de l’« intelligence de frontière » de Fable 5 et le dépasse même sur certaines évaluations de programmation, d’usage d’ordinateur et de travail professionnel. Sur CursorBench 3.2, au niveau d’effort maximal, il terminerait à moins de 0,5 % du meilleur résultat de Fable 5, pour moitié moins cher par tâche.

Il faut toutefois lire cette formule comme un positionnement, pas comme une équivalence universelle. Fable 5 reste le modèle supérieur pour les projets autonomes les plus longs et les plus complexes. Les résultats publiés viennent principalement d’Anthropic et de partenaires de lancement. Et le coût réel dépend du nombre de tokens consommés, des outils appelés et du niveau d’effort choisi — pas seulement du prix affiché pour un million de tokens.

Opus 5 reprend le rôle du modèle puissant utilisable tous les jours

La gamme Claude s’est fortement élargie en quelques semaines. Fable 5 et Mythos 5 occupent le sommet, Sonnet 5 vise le compromis entre vitesse et intelligence, tandis qu’Opus 5 doit devenir le modèle de travail exigeant que l’on peut appeler régulièrement sans payer systématiquement le prix du niveau le plus élevé.

Anthropic le rend disponible sur toutes les offres payantes, ainsi que dans Claude Code et via l’API sous l’identifiant claude-opus-5. Il devient le modèle par défaut de Claude Max et le modèle le plus puissant proposé aux abonnés Pro. GitHub l’a également ajouté à Copilot dès le jour du lancement pour les tâches de programmation longues et multi-étapes.

Cette place est importante. Fable 5 a été conçu comme un modèle de classe Mythos capable de soutenir des agents pendant plusieurs jours, de déléguer à des sous-agents et de vérifier un travail complexe avec peu de supervision. Une telle capacité a un prix économique, mais aussi des contraintes de sécurité plus fortes. Opus 5 vise une zone plus large : développement logiciel, analyse financière, recherche, création de présentations, navigation web et automatisation d’entreprise.

Autrement dit, Anthropic ne présente pas Opus 5 comme une version dégradée de Fable. L’entreprise en fait le nouveau centre de gravité de sa gamme payante : assez capable pour prendre en charge les tâches difficiles, mais assez économique pour entrer dans les budgets de production.

La moitié du prix par token, pas toujours la moitié de la facture

La comparaison tarifaire est simple sur le papier :

Modèle Entrée, par million de tokens Sortie, par million de tokens
Claude Opus 5 5 $ 25 $
Claude Fable 5 10 $ 50 $

À volume identique, Opus 5 coûte donc deux fois moins cher. Pour une entreprise qui analyse des milliers de documents ou fait fonctionner des agents en continu, l’écart peut rapidement représenter des sommes importantes.

Mais un agent ne consomme pas un volume fixe. Il peut réfléchir plus longtemps, relire des fichiers, exécuter des commandes, revenir sur une erreur ou lancer plusieurs recherches. Deux modèles facturés à des prix différents peuvent aboutir à des coûts proches si le moins cher utilise davantage de tokens ou multiplie les tentatives.

Le réglage d’effort devient une variable économique

Opus 5 propose plusieurs niveaux d’effort. À faible effort, le modèle cherche une réponse plus rapidement et consomme moins de tokens de raisonnement. À effort élevé, très élevé ou maximal, il consacre davantage de calcul à la tâche. Le développeur peut ainsi choisir entre latence, coût et qualité sans changer de modèle.

C’est cette courbe coût-performance qu’Anthropic met en avant. Sur Frontier-Bench, une évaluation de programmation autonome, l’entreprise affirme qu’Opus 5 fait plus que doubler le résultat d’Opus 4.8 tout en réduisant le coût par tâche. Sur OSWorld 2.0, qui mesure l’usage d’un ordinateur, le modèle dépasserait le meilleur résultat de Fable 5 pour un peu plus du tiers du coût. Sur AutomationBench de Zapier, son taux de réussite serait environ 1,5 fois supérieur à celui du modèle suivant à dépense comparable.

Ces chiffres suggèrent que le gain ne vient pas seulement du tarif. Opus 5 semble aussi avoir besoin de moins d’essais, d’appels d’outils ou de corrections sur certaines tâches. C’est essentiel : dans un système agentique, le coût d’une erreur inclut toute la boucle nécessaire pour la détecter et la réparer.

Le mode Fast efface l’avantage tarifaire unitaire

Anthropic propose également un mode Fast annoncé comme environ 2,5 fois plus rapide. Cette vitesse est facturée au double du tarif de base. Un Opus 5 en mode Fast revient donc à 10 dollars par million de tokens en entrée et 50 dollars en sortie — soit le tarif standard de Fable 5.

Cela ne rend pas le mode inutile. Une réponse plus rapide peut avoir davantage de valeur dans un outil interactif, une revue de code ou un service client. Mais le slogan « moitié prix » ne s’applique plus dans cette configuration. Le choix doit se faire sur le coût total de la tâche et le délai acceptable, pas sur le seul nom du modèle.

Sur quels tests Opus 5 rejoint ou dépasse Fable 5

Anthropic revendique plusieurs résultats de premier plan. Opus 5 arriverait en tête sur Frontier-Bench pour le génie logiciel et sur GDPval-AA pour certaines tâches de travail intellectuel. Sur ARC-AGI 3, consacré à la résolution de problèmes nouveaux, son score serait trois fois supérieur à celui du deuxième modèle. Il progresserait également dans les sciences de la vie, notamment en chimie organique, bio-informatique et analyse de protéines.

Le résultat le plus directement lié au positionnement « presque Fable » reste CursorBench. Au réglage maximal, Opus 5 se situe à moins de 0,5 % du pic de Fable 5 et affiche, selon Anthropic, une meilleure performance à coût donné aux niveaux d’effort élevé, très élevé et maximal.

Ces évaluations décrivent une tendance crédible : une partie des capacités qui exigeait récemment le modèle le plus cher descend vers la gamme Opus. Elles ne démontrent pas qu’Opus 5 est supérieur dans tous les contextes.

Des benchmarks utiles, mais encore très proches du lancement

Plusieurs précautions s’imposent. Frontier-Bench est présenté à partir d’une exécution interne d’Anthropic, avec cinq tentatives par tâche. Certains témoignages viennent d’entreprises ayant bénéficié d’un accès anticipé. Les réglages, outils, budgets de tokens et mécanismes de secours peuvent modifier fortement les résultats.

Anthropic précise par exemple qu’Opus 4.8 servait de modèle de repli lorsqu’un classificateur de sécurité bloquait une requête d’Opus 5 ou de Fable 5 sur Frontier-Bench. Une note de bas de page de ce type paraît technique, mais elle compte : le résultat attribué à un modèle peut intégrer le comportement d’un second système.

Il faudra donc attendre des mesures indépendantes, menées avec des budgets comparables et sur des charges réelles, avant de conclure qu’Opus 5 remplace Fable 5. Une entreprise devrait tester ses propres documents, dépôts de code, outils et critères de réussite. Le meilleur score moyen ne garantit ni la meilleure fiabilité sur un cas particulier, ni la facture la plus basse.

Fable 5 conserve un avantage sur les missions les plus longues

Si Opus 5 fait aussi bien ou mieux sur plusieurs graphiques, pourquoi conserver Fable 5 ? Parce qu’un benchmark court ne mesure pas complètement la capacité à conduire un projet pendant des heures ou des jours, à gérer une grande quantité de contexte et à maintenir une stratégie malgré les erreurs intermédiaires.

Anthropic continue de présenter Fable 5 comme son modèle largement disponible le plus capable pour les raisonnements les plus difficiles et les agents de longue durée. Axios rapporte que l’entreprise le recommande encore pour les tâches autonomes les plus complexes. Fable peut planifier plusieurs étapes, déléguer et vérifier son travail sur des projets qui dépassent une session habituelle.

La différence pourrait donc moins ressembler à une frontière entre « intelligent » et « moins intelligent » qu’à une différence d’endurance, de profondeur et de fiabilité sur les cas extrêmes. Opus 5 peut gagner un test précis ou atteindre un excellent rapport coût-performance sans offrir la même marge sur une migration logicielle de plusieurs jours ou une recherche scientifique très ouverte.

Pour la plupart des équipes, le choix rationnel sera probablement de commencer avec Opus 5, puis de réserver Fable 5 aux tâches qui échouent, exigent davantage d’autonomie ou justifient le surcoût. La possibilité de changer de modèle au milieu d’une tâche, également annoncée par Anthropic, va dans ce sens : la gamme devient un système de paliers plutôt qu’une série de produits isolés.

Des garde-fous moins bloquants que ceux de Fable

Opus 5 est également intéressant par sa politique de sécurité. Anthropic affirme que son audit comportemental automatisé lui attribue le niveau le plus faible de comportements désalignés parmi ses modèles récents, avec un score global de 2,3. Il respecterait mieux la « Constitution » de Claude, adopterait moins de comportements trompeurs et serait moins susceptible d’entreprendre une action irréversible de manière imprudente.

Ces résultats proviennent du dispositif d’évaluation d’Anthropic et ne constituent pas un audit indépendant. Ils montrent néanmoins que l’entreprise cherche à améliorer simultanément la capacité et le comportement, plutôt qu’à présenter la sécurité comme un simple filtre ajouté après l’entraînement.

Sur la cybersécurité, les règles sont plus permissives que pour Fable 5. Opus 5 peut rechercher des vulnérabilités dans du code source, mais ses classificateurs bloquent notamment l’analyse de binaires, les tests d’intrusion et la génération d’exploits lorsqu’ils entrent dans les catégories interdites. Anthropic estime que ces protections devraient intervenir environ 85 % moins souvent que celles de Fable 5.

Cette souplesse ne signifie pas qu’Opus 5 est plus dangereux. Selon les évaluations publiées, il se rapproche de Mythos 5 pour trouver des failles, mais reste nettement derrière lui lorsqu’il faut transformer ces failles en exploits opérationnels. Les requêtes bloquées peuvent être redirigées vers Opus 4.8, automatiquement dans certains produits ou via une option de repli dans l’API.

Pour les développeurs, cette différence peut compter autant que les benchmarks. Un modèle légèrement moins puissant mais moins souvent interrompu peut être plus utile pour l’audit défensif, le débogage et la maintenance quotidienne.

Le vrai progrès est la baisse du prix de l’intelligence utile

Opus 5 n’enterre pas Fable 5. Il montre plutôt à quelle vitesse une capacité haut de gamme peut devenir un produit plus accessible. Six semaines après l’arrivée de Fable, Anthropic affirme déjà proposer une grande partie de ses performances pour moitié moins cher par token, avec une vitesse et des garde-fous mieux adaptés à un usage régulier.

Le titre « presque Fable à moitié prix » résume donc correctement le lancement, à condition de conserver chacun de ses mots. Presque, parce que la proximité varie selon les tâches et que Fable reste destiné aux projets les plus ambitieux. Moitié prix, parce que le tarif API standard est bien divisé par deux, mais pas forcément la dépense finale d’un agent. Et Opus, parce que ce niveau redevient le choix de référence pour les utilisateurs professionnels qui veulent de fortes capacités sans payer systématiquement le sommet de la gamme.

La prochaine étape sera moins spectaculaire qu’un nouveau classement. Elle consistera à mesurer, sur des semaines de production, combien de tâches Opus 5 termine sans reprise humaine, combien de tokens il consomme réellement et dans quels cas Fable 5 justifie encore son surcoût. C’est là que se décidera le modèle le plus économique — dans les factures et les taux de réussite, pas uniquement dans les graphiques de lancement.

Références