Claude Opus 5 : performances de Fable 5 à demi-prix, Anthropic restructure sa gamme
Anthropic a lancé Claude Opus 5, le nouveau modèle frontier qui se positionne entre Opus 4.8 et Fable 5 en intelligence, mais à la moitié du prix de Fable 5. Il est disponible dès aujourd’hui sur Claude Max comme modèle par défaut et sur Claude Pro comme modèle le plus puissant.
Pourquoi c’est pertinent pour toi. Si tu utilises Claude au travail, l’équation change. Opus 5 coûte comme son prédécesseur Opus 4.8 mais plus que double les performances sur Frontier-Bench, et sur CursorBench il atteint 0,5 points de pourcentage de Fable 5 en dépensant deux fois moins. Pour ceux qui lançaient des tâches complexes sur Fable 5 parce que c’était le seul qui tenait la charge, il y a maintenant une alternative qui coûte la moitié pour un résultat équivalent.
Le modèle inclut aussi un paramètre effort qui te permet de choisir si tu vises l’intelligence maximale ou si tu préserves des tokens pour des résultats plus rapides et économiques. Même au niveau le plus faible, Opus 5 réussit plus de tâches que n’importe quel autre modèle, selon les données Anthropic du 24 juillet 2026.
Le deuxième point, c’est l’autonomie. Anthropic rapporte qu’Opus 5 vérifie mieux son travail et itère jusqu’à réussir. L’exemple le plus parlant : on lui a donné le dessin d’une pièce mécanique sans lui permettre de la voir directement, et le modèle a écrit seul un pipeline de computer vision pour extraire la géométrie des pixels et reconstruire le modèle 3D. Aucun modèle concurrent n’y est parvenu avec la même configuration en cinq tentatives.
Les limites restent : en cybersécurité, Opus 5 est derrière Mythos 5, et les benchmarks viennent du labo qui a construit le modèle. Mais les 799 points et 451 commentaires sur Hacker News en quelques heures indiquent que la communauté technique le teste vraiment.
En détail
L’état antérieur. Jusqu’à hier, la gamme Claude avait Opus 4.8 comme modèle intermédiaire et Fable 5 au sommet. Fable 5 avait été proposé plusieurs fois en version réduite dans les plans Max et Team Premium (comme nous l’avions rapporté le 18 juillet), ce qui montrait que la demande dépassait l’offre et qu’Anthropic n’avait qu’un seul modèle vraiment frontier. Opus 5 change cette géométrie : il apporte des performances proches de Fable 5 à demi-prix, et devient le modèle par défaut sur Claude Max.
Les chiffres en contexte. Les benchmarks cités sont mesurés au 24 juillet 2026 selon l’annonce officielle. Sur Frontier-Bench v0.1, Opus 5 plus que double les performances d’Opus 4.8 à un coût par tâche inférieur. Sur CursorBench 3.2 au maximum effort, il atteint 0,5 points de pourcentage du pic de Fable 5, mais à demi-prix par tâche. Sur ARC-AGI 3, un test de résolution de problèmes sur des problèmes nouveaux, le score est triple par rapport au modèle second. Sur OSWorld 2.0, le benchmark d’utilisation d’ordinateur, il surpasse Fable 5 en dépensant environ un tiers du coût. Sur Zapier AutomationBench, qui mesure la capacité à compléter des tâches métier end-to-end, le taux de réussite est 1,5 fois supérieur au modèle suivant à coût égal.
L’histoire que racontent les chiffres, c’est l’efficacité à dépense égale, plus que la puissance brute. C’est un message direct à ceux qui paient les API à la consommation et doivent optimiser le rapport coût-résultat sur chaque appel.
Le paramètre effort. Opus 5 introduit un paramètre qui te permet de choisir le niveau de dépense pour chaque étape : effort maximal pour les tâches difficiles, économies de tokens pour les plus simples. Pour ceux qui construisent des agents, cela signifie pouvoir calibrer le coût sur chaque étape d’un flux, au lieu d’utiliser le même modèle pour tout.
L’autonomie dans les tests. Les exemples des testeurs early-access sont le signal le plus intéressant. Un ingénieur d’une trading firm a utilisé Opus 5 pour construire un market data feed pour un nouvel exchange en une seule session : les modèles précédents ne complétaient pas la tâche même avec des plans détaillés. Ne trouvant pas de feed live pour valider le code, le modèle a construit seul un test harness pour vérifier que le parsing des données était correct. Sur un bug réel dans un package manager open source, Opus 5 a trouvé la cause profonde et corrigé un edge case que la patch de la communauté avait manqué ; un modèle concurrent avait corrigé seulement le symptôme superficiel et déclaré le bug résolu.
Les limites à garder à l’esprit. En cybersécurité, Opus 5 reste derrière Mythos 5. Les testeurs cités sont des partenaires commerciaux d’Anthropic (CEO de Cursor, Zapier, Lovable, Devin), donc ils ont intérêt à parler positivement du produit. Les chiffres du terrain arriveront dans les prochaines semaines, quand les professionnels commenceront à l’utiliser sur de vraies tâches.
Pour t’orienter dans le choix du modèle, le guide mis à jour hier par Mollick reste un point de départ. Si tu attendais que le rapport qualité-prix de Claude s’améliore avant de construire des agents sérieux, ce lancement change les conditions de départ.