Claude Opus 5 : Anthropic ne baisse pas ses prix, il baisse la facture
Anthropic a lancé Claude Opus 5 le 24 juillet. Même tarif qu'Opus 4.8, mais moins de tokens brûlés par tâche — sous conditions.

Anthropic a publié Claude Opus 5 le vendredi 24 juillet 2026, vers 19 h heure de Paris. Deux mois seulement après Opus 4.8, rappelle TechCrunch, et à peine six semaines après Fable 5 et Sonnet 5 — la cadence de l'éditeur est devenue franchement inhabituelle.
Sur le papier, l'annonce ressemble à toutes les autres : de meilleurs scores, un modèle « plus réfléchi », des clients enthousiastes. Mais la ligne qui compte pour quiconque paie à l'usage tient en huit caractères : 5 $ / 25 $. Exactement le tarif d'Opus 4.8. Le prix du token n'a pas bougé d'un centime ; c'est le nombre de tokens nécessaires pour finir le travail qui est censé avoir changé.

Opus 5 est-il disponible, et sur quelles offres ?
Oui, et sans période d'attente. Anthropic indique que le modèle est « disponible dès aujourd'hui sur toutes les plateformes » : l'API Claude sous l'identifiant `claude-opus-5`, Amazon Bedrock sous `anthropic.claude-opus-5`, Google Cloud, Microsoft Foundry et Claude Platform on AWS.
Côté abonnements, Anthropic précise deux choses et deux seulement : Opus 5 devient le modèle par défaut de l'offre Max, et le modèle le plus puissant accessible en Pro. Rien n'est annoncé pour l'offre gratuite, où Sonnet 5 tenait ce rôle depuis fin juin. Il n'existe pas de variante à contexte réduit : la fenêtre de 1 million de tokens est à la fois le défaut et le plafond, avec 128 000 tokens en sortie.
| Modèle | Entrée (par M de tokens) | Sortie (par M de tokens) | Contexte |
|---|---|---|---|
| Claude Fable 5 | 10 $ | 50 $ | 1 M |
| Claude Opus 5 | 5 $ | 25 $ | 1 M |
| Claude Opus 4.8 | 5 $ | 25 $ | 1 M |
| Claude Sonnet 5 | 2 $ (3 $ au 1ᵉʳ septembre) | 10 $ (15 $) | 1 M |
| Claude Haiku 4.5 | 1 $ | 5 $ | 200 k |
Source : page de tarifs officielle d'Anthropic, consultée le 27 juillet 2026.
Un mode « Fast » existe également : environ 2,5 fois la vitesse standard, facturé le double (10 $ / 50 $), et réservé à l'API Claude — il n'est disponible ni sur Bedrock, ni sur Google Cloud, ni sur Microsoft Foundry.
« Plus efficace en tokens » : que disent vraiment les chiffres ?
C'est la lecture qu'en a fait Ars Technica dès le jour du lancement, sous un titre sans ambiguïté : « l'Opus 5 d'Anthropic, c'est une histoire d'efficacité en tokens, pas un bond de capacité ». Le journaliste Samuel Axon y voit surtout « une histoire de coût » et rappelle la pression concurrentielle : le modèle chinois à poids ouverts Kimi K3 affiche 15 $ par million de tokens en sortie pour des performances comparables.
Anthropic assume le cadrage. L'éditeur annonce que sur Frontier-Bench v0.1, Opus 5 « fait plus que doubler la performance d'Opus 4.8 à un coût par tâche inférieur » ; que sur CursorBench 3.2 en effort maximal, il arrive à 0,5 % du meilleur score de Fable 5 « pour la moitié du coût par tâche » ; et que sur OSWorld 2.0, il dépasse le meilleur résultat de Fable 5 « pour un peu plus du tiers du coût ». Ce sont des chiffres maison, à prendre comme tels.
Les retours de clients en accès anticipé publiés par Anthropic vont dans le même sens, avec des ordres de grandeur très variables : un responsable de recherche appliquée dans le juridique évoque « 26 % de tokens en moins en moyenne par rapport à Opus 4.8 en raisonnement maximal » ; un responsable data d'une société de trading parle d'« environ un septième des tokens de raisonnement et moins de la moitié de la latence d'Opus 4.8 ».
Ce que dit un baromètre indépendant
Le seul relevé tiers publié à ce jour est celui d'Artificial Analysis, qui exécute la même batterie de tests sur tous les modèles et publie le volume de tokens consommé. Voici les mesures relevées le 27 juillet 2026, toutes en configuration « raisonnement adaptatif, effort maximal ».
| Modèle (effort max) | Indice d'intelligence | Tokens générés | Vitesse | Coût total du test |
|---|---|---|---|---|
| Claude Opus 5 | 61 (1ᵉʳ / 190) | 100 M | 52,8 t/s | 3 836 $ |
| Claude Fable 5 | 60 | 87 M | 70 t/s | 5 631 $ |
| Claude Opus 4.8 | 56 | 120 M | 55 t/s | 3 753 $ |
| Médiane des modèles | 32 | 63 M | 73 t/s | — |
Le gain est réel : 17 % de tokens en moins qu'Opus 4.8 pour cinq points d'indice en plus, à tarif identique. Mais deux nuances méritent d'être posées. D'abord, Artificial Analysis classe toujours Opus 5 parmi les modèles « très verbeux » (100 M de tokens contre 63 M pour la médiane) et « nettement lents » (52,8 tokens/s contre 73 pour la médiane). Ensuite, le coût total pour faire tourner l'ensemble des tests n'a pas baissé : 3 836 $ contre 3 753 $ pour Opus 4.8, soit 2 % de plus. À effort maximal, l'économie de tokens de sortie est absorbée par le reste.
La documentation officielle d'Anthropic est explicite sur ce point : « les réponses par défaut de Claude Opus 5 destinées à l'utilisateur sont plus longues que celles des Opus précédents », et les fichiers qu'il écrit sur disque « sont souvent plus longs que sur les modèles précédents ». Elle précise même que baisser le paramètre d'effort « peut réduire le volume de raisonnement sans raccourcir de façon fiable la réponse visible ». Autrement dit : sorti de la boîte, Opus 5 est plus bavard. Le gain de coût n'apparaît que si l'on descend explicitement l'effort en `low` ou `medium` — les deux niveaux qu'Anthropic présente comme « le levier principal du coût en tokens et du temps de réponse » — et si l'on demande de la concision dans le prompt système.
Un troisième poste de dépense est passé sous le radar : Anthropic prévient qu'Opus 5 « délègue à des sous-agents plus volontiers que les modèles précédents », ce qui « multiplie le coût et le temps » sur les petites tâches. Les équipes qui font tourner des agents en parallèle ont donc un plafond à poser elles-mêmes.
Quelle est la différence entre Claude et Opus ?
La confusion est fréquente et vaut d'être levée : Claude est l'assistant, Opus est l'un de ses modèles. Anthropic décline aujourd'hui cinq familles, du plus léger au plus capable : Haiku (rapide et bon marché), Sonnet (l'équilibre), Opus (le travail agentique complexe et le code), puis Fable et Mythos au sommet. Quand vous discutez sur Claude, vous parlez à l'assistant ; le modèle qui répond dépend de votre offre et de votre sélecteur. Pour situer l'assistant face à son concurrent direct, voir notre comparatif Claude vs ChatGPT.
Opus 5 et Claude Code : ce qui change côté développeurs
Opus 5 est utilisable dans Claude Code, où le paramètre d'effort est réglé sur `high` par défaut — comme sur l'API. Trois changements techniques méritent l'attention avant de basculer une production :
- Le raisonnement est activé par défaut. Sur Opus 4.8, une requête sans paramètre `thinking` ne réfléchissait pas ; sur Opus 5, si. Comme `max_tokens` plafonne le raisonnement et la réponse, une valeur calibrée pour 4.8 peut désormais tronquer la sortie.
- Désactiver le raisonnement est plafonné. Le combiner avec un effort `xhigh` ou `max` renvoie désormais une erreur.
- Le cache de prompt démarre plus tôt : 512 tokens minimum au lieu de 1 024, ce qui rend cachables des prompts qui ne l'étaient pas.
Anthropic ouvre par ailleurs deux bêtas : la modification d'outils en cours de conversation sans invalider le cache, et les bascules automatiques, qui redirigent vers un autre modèle une requête bloquée par les classificateurs de sécurité plutôt que de renvoyer une erreur. Selon TechCrunch, ces classificateurs devraient se déclencher « 85 % moins souvent » que sur Fable 5, dont le retour en ligne début juillet avait été assorti de garde-fous renforcés. Contrairement à Fable 5, Opus 5 n'impose aucune exigence de rétention des données.
Avant de basculer un agent de production sur Opus 5, refaites un balayage du paramètre d'effort sur vos propres cas : Anthropic recommande explicitement de repartir du défaut (`high`) et de descendre tant que la qualité tient. C'est là que se joue la facture, pas dans le choix du modèle.
Reste la question que personne ne tranchera avant plusieurs semaines : ce gain d'efficacité tient-il sur des charges réelles, hors bancs d'essai ? Les retours du terrain sur Cursor face à Claude Code en donneront une première idée.
Voici Claude Opus 5. C'est un modèle réfléchi et proactif qui s'approche de l'intelligence de pointe de Fable 5, pour moitié prix.Voir le post sur X
Questions fréquentes
Opus 5 est-il disponible ?
Oui, depuis le 24 juillet 2026, sur l'API Claude, Amazon Bedrock, Google Cloud, Microsoft Foundry et Claude Platform on AWS. Côté abonnements, il est le modèle par défaut de l'offre Max et le plus puissant accessible en Pro.
Opus 5 est-il disponible dans Claude Code ?
Oui. Il y est utilisable avec le paramètre d'effort réglé sur `high` par défaut, comme sur l'API. Voir notre fiche Claude Code.
Combien coûte Claude Opus 5 ?
5 $ par million de tokens en entrée et 25 $ en sortie, soit le tarif d'Opus 4.8 et la moitié de celui de Fable 5. Le mode Fast, environ 2,5 fois plus rapide, est facturé le double.
Quelle est la différence entre Claude et Opus ?
Claude est l'assistant d'Anthropic ; Opus est l'une de ses familles de modèles, positionnée sur le travail agentique complexe et le code, entre Sonnet et Fable.
Quelle est la date de sortie de Sonnet 5 ?
Claude Sonnet 5 est sorti le 30 juin 2026, trois semaines et demie avant Opus 5. Notre article détaille ce qu'il change.
Opus 5 est-il meilleur que Fable 5 ?
Selon Anthropic, il s'en approche « dans de nombreux domaines » pour moitié prix, et le dépasse sur plusieurs bancs d'essai. Fable 5 reste devant sur les tâches de cybersécurité offensive et les travaux autonomes très longs.


