Que s’est-il passé
Anthropic a sorti Claude Opus 5 le 24 juillet 2026. Il coûte 5 $ par million de jetons d’entrée et 25 $ par million de jetons de sortie, ce qui correspond exactement à ce que coûte déjà le modèle qu’il remplace, Opus 4.8.
Ce prix forfaitaire est toute l’histoire. Le modèle le plus performant d’Anthropic, Claude Fable 5, fonctionne à 10 $ par million de jetons d’entrée et à 50 $ par million de jetons de sortie. Opus 5 représente la moitié de cela, et sur les propres graphiques de référence d’Anthropic, il se rapproche suffisamment de Fable 5 pour que l’écart soit mesuré en fractions de point de pourcentage.
Pour toute personne payant un abonnement plutôt qu’une facture d’interface de programmation d’application (API), le changement s’est déjà produit sans rien demander. Opus 5 est “le nouveau modèle par défaut sur Claude Max, et le modèle le plus performant sur Claude Pro”.
Détails clés
- Prix : $5 par million de tokens en entrée, $25 par million de tokens en sortie, identique à Opus 4.8.
- Fenêtre contextuelle : 1 million de jetons, avec une sortie maximale de 128 000 jetons.
- ID de modèle :
claude-opus-5sur l’API Claude. - Mode rapide : disponible au double du prix de base de l’Opus 5.
Le cadran qui fixe le prix
La fonctionnalité de titre n’est pas une fonctionnalité. C’est un bouton.
L’Opus 5 est livré avec une fonctionnalité “permettant aux utilisateurs de basculer la quantité d’effort… que le modèle dépense pour accomplir une tâche ou répondre à une invite”, avec des paramètres faibles, moyens et élevés. Anthropic le décrit comme un contrôle “les clients peuvent utiliser pour optimiser l’intelligence ou conserver les jetons pour des résultats plus rapides et moins chers”.
Cela compte plus qu’il n’y paraît. Les jetons sont l’unité de facturation, donc un paramètre qui modifie le nombre de jetons brûlés par un modèle est un paramètre qui modifie le coût d’une tâche. Les résultats de référence sont cités à des niveaux d’effort spécifiques pour la même raison : sur CursorBench 3.2, Opus 5 atterrit à moins d’un demi-point de pourcentage du meilleur score de Fable 5 à environ la moitié du coût par tâche, mais seulement avec un effort maximum. Baissez-le et le score et la facture diminuent.
Sur Frontier-Bench v0.1, Anthropic rapporte que l’Opus 5 fait plus que doubler le score de l’Opus 4.8 tout en coûtant moins cher par tâche. Traitez cela comme un chiffre du fournisseur. Anthropic a publié ses résultats de référence sous forme d’images graphiques sans chiffres sous-jacents, de sorte que les scores actuellement en circulation ont été lus sur un graphique plutôt que tirés d’un tableau. La réplication indépendante n’a pas encore eu lieu.
Là où Anthropic dit que cela ne suffit pas
L’admission la plus intéressante se trouve dans la section sécurité, et elle est facile à mal lire.
Anthropic déclare que « l’Opus 5 ne fait pas avancer les frontières en matière de capacités risquées et à double usage » et qu’il « reste derrière le Mythe 5 à la fois dans la recherche en biologie et dans la cybersécurité offensive ». Lisez cela attentivement, car la comparaison n’est pas celle à laquelle vous vous attendriez. Mythos 5 n’est pas le produit phare. Il s’agit d’un modèle distinct proposé pour les flux de travail de cybersécurité défensive dans le cadre du projet Glasswing d’Anthropic, sur invitation uniquement, sans inscription en libre-service.
Cette distinction est tout le problème. Anthropic a comparé la capacité de piratage de son modèle grand public à son modèle de sécurité spécialisé, et non à son produit phare. Sur OSS-Fuzz, le propre benchmark de vulnérabilité d’Anthropic, les graphiques publiés montrent que l’Opus 5 correspond étroitement au Mythos 5 pour la recherche de vulnérabilités, tout en obtenant un score bien inférieur pour la création d’exploits fonctionnels. Il peut trouver le bug. Il est nettement pire pour le transformer en arme. Mythos Preview, le modèle précédent de cette gamme, est celui couvert par ce site [trouver 27 ans de bugs cachés en trois semaines] (/tech/the-ai-that-found-27-years-of-hidden-bugs-in-3-weeks).
Tout le monde ne considère pas cette retenue comme une vertu. Le directeur général de Hugging Face, Clem Delangue, a expliqué que « les API de modèle fermé ont des garde-fous qui signalent et refusent de nombreux travaux de sécurité légitimes, car analyser une attaque ressemble beaucoup à en préparer une ».
Et l’Opus 5 n’est pas le haut de la pile. Anthropic “recommande toujours Fable 5 pour les projets plus avancés, y compris ceux que le modèle peut gérer de manière autonome pendant des jours”. Fable 5, le modèle qu’une directive américaine de contrôle des exportations a forcé Anthropic à désactiver pour chaque client en juin avant de [revenir le 1er juillet et passer aux crédits d’utilisation mesurée le 12 juillet] (/ai/fable-5-back-in-your-plan-july-12), conserve son emploi.
La lecture
Maintenir les prix à un niveau stable pendant une génération est une baisse de prix qui n’en a pas l’air. Anthropic n’a pas baissé le nombre sur l’Opus 4.8 ; il a augmenté ce que le nombre achète. Pour les acheteurs qui budgétisent en dollars par tâche plutôt qu’en dollars par million de jetons, c’est la seule comparaison qui compte, et elle a fonctionné alors que le cadran d’effort leur donne un deuxième levier pour réduire davantage les coûts.
Le problème est que chaque affirmation de performance ci-dessus remonte aux propres évaluations d’Anthropic, plusieurs d’entre elles lisant des graphiques sans étiquette. Tout le monde peut vérifier les prix. Personne en dehors de l’entreprise n’a encore vérifié ces renseignements.
Le résultat
Anthropic a laissé le prix de l’autocollant seul et a déplacé la capacité à la place. Si vous payez pour Claude Max ou Pro, vous l’utilisez déjà. Si vous payez par jeton, le réglage de l’effort est le levier qui décide désormais de votre facture. Et si le travail implique quelque chose de proche de la sécurité offensive, Anthropic vous a clairement dit que ce n’était pas le modèle pour cela.
Nos sources (5)
- anthropic.com Introducing Claude Opus 5
- platform.claude.com Anthropic Docs: Models Overview
- fortune.com Anthropic debuts Claude Opus 5
- officechai.com Claude Opus 5 Benchmarks
- trendytechtribe.com Fable 5 Back in Your Plan
🦋 Discussion sur Bluesky
Discuter sur Bluesky