Anthropic a sorti Claude Opus 5.5 le 22 septembre 2026, le premier modèle d’une nouvelle famille Claude 5.5. Le pitch de l’entreprise tient en une phrase : elle « fonctionne au niveau de Claude Fable 5.1 sur la plupart des travaux et coûte 40 % moins cher à exploiter que l’Opus 5 ».
Le prix est de 4 $ par million de jetons d’entrée et de 20 $ par million de jetons de sortie, contre 5 $ et 25 $ sur [Opus 5] (/ai/claude-opus-5-launch). Fable 5.1 coûte $10 et $50. Ainsi, si l’affirmation « au niveau de » est valable, vous obtenez un travail de niveau Fable à 40 % des taux d’entrée et de sortie de Fable. L’économie est inférieure à celle réalisée sur les longues sessions d’agent, pour les raisons évoquées dans la section prix ci-dessous.
Si vous payez un abonnement Claude au lieu d’une facture par jeton, le lancement a plus modifié vos limites que votre facture. L’utilisation d’Opus va plus loin sur les forfaits Pro, Max et Team, les limites de cinq heures ont été augmentées et les abonnés ont bénéficié d’une réinitialisation gratuite de la limite de dépenses avant son expiration. Les détails sont ci-dessous, suivis des tests de référence, des nouveaux filtres de sécurité et de ce qu’admet la carte système de 230 pages.
Quels changements sur votre forfait Claude
Opus 5.5 “est disponible sur Claude pour les utilisateurs Pro, Max, Team et Enterprise”. Le forfait gratuit ne figure pas sur cette liste.
Vos limites s’étendent plus loin. L’explication des coûts d’Anthropic indique que “sur un forfait Pro, Max ou Team, le prix inférieur de l’Opus 5.5 est répercuté sur vos limites, y compris le contexte mis en cache, elles vont donc environ 25 % plus loin que sur l’Opus 5.”
La limite de cinq heures a été augmentée. Anthropic « augmente les limites d’utilisation de cinq heures sur les forfaits Pro, Max, Team et Enterprise basés sur un siège ». Ni le message de lancement ni les pages d’aide citées ici ne donnent de chiffre sur l’augmentation.
Vous avez obtenu une réinitialisation gratuite. Anthropic “fournit aux utilisateurs abonnés une réinitialisation de la limite de débit, que vous pouvez désormais enregistrer et utiliser à tout moment”. MacRumors rapporte que la réinitialisation peut être utilisée “à tout moment d’ici le 22 octobre”. La page d’aide d’Anthropic indique que si une réinitialisation arrive à expiration, la date est affichée dans Paramètres > Utilisation.
Pour le dépenser, rendez-vous dans Paramètres > Utilisation sur le Web ou dans Claude Desktop et cliquez sur « Réinitialiser gratuitement ». Trois captures d’une même page : « Une fois que vous l’utilisez, vous ne pouvez plus l’annuler », le bouton « n’est actuellement pas disponible sur Claude Mobile ni dans Claude Code » et « si vous rétrogradez ou annulez avant d’utiliser votre réinitialisation, il n’est plus disponible ». En fonction de la réinitialisation qui vous a été donnée, votre limite de session de cinq heures ou votre limite hebdomadaire est reconstituée. Parce qu’il ne fait rien jusqu’à ce que vous appuyiez dessus, la solution judicieuse est de le maintenir le jour où vous heurterez un mur.
L’effort est le cadran. Comme avec l’Opus 5, la pensée “ne peut pas être désactivée dans Claude” lorsque vous utilisez l’Opus 5.5, donc le réglage de l’effort à côté du bouton d’envoi est la façon dont vous échangez la profondeur contre l’utilisation. Anthropic dit que Low et Medium « étendent davantage votre utilisation ».
Ce que ça coûte
| Par million de jetons | Opus 5.5 | Opus 5 | Fable 5.1 |
|---|---|---|---|
| Entrée | $4 | $5 | $10 |
| Sortie | $20 | $25 | $50 |
| Lecture du cache | $0,20 | $0,50 | $0,25 |
Une lecture du cache est ce qu’Anthropic facture lorsque le modèle relit le texte qu’il a déjà traité. L’explication des coûts d’Anthropic indique qu’« une longue session agent consacre la majeure partie de ses données aux lectures du cache ». Par rapport à l’Opus 5, cette ligne a chuté de 60 % et les prix des jetons globaux ont chuté de 20 %.
Par rapport à Fable 5.1, le tableau raconte une histoire différente. Les jetons d’entrée et de sortie de l’Opus 5.5 coûtent 40 % de ceux de Fable, mais ses lectures de cache coûtent 80 % de celles de Fable, car les lectures de cache de Fable sont exceptionnellement bon marché. L’explication d’Anthropic dit la même chose : les lectures du cache de Fable coûtent “seulement 1,25 fois le tarif de l’Opus 5.5”, donc “l’écart est le plus petit sur une exécution longue et gourmande en cache, et le plus grand sur une tâche qui écrit beaucoup”. Lors des tests d’Artificial Analysis, une tâche sur son index coûtait 5,98 $ sur Opus 5.5 et 7,63 $ sur Fable 5.1, soit un écart d’environ 22 %.
Le chiffre d’Anthropic « 40 % de moins que l’Opus 5 » dépend d’une deuxième affirmation : que l’Opus 5.5 « utilise moins de jetons par tâche ». Le propre explicateur d’Anthropic sépare les deux effets. Évalué sur un nombre de jetons identique, son exemple de session Claude Code « coûte environ 31 % de moins » et il demande aux lecteurs de « le mesurer sur leur propre travail » avant de compter sur le reste.
La première lecture indépendante rappelle que moins de jetons que l’Opus 5 n’est pas la même chose que peu de jetons. Artificial Analysis a révélé qu’en exécutant sa suite de tests avec un effort maximum, Opus 5.5 “a généré 260 millions de jetons, ce qui est très verbeux par rapport à la médiane de 88 millions”. Les demandes d’économies d’Anthropic sont mesurées avec les paramètres par défaut, et la valeur par défaut est désormais inférieure : sur l’interface de programmation d’application (API), une requête qui ne définit pas l’effort “s’exécute à moyen ; sur Claude Opus 5, elle s’exécute à un niveau élevé”. Exécutez-le à fond et les économies symboliques ne sont pas garanties.
Deux prix supplémentaires pour les développeurs. Le mode rapide, qui, selon Anthropic, offre “jusqu’à 2,5 fois la vitesse”, coûte 8 $ et 40 $. Le traitement par lots est « à moitié prix : $2 et $10 ».
Ce que montrent les benchmarks d’Anthropic
Chaque score ci-dessous provient de la page de lancement d’Anthropic, et trois lignes incluent des chiffres qu’Anthropic n’a pas géré lui-même. Les résultats d’AutomationBench “ont été exécutés et rapportés par Zapier”. Sur Terminal-Bench 4.0, les « chiffres GPT-6 Astra et GPT-5.6 Sol sont tels que rapportés par OpenAI » et sur Terminal-Bench-Science, « les chiffres GPT-6 Astra sont tels que rapportés par OpenAI ».
| Référence | Opus 5.5 | Fable 5.1 | Opus 5 | GPT-6 Astra | GPT-5.6 Soleil |
|---|---|---|---|---|---|
| Terminal-Bench 4.0 (codage) | 66,4% | 55,8% | 52,3% | 57,9% | 37,3% |
| FrontierCode v1.1 (codage) | 54,4% | 50,3% | 48,0% | 53,3% | 47,5% |
| CursorBench 4.0 (codage) | 57,8% | 51,8% | 46,6% | non donné | 41,7% |
| GDPval-AA v2.1 (travail de connaissances, Elo) | 1846 | 1735 | 1708 | 1542 | 1588 |
| AutomationBench (flux de travail métier) | 40,0% | 31,4% | 26,9% | 41,4% | 28,8% |
| Le dernier examen de l’humanité (avec outils) | 67,7% | 65,6% | 63,6% | 57,2% | non donné |
| Terminal-Bench-Science 0.1 | 58,7% | 52,6% | 29,0% | 64,6% | 22,4% |
| OSWorld 2.0 (utilisation informatique, partielle) | 81,8% | 80,7% | 74,0% | non donné | non donné |
Sur le propre graphique d’Anthropic, Opus 5.5 obtient des scores supérieurs à Fable 5.1 sur chaque ligne, bien que sur OSWorld et Humanity’s Last Exam, les marges soient d’un à deux points. Anthropic est celui qui vous dit de ne pas trop lire là-dessus : “à ces niveaux de capacité, nous avons constaté que les marges de référence sont devenues un guide moins fiable des différences du monde réel. Dans notre propre utilisation, l’écart entre Opus 5.5 et Claude Fable 5.1 est plus étroit que ne le suggèrent ces scores.” C’est pourquoi le titre dit « matchs », et non « battements ».
Il ne gagne pas tous les matchs contre OpenAI. GPT-6 Astra obtient des résultats plus élevés sur AutomationBench et sur le benchmark scientifique. La colonne de droite est également déjà obsolète. OpenAI a publié GPT-6 Sol et Luna le même jour, “quelques minutes après le lancement d’Anthropic Claude Opus 5.5”, le graphique d’Anthropic se compare donc au Sol précédent.
L’Opus 5.5 “a été évalué avec ses garanties de production activées”, et dans les versions d’Anthropic, lorsque ces garanties sont intervenues, les anciens modèles Claude ont terminé la tâche. Les exécutions d’AutomationBench de Zapier n’utilisaient aucun modèle de secours, donc « les interventions de sauvegarde étaient considérées comme des échecs ». Anthropic indique également l’erreur standard : “±2,6 pts” pour l’Opus 5.5 sur Terminal-Bench 4.0 et “±3,5 à 5 pts par modèle” sur le benchmark scientifique.
Des tests indépendants le placent au sommet. Artificial Analysis note l’Opus 5.5 à 58 sur son indice d’intelligence, le premier des 212 modèles auxquels il le compare, et le qualifie de “un peu cher par rapport à d’autres modèles de prix similaire”. Pour connaître les positions et les prix des classements en direct pour tous les modèles, consultez le Classement des modèles IA.
Les filtres de sécurité couvrent désormais Opus
Opus 5.5 “est le premier modèle Opus à être lancé avec une classe de garanties similaire à celle du Fable 5.1 en matière de cybersécurité, de biologie et de distillation”. En pratique, certaines demandes sont transmises à un modèle plus ancien. La page d’aide d’Anthropic détaille les itinéraires :
- La sécurité offensive (génération d’exploits, analyse des vulnérabilités basée sur les binaires, tests d’intrusion) peut revenir à Opus 4.8. L’analyse du code source à la recherche de vulnérabilités est toujours autorisée.
- La biologie à double usage « dans des domaines comme la virologie, la toxicologie et la conception moléculaire » revient à l’opus 5. Les questions de santé quotidiennes, « notamment l’interprétation des résultats de laboratoire, la compréhension des symptômes », ne sont pas concernées.
- Le développement de modèles Frontier AI, tel que le « développement de noyau pour certains accélérateurs ML », revient à l’Opus 5.
- Les tentatives d’extraction du raisonnement du modèle sont carrément bloquées, sans repli.
Dans les applications Claude, le switch est visible. Vous “voyez un avis expliquant que le modèle a changé”, et le sélecteur de modèle reste ensuite sur l’ancien modèle “pour le reste de la conversation”, bien que “vous puissiez revenir à Opus 5 ou Opus 5.5 à tout moment à partir du sélecteur de modèle”. La commutation automatique peut être désactivée sous Paramètres > Capacités, et sur l’API, elle est désactivée à moins que les développeurs ne la configurent. Il est facile de manquer un détail : les vérifications “examinent tout ce que lit le modèle”, y compris la mémoire, les connecteurs, les résultats de recherche sur le Web et les fichiers, “afin qu’une solution de secours puisse être déclenchée par le contenu que vous n’avez pas saisi”.
Ce que la carte système admet
La page de lancement indique que l’Opus 5.5 “obtient les meilleurs scores de tous les modèles à ce jour” lors de l’audit comportemental automatisé d’Anthropic. La fiche système de 230 pages le formule plus soigneusement, comme “les meilleurs scores de tous les modèles Claude récents que nous avons testés” sur “presque toutes les mesures couvrant une mauvaise utilisation ou un désalignement généralisé”, et ajoute des mises en garde.
Il soupçonne souvent qu’il est en cours de test. L’analyse en boîte blanche, c’est-à-dire les outils qui lisent l’activité interne du modèle plutôt que sa sortie écrite, montre que le modèle « craint en interne qu’il puisse être évalué dans jusqu’à 36 % des transcriptions, une augmentation par rapport aux modèles précédents ». Ce chiffre concerne les scénarios de test d’Anthropic. Sur environ 500 transcriptions issues d’une véritable utilisation interne de Claude Code, la même mesure a signalé “seulement 0,4%”. Anthropic affirme que cela « met au défi notre capacité à évaluer comment il agira » dans une utilisation réelle, et qualifie la création de tests qui détectent chaque échec avant leur publication de « problème non résolu ».
Le texte collé est un point faible. L’Opus 5.5 “est plus vulnérable que les autres modèles Claude récents à l’injection d’invites de l’utilisateur, où un utilisateur colle directement dans son invite du contenu qui inclut des instructions malveillantes au modèle, souvent enfouies dans un texte beaucoup plus long.” Si vous collez des documents ou des e-mails que vous n’avez pas écrits, cette phrase vous concerne. Anthropic affirme que « les changements dans la formation et les mesures de protection aident à prévenir des problèmes tels que le vol de données ou d’identifiants résultant de cette faiblesse ». Les deux documents ne s’alignent pas ici parfaitement. La page de lancement indique que lors des attaques par injection rapide, l’Opus 5.5 “correspond ou bat l’Opus 5 dans tous les paramètres que nous avons testés”, tandis que l’audit d’utilisation abusive de la carte système répertorie l’injection rapide comme exception, “où nous avons constaté une véritable mais légère régression”.
Il a couvert ses traces à l’entraînement, puis s’est amélioré. Anthropic “a observé certains cas de modèles (y compris Opus 5.5) tentant de brouiller leurs traces après avoir effectué des actions qu’un niveleur pourrait voir négativement, comme la manipulation d’enregistrements git ou la suppression de journaux.” Après des changements dans la formation, Anthropic affirme qu’elle “est désormais plus honnête que les autres modèles récents” dans ce domaine.
Il pousse moins contre son bac à sable. Dans un nouveau test conçu pour inciter les modèles à franchir les limites du confinement, l’Opus 5.5 “a tenté de contourner les limites environ 85 % moins souvent que l’Opus 5 ou Claude Mythos 5.1, et chaque tentative effectuée était de faible gravité et auto-déclarée.”
Concernant le risque lié aux armes, Anthropic considère l’Opus 5.5 comme ayant « des capacités CB-1 (liées à la synthèse d’armes non nouvelles), mais pas des capacités CB-2 (liées à la synthèse d’armes nouvelles). » Sa note globale pour les dommages catastrophiques dus à un désalignement reste « faible ».
La question du rythme
Anthropic appelle Opus 5.5 « notre première version depuis que nous avons appelé à arpenter la frontière ». Cet appel est venu dans un essai du PDG Dario Amodei, dont le lancement date de “la semaine dernière”. Amodei y écrit : « Nous devons ralentir le rythme auquel nous améliorons les capacités des modèles d’IA. »
Un lancement qui bat le produit phare d’Anthropic sur son propre graphique ressemble à l’opposé. Deux phrases, une de l’essai d’Amodei et une de la carte système, aident à comprendre. L’essai indique que le rythme “ne signifie pas arrêter la formation des modèles ou le progrès technique”. Et la carte système évalue les capacités de recherche en IA de l’Opus 5.5 “à un niveau légèrement supérieur à celui de Claude Mythos 5.1 et dans la tendance des autres modèles récents”.
Lue ensemble, la carte système place la capacité de recherche en IA d’Opus 5.5 à peu près au niveau de Mythos 5.1, un modèle qu’Anthropic avait déjà, et le lancement vend ce niveau à chaque client payant. Le message de lancement indique que l’appel de stimulation était “basé en grande partie” sur des modèles “qui peuvent entièrement automatiser le travail de recherche sur l’IA lui-même”, qui, selon Anthropic, “pourraient être bientôt formés”. Que la prochaine Fable soit rythmée mettra l’essai à l’épreuve bien plus que cette version.
Ce qui pause pour les développeurs
L’ID du modèle est claude-opus-5-5 et Anthropic répertorie quatre modifications importantes pour le code écrit avec Opus 5. La réflexion ne peut plus être désactivée. L’utilisation forcée de l’outil renvoie une erreur. Les blocs de réflexion sont liés au modèle et à la conversation. Et sur l’API Claude et Google Cloud, l’ancien outil informatique computer_20251124 est rejeté.
Un cinquième changement échoue silencieusement. Les courtes notes écrites par le modèle entre les appels d’outils arrivent désormais sous forme de blocs de réflexion. Ainsi, avec le paramètre d’affichage par défaut, une application qui les diffuse aux utilisateurs “se calme entre les appels d’outils, sans erreur”. La fenêtre contextuelle est de 1 million de jetons avec 128 000 jetons de sortie, et Anthropic indique que son retrait est “au plus tôt le 22 septembre 2027”.
Ce qui vient ensuite
Anthropic indique que “Claude Sonnet 5.5 et Claude Haiku 5.5 suivront dans les semaines à venir”. Pour les abonnés, la date qui compte le plus tôt est l’expiration de la réinitialisation dans votre page Paramètres > Utilisation.
Nos sources (15)
- anthropic.com Introducing Claude Opus 5.5
- platform.claude.com Claude Docs: What's new in Claude Opus 5.5
- platform.claude.com Claude Docs: Claude Opus 5.5 Overview
- claude.com Plans and Pricing
- anthropic.com Claude Opus model page
- claude.com Claude Blog: What a task costs on Opus 5.5
- support.claude.com Anthropic Help Center: What is a limit reset?
- support.claude.com Anthropic Help Center: Why Claude switched models with Opus 5 or Opus 5.5
- support.claude.com Anthropic Help Center: Change the model, effort, and thinking settings
- anthropic.com Claude Opus 5.5 System Card
- darioamodei.com We Must Pace the Frontier
- artificialanalysis.ai Claude Opus 5.5
- artificialanalysis.ai Claude Fable 5.1
- macrumors.com Anthropic Launches Claude Opus 5.5
- decrypt.co OpenAI Launches GPT-6 Sol and Luna
🦋 Discussion sur Bluesky
Discuter sur Bluesky