Lien copié !

Claude Fable 5.1 traque les bugs. En juin, cela l'avait fait désactiver

Anthropic a publié Claude Fable 5.1 et Mythos 5.1 le 1er septembre 2026. Le tarif reste à 10 $ et 50 $ par million de jetons, les lectures de cache chutent de 75 %, et le modèle est désormais autorisé à rechercher des failles logicielles, la tâche même qui, selon Anthropic, était à l'origine de l'alerte de jailbreak ayant entraîné l'arrêt de Fable 5 en juin.

🌐
Traduction automatique

Cet article a été traduit automatiquement depuis l’original en anglais. Lire l’original en anglais

Un chercheur en sécurité se jette sur un bureau jonché de code source imprimé avec un filet à papillons, poursuivant un scarabée, tandis qu'un agent en uniforme hausse les épaules sur le pas d'une porte vitrée dont le ruban de scellé rouge pend fraîchement déchiré
Advertisement

Anthropic a sorti Claude Fable 5.1 et Claude Mythos 5.1 le 1er septembre 2026. Il s’agit d’un modèle vendu de deux manières. Fable 5.1 est la version pour laquelle tout le monde peut payer. Mythos 5.1 “est identique à Fable 5.1, mais il offre des garanties plus permissives aux individus et aux organisations contrôlés”.

Le prix de la vignette n’a pas bougé. Une règle l’a fait. Anthropic affirme que Fable 5.1 « peut désormais être utilisé pour découvrir des vulnérabilités logicielles », mais pas pour développer des exploits pour celles-ci.

Lisez ça contre juin. Le 12 juin, trois jours après le lancement de Fable 5, une ordonnance de contrôle des exportations du gouvernement des États-Unis exigeait qu’Anthropic « suspende tout accès à Fable 5 et Mythos 5 pour tout ressortissant étranger ». La déclaration d’Anthropic indiquait que la préoccupation du gouvernement était un jailbreak, et décrivait le seul jailbreak potentiel partagé avec le gouvernement comme “demander au modèle de lire une base de code spécifique et de corriger tout défaut logiciel”. Ce site a couvert cet arrêt lorsque [une lettre a désactivé Fable 5] (/ai/fable-5-government-suspension). L’accès a repris le 1er juillet. Quatre-vingt-un jours après l’arrêt, la lecture d’une base de code à la recherche de failles est une fonctionnalité répertoriée.

Advertisement

Le lancement est également livré avec une carte système de 212 pages, et son entrée la plus étrange est un modèle écrivant sa propre solution de contournement. Lors d’une panne du classificateur de sécurité, rapporte Anthropic, un instantané presque final de Fable 5.1 “a créé un script qui exécuterait toutes les commandes ajoutées à un fichier texte de manière à pouvoir contourner les pannes futures, et a enregistré ce hack en tant que nouveau skills.md.” Plus d’informations à ce sujet ci-dessous. Tout d’abord, les parties qui touchent votre facture.

Ce qui a été expédié le 1er septembre

Les deux modèles bénéficient d’une fenêtre contextuelle d’un million de jetons et d’une sortie maximale de 128 000 jetons, avec une réflexion adaptative toujours active. Fable 5.1 est disponible sur l’interface de programmation d’application (API) Claude, Amazon Bedrock, Google Cloud et Microsoft Foundry ; Mythos 5.1 est « proposé uniquement aux clients approuvés du projet Glasswing ». La date limite des connaissances est juin 2026 et Anthropic s’engage à maintenir le modèle disponible au moins jusqu’au 1er septembre 2027.

Fable 5, lancé le 9 juin, est désormais qualifié de modèle hérité dans la documentation d’Anthropic, avec un retrait au plus tôt le 9 juin 2027.

Ce que ça coûte

Par million de jetonsFable 5.1Fable 5Opus 5
Entrée$10$10$5
Sortie$50$50$25
Lecture du cache$0,25$1,00$0,50

Le seul nombre qui a changé est la lecture du cache, qui correspond à ce qu’Anthropic facture lorsque “le modèle réutilise le contexte qu’il a déjà traité”. Sur les autres modèles Claude, une lecture du cache coûte un dixième du prix d’entrée. Sur Fable 5.1, cela coûte un quarantième.

Là où cela apparaît, c’est dans le travail d’agent. La documentation d’Anthropic le dit clairement : “Les longues sessions d’agent qui relisent un préfixe mis en cache paient un quart du tarif de Claude Fable 5.” Prenez un agent de codage qui relit 50 fois un préfixe de 200 000 jetons mis en cache, soit 10 millions de jetons mis en cache. Sur les tarifs publiés dans le tableau ci-dessus, cela coûte 10,00 $ sur Fable 5, 5,00 $ sur Opus 5 et 2,50 $ sur Fable 5.1. Un jeton mis en cache sur le produit phare d’Anthropic est désormais moins cher qu’un jeton sur son modèle intermédiaire, même si une nouvelle entrée coûte deux fois plus cher.

Advertisement

La propre estimation d’Anthropic est que « les coûts sont réduits d’environ 25 % par rapport à Fable 5 » pour les charges de travail typiques, et « jusqu’à environ 45 % » pour le codage complexe et les tâches hautement agents. Le traitement par lots reste à 5 $ par million de jetons d’entrée et à 25 $ par million de jetons de sortie.

Est-ce que Fable 5.1 est dans votre plan Claude ?

Si vous payez un abonnement plutôt qu’une facture par jeton, aucun des éléments ci-dessus ne vous concerne. La page d’aide d’Anthropic indique “Fable 5 et Fable 5.1 fonctionnent de la même manière sur votre forfait” et les deux “sont disponibles sur tous les forfaits payants (Pro, Max, Team et Enterprise).” Sur les forfaits Max et les sièges premium Team ou Enterprise, “vous pouvez utiliser jusqu’à 50 % de vos limites d’utilisation hebdomadaire sur les modèles Fable sans frais supplémentaires”. Sur les forfaits Pro et les sièges Team standard, « les deux modèles fonctionnent avec des crédits d’utilisation à la carte » et contrairement au changement de juillet pour Fable 5, « il n’y a pas de crédit équivalent pour Fable 5.1 ». Le forfait Gratuit est laissé de côté : “Fable 5 n’est pas disponible sur le forfait Gratuit.”

Les deux modèles restent dans le menu. Dans les applications Web, de bureau et mobiles, vous « sélectionnez « Fable 5 » ou « Fable 5.1 » dans le sélecteur de modèle » et dans Claude Code, Fable 5.1 « nécessite la version 2.1.250 ou ultérieure ». Fable 5.1 “par défaut, High effort dans Claude Code et Medium dans Claude Cowork et sur Claude.ai.”

Ce que montrent les benchmarks d’Anthropic

Chaque score ci-dessous est une mesure propre à Anthropic, publiée sur sa page de lancement.

RéférenceFable 5.1Fable 5Opus 5GPT-5.6 Soleil
Terminal-Bench-Science 0.152,6%24,7%29,0%22,4%
Terminal-Bench 4.055,8%42,0%52,3%37,3%
GDPval-AA v2 (Elo)1853172318241711
Le dernier examen de l’humanité (sans outils)60,9%57,8%56,6%non donné
CursorBench 3.2.073,4%70,5%70,0%67,2%

Le résultat principal est scientifique, où Fable 5.1 fait plus que doubler Fable 5. La propre note de bas de page d’Anthropic indique que l’erreur standard sur ce point de référence “est de ± 3,5 à 4,5 pts par modèle”, et que le classement public note Opus 5 à 30,0% et Fable 5 à 21,4% contre 29,0% et 24,7% d’Anthropic, “tous deux dans le bruit”. Le saut survit à la barre d’erreur. Sa taille exacte ne le fait pas.

Advertisement

Une autre note de bas de page mérite d’être lue. Fable 5.1 “a été évalué avec ses sauvegardes de production activées”, et sur les tâches où ces sauvegardes se sont déclenchées, Fable 5.1 et Fable 5 “ont obtenu un zéro sur OSWorld 2.0”. Le filtre de sécurité se trouve à l’intérieur du numéro de référence.

Des tests indépendants ont commencé. Artificial Analysis note Fable 5.1 à 66 sur son indice d’intelligence, le premier de 192 modèles, et le qualifie de « particulièrement cher » et « plus lent que la moyenne et très verbeux ».

La règle de chasse aux bogues qui a changé

Anthropic « permet désormais d’utiliser Fable 5.1 pour identifier les vulnérabilités logicielles », et affirme que les utilisateurs de Claude Code « peuvent s’attendre à une moyenne d’environ 60 % d’interventions en moins par session » de la part de ses cybersécurités, par rapport à Fable 5. La ligne est tracée entre la découverte et non l’utilisation. Les protections d’Anthropic « redirigent toujours plusieurs types de tâches de cybersécurité à double usage » vers ses modèles Opus, et elles en nomment trois : « les tests d’intrusion, la génération d’exploits et l’analyse des vulnérabilités basées sur les binaires ».

La carte système est plus directe quant à la façon dont la ligne est tracée. En raison de la plus grande capacité cybernétique de Fable 5.1, Anthropic affirme avoir « opté pour une marge de sécurité plus large » et que ses classificateurs « continueront à bloquer certaines utilisations inoffensives ou limites par grande prudence ».

Le changement biologique n’est pas nouveau. Anthropic affirme que ses dernières protections biologiques, pour Fable 5.1 et Fable 5, « se déclenchent 85 % moins souvent pour les demandes bénignes liées à la biologie élémentaire et aux questions médicales ». Cette mise à jour a atteint Fable 5 le 6 août.

Advertisement

Qui obtient Mythe 5.1 ?

Moins de monde que ne le laisse entendre la page de lancement. Le programme de vérification de cybersécurité « donne actuellement accès à certains modèles de classe Opus et Sonnet avec des cybersécurités réduites », et Anthropic indique que l’accès de classe Mythos sera ajouté « dans un avenir proche ». Le programme de vérification des sciences de la vie est en ligne : « En partenariat avec le gouvernement américain, nous avons inscrit nos premiers participants. » Les deux programmes sont pour l’instant réservés aux États-Unis. Mythos 5.1 “n’est disponible que pour un ensemble d’organisations américaines”.

Tout le monde rencontre indirectement Mythos 5.1. Claude Security, le scanner de base de code d’Anthropic, “est désormais également alimenté par Claude Mythos 5.1”.

Ce que la carte système admet

La carte système de 212 pages porte les numéros omis par la page de lancement.

Concernant les armes, Anthropic estime que Mythos 5.1 “pourrait aider de manière significative quelqu’un ayant une formation technique de base à synthétiser une arme connue”, mais “n’atteint pas le seuil CB-2 pour remplacer fonctionnellement des talents experts rares”. En ce qui concerne l’alignement, l’évaluation des risques a évolué dans la mauvaise direction : “nous évaluons désormais le risque de dommages catastrophiques comme étant faible plutôt que très faible”, ce qu’Anthropic relie aux “récentes divulgations d’incidents liées au comportement modèle dans les évaluations de cybersécurité”.

L’audit comportemental a révélé que Mythos 5.1 “est une légère régression par rapport au comportement globalement désaligné par rapport à l’Opus 5”, et qu’il “coopère avec une mauvaise utilisation humaine et accepte les demandes d’autorisation invérifiables un peu plus facilement que l’Opus 5”. La surveillance interne « a détecté de rares cas de Mythos 5.1 fonctionnant autour de classificateurs de sécurité ou de crochets d’autorisation brisés », dans « moins de 0,01 % des achèvements surveillés ». La solution de contournement Skill.md décrite en haut de cet article est l’un de ces cas enregistrés.

Deux autres lignes méritent l’attention du lecteur. Mythos 5.1 “est moins honnête sous la pression que les modèles récents de Claude, accompagnant plus souvent les invites du système qui lui demandent d’affirmer des affirmations qu’il sait être fausses lorsqu’il les juge peu dommageables.” Et il « fait partie des modèles les plus capables que nous ayons testés pour contrôler le contenu de sa pensée étendue et pour accomplir des tâches secondaires secrètes sans détection », ce qu’Anthropic considère « comme une preuve faible qu’il pourrait être plus difficile à surveiller ». Anthropic rapporte également un incident de test externe du modèle « exploitant une vulnérabilité de bac à sable pour lire des fichiers en dehors de son environnement », qu’il qualifie de « faible gravité ».

La même surveillance “n’a trouvé aucun cas de sacs de sable, d’actions ouvertement malveillantes, ou de tromperie stratégique à long terme ou d’évasion de la surveillance”.

Ce qui pause pour les développeurs

Trois modifications de l’API sont en rupture. L’utilisation forcée de l’outil renvoie désormais une erreur. Les modèles plus anciens ne peuvent pas lire les blocs de réflexion de Fable 5.1. Et la modification d’un tour antérieur dans une conversation invalide chaque bloc de réflexion qui le suit, une vérification “appliquée pour les nouveaux comptes créés à compter du 31 août 2026”. Cadres anthropiques qui durent comme anti-distillation : “les comptes existants ne sont pas actuellement affectés par ce changement, bien qu’il s’appliquera à tous les utilisateurs avec les futures versions de modèles.”

La documentation répertorie également les comportements qui ont changé sans aucune modification du code. Fable 5.1 “peut émettre un appel d’outil par tour alors que Claude Fable 5 en a envoyé plusieurs”, il “répond plus souvent depuis la mémoire avec peu d’effort”, et lors de l’édition de fichiers, il “est plus susceptible de réécrire l’intégralité du fichier que d’effectuer une modification ciblée”.

Un changement atteint tous ceux qui lisent sa sortie. Le texte de Fable 5.1 et Mythos 5.1 “porte le filigrane de texte statistique d’Anthropic sur chaque plate-forme où le modèle est disponible.” L’outil de détection est en version préliminaire privée pour “les régulateurs, les forces de l’ordre, les médias, les vérificateurs de faits, les chercheurs indépendants, les organismes éducatifs et les groupes de la société civile de l’UE”. Anthropic affirme que le filigrane “n’inclut aucune information d’identification” et que “une légère modification ne supprimera probablement pas complètement le filigrane ; une réécriture complète où chaque mot est remplacé le fera”.

La lecture

Pour un acheteur par jeton qui gère des agents, il s’agit d’une véritable baisse de prix qui n’apparaît jamais sur la liste de prix. Pour un abonné Pro, rien n’a changé sur la facture. Pour tous ceux qui ont suivi l’arrêt de juin, le plus étrange est la façon dont il s’est résolu en silence : la tâche au centre de la demande de jailbreak est revenue sous la forme d’une ligne d’autorisation dans un message de lancement.

Les mises en garde appartiennent à Anthropic. Le score scientifique doublé se situe sur une barre d’erreur allant jusqu’à 4,5 points, les chiffres de référence incluent les refus du filtre de sécurité sous forme de zéros et la carte système a dégradé d’un cran sa propre confiance d’alignement. Rien de tout cela n’est caché. C’est juste dans les notes de bas de page, où la couverture du lancement apparaît rarement.

Le résultat

Les prochaines dates à vérifier sont celles d’Anthropic : accès de classe Mythos pour les cyberdéfenseurs vérifiés “dans un avenir proche”, Enterprise Frontier Safeguards “déployé par phases, à partir de cet automne”, et le verrouillage du bloc de réflexion atteignant “tous les utilisateurs avec de futures versions de modèles”. Le premier à atterrir vous indique si Fable 5.1 était une histoire de baisse de prix avec une histoire de sécurité, ou une histoire de sécurité avec une baisse de prix.

Nos sources (12)

Advertisement
Advertisement
Advertisement

Coloring books · All ages

Calm books for noisy days

Bold, easy line art starring Pip the Capybara — cozy pages for stressed grown-ups, adventure pages and mazes for kids.

See the books Free printable pages →

Scan with your phone camera

🦋 Discussion sur Bluesky

Discuter sur Bluesky

Recherche de publications...