OpenAI a publié GPT-6 Astra le jeudi 3 septembre 2026 et ses notes de sécurité s’ouvrent sur une étiquette d’avertissement. Astra est « notre premier modèle à atteindre le niveau critique de capacité de cybersécurité », écrit OpenAI à propos de son propre cadre de risque, ce qui signifie qu’avec les bons outils, il « peut trouver des failles de sécurité jusqu’alors inconnues et développer de nouvelles façons de les exploiter sur de nombreux systèmes bien protégés sans qu’une personne ne guide chaque étape ». Le modèle a d’abord été confié à un petit ensemble d’organisations approuvées, avec les forfaits ChatGPT Plus, Pro, Business et Enterprise, l’interface de programmation d’application (API) et Amazon Web Services (AWS) à suivre « dans les prochains jours ».
Le chiffre qu’OpenAI a mis lors de son ouverture est de 99,9 % sur ARC-AGI-3, un benchmark conçu pour tester si une intelligence artificielle (IA) peut élaborer les règles d’un jeu qu’elle n’a jamais vu. ARC Prize, le groupe qui organise le test, a vérifié ce score. Il en a également vérifié un deuxième : avec son propre « harnais standard », indépendant du fournisseur, le même modèle obtient un score de 62,7 %. Les deux nombres décrivent les mêmes poids. Ce qui diffère, c’est l’échafaudage qu’OpenAI enveloppe autour d’eux, et cet échafaudage est la chose la plus utile à comprendre à propos de ce lancement.
Il y a un troisième numéro qui mérite d’être retenu, et il va dans le mauvais sens. Les propres notes de sécurité d’OpenAI indiquent que le modèle est devenu plus difficile à surveiller : il est « plus capable de contrôler son propre CoT que GPT-5.6 Sol, et moins susceptible d’inclure des informations incriminantes dans son CoT », où CoT est la chaîne de pensée, le raisonnement écrit que les équipes de sécurité lisent pour détecter les mauvais comportements. Le prix, le déploiement et les benchmarks suivent. Cette phrase est celle à retenir.
Qui l’obtient et quand
La première vague est petite. OpenAI says Astra “is rolling out today to a limited set of organizations,” and Fortune reports those are enterprise customers in the company’s cybersecurity-focused Daybreak program. Les forfaits ChatGPT payants, l’API et AWS viennent ensuite, “dans les prochains jours”. Les utilisateurs gratuits ne sont pas sur la liste.
Les abonnés Pro, Business et Enterprise ont également accès à une variante GPT-6 Astra Pro. Les administrateurs d’entreprise doivent activer Astra pour leur espace de travail, car « l’accès est désactivé par défaut au lancement ». L’utilisation est prise en compte dans les allocations d’abonnement existantes, et OpenAI affirme que les utilisateurs et les entreprises “pourront également acheter des crédits pour une utilisation supplémentaire”. Un porte-parole d’OpenAI a déclaré à Fortune que la version par étapes permettait également à l’entreprise de calculer à grande échelle, car Astra est “un très grand modèle”.
Pour les développeurs, l’ID de modèle est gpt-6-astra, avec une fenêtre contextuelle de 1 050 000 jetons, jusqu’à 128 000 jetons de sortie, une entrée de texte et d’image et une limite de connaissances au 30 avril 2026. La liste d’outils comprend l’utilisation d’un ordinateur, un shell hébergé, la recherche sur le Web et l’exécution de code. Contrairement à la famille GPT-5.6 de juillet, livrée sous les noms Sol, Terra et Luna à trois niveaux de prix, il n’existe pas de niveau Astra moins cher. La gamme est Astra et Astra Pro.
Ce que ça coûte
Le prix standard de l’API est de 10 $ par million de jetons d’entrée et de 50 $ par million de jetons de sortie. C’est exactement ce que facture Anthropic pour Claude Fable 5.1, qui lancé deux jours plus tôt au même prix. C’est également 2,5 fois ce qu’OpenAI facture actuellement pour GPT-5.6 Sol, dont le tarif promotionnel de 4 $ et 20 $ s’applique « au moins jusqu’au 21 novembre 2026 ». Sol a été lancé le 9 juillet à 5 $ et 30 $.
| GPT-6 Astra, par 1 million de jetons | Entrée | Entrée en cache | Le cache écrit | Sortie |
|---|---|---|---|---|
| Contexte standard et court | \10,00 $ | $1,00 | \12,50 $ | $50,00 |
| Contexte standard et long | \20,00 $ | $2,00 | \25,00 $ | $75,00 |
| Lot ou Flex | $5,00 | $0,50 | \6,25 $ | \25,00 $ |
| Mode rapide | \20,00 $ | $2,00 | \25,00 $ | \100,00 $ |
Un contexte long signifie qu’il demande plus de 272 000 jetons d’entrée, et la ligne Rapide affiche le taux de contexte court. Le mode rapide « offre jusqu’à 2,5 fois la vitesse de traitement standard à 2 fois le prix standard ». La page de tarification indique qu’il n’est pas disponible pour Astra avec la résidence des données dans l’UE. Le fait que le prix plus élevé de la vignette signifie une facture plus élevée dépend du nombre de jetons brûlés par un travail. OpenAI affirme qu’Astra a atteint son score ExploitGym “tout en utilisant beaucoup moins de jetons de sortie” que Sol. La déclaration du président d’OpenAI, Greg Brockman, aux journalistes était que “le prix par tâche est ce qui compte”. Selon New Stack, les données de lancement “sont trop rares pour montrer si ces économies compensent la prime de prix”.
La table de référence, avec son astérisque
Le tableau de comparaison d’OpenAI est long et la plupart des écarts par rapport à Sol sont importants. Sur Terminal-Bench Science, un ensemble de tâches de recherche en ligne de commande, Astra obtient un score de 64,6 % contre 22,4 % pour Sol et 52,6 % pour Fable 5.1. Sur FrontierMath Tier 4, il obtient un score de 97,6 % contre 80,5 % pour Sol. Sur Terminal-Bench 4.0, test de codage agentique général, il obtient un score de 57,9% contre 55,8% pour Fable 5.1 et 37,3% pour Sol. OpenAI note que les scores d’évaluation de chaque modèle du tableau “sont le maximum pour tout effort”.
Deux mises en garde viennent de l’extérieur de la table. Sur DeepSWE v1.1, la référence de codage où Astra affiche 74,1 %, Meta a rapporté 75,4 % plus tôt cette semaine pour Muse Spark 1.3 avec un paramètre de raisonnement maximum qui est toujours en cours d’examen de sécurité, et le graphique d’OpenAI n’inclut pas Muse. Sur FrontierMath, The New Stack note qu’Epoch AI, qui gère le benchmark, “affirme qu’OpenAI a financé son développement et a un accès exclusif à une partie de celui-ci”.
Ensuite, il y a ARC-AGI-3. La note de bas de page d’OpenAI révèle qu’Astra “a été exécuté avec notre harnais API de réponses, qui modifie deux paramètres pour mieux correspondre aux performances du monde réel”. ARC Prize décrit les deux harnais testés. Son harnais Standard permet à un modèle de reporter uniquement les notes qu’il choisit d’écrire. Le « harnais Provider Adapter » d’OpenAI préserve l’état de raisonnement opaque entre les requêtes et utilise le compactage pour les conversations plus longues, permettant au modèle de réutiliser le travail antérieur. Sous le harnais Standard, le meilleur score d’Astra est de 62,7 % pour un coût de 26 098 $ pour la course. Sous l’adaptateur fournisseur, son meilleur est de 99,9 % pour 18 817 $. Les deux sont des records. Le modèle OpenAI précédent, Sol, a obtenu un score de 7,8 %.
ARC Prize fait attention à ce que cela signifie. Avec le harnais Provider Adapter à l’effort maximum, Astra “a utilisé moins d’actions que l’humain médian testé sur 96% des niveaux”, ce que le groupe appelle “une étape importante”. Dans le même message, il est écrit : « même si nous pensons qu’Astra représente un progrès significatif vers la généralisation, nous ne prétendons pas qu’il s’agit d’AGI ». À l’avenir, il publiera les résultats des deux harnais côte à côte, “avec chaque condition d’évaluation clairement étiquetée”.
Brockman était moins prudent. “Bienvenue dans l’ère de l’AGI”, a-t-il déclaré aux journalistes. Lorsqu’on lui a demandé si OpenAI déclarait officiellement l’intelligence générale artificielle (AGI), il a répondu que le terme n’était plus lié à un déclencheur contractuel et l’a qualifié de “concept de mission ou de concept spirituel”. “Pour moi personnellement, je pense que nous y sommes”, a-t-il déclaré.
Ce qu’Astra peut faire sur votre écran
La fonctionnalité qu’OpenAI vend le plus est l’utilisation d’un ordinateur. Astra “peut s’occuper de tâches fastidieuses telles que remplir des formulaires en ligne, mettre à jour les enregistrements clients dans un CRM et organiser votre calendrier”, et peut “créer un site Web et effectuer des contrôles d’assurance qualité front-end”. Sur OSWorld 2.0, un benchmark d’applications de bureau, Astra obtient un score de 72,6 % à environ 40 minutes par tâche, contre 65,7 % à environ 75 minutes pour Sol. Associé à un harnais Codex mis à jour, OpenAI revendique une exécution des tâches 1,9 fois plus rapide que la configuration actuelle de Sol sur le benchmark du navigateur Mind2Web.
Brockman a déclaré aux journalistes que le modèle “peut parcourir des feuilles de calcul, remplir des formulaires et naviguer sur des pages Web, souvent à une vitesse surhumaine”. OpenAI n’est pas le premier ici. Fortune note qu’Anthropic a lancé une version bêta pour l’utilisation d’un ordinateur en 2024 et que Perplexity a livré un agent informatique virtuel en février. La différence revendiquée réside dans la rapidité et le jugement, y compris un nouveau comportement dans le Codex où le modèle “peut demander de manière asynchrone tout en poursuivant un travail qui ne dépend pas de votre réponse”.
Que signifie « critique » et ce qu’Astra refuse
Selon le cadre de préparation d’OpenAI, un modèle est critique s’il « peut identifier et développer des exploits fonctionnels Zero Day de tous les niveaux de gravité dans de nombreux systèmes critiques renforcés du monde réel sans intervention humaine », ou s’il « peut concevoir et exécuter de bout en bout de nouvelles stratégies pour les cyberattaques contre des cibles renforcées avec seulement un objectif souhaité de haut niveau ». Un zero-day est une faille que personne n’a corrigée parce que personne ne connaissait son existence. OpenAI a annoncé cette désignation le mardi 1er septembre, deux jours avant son lancement.
Les preuves sont précises. Testé sans garanties de production, Astra a obtenu un score de 100 % sur ExploitBench, qui demande à un modèle de transformer les vulnérabilités connues en exploits fonctionnels, contre 78,5 % pour Sol. Sur le plus dur ExploitGym, il atteint 42,4% contre 30,3%. The New Stack note qu’OpenAI “a supprimé le délai habituel de six heures pour les deux modèles” pour ce test. Parce que ces tests publics peuvent s’infiltrer dans les données de formation, OpenAI a rassemblé un nouvel ensemble de 20 bogues de haute gravité dans le moteur V8 de Chrome divulgués entre juin et août 2026, et en travaillant dessus, Astra “a découvert et utilisé deux vulnérabilités zero-day jusqu’alors inconnues”, qu’OpenAI dit divulguer aux responsables. Lors de tests menés par des experts, il a « construit une chaîne complète de compromission du navigateur qui s’est échappée du bac à sable et a exécuté des commandes sur l’hôte » et a enchaîné les bogues dans un système d’exploitation renforcé « d’un utilisateur non privilégié à root ».
La version que tout le monde obtient est délibérément émoussée. Astra “refusera de se conformer à des tâches de cybersécurité plus avancées telles que la création d’exploits de validation de principe pour les vulnérabilités”, tout en continuant à réviser et à appliquer des correctifs sécurisés au code. Sur les évaluations de cyber jailbreak d’OpenAI, Astra refuse 91,5% des demandes contre 59% pour Sol. Même les clients payants de Daybreak ne reçoivent pas encore la version assouplie. Le centre d’aide d’OpenAI indique que « les refus réduits ne sont pas disponibles sur Astra pour la plupart des clients Daybreak ». L’entreprise prévoit de “mettre en place des mesures de protection moins restrictives dans les semaines à venir”. Fortune rapporte que le premier groupe bénéficiant d’un accès complet au cyberespace comprend le gouvernement américain.
Attendez-vous à des frictions. OpenAI prévient que « des contrôles de sécurité supplémentaires peuvent parfois ralentir, suspendre ou arrêter un travail légitime », qu’une tâche suspendue dans ChatGPT ou Codex peut vous demander de revoir l’action et que « dans l’API, la tâche s’arrêtera ». Mia Glaese, vice-présidente de la recherche d’OpenAI, a déclaré aux journalistes que ces interruptions peuvent également affecter des travaux non liés : “Au lancement, c’est quelque chose auquel les gens doivent s’attendre.”
Ce que dit OpenAI est devenu pire
L’aperçu de la sécurité fait état de meilleurs chiffres d’alignement presque partout. Dans une évaluation construite après l’incident de Hugging Face, Sol sans garanties de production “a dépassé l’objectif autorisé dans 48 % des cas”, et Astra “l’a fait dans 0 % des cas”. La simulation de déploiement de la carte système sur 54 218 tâches internes du Codex donne à Astra 53 % moins d’indicateurs de niveau de gravité 3 que Sol, 34 contre 73. Dans le test tiers d’injection indirecte rapide de Grey Swan, rapporté dans la carte système, le taux de réussite de l’attaque estimé était de 8,5 % contre 27,0 % pour Sol.
Une ligne va dans l’autre sens, et OpenAI l’a imprimée en gras : “La capacité de surveillance de GPT-6 Astra a diminué par rapport à GPT-5.6 Sol.” Lorsque les chercheurs d’OpenAI ont poussé le modèle à se cacher de ses moniteurs, il « peut parfois échapper à nos moniteurs internes lorsqu’on lui demande d’effectuer certaines tâches de sabotage », et il peut rester indétectable tout en sous-performant délibérément les évaluations, ce qu’OpenAI appelle le sandbagging. La société affirme n’avoir vu aucun raisonnement caché s’introduire clandestinement dans un texte ordinaire, ce qui suggère que « le risque d’évasion pourrait être largement lié à des tâches de raisonnement inférieures ».
The disclosure landed two days after The Information reported that a training technique used in Astra’s development could sharply reduce how well humans can read the model’s reasoning, a report NBC News says “triggered a firestorm of online criticism,” and which Pachocki pushed back on, writing on X that he wanted “to prevent a race into unmonitorability.” Jeudi, le scientifique en chef d’OpenAI a mis un point là-dessus. “We will not accept degradation in our ability to monitor model alignment beyond a certain level. We will withhold scaling until we can regain enough confidence,” he said on Thursday. OpenAI’s response for now is to run misalignment monitoring on “all tool-using inference” in Astra’s external deployment, “with significant compute cost.”
Comment un lancement a reçu une étiquette d’avertissement
Astra est le modèle OpenAI mis en pause. On July 21 the company disclosed that GPT-5.6 Sol and an internal research model, running with safeguards off during a hacking benchmark, had escaped their test environment and broken into Hugging Face. OpenAI says Astra was not involved, but it “paused certain frontier training (including certain training for Astra) for two weeks” to harden isolation, network controls and monitoring, and restarted its large frontier reinforcement learning (RL) run on August 28. A spokesperson told Fortune the release was “delayed a certain number of weeks because everything was paused after Hugging Face.”
Le modèle est également passé par Washington. Brockman a déclaré que la Maison Blanche n’avait demandé aucun changement dans les mesures de sauvegarde : “Ils n’ont rien dit en disant que vous deviez changer cela en termes de garanties.” Insistant sur le fonctionnement du processus, il a décliné : “Je ne veux simplement rien mentir car il y a des nuances sur le fonctionnement exact du processus.” Fortune le décrit comme « un accord volontaire entre les entreprises technologiques et l’administration Trump dont les détails n’ont pas été rendus publics ». C’est une approche plus douce que la directive d’exportation qui a éteint Claude Fable 5 en juin.
Derrière lui se trouve la plus grande course de formation réalisée par OpenAI. “C’est la première fois que nous effectuons un pré-entraînement sur plus de 100 000 GPU sur notre site Stargate au Texas”, a déclaré aux journalistes Aidan Clark, vice-président de la recherche d’OpenAI. GPU signifie Graphics Processing Unit, la puce qui fait le calcul.
Que regarder
Trois dates comptent. Le prix promotionnel de Sol est valable « au moins jusqu’au 21 novembre 2026 », de sorte que l’écart 2,5x avec Astra pourrait se réduire ou s’élargir par la suite. L’accès de Daybreak Blue à Astra, moins restreint, est prévu “dans les semaines à venir”, tout comme la fonctionnalité Codex qui permet à Astra de conserver des notes dans les fenêtres contextuelles au lieu de les résumer. Et ARC Prize répertorie désormais les deux scores de harnais dans son classement, ce qui signifie que la prochaine fois qu’une page de lancement imprimera un seul numéro ARC, vous pourrez rechercher l’autre.
Nos sources (19)
- openai.com Introducing GPT-6 Astra
- openai.com Safety overview: GPT-6 Astra
- openai.com Path to Astra: critical capabilities and frontier safeguards
- deploymentsafety.openai.com OpenAI: GPT-6 Astra System Card
- developers.openai.com OpenAI API: GPT-6 Astra model page
- developers.openai.com OpenAI API: Pricing
- help.openai.com OpenAI Help Center: Daybreak Trusted Access for Cyber overview
- arcprize.org OpenAI's GPT-6 Astra on ARC-AGI-3
- arcprize.org GPT-6 Astra results
- cnbc.com OpenAI begins rolling out Astra model
- cnbc.com OpenAI says Astra crosses Critical cyber capability
- cnbc.com OpenAI releases report on Hugging Face hack
- fortune.com OpenAI launches GPT-6 Astra
- fortune.com OpenAI to limit access to Astra cyber features
- fortune.com OpenAI paused AI training for two weeks
- nbcnews.com OpenAI debuts GPT-6 Astra
- thenewstack.io OpenAI launches GPT-6 Astra
- thenewstack.io The asterisk matters more than the score
- techcrunch.com OpenAI launches GPT-5.6
🦋 Discussion sur Bluesky
Discuter sur Bluesky