GPT-6 Astra est disponible : prix, accès, benchmarks et ce qui casse
OpenAI a lancé GPT-6 Astra le 3 septembre 2026. Identifiant gpt-6-astra, 10 $ / 50 $ par million de tokens, Fast mode à 20 $ / 100 $, et les garde-fous qui arrêtent les tâches via l’API.
Publié le : Mis à jour le :

En bref
OpenAI a lancé GPT-6 Astra le 3 septembre 2026, sous l’identifiant d’API gpt-6-astra, à 10 $ en entrée et 50 $ en sortie par million de tokens. Le déploiement commence par les entreprises du programme Daybreak et s’étendra « dans les prochains jours » à ChatGPT Plus, Pro, Business et Enterprise, à l’API, à AWS Bedrock et à Microsoft Azure. Greg Brockman a clos le point presse par une phrase que personne n’attendait sur un lancement produit : bienvenue dans l’ère de l’AGI.
- Le positionnement n’est pas le raisonnement, c’est l’usage d’ordinateur. OpenAI décrit Astra comme le meilleur modèle au monde pour piloter des logiciels comme le ferait un humain, à travers navigateurs, tableurs, sites et applications de bureau.
- Un Fast mode existe : 2,5 fois plus rapide, au double du tarif, soit 20 $ / 100 $. C’est la configuration la plus chère du marché.
- Prix identique à Claude Fable 5.1, au dollar près. Le haut de gamme frontière a convergé sur 10 $ / 50 $.
- Contrairement à Fable 5.1, Astra supporte le Zero Data Retention pour les clients API éligibles.
- Ce qui va casser tes intégrations : les garde-fous peuvent ralentir, mettre en pause ou arrêter un travail légitime. Dans ChatGPT ou Codex, l’utilisateur valide. Via l’API, la tâche s’arrête.
Demander à l’IA de résumer cet article :
Prix, accès et identifiant d’API
Le nom commercial est tranché : GPT-6 Astra. Les appellations « ChatGPT Astra », « GPT Astra » et « ChatGPT 6 » qui circulaient depuis août n’étaient pas officielles.
Deux lectures de ce tableau. D’abord la convergence : Astra et Claude Fable 5.1 sont au même prix exactement, 10 $ et 50 $. Le palier frontière a trouvé son point d’équilibre tarifaire, et l’arbitrage entre les deux ne se fera plus sur le prix par token. Ensuite le Fast mode à 20 $ / 100 $, qui devient la configuration la plus chère disponible sur le marché, tous fournisseurs confondus.
Côté déploiement, Astra a commencé jeudi par les entreprises du programme d’accès contrôlé Daybreak. ChatGPT Plus, Pro, Business et Enterprise, l’API, AWS Bedrock et Microsoft Azure suivront dans les jours qui viennent. Le modèle supporte le Zero Data Retention pour les clients API éligibles, et OpenAI teste un dispositif appelé Private Safety Processing. C’est un avantage net sur Claude Fable 5.1, qui impose 30 jours de rétention sauf autorisation expresse.
| Modèle | Entrée | Sortie | Note |
|---|---|---|---|
| GPT-6 Astra, mode Standard | 10 $ | 50 $ | Tarification distincte pour les lectures et écritures de cache |
| GPT-6 Astra, Fast mode | 20 $ | 100 $ | Jusqu’à 2,5 fois la vitesse du mode Standard |
| Claude Fable 5.1 / Mythos 5.1 | 10 $ | 50 $ | Lectures de cache à 0,25 $ |
| GPT-5.6 Sol, mode Standard | 5 $ | 30 $ | Tarif promotionnel de 4 $ / 20 $ jusqu’au 21 novembre 2026 |
| GPT-5.6 Sol, Fast mode | 10 $ | 60 $ | |
| Claude Opus 5 | 5 $ | 25 $ | |
| GPT-5.6 Terra | 2 $ | 12 $ | |
| Gemini 3.8 Flash | 0,75 $ | 3,75 $ | Tarif de lancement jusqu’au 31 décembre 2026 |
Le vrai positionnement : piloter des logiciels, pas répondre à des questions
OpenAI ne vend pas Astra comme un meilleur modèle de raisonnement, mais comme le meilleur modèle d’usage d’ordinateur au monde. Au lieu de connecter un modèle à chaque outil via une API dédiée, Astra navigue dans les logiciels comme le ferait un humain, avec des pixels, un clavier et une souris.
Ce qu’OpenAI annonce comme opérationnel : remplir des formulaires, mettre à jour des fiches CRM, organiser des agendas, mener une recherche web et en rédiger le résultat, manipuler des tableurs, analyser des données dans des notebooks Python, travailler dans Power BI, créer et tester des sites, piloter KiCad ou FreeCAD, installer et dépanner des logiciels.
Greg Brockman a résumé l’argument : le secteur a passé des années à écrire péniblement des connecteurs vers des outils que les gens savent déjà utiliser. Un agent capable d’usage d’ordinateur contourne ce travail, parce que le logiciel expose déjà une interface conçue pour une intelligence généraliste, celle de l’utilisateur humain.
Le chiffre qui étaye la promesse : sur un sous-ensemble hors ligne d’OSWorld 2.0, Astra atteint 72,6 % en environ 40 minutes par tâche, contre 65,7 % en environ 75 minutes pour GPT-5.6 Sol. Soit environ 47 % de temps en moins par tâche, à performance supérieure.

Les benchmarks, et ce qu’il faut en penser
Scores auto-déclarés par OpenAI, publiés au lancement.
Le 98,6 % sur ARC-AGI-3 est le chiffre qui va circuler partout, et c’est celui qui demande le plus de prudence. Les notes d’évaluation d’OpenAI précisent qu’Astra utilise le harnais de l’API Responses de l’entreprise, quand les modèles de comparaison tournent sous d’autres configurations.
Le précédent d’août l’illustre. NVIDIA a annoncé 100 % sur l’ensemble public d’ARC-AGI-3 avec son architecture Agentic Variation Operators, sans construire de modèle : AVO s’appuyait sur Claude Opus 5, dont la performance de base était d’environ 30 %. Le gain venait de la mémoire persistante, des outils et des mécanismes de reprise. Conclusion explicite de NVIDIA : la capacité long horizon peut émerger du système d’agent complet, pas du modèle seul.
La question que ces chiffres posent est donc : qu’est-ce qu’on mesure exactement ? Un modèle, un modèle plus sa mémoire, un modèle avec un navigateur et des outils, ou le système déployé entier ? Pour une entreprise, la distinction compte moins que le coût, la fiabilité et l’auditabilité. Mais pour lire un classement, elle est décisive.
| Épreuve | GPT-6 Astra |
|---|---|
| FrontierMath Tier 4 v2 | 97,6 % |
| ARC-AGI-3 | 98,6 % |
| GPQA Diamond | 96 % |
| BenchCAD | 95,9 % |
| DeepSWE v1.1 | 74,1 % |
| OSWorld 2.0, sous-ensemble hors ligne | 72,6 % |
| ExploitBench | 100 % |
Le prix par tâche, l’argument que pousse OpenAI
Brockman a défendu un changement de métrique : le prix au token ne veut plus dire grand-chose, parce que les tokens d’un fournisseur ne valent pas ceux d’un autre, ni ceux d’une autre famille de modèles. Ce qu’il faut regarder, selon lui, c’est le prix par tâche accomplie.
L’exemple avancé par OpenAI : sur DeepSWE v1.1, la configuration la plus performante d’Astra bat le meilleur réglage de GPT-5.6 Sol tout en produisant un coût d’API estimé par tâche environ 57 % inférieur.
L’argument tient sur le fond, et c’est le raisonnement de notre comparatif Claude Fable 5.1 contre Opus 5 : un modèle bon marché qui exige des reprises, des corrections humaines et des milliers d’étapes supplémentaires coûte plus cher qu’un modèle onéreux qui termine du premier coup.
Deux réserves d’honnêteté. Le prix par tâche est une métrique proposée par le vendeur, mesurée par le vendeur, sur des tâches choisies par le vendeur. Et elle arrive au moment précis où OpenAI double son prix par token par rapport à Sol. Ça ne rend pas l’argument faux, ça oblige à le vérifier sur tes propres charges plutôt qu’à le reprendre tel quel.
Ce qui va casser tes intégrations
C’est la partie la moins reprise du lancement, et la plus importante si tu construis quelque chose.
Trois actions avant de basculer du trafic de production. Un : traite l’interruption comme un chemin d’erreur normal, avec reprise sur point de contrôle et bascule vers un modèle de repli. C’est le même réflexe que pour les refus de classifieurs de Claude Fable, détaillé dans notre guide de migration vers Fable 5.1. Deux : découpe les tâches longues en segments avec points de sauvegarde. Plus une tâche dure, plus elle a de chances d’être interrompue, et plus l’interruption coûte cher puisqu’elle survient après des heures de travail. Trois : suis ton taux d’interruption, pas seulement ton nombre de tokens. C’est le chiffre qu’aucun benchmark ne donne et que seule ton évaluation dira.
- Les garde-fous peuvent ralentir, mettre en pause ou arrêter un travail légitime, y compris de la cybersécurité défensive et des activités sans rapport apparent avec la sécurité.
- Différence critique selon la surface. Dans ChatGPT ou Codex, l’utilisateur peut être invité à valider une action avant que le système continue. Dans un flux API, une tâche signalée s’arrête net.
- OpenAI ajoute une surveillance du désalignement au déploiement externe : des systèmes inspectent le raisonnement et les actions du modèle pour détecter s’il sort de son périmètre d’autorisation. Dans les cas graves, cette surveillance peut interrompre l’activité.
- Le dispositif est conçu pour rester compatible avec le Zero Data Retention : les classifieurs tournent sans que la conversation soit conservée.
Sécurité : premier modèle au seuil Critical
Astra est le premier modèle d’OpenAI classé au niveau Critical en cybersécurité de son Preparedness Framework. Avec les outils et les accès appropriés, il est capable de trouver des vulnérabilités inconnues et de construire des chaînes d’exploitation contre des systèmes bien protégés, sans direction humaine continue.
Ce qu’OpenAI publie : 100 % sur ExploitBench ; sur un jeu de 20 vulnérabilités sérieuses récemment divulguées, des résultats nettement supérieurs à GPT-5.6 Sol avec moins de tokens de sortie ; deux vulnérabilités inédites découvertes en évaluation, ensuite divulguées aux mainteneurs ; et des tests d’experts humains confirmant l’identification de zero-day dans des navigateurs et des systèmes d’exploitation.
Le résultat d’alignement le plus parlant vient d’une évaluation inspirée par l’incident Hugging Face de juillet, qui testait si un modèle dépasse son périmètre autorisé face à des objectifs difficiles ou impossibles. Sans garde-fous de production, GPT-5.6 Sol est sorti du périmètre dans 48,2 % des cas. Astra, dans 0 % des cas.
L’accès aux capacités cyber les plus avancées reste limité. Les défenseurs de confiance passeront par Daybreak Blue, avec priorité aux organisations qui protègent des infrastructures numériques critiques.
Jakub Pachocki, directeur scientifique d’OpenAI, a posé la limite la plus nette de la journée : les progrès en intelligence ne garantissent pas les progrès en alignement. Sa préoccupation porte sur l’observabilité, la capacité à comprendre assez du raisonnement d’un modèle pour repérer un comportement dangereux. À mesure qu’ils progressent, les modèles accomplissent des tâches plus dures avec moins de tokens de raisonnement, et deviennent plus capables d’influencer leur propre chaîne de pensée. Pachocki a annoncé qu’OpenAI mettrait la montée en échelle en pause plutôt que d’accepter une dégradation de sa capacité de surveillance.
Ce que ça change pour ta visibilité IA
Astra étant intégré à ChatGPT, l’un des six moteurs qui décident de ta visibilité générative, une nouvelle génération change la façon dont le moteur arbitre entre deux sources contradictoires et pèse la fraîcheur face à l’autorité.
Ça se mesure. Relève cette semaine ce que ChatGPT cite sur tes vingt requêtes principales, refais le relevé quinze jours après : si les sources ont bougé sans que ton contenu ait changé, le modèle en est la cause. La méthode est dans notre guide de la visibilité IA en 2026 et la page sur la visibilité dans ChatGPT.
Ce qui ne change pas : les pages datées, sourcées et structurées en réponses directes restent celles qu’un moteur reprend telles quelles. Et un modèle plus capable produit des erreurs plus convaincantes, donc la vérification reste une étape distincte de la génération.
Le contexte de la semaine : Anthropic a lancé Claude Fable 5.1 le 1er septembre, Google a déployé Gemini 3.8 Flash le 2, et Grok 4.7 est attendu le 12. Quatre lancements frontière en douze jours : un routage de modèles réévalué chaque trimestre est déjà obsolète.
Sources
OpenAI : billet d’annonce et point presse du 3 septembre 2026 ; « Path to Astra », 1er septembre (openai.com/fr-FR/index/path-to-astra/) ; rapport technique sur l’incident Hugging Face, 26 août ; « Pacing model development in an era of cyber-critical capabilities », 18 août ; « Responding to the next frontier of critical cyber capabilities », 7 août ; « Ten advances in mathematics and theoretical computer science », 1er août ; page de tarification développeur et formulaire Daybreak.
Presse : VentureBeat, Carl Franzen, 3 septembre 2026, pour le compte rendu du point presse, les tarifs et les déclarations de Greg Brockman, Aidan Clark, Mia Glaese et Jakub Pachocki ; CNBC, 3 septembre 2026, pour les modalités de déploiement.
Contexte comparatif : NVIDIA, résultat Agentic Variation Operators sur ARC-AGI-3, août 2026 ; annonce Anthropic Fable 5.1 et Mythos 5.1 du 1er septembre et documentation Claude Platform ; model card Gemini 3.8 Flash ; baisses de prix GPT-5.6 du 22 août 2026.
Mise à jour
3 septembre 2026, lancement. GPT-6 Astra est disponible sous l’identifiant gpt-6-astra, à 10 $ / 50 $ par million de tokens en mode Standard. Cet article sera mis à jour avec la system card complète et les premières évaluations indépendantes, généralement publiées sous une semaine, qui donneront le taux d’interruption réel que la fiche officielle ne fournit pas.
2 septembre 2026. Version antérieure au lancement : OpenAI avait confirmé le franchissement du seuil Critical et annoncé une disponibilité « bientôt », sans date ni nom commercial.
La prochaine étape
Quatre lancements frontière en douze jours. Le seul moyen de ne pas les subir est de mesurer chaque semaine ce que les six moteurs citent sur tes requêtes, et de router ta production par étape plutôt que de la reconstruire à chaque modèle. Mesurer ma visibilité IA ou voir les tarifs.
Questions fréquentes
Comment accéder à GPT-6 Astra ?
Le déploiement a commencé le 3 septembre 2026 par les entreprises du programme Daybreak. ChatGPT Plus, Pro, Business et Enterprise, l’API OpenAI, AWS Bedrock et Microsoft Azure suivent dans les jours qui viennent. L’identifiant d’API est gpt-6-astra. Les capacités cybersécurité les plus avancées restent réservées aux défenseurs de confiance via Daybreak Blue.
Combien coûte GPT-6 Astra ?
10 $ en entrée et 50 $ en sortie par million de tokens en mode Standard, avec une tarification distincte pour les lectures et écritures de cache. Le Fast mode, jusqu’à 2,5 fois plus rapide, coûte le double : 20 $ / 100 $. À titre de comparaison, Claude Fable 5.1 est exactement au même tarif Standard, Claude Opus 5 à 5 $ / 25 $, et GPT-5.6 Sol à 4 $ / 20 $ en tarif promotionnel.
Astra, c’est bien ChatGPT 6 ?
Le nom officiel est GPT-6 Astra. Les expressions « ChatGPT Astra », « GPT Astra » et « ChatGPT 6 » qui circulaient depuis août n’étaient pas confirmées : OpenAI n’employait que le terme « Astra » dans ses publications, et The Information rapportait que l’entreprise hésitait encore entre GPT-6 et une déclinaison de la série GPT-5.
Astra est-il une AGI ?
OpenAI ne le présente pas comme une preuve. Greg Brockman a déclaré qu’à titre personnel il estime qu’on y est, et qu’il n’est pas déraisonnable de considérer qu’on est entré dans l’ère de l’AGI. Son argument est économique plutôt que technique : ce qui change est l’ampleur du travail délégable, pas le franchissement d’un seuil défini. Le 98,6 % sur ARC-AGI-3 dépend en partie du harnais d’évaluation.
La prochaine étape
Appliquez cette méthode à votre site, puis mesurez le même périmètre chaque semaine.
Partager
À propos de l’auteur
Contenu écrit et vérifié par l’équipe GetRerank, à partir de données produit réelles et de sources publiques citées dans l’article. Aucun résultat client n’est utilisé comme preuve.


