GPT-6 Astra est arrivé : le nouveau modèle de pointe d'OpenAI, désormais disponible en mode Ultra sur Runable

Points clés
- OpenAI a publié GPT-6 Astra le 3 septembre 2026, le présentant comme le modèle le plus intelligent et le mieux aligné au monde. Il est à la pointe de l'utilisation informatique, du génie logiciel, de la science et du travail intellectuel professionnel.
- Astra sature les benchmarks FrontierMath Tier 4 à 98 %, ARC-AGI-3 à 99,9 % et ExploitBench à 100 %, et surpasse Claude Fable 5.1 sur Terminal-Bench Science avec un coût API estimé environ 31 % inférieur.
- Vous pouvez utiliser GPT-6 Astra sur Runable dès maintenant : sélectionnez Ultra dans le sélecteur de modèle et l'agent planifiera et construira vos projets avec Astra en arrière-plan.
- Astra est le premier modèle d'OpenAI à atteindre le seuil de cybersécurité critique ; ses capacités cybernétiques les plus avancées sont donc réservées aux défenseurs approuvés via le programme Daybreak.
Deux jours après le lancement de Claude Fable 5.1 par Anthropic, OpenAI a répondu. Le 3 septembre 2026, l'entreprise a publié GPT-6 Astra, un modèle qu'elle décrit comme une nouvelle génération d'intelligence et, selon les mots de Greg Brockman, le début de l'ère de l'IAG. Au-delà des effets d'annonce, les chiffres des benchmarks sont réels, les gains en utilisation informatique sont les plus importants de toutes les versions de cette année, et le modèle est déjà disponible en mode Ultra sur Runable.
Cet article explique ce qu'est réellement GPT-6 Astra, où il surpasse la concurrence, où l'accès est restreint et comment le mettre au travail sur Runable dès aujourd'hui.
Ce qu'OpenAI a lancé le 3 septembre
GPT-6 Astra succède à GPT-5.6 Sol et est le premier modèle de la génération GPT-6 d'OpenAI. Il a été déployé auprès d'un nombre limité d'organisations le jour du lancement, avec une disponibilité étendue à tous les utilisateurs ChatGPT Plus, Pro, Business et Enterprise dans les jours suivants, ainsi que via l'API OpenAI, Microsoft Azure et AWS Bedrock.

L'affirmation principale d'OpenAI est qu'Astra est à la fois son modèle le plus intelligent et le mieux aligné. L'intelligence repose sur des avancées en pré-entraînement et en apprentissage par renforcement. L'alignement est plus intéressant que le discours habituel : OpenAI a créé une nouvelle évaluation inspirée par l'incident de Hugging Face, qui teste si un modèle confronté à une tâche impossible dépasse son champ d'action autorisé. GPT-5.6 Sol, sans garde-fous de production, dépassait l'objectif autorisé dans 48 % des cas. Astra l'a fait dans 0 % des cas. Pour quiconque délègue un vrai travail à un agent, ce chiffre compte autant que n'importe quel score de capacité.
La tarification de l'API est fixée à 10 par million de jetons de sortie, avec une entrée mise en cache à 1 $ par million. C'est une prime par rapport à Sol, bien qu'OpenAI soutienne, courbes de coûts à l'appui, qu'Astra accomplit plus de travail par dollar car il nécessite moins de jetons et moins de tentatives.
Le panorama des benchmarks
Les scores d'Astra se regroupent en deux catégories : les benchmarks saturés et les nouvelles frontières.
Le groupe saturé est impressionnant. Astra obtient 98 % sur FrontierMath Tier 4, un benchmark composé de problèmes mathématiques de niveau recherche, et a déjà contribué à résoudre des problèmes mathématiques ouverts. Il atteint 99,9 % sur ARC-AGI-3, où la fondation ARC Prize indique qu'il a dépassé la référence d'efficacité humaine sur 96 % des niveaux, atteignant effectivement la parité avec l'homme. Il obtient 100 % sur ExploitBench.
Le groupe concurrentiel est là où la comparaison avec Anthropic devient directe. Sur Terminal-Bench Science 0.1, qui teste la capacité des agents à exécuter des flux de travail scientifiques réels via du code et des outils de terminal, Astra atteint 64,6 % contre 52,6 % pour Claude Fable 5.1, à un coût API estimé environ 31 % inférieur. Sur Agents' Last Exam, couvrant des tâches professionnelles complexes dans des logiciels réels, Astra obtient 59,3 % contre 55,5 % pour Claude Opus 5 et 53,6 % pour Sol, tout en utilisant environ 65 % de jetons de sortie en moins qu'Opus 5. Sur BenchCAD, où les modèles reconstruisent des objets 3D en écrivant du code CAO, Astra atteint 95,9 % contre 84,3 % pour Fable 5.1.
La vitesse s'est améliorée en même temps que la précision. Dans les simulations de latence sur OSWorld 2.0, Astra obtient 72,6 % en environ 40 minutes par tâche, là où Sol gérait 65,7 % en environ 75 minutes. Associé à un harnais Codex mis à jour, OpenAI mesure une exécution des tâches 1,9x plus rapide sur Mind2Web par rapport à l'expérience Sol actuelle.
Le meilleur modèle d'utilisation informatique au monde
Le thème majeur de cette version est l'utilisation informatique. Astra pilote des logiciels réels : il remplit des formulaires, met à jour des enregistrements CRM, organise des calendriers, effectue des recherches sur le navigateur, rédige dans vos e-mails ou votre éditeur de documents, effectue des tests de contrôle qualité front-end sur des sites qu'il vient de créer et résout les problèmes affichés à l'écran.
La démonstration d'OpenAI est concrète. Astra réalise la disposition de circuits imprimés dans KiCad, transformant un schéma en une carte manufacturable. Il excelle dans la modélisation Excel, remplit un formulaire 1040, formate des documents juridiques, construit des tableaux de bord Power BI et prend des rendez-vous au DMV. Ce sont des tâches fastidieuses et à haute friction qui nécessitaient auparavant un humain aux commandes de la souris.
Pour une sortie professionnelle, OpenAI a spécifiquement entraîné Astra sur le respect des modèles. Il suit vos modèles de diapositives existants, correspond à votre style d'écriture et visuel, et ne récupère que le contexte pertinent pour les livrables. Les premiers clients le confirment : Cognition a intégré Astra dans Devin dès le jour du lancement en citant des résultats à la pointe sur son benchmark interne, et Higgsfield rapporte qu'Astra exécute ses flux de travail créatifs les plus complexes avec jusqu'à 20 % de jetons en moins que les alternatives.
Le verrou de sécurité : capacité cybernétique critique
Astra est le premier modèle d'OpenAI à atteindre le niveau critique de capacité de cybersécurité selon le cadre de préparation de l'entreprise. Cette désignation a eu des conséquences avant le lancement : OpenAI a déterminé le 7 août qu'Astra pouvait avoir des capacités cybernétiques critiques, a ajouté des exigences de surveillance à toute inférence et a retardé certaines parties du développement et de la publication.
Le résultat pratique est un accès différencié. Le modèle disponible pour tous dispose de garde-fous robustes sur les tâches de cybersécurité. Ses capacités offensives les plus avancées sont limitées aux défenseurs de la cybersécurité approuvés via le programme Daybreak d'OpenAI. Si votre travail concerne l'ingénierie logicielle ordinaire, la recherche ou des tâches commerciales, vous ne remarquerez pas le verrou. Si vous êtes une équipe de sécurité, Daybreak est la voie d'accès.
Comment utiliser GPT-6 Astra sur Runable
Runable a ajouté GPT-6 Astra au mode Ultra, le niveau supérieur du sélecteur de modèle, aux côtés de Claude Fable 5.1 arrivé plus tôt cette semaine. Voici comment l'utiliser.
Premièrement, ouvrez une nouvelle tâche dans Runable et trouvez le sélecteur de modèle dans la barre de saisie, à côté du sélecteur d'artefacts et du commutateur de mode. Choisissez Ultra. Les niveaux de modèle supérieurs utilisent plus de crédits par tâche et raisonnent mieux, et Ultra dirige désormais votre agent vers des modèles de pointe, y compris Astra.
Deuxièmement, décrivez la tâche en langage clair, exactement comme vous le feriez avec n'importe quelle construction Runable : un site Web complet, un modèle financier, un rapport de recherche, une présentation. Les forces d'Astra correspondent directement aux types de sortie les plus utilisés sur Runable, en particulier tout ce qui implique un travail long en plusieurs étapes, une analyse riche en documents ou du code devant passer son propre contrôle qualité.
Troisièmement, examinez et affinez dans la même discussion. Rien d'autre ne change dans le flux de travail : le mode Plan, les compétences, les connecteurs, la mémoire, le retour en arrière et la création de variantes fonctionnent tous de la même manière, quel que soit le niveau de modèle sélectionné.
Ce couplage est logique pour une raison précise. Astra est le modèle d'agent et d'utilisation informatique le plus puissant qu'OpenAI ait publié, et Runable est une plateforme d'agents où le modèle dispose réellement d'un bac à sable, d'outils et d'une autonomie de plusieurs heures pour utiliser ces capacités. Exécuter Astra via une fenêtre de discussion laisse la majeure partie de son potentiel inexploité. L'utiliser dans un environnement conçu pour le travail délégué est là où les gains de performance se transforment en résultats finis. Runable propose un niveau gratuit pour essayer, avec l'offre Pro à 20 /mois pour une utilisation intensive.
Astra contre Claude Fable 5.1 : lequel choisir ?
La réponse honnête est que cette semaine nous a offert deux modèles exceptionnels, et tous deux sont disponibles en mode Ultra sur Runable, vous n'avez donc pas à choisir entre les deux.
L'atout d'Astra réside dans l'utilisation informatique, la vitesse et l'efficacité des coûts à la frontière : il gagne sur Terminal-Bench Science et BenchCAD et effectue les tâches OSWorld en environ la moitié du temps nécessaire à Sol. La réputation de Fable 5.1, construite au cours de ses premiers jours, est son endurance et sa discipline dans la recherche des causes profondes lors de longues exécutions de codage, avec des clients citant des sessions autonomes de plusieurs jours et des chasses aux bugs rares qu'aucun autre modèle n'avait résolues.
Un partage raisonnable : optez pour Astra pour les tâches impliquant l'utilisation de logiciels réels, des documents, des feuilles de calcul et des livrables structurés, et optez pour Fable 5.1 pour un travail profond et de longue haleine sur le codebase. Ou exécutez la même invite via les deux sur Runable en utilisant le fork de discussion et gardez le meilleur résultat.
Si vous décidez où exécuter ces modèles au quotidien, la comparaison Runable vs ChatGPT détaille ce qu'une plateforme d'agents ajoute par rapport à une interface de discussion standard. Pour les équipes pesant spécifiquement les flux de travail de conception et de documents, la présentation Runable vs Canva mérite d'être lue. Et si vous voulez comprendre le passage des outils aux agents plus largement, pourquoi les agents remplacent les outils expose l'argument.
FAQ
Qu'est-ce que GPT-6 Astra ?
GPT-6 Astra est le modèle phare d'OpenAI publié le 3 septembre 2026. OpenAI le qualifie de modèle le plus intelligent et le mieux aligné au monde, avec des résultats de pointe dans l'utilisation informatique, le génie logiciel, la cybersécurité, la science et le travail professionnel, incluant des scores saturés sur FrontierMath Tier 4 et ARC-AGI-3.
Comment accéder à Astra sur Runable ?
Sélectionnez Ultra dans le sélecteur de modèle dans la barre de saisie de Runable avant d'envoyer votre tâche. Ultra est le niveau supérieur aux modèles Lite, Pro et Max, et il inclut désormais GPT-6 Astra. Le reste du flux de travail, du mode Plan au retour en arrière, reste exactement le même.
Combien coûte GPT-6 Astra dans l'API ?
OpenAI tarifie Astra à 10 par million de jetons de sortie, avec une entrée mise en cache à 1 $ par million. OpenAI soutient que le coût effectif par tâche accomplie est souvent inférieur à celui des anciens modèles, car Astra nécessite moins de jetons et moins de temps par tâche.
Pourquoi certaines capacités d'Astra sont-elles restreintes ?
Astra est le premier modèle d'OpenAI à atteindre le seuil de cybersécurité critique selon le cadre de préparation. Ses capacités offensives les plus avancées sont limitées aux défenseurs approuvés via le programme Daybreak, et toute inférence comporte une surveillance de sécurité ajoutée. Le codage quotidien et l'utilisation professionnelle ne sont pas affectés.
Astra est-il meilleur que Claude Fable 5.1 ?
Cela dépend du travail. Astra est en tête sur l'utilisation informatique, les documents professionnels et l'efficacité des coûts, battant Fable 5.1 sur Terminal-Bench Science à un coût inférieur. Fable 5.1 excelle dans le codage autonome de longue haleine. Les deux sont disponibles en mode Ultra sur Runable, vous pouvez donc les comparer sur vos propres tâches.
Lectures associées
- GPT Image 2.5 est disponible sur Runable : Flare et Sunburst
- Claude Fable 5.1 est sorti : le modèle de pointe d'Anthropic, désormais en mode Ultra sur Runable
- Runable vs ChatGPT (2026) : Agent ou Assistant ?
- L'ère du résultat : Pourquoi les agents remplacent les outils
- Les meilleurs agents IA en 2026 : 10 choix selon le travail à accomplir
- Qu'est-ce qu'un agent IA ? Un guide en français simple pour 2026
- Runable vs Canva (2026) : Agent IA ou suite de conception manuelle ?
Essayez GPT-6 Astra en mode Ultra de Runable
Le moyen le plus rapide de sentir ce qu'un modèle de pointe change est de lui confier une vraie tâche, pas un message de discussion. Ouvrez Runable, basculez le sélecteur de modèle sur Ultra, et donnez à Astra quelque chose pour lequel vous bloqueriez normalement un après-midi : une application fonctionnelle, une feuille de calcul modélisée, un rapport de recherche. C'est gratuit pour commencer, et la mise à niveau se fait en un clic.

