GPT-6 Astra met l’accent sur la cybersécurité et les agents

OpenAI a présenté GPT-6 Astra le 3 septembre 2026, avec un déploiement d’abord limité. Le modèle se distingue par ses scores annoncés, mais aussi par un statut inédit sous le cadre de sécurité de l’entreprise.

OpenAI a lancé GPT-6 Astra le 3 septembre 2026, en le présentant comme son modèle « le plus intelligent et aligné » à ce jour. Le déploiement a commencé auprès d’un nombre limité d’organisations, avant une ouverture annoncée aux abonnés ChatGPT et via l’API dans les jours suivants. Le point le plus sensible tient à la cybersécurité : Astra est le premier modèle d’OpenAI à franchir le seuil « Critical » de son Preparedness Framework, ce qui impose des garde-fous renforcés avant diffusion plus large.

Des performances très hautes, mais pas sur toutes les scènes

Sur le papier, Astra coche beaucoup de cases. OpenAI dit le modèle à l’état de l’art en usage d’ordinateur, navigation, ingénierie logicielle, science et travail professionnel, avec des scores annoncés de 98 % sur FrontierMath Tier 4, 99,9 % sur ARC-AGI-3 et 100 % sur ExploitBench. D’autres évaluations citées par des publications spécialisées nuancent toutefois le tableau : certains classements agrégés placent Astra devant GPT-5.6 Sol, mais derrière Claude Fable 5.1 sur des mesures générales. Bref, le modèle gagne haut la main sur plusieurs terrains, sans écraser la concurrence partout.

Le cas ARC-AGI-3 a particulièrement retenu l’attention. Le benchmark teste la capacité d’un système à comprendre des règles inédites dans des environnements de jeu inconnus. Selon les mesures reprises par The Decoder, Astra atteint 62,7 % dans une configuration comparable entre modèles, loin devant GPT-5.6 Sol à 7,8 % et au-dessus de Claude Opus 5 à 30,2 %. La même source indique aussi qu’Astra sait produire une forme de notation symbolique compacte pour suivre ses actions et l’état du jeu, un indice de plus sur ses capacités de planification. C’est le genre de détail qui fait lever un sourcil dans les labos.

Pourquoi la sécurité a pesé sur le lancement

Le lancement n’a pas seulement été une histoire de score. Dans sa note de sécurité du 1er septembre 2026, OpenAI a expliqué avoir retardé certaines étapes de développement pendant plusieurs semaines pour renforcer les protections contre les usages cybermalveillants et les actions non autorisées du modèle. L’entreprise dit aussi avoir découvert, sur un jeu interne de vulnérabilités V8, des exploits inconnus auparavant, qu’elle s’est engagée à signaler aux mainteneurs concernés.

OpenAI précise qu’Astra refuse les tâches cyber avancées, comme la création d’exploits de preuve de concept, tout en restant utilisable pour la revue de code sécurisée et le correctif. En parallèle, la société déploie un dispositif de « misalignment monitoring » sur les usages outillés : des classifieurs inspectent raisonnements et actions pour bloquer les comportements non autorisés. Cette surveillance peut toutefois ralentir ou interrompre des tâches légitimes. À ce stade, la promesse d’un modèle plus sûr se paie donc par un peu de friction opérationnelle.

Un accès progressif, et des abonnés pas franchement ravis

OpenAI a prévu un accès échelonné. Astra doit arriver pour les abonnés ChatGPT Plus, Pro, Business et Enterprise, ainsi que via l’API, Microsoft Azure et AWS Bedrock. Le tarif API standard est fixé à 10 dollars par million de jetons d’entrée et 50 dollars par million de jetons de sortie, avec des prix distincts pour les lectures et écritures de cache. Les plans Pro, Business et Enterprise doivent aussi recevoir une version Astra Pro, tandis que l’accès entreprise reste désactivé par défaut au lancement et doit être activé par un administrateur. Les clients pressés devront donc continuer à patienter un peu, la magie du “bientôt” ayant ses propres délais.

Cette montée en charge progressive a provoqué des critiques publiques. Le 4 septembre 2026, Sam Altman a présenté ses excuses pour un déploiement qu’il a jugé « messy », après qu’une partie des abonnés payants n’a pas eu accès au modèle le jour promis. OpenAI a ensuite annoncé un reset bancaire par jour d’attente pour les abonnés concernés. Ce choix montre bien la tension du moment : OpenAI veut installer Astra comme pièce maîtresse de son offre, mais doit encore concilier mise à disposition rapide, sécurité renforcée et attentes commerciales très concrètes.

En chiffres

  • 98 % — score annoncé sur FrontierMath Tier 4, OpenAI, 3 septembre 2026.
  • 99,9 % — score annoncé sur ARC-AGI-3, OpenAI, 3 septembre 2026.
  • 100 % — score annoncé sur ExploitBench, OpenAI, 3 septembre 2026.
  • 10 dollars / 50 dollars — prix API par million de jetons d’entrée/sortie, OpenAI, lancement 2026.
  • 62,7 % — résultat ARC-AGI-3 rapporté par The Decoder, 4 septembre 2026.

À lire