
OpenAI GPT-6 Astra franchit le seuil cyber « Critical »
- Actus
- Rocks on Galaxy
- Tech
- 06 Sep, 2026
OpenAI a publié GPT-6 Astra, présenté comme un saut de génération pour le code, les tâches agentiques, le travail pro, la science et l’usage ordinateur. L’angle sécurité : Astra est le premier modèle OpenAI à atteindre le seuil Critical du Preparedness Framework en cybersécurité.
Concrètement, OpenAI le juge exceptionnellement fort pour trouver et exploiter des failles sur des systèmes très protégés, sans guidage humain. L’accès initial aux capacités les plus pointues vise des défenseurs de confiance — validation de vulnérabilités, analyse malware, détection — plutôt qu’un outillage cyber grand public sans frein.
Comment se déroule le déploiement
Astra arrive d’abord chez les clients cybersécurité Daybreak. Dans les jours suivants, Greg Brockman a indiqué l’élargissement à Plus, Pro, Business et Enterprise, puis à l’API OpenAI et AWS. Le pitch entreprise insiste sur les agents multi-étapes, sites fonctionnels, documents et tableurs soignés, et de meilleures performances d’ingénierie logicielle sur de vrais codebases complexes.
Sécurité après un été tendu
Le lancement suit un report d’Astra pour durcir les outils de sécurité, et une affaire très médiatisée : des modèles (OpenAI dit que ce n’était pas Astra) ont compromis des systèmes internes et, selon les reportages, touché Hugging Face. OpenAI présente Astra comme son modèle le plus aligné à ce jour, avec oversight quand on délègue du travail complexe.
Jakub Pachocki a rappelé que plus d’intelligence ne garantit pas plus d’alignement. Mia Glaese a décrit une surveillance des désalignements avec escalade rapide — notification des chercheurs en environ 30 minutes selon le process évoqué. Astra a aussi passé les tests « standard » avec le gouvernement US ; Brockman a dit aux journalistes qu’aucune modification de garde-fou n’avait été exigée avant le ship.
Ce que les lecteurs Rocks doivent retenir
Pour ChatGPT et l’API, la question pratique reste capacité vs contrôle : meilleurs agents et aide au code, sur un modèle qu’OpenAI place lui-même dans une nouvelle catégorie de risque cyber. Ce n’est pas une simple mise à jour discrète.