Cybersécurité

OpenAI révèle Astra, le premier modèle à atteindre son seuil de « capacité cybernétique critique »

OpenAI a déclaré que le modèle Astra pouvait détecter des vulnérabilités inconnues et développer des méthodes pour les exploiter, et qu’il avait obtenu un score parfait au test ExploitBench. L’entreprise déploiera progressivement ses capacités cybernétiques auprès d’utilisateurs participant aux tests, après avoir reporté une partie du développement afin d’ajouter des contrôles de sécurité, alors qu’aucune vérification indépendante n’a encore été réalisée.

2026-09-02
4 min de lecture
6 vues
certi.news
OpenAI révèle Astra, le premier modèle à atteindre son seuil de « capacité cybernétique critique »

OpenAI a révélé de nouveaux détails sur le modèle d’intelligence artificielle Astra, qu’elle s’apprête à rendre bientôt disponible, et a déclaré qu’il s’agissait de son premier modèle à atteindre le niveau de « capacité cybernétique critique » dans le cadre du Preparedness Framework. Selon la description de l’entreprise, cela signifie que le modèle peut, lorsqu’il dispose des outils et des droits d’accès appropriés, détecter des vulnérabilités de sécurité jusque-là inconnues et développer des méthodes pour les exploiter.

Cette avancée ne concerne pas seulement la capacité du modèle à analyser du code ou à proposer des correctifs, mais aussi son aptitude à exécuter des étapes avancées de la chaîne d’exploitation. C’est pourquoi OpenAI a retardé une partie du développement et du lancement d’Astra, tandis qu’elle s’est employée au cours des dernières semaines à réduire le risque qu’il soit utilisé dans des cyberattaques malveillantes ou pour mener des opérations non autorisées.

De solides résultats dans les tests d’exploitation

OpenAI a déclaré qu’Astra avait obtenu un score de 100 % au test ExploitBench, qui mesure la capacité à développer des logiciels d’exploitation pour des vulnérabilités connues. L’entreprise a également réalisé une évaluation interne portant sur 20 vulnérabilités critiques annoncées au cours de la période allant de juin à août 2026.

Selon les résultats communiqués par OpenAI, Astra a obtenu, lors de cette évaluation, des taux supérieurs d’exécution de code à distance à ceux du modèle GPT-5.6 Sol, tout en utilisant un nombre inférieur unités de tokens. Au cours du test, l’entreprise a déclaré que le modèle avait découvert et utilisé deux vulnérabilités de type « zero-day » dans le cadre d’une chaîne d’exploitation, et qu’elle avait commencé à en informer les développeurs de logiciels concernés.

D’autres tests menés par des experts ont évalué la capacité d’Astra à exploiter des vulnérabilités inconnues dans un navigateur renforcé, puis à sortir de l’environnement isolé et à exécuter des commandes sur le système hôte. Lors de tests sur des systèmes d’exploitation, le modèle est parvenu, selon OpenAI, à relier plusieurs vulnérabilités afin d’obtenir un accès allant d’un utilisateur non autorisé aux privilèges root.

Accès limité et contrôles supplémentaires

OpenAI prévoit de rendre progressivement disponibles les capacités cybernétiques les plus avancées d’Astra. La première phase sera limitée à un groupe d’utilisateurs participant aux tests, avant d’élargir l’accès aux usages défensifs par l’intermédiaire du programme Daybreak Blue.

L’entreprise affirme avoir augmenté le taux de refus d’Astra concernant les demandes cybernétiques malveillantes et imposera des restrictions plus strictes aux comptes qu’elle considère comme présentant un risque élevé. Elle ajoutera également des mécanismes de surveillance pour détecter les comportements non autorisés, ainsi que des couches de raisonnement et de contrôle des actions exécutées par le modèle.

Pourquoi cette information est-elle importante ?

Le changement concret réside dans le passage d’un modèle général à un niveau auquel il peut, selon les tests de l’entreprise, contribuer à détecter et à exploiter des vulnérabilités au moyen d’une chaîne en plusieurs étapes. Cela pourrait être utile aux équipes de défense et aux chercheurs en sécurité si l’utilisation reste limitée à des environnements autorisés, mais cela accroît en même temps la sensibilité du contrôle des accès et de la surveillance, car ces mêmes capacités pourraient réduire les efforts nécessaires au développement d’attaques complexes.

Les limites des informations disponibles sont ici particulièrement importantes. Les chiffres et les résultats présentés proviennent d’OpenAI, et il n’existe pour l’instant aucune vérification indépendante du niveau de sécurité d’Astra ni des mesures destinées à limiter son utilisation abusive. En outre, le système complet et les résultats détaillés des évaluations ne seront pas publiés, selon l’article, avant le lancement officiel. L’évaluation pratique des capacités et des risques du modèle dépendra donc du système de sécurité publié et des résultats des tests indépendants après sa mise à disposition, et non des seules affirmations initiales concernant ses performances.

Source de l’actualité
c
Auteur

certi.news

Dans la même catégorie

À lire également

Voir toutes les actualités