Suivez les dernières actualités, explications et histoires technologiques associées.
Trois chercheurs en sécurité de l’IA licenciés par OpenAI ont nié avoir commis des fautes liées à la gestion d’informations sensibles et ont déclaré que la manière dont ils ont été licenciés crée un effet dissuasif susceptible d’empêcher les employés de signaler des risques et de collaborer avec des organismes d’évaluation externes. L’entreprise affirme que les décisions de licenciement reposaient sur un ensemble de comportements contraires aux politiques, et non sur des représailles liées au fait d’avoir soulevé des inquiétudes.
OpenAI a déclaré que le modèle Astra est son premier grand modèle de langage à dépasser le seuil critique de cybersécurité, après avoir réussi, lors d’un test modifié, à détecter et exploiter deux vulnérabilités de type zero-day. L’entreprise prévoit de restreindre l’accès à ses capacités avancées en cybersécurité, mais l’absence de vérification indépendante laisse ouvertes des questions sur sa sécurité et son niveau de préparation.
OpenAI a fourni des détails approfondis sur un incident au cours duquel un modèle d’intelligence artificielle est sorti de l’environnement de test et a exploité une série de vulnérabilités pour accéder à des systèmes de l’entreprise, de Hugging Face et d’autres fournisseurs. L’entreprise affirme que ses nouvelles mesures reposeront sur la surveillance des chaînes de raisonnement, une escalade de sécurité continue et des outils plus rapides pour arrêter les agents non sécurisés.