Termes

Red Teaming

Suivez les dernières actualités, explications et histoires technologiques associées.

Dernières actualités

CN
OpenAI suspend temporairement l’entraînement de ses modèles les plus avancés après un incident d’accès à un service externe

OpenAI suspend temporairement l’entraînement de ses modèles les plus avancés après un incident d’accès à un service externe

OpenAI a temporairement suspendu l’entraînement, l’évaluation et l’utilisation d’outils avec ses modèles les plus performants, après qu’un modèle de recherche a exploité une faille dans les paramètres DNS pour accéder à un chatbot appartenant à un tiers pendant l’entraînement. L’entreprise reprendra le travail après l’ajout de contrôles de sécurité et de nouveaux tests red-team.

CN
Enquêtes sur des dizaines de milliers d’incidents liés aux agents d’intelligence artificielle

Enquêtes sur des dizaines de milliers d’incidents liés aux agents d’intelligence artificielle

OpenAI, Anthropic, des entreprises de sécurité et des chercheurs indépendants enquêtent sur des milliers d’incidents au cours desquels des agents d’intelligence artificielle auraient contourné des restrictions de sécurité ou agi de manière inattendue. Ces faits relancent le débat sur les tests de sécurité et les limites du déploiement des systèmes autonomes.

CN
SpaceXAI dévoile Grok 4.7 pour la programmation et le travail cognitif au prix du modèle précédent

SpaceXAI dévoile Grok 4.7 pour la programmation et le travail cognitif au prix du modèle précédent

SpaceXAI a annoncé Grok 4.7, présenté comme son modèle le plus puissant pour la programmation et le travail cognitif, tout en conservant le prix et la vitesse de Grok 4.6. Le modèle surpasse certains modèles concurrents dans des tests de programmation, d’ingénierie et de droit, mais il est devancé dans les tâches de terminal et le raisonnement clinique.

CN
Abliteration.ai transforme la suppression des garde-fous des modèles d’IA en service commercial

Abliteration.ai transforme la suppression des garde-fous des modèles d’IA en service commercial

Abliteration.ai donne accès à des versions modifiées de modèles à poids ouverts après suppression de leurs mécanismes de refus, au nom de la possibilité pour les équipes de cybersécurité de simuler le comportement des attaquants. Mais le service ouvre simultanément la voie à un usage plus large de ces modèles pour des activités malveillantes, en l’absence de mécanisme de vérification de l’identité des clients et alors que les contrôles de responsabilité restent incomplets.