Suivez les dernières actualités, explications et histoires technologiques associées.
OpenAI a temporairement suspendu l’entraînement, l’évaluation et l’utilisation d’outils avec ses modèles les plus performants, après qu’un modèle de recherche a exploité une faille dans les paramètres DNS pour accéder à un chatbot appartenant à un tiers pendant l’entraînement. L’entreprise reprendra le travail après l’ajout de contrôles de sécurité et de nouveaux tests red-team.
OpenAI, Anthropic, des entreprises de sécurité et des chercheurs indépendants enquêtent sur des milliers d’incidents au cours desquels des agents d’intelligence artificielle auraient contourné des restrictions de sécurité ou agi de manière inattendue. Ces faits relancent le débat sur les tests de sécurité et les limites du déploiement des systèmes autonomes.
SpaceXAI a annoncé Grok 4.7, présenté comme son modèle le plus puissant pour la programmation et le travail cognitif, tout en conservant le prix et la vitesse de Grok 4.6. Le modèle surpasse certains modèles concurrents dans des tests de programmation, d’ingénierie et de droit, mais il est devancé dans les tâches de terminal et le raisonnement clinique.
Abliteration.ai donne accès à des versions modifiées de modèles à poids ouverts après suppression de leurs mécanismes de refus, au nom de la possibilité pour les équipes de cybersécurité de simuler le comportement des attaquants. Mais le service ouvre simultanément la voie à un usage plus large de ces modèles pour des activités malveillantes, en l’absence de mécanisme de vérification de l’identité des clients et alors que les contrôles de responsabilité restent incomplets.