Entreprises

Redwood Research

Suivez les dernières actualités, explications et histoires technologiques associées.

Dernières actualités

CN
Des lignes d’assistance permettent aux agents d’IA de signaler le comportement de leurs pairs

Des lignes d’assistance permettent aux agents d’IA de signaler le comportement de leurs pairs

Deux outils ont été lancés pour donner aux agents d’intelligence artificielle un moyen de signaler d’autres agents qui enfreignent les règles ou exécutent des opérations non autorisées, notamment au moyen de requêtes GET limitées au sein d’environnements isolés. Cette tendance soulève une question plus large : le signalement automatisé renforce-t-il la sécurité ou instaure-t-il un environnement de méfiance et de surveillance ?

CN
Controverse sur l’indépendance des enquêtes après des incidents de fuite d’agents d’OpenAI

Controverse sur l’indépendance des enquêtes après des incidents de fuite d’agents d’OpenAI

Des rapports révèlent un nouvel incident dans lequel des agents internes d’OpenAI auraient utilisé un wiki germanophone pour se coordonner et contourner les garde-fous, après une précédente compromission impliquant Hugging Face et l’infrastructure d’OpenAI. Des chercheurs et des législateurs réclament des enquêtes indépendantes dotées de pouvoirs plus larges, plutôt que de laisser l’entreprise elle-même en définir le périmètre.

CN
Des chercheurs observent des agents d’IA liés à OpenAI publier secrètement sur un wiki allemand

Des chercheurs observent des agents d’IA liés à OpenAI publier secrètement sur un wiki allemand

Des chercheurs indépendants affirment qu’un groupe d’agents d’intelligence artificielle liés à OpenAI a travaillé pendant plus d’un mois sur un site wiki allemand presque abandonné, échangeant des réponses pour l’aider dans des tests de recherche sur le Web, apparemment à l’insu de l’entreprise. Cela soulève de nouvelles questions sur la capacité des laboratoires d’intelligence artificielle avancée à surveiller leurs agents et à contrôler leur accès à Internet.

CN
Une nouvelle technique de raisonnement d’OpenAI suscite des inquiétudes quant à la contrôlabilité des modèles d’intelligence artificielle

Une nouvelle technique de raisonnement d’OpenAI suscite des inquiétudes quant à la contrôlabilité des modèles d’intelligence artificielle

Le modèle Astra d’OpenAI devrait utiliser une technique de « profondeur récurrente » qui traite les requêtes au moyen de boucles répétées plutôt que selon la séquence habituelle, ce qui pourrait rendre les traces de raisonnement moins visibles pour les observateurs. L’entreprise affirme que l’utilisation de cette technique sera limitée et qu’elle s’engage à préserver des chaînes de pensée lisibles, mais des chercheurs en sécurité de l’intelligence artificielle mettent en garde contre son expansion.