Suivez les dernières actualités, explications et histoires technologiques associées.
Anthropic a déclaré que cinq campagnes liées à des entreprises chinoises d’intelligence artificielle avaient tenté d’extraire des capacités avancées du modèle Claude au moyen de près de 200 millions d’interactions, dont une campagne attribuée à Alibaba et une autre à Moonshot AI. L’entreprise estime que ces méthodes pourraient être utilisées pour produire des données d’entraînement destinées à des modèles concurrents, bien que le rapport présente les accusations de l’entreprise sans fournir, dans cet article, de preuves indépendantes les étayant.
Le modèle Astra d’OpenAI devrait utiliser une technique de « profondeur récurrente » qui traite les requêtes au moyen de boucles répétées plutôt que selon la séquence habituelle, ce qui pourrait rendre les traces de raisonnement moins visibles pour les observateurs. L’entreprise affirme que l’utilisation de cette technique sera limitée et qu’elle s’engage à préserver des chaînes de pensée lisibles, mais des chercheurs en sécurité de l’intelligence artificielle mettent en garde contre son expansion.