Informatique en nuage et centres de données

Amazon S3 Vectors ajoute le filtrage préalable des métadonnées pour améliorer le rappel des résultats de recherche

AWS a ajouté à Amazon S3 Vectors un mécanisme de filtrage préalable des métadonnées avant la recherche par similarité, ce qui peut multiplier jusqu’à cinq fois le taux de rappel des résultats correspondants dans les requêtes utilisant des filtres sélectifs. La fonctionnalité est disponible sans coût supplémentaire ni réinjection des données, mais elle nécessite la migration des index existants vers le mode ENHANCED.

2026-09-30
4 min de lecture
10 vues
certi.news Editorial Team
Amazon S3 Vectors ajoute le filtrage préalable des métadonnées pour améliorer le rappel des résultats de recherche

AWS a annoncé l’ajout du filtrage préalable des métadonnées à Amazon S3 Vectors. Les conditions portant, par exemple, sur le locataire, la catégorie, l’état ou la date sont ainsi appliquées avant l’exécution de la recherche par similarité, au lieu de vérifier le filtre en parallèle de la sélection des résultats. L’entreprise affirme que ce changement peut fournir jusqu’à cinq fois plus de vecteurs correspondants dans les requêtes utilisant des filtres sélectifs.

La fonctionnalité vise les applications qui ne recherchent pas dans un index complet, mais qui doivent limiter les résultats à un périmètre défini, comme les documents d’un seul client dans un système multitenant, les fichiers d’un utilisateur particulier ou le contenu autorisé dans une région et sous une licence données. Parmi les cas d’utilisation cités par AWS figurent les bases de connaissances fondées sur la génération augmentée par récupération (RAG), les applications agentiques, la recherche documentaire ainsi que les plateformes de recherche financière et les services juridiques.

Qu’est-ce qui change concrètement ?

En mode ENHANCED, le service résout d’abord le filtre, puis exécute la recherche vectorielle uniquement au sein de l’ensemble des vecteurs correspondants. En revanche, le mode CLASSIC, utilisé par défaut pour les index existants, effectue la recherche et le filtrage simultanément, ce qui peut réduire le nombre de résultats correspondants lorsque l’ensemble recherché représente une petite partie de l’index.

AWS illustre la différence avec l’exemple d’un index contenant 8 millions de tickets d’assistance, dont 400 appartiennent à un seul client. En mode amélioré, la recherche est effectuée dans les tickets de ce client, au lieu de sélectionner les candidats dans l’index complet puis de filtrer les résultats. Dans un autre exemple, la mise à jour d’un index a transformé le résultat limité à un seul locataire, qui ne produisait que deux résultats sur les dix demandés, en un ensemble complet de résultats issus des documents de ce locataire.

Capacités et limites

Chaque vecteur peut contenir jusqu’à 2 Ko de métadonnées filtrables, tandis qu’une requête unique prend en charge jusqu’à 100 conditions de filtrage. Le langage de requête comprend l’égalité, la logique booléenne avec $and et $or, les comparaisons numériques, l’appartenance à des ensembles et la vérification de l’existence. AWS a également ajouté l’opérateur $startsWith pour limiter la recherche à des chemins, des URL ou des clés hiérarchiques, par exemple pour effectuer une recherche dans un sous-dossier ou un préfixe d’identifiant de document.

Les index existants ne nécessitent pas de réinjection des vecteurs et les requêtes n’ont pas besoin d’être modifiées. Toutefois, l’utilisateur doit appeler UpdateIndexMode pour convertir l’index en ENHANCED. Les nouveaux index dans des conteneurs de vecteurs créés le 30 septembre 2026 ou après cette date utilisent le mode amélioré, tandis que les conteneurs plus anciens et leurs index restent en CLASSIC jusqu’à ce que l’utilisateur modifie le paramètre.

Pourquoi cette actualité est-elle importante ?

La valeur pratique ne réside pas seulement dans l’augmentation du nombre de résultats, mais aussi dans la réduction du risque que la recherche vectorielle masque les bons documents en raison de l’étroitesse du périmètre demandé. Cela est important pour les systèmes multitenants et les agents qui doivent respecter un ensemble précis de documents, car la qualité de la récupération dépend ici de la combinaison entre la pertinence sémantique et la justesse du périmètre.

La fonctionnalité est disponible sans coût supplémentaire dans toutes les régions commerciales AWS où Amazon S3 Vectors est disponible, ainsi que dans les régions AWS en Chine. Les frais de stockage et les frais liés aux requêtes PUT et aux requêtes continuent d’être calculés selon les tarifs habituels de S3 Vectors. Les limites relatives au nombre de conditions et à la taille des métadonnées restent des facteurs à prendre en compte ; AWS suggère de combiner les grands filtres ou de les répartir en requêtes plus petites lorsque la limite de 100 conditions est dépassée.

Source de l’actualité
c
Auteur

certi.news Editorial Team

Dans la même catégorie

À lire également

Voir toutes les actualités