AWSはAmazon S3 Vectorsにメタデータの事前フィルタリングを追加したと発表した。これにより、テナント、カテゴリー、ステータス、日付などの条件が、類似性検索の実行前に適用される。これは、結果の選択と並行してフィルターを検査する従来の方式とは異なる。AWSによると、この変更により、選択性の高いフィルターを使用するクエリでは、一致するベクトルの数が最大5倍になる可能性がある。
この機能は、インデックス全体を検索するのではなく、特定の範囲内に結果を限定する必要があるアプリケーションを対象としている。たとえば、マルチテナントシステムにおける1社の顧客の文書、特定のユーザーのファイル、特定の地域とライセンスで許可されたコンテンツなどである。AWSが挙げているユースケースには、検索拡張生成(RAG)に基づくナレッジベース、エージェント型アプリケーション、文書検索、金融調査および法務サービスのプラットフォームが含まれる。
実際には何が変わるのか?
ENHANCEDモードでは、サービスがまずフィルターを処理し、一致するベクトルの集合内でのみベクトル検索を実行する。一方、現在のインデックスでデフォルトとして使用されるCLASSICモードでは、検索とフィルタリングが同時に行われるため、必要な集合がインデックスのごく一部を占める場合、一致する結果の数が減少する可能性がある。
AWSは、800万件のサポートチケットを含み、そのうち1社の顧客に属するものが400件であるインデックスを例に、違いを説明している。拡張モードでは、完全なインデックスから候補を選択して結果をフィルタリングするのではなく、その顧客のチケット内で検索が行われる。別の例では、インデックスの更新により、1つのテナントに限定された検索結果が、必要な10件のうちわずか2件から、そのテナントの文書による完全な結果集合へと変わった。
機能と制限
各ベクトルには、フィルタリング可能なメタデータを最大2キロバイト格納でき、1つのクエリでは最大100個のフィルター条件をサポートする。クエリ言語には、等価比較、$andおよび$orによる論理演算、数値比較、集合のメンバーシップ、存在確認が含まれる。またAWSは、パス、URL、階層型キーによって検索を限定するための$startsWith演算子を追加した。たとえば、サブフォルダーや文書識別子のプレフィックス内を検索できる。
既存のインデックスではベクトルを再取り込みする必要がなく、クエリの変更も必要ない。ただし、ユーザーはUpdateIndexModeを呼び出して、インデックスをENHANCEDに変更する必要がある。2026年9月30日以降に作成されたベクトルバケット内の新しいインデックスは拡張モードを使用する一方、それ以前のバケットとそのインデックスは、ユーザーが設定を変更するまでCLASSICのままとなる。
なぜこのニュースが重要なのか?
実用上の価値は、結果の数を増やすことだけにあるのではなく、必要な範囲が狭いために、ベクトル検索によって正しい文書が除外される可能性を減らすことにある。これはマルチテナントシステムや、特定の文書集合に従う必要があるエージェントにとって重要である。こうしたシステムでは、検索品質が意味的な関連性と範囲の正確性の組み合わせに左右されるためだ。
この機能は、Amazon S3 Vectorsが利用可能なすべてのAWS商用リージョンに加え、中国のAWSリージョンでも追加料金なしで利用できる。ただし、ストレージ、PUTリクエスト、クエリの料金は、通常のS3 Vectorsの料金に従って引き続き課金される。条件数とメタデータのサイズに関する制限は、考慮すべき要素として残る。100条件の上限を超える場合、AWSは大規模なフィルターを統合するか、より小さなクエリに分割することを提案している。