Cloudflareは、Workers AI、Vectorize、R2、Browser Runを組み合わせた、インデックス作成と検索・取得のためのマネージドプラットフォームであるAI Searchの一般提供を発表しました。このサービスは、検索対象をテキストから画像やスキャン文書へ拡大し、2026年11月1日から課金を開始するとともに、すべてのWorkersプランで月間無料枠を引き続き提供します。
画像そのものを扱う検索
AI Searchは現在、画像のピクセルをネイティブに埋め込む機能に加え、画像のテキスト説明も保持します。Cloudflareによると、この方式は、画像を説明に縮約した際に失われる可能性のある、色、質感、文書のレイアウト、図やチャート内の空間的関係といった詳細を維持します。
このサービスはMatryoshka Representation Learningを使用し、より小さく、ストレージと検索の効率に優れた表現を維持します。現在、ネイティブのマルチモーダル検索はQwen3-VL-Embeddingモデルで利用できます。画像に対応するモデルを使用する場合、クエリ画像は、インデックス化された画像やテキストが存在するものと同じベクトル空間に直接埋め込まれます。
一方、埋め込みモデルがテキストのみに対応する場合、AI SearchはToMarkdownを使用してクエリ画像をテキストに変換し、生成された説明に基づいて検索します。これにより、画像クエリは基本的にすべてのモデルで利用可能であり、マルチモーダルモデルでは完全な視覚情報を取得できます。
より大きなファイルとスキャン文書の読み取り
Cloudflareは、テキストファイルとPDFの最大ファイルサイズを4メガバイトから10メガバイトに引き上げました。また、抽出可能なテキストを含まないスキャン画像で構成されたPDFに対して、光学文字認識OCRを有効にできるようになりました。ページはコンテンツの分割と埋め込みの前に読み取られます。
これらの機能は、内部文書の検索、スクリーンショットの照合、図表やグラフィックのインデックス作成、製品の発見、視覚的に類似した画像や視覚的特徴とテキスト説明を組み合わせた画像の検索に利用できます。
実際に何が変わるのか
AI Searchは、主にテキストや画像の説明に依存する検索から、ベクトル検索とキーワード検索を組み合わせ、結果を統合して必要に応じて再ランキングし、その結果を返すか、生成モデルに渡して回答を作成できる検索・取得の流れへと変化します。
この動きは、多様なコンテンツを含むリポジトリを管理する開発チームにとって重要です。なぜなら、一部の重要な情報は画像の説明や文書から抽出されたテキストには現れないためです。ただし、画像のネイティブサポートは使用する埋め込みモデルに関連しており、テキストモデルの利用者は画像を説明に変換する方式に依存します。そのため、検索・取得の品質はモデルとコンテンツの性質によって異なります。
料金と無料枠
料金は2026年11月1日から、入力コンテンツ、保存データ、クエリの3つの要素について計算されます。基本処理には、Workers AIモデルを使用した分析、分割、埋め込み、キーワードインデックス作成、再ランキングが含まれ、インスタンスの稼働時間に対する別料金や月額最低料金はありません。
- コンテンツ入力:100万トークンあたり0.75ドル。月間500万トークンの無料枠。
- 画像処理:100万トークンあたり0.50ドルの追加料金。
- ストレージ:1ギガバイト・月あたり2ドル。10ギガバイトまで無料。
- セマンティック検索:1,000クエリあたり0.75ドル。1,000クエリまで無料。
- 全文検索:1,000クエリあたり0.10ドル。1,000クエリまで無料。
Cloudflareは、指定されたWorkers AIモデルを使用する場合、埋め込みと再ランキングは無料である一方、サードパーティーに属するモデルは別途課金されると説明しています。月間の無料入力枠には、対応するすべてのファイル形式が含まれます。
同社は今後、動画と音声の完全な処理、 大規模なデータリポジトリに合わせて拡張できるキーワード検索エンジンの改善、Cloudflare上でホストされているサイト向けのインデックス作成の簡素化を予定しています。