Künstliche Intelligenz

Cloudflare führt AI Search offiziell mit visueller Suche und OCR für gescannte Dateien ein

Der Dienst AI Search von Cloudflare ist nun offiziell verfügbar und unterstützt die native Einbettung von Bildern, die multimodale Suche sowie OCR für gescannte PDF-Dateien bis zu 10 Megabyte. Die Abrechnung beginnt am 1. November 2026; ein kostenloses Kontingent bleibt in allen Workers-Tarifen bestehen.

2026-10-01
4 Min. Lesezeit
12 Aufrufe
certi.news Editorial Team
Cloudflare führt AI Search offiziell mit visueller Suche und OCR für gescannte Dateien ein

Cloudflare hat die allgemeine Verfügbarkeit des Dienstes AI Search angekündigt, einer verwalteten Plattform für Indexierung und Retrieval, die Workers AI, Vectorize, R2 und Browser Run kombiniert. Der Dienst erweitert den Suchumfang von Texten auf Bilder und gescannte Dokumente. Die Abrechnung beginnt am 1. November 2026, während ein monatliches kostenloses Kontingent in allen Workers-Tarifen bestehen bleibt.

Eine Suche, die das Bild selbst verarbeitet

AI Search unterstützt jetzt die native Einbettung von Bildpixeln und bewahrt zugleich die Textbeschreibung des Bildes. Cloudflare zufolge erhält dieser Ansatz Details, die verloren gehen können, wenn ein Bild auf eine Beschreibung reduziert wird, etwa Farben, Texturen, das Layout eines Dokuments sowie räumliche Beziehungen innerhalb von Grafiken und Diagrammen.

Der Dienst verwendet Matryoshka Representation Learning, um kleinere und speichereffizientere Darstellungen für Speicherung und Suche zu bewahren. Die native multimodale Suche ist derzeit mit dem Modell Qwen3-VL-Embedding verfügbar. Wird ein bildunterstützendes Modell verwendet, wird das Abfragebild direkt in denselben Vektorraum eingebettet, in dem sich die indexierten Bilder und Texte befinden.

Wenn das Einbettungsmodell dagegen ausschließlich textbasiert ist, wandelt AI Search das Abfragebild mithilfe von ToMarkdown in Text um und sucht auf Grundlage der daraus erzeugten Beschreibung. Dadurch bleiben bildbasierte Abfragen grundsätzlich für alle Modelle verfügbar, während multimodale Modelle das vollständige visuelle Signal erhalten.

Größere Dateien und das Lesen gescannter Dokumente

Cloudflare hat die maximale Größe für Textdateien und PDF-Dateien von 4 Megabyte auf 10 Megabyte erhöht. Außerdem kann die optische Zeichenerkennung OCR für PDF-Dateien aktiviert werden, die aus gescannten Bildern bestehen und keinen extrahierbaren Text enthalten; ihre Seiten werden gelesen, bevor der Inhalt aufgeteilt und eingebettet wird.

Diese Funktionen können für die Suche in internen Dokumenten, den Abgleich von Screenshots, die Indexierung von Diagrammen und Grafiken, die Produkterkennung sowie die Suche nach Bildern verwendet werden, die visuell ähnlich sind oder visuelle und textliche Merkmale kombinieren.

Was ändert sich praktisch?

AI Search entwickelt sich von einer Suche, die hauptsächlich auf Texten oder Bildbeschreibungen basiert, zu einem Retrieval-Prozess, der Vektorsuche und Schlüsselwörter kombinieren, die Ergebnisse anschließend optional zusammenführen und neu ordnen sowie sie dann zurückgeben oder an ein generatives Modell zur Formulierung einer Antwort weiterleiten kann.

Dieser Schritt ist für Entwicklungsteams relevant, die Inhaltsbestände mit unterschiedlichen Medien verwalten, da einige wichtige Informationen weder in der Bildbeschreibung noch im aus dem Dokument extrahierten Text erscheinen. Die native Bildunterstützung ist jedoch an das verwendete Einbettungsmodell gebunden, während Nutzer textbasierter Modelle auf die Umwandlung des Bildes in eine Beschreibung angewiesen sind. Daher unterscheidet sich die Qualität des Retrievals je nach Modell und Art des Inhalts.

Abrechnung und kostenloses Kontingent

Die Gebühren werden ab dem 1. November 2026 für drei Komponenten berechnet: ingestierten Inhalt, gespeicherte Daten und Abfragen. Der grundlegende Prozess umfasst Analyse, Aufteilung und Einbettung mithilfe von Workers-AI-Modellen, die Indexierung nach Schlüsselwörtern sowie die Neuanordnung, ohne separate Gebühren für die Laufzeit von Instanzen oder ein monatliches Mindestentgelt.

  • Inhaltsaufnahme: 0,75 Dollar pro eine Million Token, mit einem kostenlosen Kontingent von 5 Millionen Token pro Monat.
  • Bildverarbeitung: zusätzlich 0,50 Dollar pro eine Million Token.
  • Speicher: 2 Dollar pro Gigabyte-Monat, mit 10 kostenlosen Gigabyte.
  • Semantische Abfrage: 0,75 Dollar pro 1.000 Abfragen, mit 1.000 kostenlosen Abfragen.
  • Volltextsuche: 0,10 Dollar pro 1.000 Abfragen, mit 1.000 kostenlosen Abfragen.

Cloudflare erklärt, dass Einbettung und Neuanordnung bei Verwendung bestimmter Workers-AI-Modelle kostenlos sind, während Modelle von Drittanbietern separat abgerechnet werden. Das monatliche kostenlose Kontingent für die Inhaltsaufnahme umfasst alle unterstützten Dateitypen.

Das Unternehmen plant später die vollständige Verarbeitung von Video und Audio, eine bessere Skalierbarkeit der Schlüsselwortsuchmaschine für große Datenbestände sowie eine vereinfachte Erstellung von Indizes für auf Cloudflare gehostete Websites hinzuzufügen.

Nachrichtenquelle
Cloudflare Blog
Originalquelle öffnen ↗
c
Autor

certi.news Editorial Team

Aus derselben Kategorie

Das könnte Sie interessieren

Alle Nachrichten anzeigen