Cloudflare 宣布正式开放 AI Search,这是一项托管式索引与检索平台,结合了 Workers AI、Vectorize、R2 和 Browser Run。该服务将搜索范围从文本扩展到图像和扫描文档,费用将于 2026 年 11 月 1 日开始计算,同时所有 Workers 计划继续享有每月免费额度。
可处理图像本身的搜索
AI Search 现在支持对图像像素进行原生嵌入,同时保留图像的文本描述。Cloudflare 表示,这种方式能够保留将图像压缩为描述时可能丢失的细节,例如颜色、纹理、文档布局,以及图表和示意图中的空间关系。
该服务使用 Matryoshka Representation Learning,以保留更小且存储和搜索效率更高的表示。目前,原生多模态检索可与 Qwen3-VL-Embedding 模型配合使用。当使用支持图像的模型时,查询图像会直接嵌入与已索引图像和文本相同的向量空间。
如果嵌入模型仅支持文本,AI Search 会使用 ToMarkdown 将查询图像转换为文本,然后根据生成的描述进行搜索。因此,所有模型都能以基本形式支持图像查询,而多模态模型则可以获得完整的视觉信号。
更大的文件和扫描文档读取
Cloudflare 将文本文件和 PDF 文件的最大限制从 4 MB 提高到了 10 MB。此外,现在可以为由扫描图像组成且不包含可提取文本的 PDF 文件启用光学字符识别 OCR;系统会先读取页面,再对内容进行拆分和嵌入。
这些功能可用于搜索内部文档、匹配屏幕截图、索引图表和示意图、发现产品,以及搜索视觉上相似的图像或同时结合视觉特征与文本描述的图像。
实际有哪些变化?
AI Search 正从主要依赖文本或图像描述的搜索,转变为一种能够结合向量搜索和关键词搜索的检索流程,并可选择合并和重新排序结果,然后返回结果或将其传递给生成式模型以撰写答案。
这一步对管理多种内容存储库的开发团队十分重要,因为一些关键信息不会出现在图像描述或从文档中提取的文本里。不过,原生图像支持取决于所使用的嵌入模型,而文本模型用户则依赖将图像转换为描述;因此,检索质量会因模型和内容性质而异。
计费和免费额度
费用将从 2026 年 11 月 1 日起按三个组成部分计算:输入内容、存储数据和查询。基本流程包括使用 Workers AI 模型进行分析、拆分和嵌入,以及关键词索引和重新排序;不会单独收取实例运行时间费用,也没有月度最低消费。
- 内容输入:每百万个令牌 0.75 美元,每月免费额度为 500 万个令牌。
- 图像处理:每百万个令牌额外收取 0.50 美元。
- 存储:每 GB-月 2 美元,免费额度为 10 GB。
- 语义查询:每千次查询 0.75 美元,免费 1,000 次查询。
- 全文搜索:每千次查询 0.10 美元,免费 1,000 次查询。
Cloudflare 说明,使用指定的 Workers AI 模型时,嵌入和重新排序免费;第三方模型则单独计费。每月免费输入额度涵盖所有受支持的文件类型。
公司计划今后增加完整的视频和音频处理功能,提升关键词搜索引擎在大型数据存储库中的扩展能力,并简化 Cloudflare 托管网站的索引创建。