人工智能

Cloudflare 正式推出 AI Search,支持视觉搜索和扫描文件 OCR

Cloudflare 的 AI Search 服务现已正式上线,支持原生图像嵌入、多模态搜索,以及对最大 10 MB 的扫描 PDF 文件进行 OCR。费用将于 2026 年 11 月 1 日开始计算,所有 Workers 计划仍保留免费额度。

2026-10-01
1 分钟阅读
89 浏览量
certi.news Editorial Team
Cloudflare 正式推出 AI Search,支持视觉搜索和扫描文件 OCR

Cloudflare 宣布正式开放 AI Search,这是一项托管式索引与检索平台,结合了 Workers AI、Vectorize、R2 和 Browser Run。该服务将搜索范围从文本扩展到图像和扫描文档,费用将于 2026 年 11 月 1 日开始计算,同时所有 Workers 计划继续享有每月免费额度。

可处理图像本身的搜索

AI Search 现在支持对图像像素进行原生嵌入,同时保留图像的文本描述。Cloudflare 表示,这种方式能够保留将图像压缩为描述时可能丢失的细节,例如颜色、纹理、文档布局,以及图表和示意图中的空间关系。

该服务使用 Matryoshka Representation Learning,以保留更小且存储和搜索效率更高的表示。目前,原生多模态检索可与 Qwen3-VL-Embedding 模型配合使用。当使用支持图像的模型时,查询图像会直接嵌入与已索引图像和文本相同的向量空间。

如果嵌入模型仅支持文本,AI Search 会使用 ToMarkdown 将查询图像转换为文本,然后根据生成的描述进行搜索。因此,所有模型都能以基本形式支持图像查询,而多模态模型则可以获得完整的视觉信号。

更大的文件和扫描文档读取

Cloudflare 将文本文件和 PDF 文件的最大限制从 4 MB 提高到了 10 MB。此外,现在可以为由扫描图像组成且不包含可提取文本的 PDF 文件启用光学字符识别 OCR;系统会先读取页面,再对内容进行拆分和嵌入。

这些功能可用于搜索内部文档、匹配屏幕截图、索引图表和示意图、发现产品,以及搜索视觉上相似的图像或同时结合视觉特征与文本描述的图像。

实际有哪些变化?

AI Search 正从主要依赖文本或图像描述的搜索,转变为一种能够结合向量搜索和关键词搜索的检索流程,并可选择合并和重新排序结果,然后返回结果或将其传递给生成式模型以撰写答案。

这一步对管理多种内容存储库的开发团队十分重要,因为一些关键信息不会出现在图像描述或从文档中提取的文本里。不过,原生图像支持取决于所使用的嵌入模型,而文本模型用户则依赖将图像转换为描述;因此,检索质量会因模型和内容性质而异。

计费和免费额度

费用将从 2026 年 11 月 1 日起按三个组成部分计算:输入内容、存储数据和查询。基本流程包括使用 Workers AI 模型进行分析、拆分和嵌入,以及关键词索引和重新排序;不会单独收取实例运行时间费用,也没有月度最低消费。

  • 内容输入:每百万个令牌 0.75 美元,每月免费额度为 500 万个令牌。
  • 图像处理:每百万个令牌额外收取 0.50 美元。
  • 存储:每 GB-月 2 美元,免费额度为 10 GB。
  • 语义查询:每千次查询 0.75 美元,免费 1,000 次查询。
  • 全文搜索:每千次查询 0.10 美元,免费 1,000 次查询。

Cloudflare 说明,使用指定的 Workers AI 模型时,嵌入和重新排序免费;第三方模型则单独计费。每月免费输入额度涵盖所有受支持的文件类型。

公司计划今后增加完整的视频和音频处理功能,提升关键词搜索引擎在大型数据存储库中的扩展能力,并简化 Cloudflare 托管网站的索引创建。

新闻来源
Cloudflare Blog
查看原始来源 ↗
c
作者

certi.news Editorial Team

同一分类

你可能还喜欢

查看所有新闻