人工智能工具

OpenSearch创始人推出 Infino:为人工智能代理提供统一检索层

Infino推出了一个开源检索平台,在以 Apache Parquet 格式存储的单一数据副本之上,整合关键词搜索、语义搜索和结构化查询。该平台旨在减少代理对独立搜索引擎、向量数据库和数据仓库组合的依赖,同时集中管理访问策略。

2026-10-07
1 分钟阅读
7 浏览量
certi.news Editorial Team
OpenSearch创始人推出 Infino:为人工智能代理提供统一检索层

Infino宣布正式结束隐身阶段。该公司的创始成员拥有 OpenSearch 相关经验,此次推出了一款面向人工智能代理的检索平台。其核心理念是,为代理提供一个查询结构化和非结构化数据的统一接口,而不是将任务分散到数据仓库、搜索引擎和向量数据库中,再让代理通过多轮操作整合结果。

公司表示,代理的读取方式不同于用户和传统应用。代理不是发送一个查询并等待结果,而是会提出多个小型并行问题,以构建更大的答案。返回给代理的每个结果都会消耗一部分模型上下文,并可能增加后续调用的延迟和成本。

Infino提供什么?

Infino将检索功能直接置于 SQL 中,因此可以在一个查询中结合关键词搜索、语义搜索、过滤、计数、连接、聚合和排序。首席执行官 Ekechi Nwokah 表示,重点并不在于使用 SQL 本身,而在于将通常需要多个独立系统才能完成的查询模式集中起来。

公司表示,开发人员可以输入自然语言问题,并将其转换为一个在数秒的一小部分时间内执行的查询。Infino还为检索引擎加入了面向推理的模型,用于处理搜索循环中的重复任务,例如构建查询、检查结果质量、尝试替代查询并验证答案,而不是始终将这些步骤交给成本更高的高级模型。

一份 Parquet 格式的数据副本

该架构依赖于将数据存储在对象存储上的 Apache Parquet 文件中,并将搜索索引置于 Parquet 文件页脚旁边。Infino表示,其核心引擎为开源项目,并在 GitHub 上依据 Apache-2.0 许可证发布;Infino Cloud 服务则允许使用现有的 Parquet 数据,并在无需自行构建基础设施的情况下使其具备可搜索性。

数据仍可通过支持 Parquet 的工具读取,包括 Iceberg、Hudi、Spark、DuckDB 以及其他数据仓库。公司称,用户还可以导入 Parquet 或 JSON 数据,然后将代理连接到 Infino 接口,而无需管理集群、节点或分布式分片。

为什么这条消息重要?

如果这一理念能够在生产负载中取得成功,统一检索层或许可以减少代理需要调用的数据摄取路径、ETL 作业、模式和客户端数量。更重要的是,从安全角度看,单一数据副本或许能够集中实施访问策略,包括规定代理可以查看哪些行和列,以及哪些内容需要记录,而不是将权限分散在 MCP 网关和服务连接器之间。

该平台面向平台和数据工程师、安全团队、机器学习与数据科学团队,以及构建能够处理代码、日志、持续集成输出和工单的代理的开发人员。Infino表示,其架构的设计成本约为传统搜索和分析架构的十分之一;该公司发布的对比数据显示,在其测试的工作负载中,成本约低于 Elasticsearch 10.5 倍,低于 OpenSearch 23 倍。

限制与未决问题

这些数字由公司提供,并与特定测试负载相关,因此仅凭这些数字不足以证明其普遍优于所有 Elasticsearch 或 OpenSearch 应用。此外,减少系统数量并不能消除对检索质量、访问策略边界,以及数据变化或规模扩大时索引行为进行验证的需要。该方法的价值仍取决于 Parquet 和对象存储是否适合每个团队的数据模式和查询模式。

新闻来源
The New Stack - Software Development
查看原始来源 ↗
c
作者

certi.news Editorial Team