土耳其公司HAVELSAN宣布,大数据管理平台ORION已准备投入使用,此举旨在帮助机构汇集分散的数据,安全地管理数据,并为分析和人工智能应用进行准备。该平台面向处理大量数据或需要在统一环境中整合不同数据源的政府机构和私营部门公司。
ORION作为一个可扩展的本地平台开发而成,可处理来自数据库、企业应用、文档、传感器、安防设备、生产机器及其他数字系统的结构化和非结构化数据。数据不再停留于彼此分离的环境中,平台可以通过统一平台对其进行收集、存储、处理和分析。
从存储数据到为使用做好准备
ORION的作用并不限于保存数据,平台还着重于使数据可编辑、可处理、可搜索和可分析。根据文章,这种方式可以缩短获取信息以及开展报告编制、研究、分析和决策支持工作的时间。
该平台基于开源组件,并将这些技术整合到一个一体化环境中,使机构无需分别管理这些技术。此外,ORION可以根据数据量、用户数量和机构需求进行配置,并支持横向和纵向扩展。
机构内部运行与数据主权支持
ORION的一项特点是能够与机构目前使用的数据源和应用集成,这有助于保护现有投资并简化向该平台的迁移。平台还可以在机构的数据中心和封闭网络内运行,使数据保持在机构边界之内,访问权限继续由机构自行控制。
HAVELSAN将这种方式描述为其与广泛使用的大数据平台之间的区别,后者通常依赖将数据存储在第三方所属的云环境中。ORION采用“on-premises first”原则,即优先在机构自身基础设施内运行,同时旨在减少对单一供应商的依赖、降低许可成本,并构建更加灵活且可适配的数据基础设施。
为什么该平台对人工智能项目很重要?
人工智能应用需要结构化、可用且可处理的数据,才能产生可靠结果。从这一角度来看,ORION充当准备层,对来自多个来源的数据进行组织,并以更加一致的方式将其传送至人工智能工具和高级分析系统。
文章提到的潜在应用领域包括公共部门、国防、金融、能源、电信、交通、医疗、工业和研究。文章没有提供该平台价格或商业发布方式的细节,但指出,该平台旨在满足能够管理大量多样化数据的公共和私营机构的需求。
首个应用:土耳其语言遗产数字化
ORION首个公布的应用将是HAVELSAN与土耳其语言学会合作实施的数字化项目。该项目旨在将土耳其语自诞生以来的书面、口述和视觉遗产转移到数字环境中,随后将其录入数据库,并利用人工智能提供分析能力。
这一应用将为该平台提供一个结合不同来源和媒介的实际测试场景,而ORION所针对的是机构普遍面临的问题:拥有大量数据,却缺乏统一基础设施,使数据能够被访问、分析并用于运营。