随着计算机技术、工业信息化的发展,工业领域产生的数据量越来越大。时间序列数据(简称“时序数据”)在工业领域的应用非常广泛,是工业数据中的主要数据类型,其存储和查询问题已经成为工业大数据研究中的一项重点内容。当前,主流的列式存储文件格式并没有针对时序数据的存储进行优化。
通过本发明所述方法及系统,能够将一组时序数据的时间戳和具体的数据值存储在一个列中,减少了数据查询时的磁盘I/O;以及将数据按照页进行划分,并分别建立聚合索引信息,加快了数据的查询速度。
本发明提供一种时序数据列式存储、查询方法及系统,所述的存储方法包括:将一列时序数据划分为多个页,每一页存储所述一列时序数据的一部分数据点,所有页中存储的数据点总和为一列时序数据中所有的数据点;为每一页设置页头和页体两部分,针对每一页,将该页中的所有数据点的聚合索引信息存储于该页的页头中,以及将该页中所有数据点的数据值信息存储于该页的页体中。
天谋科技由 Apache IoTDB 核心团队创立,团队聚焦大数据底层技术软件研发,针对企业组建物联网大数据平台时所遇到的数据体量大、采样频率高、数据乱序到达、分析需求多、存储与运维成本高等多种问题,为企业提供海量时序数据管理的高效解决方案。创始团队由 Apache(国际最大开源软件基金会)旗下 IoTDB、PLC4X 两大开源物联网项目的发起人和核心开发者组成,汇集了来自清华大学、UC Berkeley、微软、德国弗劳恩霍夫协会(Fraunhofer-Gesellschaft)、德国法兰克福能源集团等一批数据库核心技术科学家和工业资深专家,拥有十几年研究和服务工业用户的经验。在时序数据管理领域,团队成员拥有中国、美国、欧洲等发明专利30余项,并在 ICDE, SIGMOD, VLDB 等数据库顶级会议上发表论文多篇。
评价单位:“科创中国”开源产业科技服务团 (中国通信学会)
评价时间:2022-11-18
综合评价
该成果对于物联网工业场景下,企业如何更好的管理由工业场景产生的时序数据有一定的引领性作用,技术创新性很强,目标市场处于成长市场,发展空间大。
查看更多>