国内刊号:11-2560/TP
国际刊号:1000-9825
发布日期:
作者:沈志宏,赵子豪,王华进,刘忠新,胡川,周园春
单位:沈志宏,中国科学院 计算机网络信息中心, 北京 10019011,赵子豪,中国科学院 计算机网络信息中心, 北京 100190;中国科学院大学, 北京 10004902,王华进,中国科学院 计算机网络信息中心, 北京 10019003,刘忠新,中国科学院 计算机网络信息中心, 北京 10019004,胡川,中国科学院 计算机网络信息中心, 北京 100190;中国科学院大学, 北京 10004905,周园春,中国科学院 计算机网络信息中心, 北京 100190;中国科学院大学, 北京 10004906
关键词:数据管理系统;异构数据融合;图数据模型;即席查询;人工智能
基金:中国科学院战略性先导科技专项(B类)课题(XDB38030300);国家自然科学基金(61836013);科技部创新方法工作专项(2019IM020100);中国科学院信息化专项课题(XXH13503)
随着大数据应用的不断深入,对大规模结构化/非结构化数据进行融合管理和分析的需求日益凸显.然而,结构化/非结构化数据在存储管理方式、信息获取方式、检索方式方面的差异给融合管理和分析带来了技术挑战.提出了适用于异构数据融合管理和语义计算的属性图扩展模型,并定义了相关属性操作符和查询语法.接着,基于智能属性图模型提出异构数据智能融合管理系统PandaDB,并详细介绍了PandaDB的总体架构、存储机制、查询机制、属性协存和AI算法集成机制.性能测试和应用案例证明,PandaDB的协存机制、分布式架构和语义索引机制对大规模异构数据的即席查询和分析具有较好的性能表现,该系统可实际应用于学术图谱实体消歧与可视化等融合数据管理场景.
来源:2021年第3期
《软件学报》期刊编辑部