基于蚁群遗传混合算法改进的连接查询研究*
2021-12-23张逸风佟国香屈亚宁
张逸风,佟国香,刘 军,屈亚宁
(1.上海理工大学光电信息与计算机工程学院,上海 200093;2.山东山大华天软件有限公司,山东 济南 250000)
1 引言
产品生命周期管理PLM(Product Lifecycle Management)是支持产品信息创建、管理、分发和应用的一系列方案。PLM的核心技术之一是面向产品全生命周期的数据建模技术。目前PLM系统主要以文档管理为主,很难解决异构平台、跨单位、跨阶段和跨领域开发时的数据交互问题,因此,研发基于模型数据库的复杂产品全生命周期模型管理原型系统PLMM(Product Lifecycle Management of Model)成为工业4.0时代大趋势。而产品生命周期中的概念产生、产品设计、采购、生产制造、销售和服务等各个阶段的数据不仅数据量大,且相互关联错综复杂,目前主流的关系型数据库和数据仓库都可以作为PLM系统的数据服务支持平台。由于PLM系统的数据库结构的复杂度高,数据信息具有多样性,将数据抽象为模型后,模型之间的关联关系越来越复杂,耦合性越来越高等诸多因素降低了数据检索的效率,因此,选择合适的连接查询算法[1]尤为重要。
在传统联机事务处理OLTP(On-Line Transaction Processing)[2]的多表连接查询方式中,Hash Join[3]是近些年研究人员改进得最多的连接查询算法。因为其稳定性和有效性,自诞生以来研究人员就尝试从各方面对其进行改进。文献[4]介绍了一种散列合并连接算法HMJ(Hash-Merge Join)。它通过不可预测的、缓慢的或突发的网络流量处理来自远程数据源的数据项。算法综合运用了非阻塞连接算法X-Join和渐进式合并连接算法的优点,得到了更优的结果。……
