面向云数据中心的成本感知容错算法
2021-10-21宋彩利
西安石油大学学报(自然科学版) 2021年5期
宋彩利,梁 斌,李 皎
(西安石油大学 计算机学院,陕西 西安 710065)
引 言
云服务的最终目的是使云用户可以稳定、快捷和方便地使用弹性的计算和存储服务。因此,提高云数据中心的稳定性不仅可以提升用户的使用体验,更能增加云服务提供商收益。然而,大型云数据中心都是由低性能的物理机构成,通过虚拟化技术将其以虚拟机的形式租用给云用户,这样就会由于机器性能不稳定而导致虚拟机故障。现代云数据中心为了提升云服务的稳定性和可靠性,通常在建立虚拟机时会设计合理的容错机制从而保证云任务顺利执行。但是,随着云数据中心规模不断扩大,大量的故障和容错问题已经成为制约云数据中心进一步发展的瓶颈之一。
云数据中心针对虚拟机故障的容错策略主要可以分为副本复制和重调度。副本复制一般开始于云任务映射初始阶段。当云数据中心的调度系统在进行云任务映射时,为了避免虚拟机故障,会激活一些冗余的虚拟机对部分云任务进行多次映射。其通过增加副本数量的方法,提升了云任务顺利完成的概率。这种方法虽然简单方便,但是也存在很多隐患。首先,由于虚拟机的故障是一个随机事件,调度系统并不能预测故障的发生,从而导致命中故障的几率较低。其次,冗余的虚拟机会带来云服务提供商成本的上升从而降低其收益。最后,副本数量的选择也是一个复杂的问题,设计人员需要综合统计学和半导体等多学科知识综合进行考虑,因此它的复杂度带来的损失将远大于问题自身的收益。……
登录APP查看全文