APP下载

浅析随机森林算法应用于燃机电厂燃料量预测的意义

2019-10-21蔡佳成徐佳宁

科学与信息化 2019年11期

蔡佳成 徐佳宁

摘 要 随着经济和信息技术的飞速发展,海量数据已经成为当今信息社会的一个重要的特点。本文提出了将海量数据应用于电厂运行参数分析当中,再基于随机森林算法对燃机电厂天然气用量预测的一种新思路,并对其实际意义进行了有效的分析。

关键词 天然气;随机森林算法;预测;燃料

引言

随着21世纪信息时代的到来,各种类型的数据信息也跟着飞速增长,而如何对这些海量数据加以利用便成了随之而来的问题。越来越多的领域研究利用这些数据进行分析、预测以此来跟上时代发展的脚步。例如,工业、管理机构、企业、研究单位等众多领域都产生并积累了众多的、各种形式的信息数据。根据相关部门的统计,2015年大量的数据增长量将给IT领域在全球带来670亿美元的支出额,并且预测在这些数据增长量全球的总支出将达到2320亿美元截止到2016年[1]。本文提出了将海量数据应用于电厂运行参数分析当中,再基于随机森林算法对燃机电厂天然气用量预测的一种新思路。

1 随机森林算法概念及其基本原理

随机森林算法(Random Forest)是常用集成学习算法中的一种,2001年统计学领域的专家Leo Breiman提出了随机森林算法的概念。随机森林算法是由多棵分类回归树所构成,且树与树之间保持互相独立的状态,随机森林算法特点是引入了两个随机变量,分别为随机向量和随机选取数据样本集,由此来提高预测的准确度。与决策树算法相比,随机森林算法由于随机变量的引入使其具有较强的泛化能力,这也证明了随机理论在回归预测当中的成功性。……

登录APP查看全文