机器学习在数据挖掘中的应用研究
2021-09-10黄心依
信息记录材料 2021年8期
黄心依
(安徽科技学院信息与网络工程学院 安徽 滁州 233100)
1 引言
随着互联网的快速发展,存在于互联网中的数据量大幅增长,故需要有更快的信息数据处理速度才能够对海量信息数据进行处理。从当前信息数据处理实际情况来看,传统的信息数据处理算法已经不能够满足大规模数据的处理[1],因此需要对数据进行深度数据挖掘。机器学习作为一种能够从数据中进行学习的算法,能够更加快速地处理数量巨大的数据信息,解决好数据问题。
2 数据挖掘及机器学习概述
2.1 数据挖掘
数据挖掘是当前一种新兴的研究领域,主要是以新的方式方法以及新的理论来挖掘数据中潜在价值。在数据挖掘中,主要通过以下4个步骤来完成数据的分析和处理:(1)选择或者构造具有一定格式以及内容的数据集,这样能够方便之后的数据处理;(2)信息数据的预处理,这一步骤主要是为了将选择或者构造的数据集处理成为统一的内容格式,主要的处理内容有数据集成、清洗、离散化等;(3)数据建模和筛选,这一步骤主要通过对数据需求和模型等因素进行考量,选择出相对最优特征集;(4)形成结论,这一步骤能够促使数据反馈出一些有价值的信息,在这些有价值信息的基础上,工程师可以得出结论。
2.2 机器学习
机器学习是一门涉及多个领域的交叉学科,包括统计学、算法、概率学等。在大规模数据中,机器学习能够在异构数据中进行规律总结,找到不同数据之间的联系,从而实现对数据的深度挖掘。……
登录APP查看全文
