计算机文本信息挖掘技术在网络安全中的应用
2016-01-22韩文智
华侨大学学报(自然科学版) 2016年1期
关键词:文本挖掘
韩文智
(四川职业技术学院 计算机科学系, 四川 遂宁 629000)
计算机文本信息挖掘技术在网络安全中的应用
韩文智
(四川职业技术学院 计算机科学系, 四川 遂宁 629000)
摘要:针对网络文本信息的安全性判别问题,采取改进的邻近分类算法挖掘文本.该改进邻近分类方法在传统方法定义分类特征的同时,起用共线性判别矩阵,对具有共线属性的特征合并处理.这种改进策略,不仅可以增加分类特征的准确性,也可以加快文本信息的分类进程.对Spambase语料库开展实验研究,从精度、召回率、联判度、误差4个维度对分类效果进行评价.结果显示:改进的邻近分类方法具有明显的优势,可以更加准确地区分安全文本和危险文本.
关键词:文本信息; 文本挖掘; 文本分类; 邻近分类
在信息量爆炸式增长的今天,人们生活方式发生了极大改变[1].人们很少通过纸质文件进行信息交流,代之的是电子邮件、微博、短信、微信.这种信息交流方式确实更为便利,但也出现了新的安全隐患.部分广告人员和诈骗者,借助网络渠道向广大网络用户的邮箱、微信中发布广告信息和诈骗信息,拦截这些垃圾信息已经成为当今网络安全的重要课题之一[2].计算机文本信息挖掘技术在信息分类、信息识别方面具有重要作用.网络信息的典型特征对于准确判断这些信息是否是垃圾信息、提升网络安全具有重要意义[3].文献[4-10]对文本挖掘进行了研究.本文对邻近分类文本挖掘方……
登录APP查看全文