APP下载

基于K-近邻算法的文本情感分析方法研究

2012-07-25安毅生李慧贤

计算机工程与设计 2012年3期
关键词:文本情感实验

樊 娜,安毅生,李慧贤

(1.长安大学 信息工程学院,陕西 西安710064;2.西北工业大学 计算机学院,陕西 西安710072)

0 引 言

面对互联网中海量信息,如何快捷而准确地鉴别人们对某政策、事件或产品等所持的观点是褒义还是贬义,必须借助于文本情感分析 (sentiment analysis)技术[1-6]。本文充分考虑网络文本内部结构以及情感表达特点,提出一种基于K-近邻算法的情感分析方法,建立情感分析层次化模型,多层次、细粒度的分析文本情感。

1 文本情感模型

为了对文本中复杂的情感进行准确的分析,首先引入全局情感和局部情感的概念。全局与局部,是反映事物及其过程包含与组合的相互关系的一对哲学范畴,是揭示客观事物的整体和部分的相互作用和关系的一种普遍联系。全局就是整体,就是事物的各个部分、各个方面的总和,它对于各个部分、各个方面具有领导的、决定的、主要的作用。我们通过分析发现,文本中的情感也符合全局和局部这样的哲学规律,通过对大量语料信息的分析,将文本中的情感分为两种:全局情感和局部情感。全局情感是指整个文本所表达出的情感;而局部情感是指文本中某个特定部分表达出的情感,这个特定部分可以是词、短语、句子或者段落等。文本中各个局部感情相互作用,相互影响,最终确定文本的全局情感。因此,可以通过确定文本的局部情感最终识别全局情感。根据上述分析,建立文本情感层次化模型,如图1所示。

图1 文本情感层次模型

登录APP查看全文

猜你喜欢

文本情感实验
记一次有趣的实验
如何在情感中自我成长,保持独立
失落的情感
情感
在808DA上文本显示的改善
做个怪怪长实验
基于doc2vec和TF-IDF的相似文本识别
如何在情感中自我成长,保持独立
NO与NO2相互转化实验的改进
实践十号上的19项实验