框架元素语义核心词自动识别研究
2011-06-28康旭珍李双红
中文信息学报 2011年4期
康旭珍,李 茹,李双红
(山西大学 计算机与信息技术学院,山西 太原 030006)
1 引 言
随着中文信息处理技术的不断发展,自然语言处理研究逐渐从句法处理转移到语义处理和语用处理方面,许多研究工作者尝试以新的角度来观察、发现新的语言问题。其中基于框架语义学理论构建的框架语义网络知识库为自然语言处理开辟了一条新的道路。基于汉语框架网,将一个汉语句子形式化表示成框架依存图,用来表示依存于目标词的各个框架元素的语义依存关系,也是进行语义理解的一种有效方法。由于在每个框架元素中不同的词对整个框架元素的语义理解起着不同程度的作用,所以本文旨在通过不同的机器学习方法对短语型框架元素的语义核心词进行识别,从而进一步将框架依存图转化为框架核心依存图。
近年来,不少研究者已经开始重视这方面的研究,而且取得了一定的成就,但是主要集中于对短语中心词和短语结构等方面的相关研究。程月,陈小荷基于条件随机场的汉语动宾搭配自动识别,验证了条件随机场模型在词语搭配实例自动识别方面有效可行性[1]。周雅倩、郭以昆等使用了基于最大熵的方法识别中文基本名词短语[2]。目前对于框架元素语义核心词提取的研究已经有了一定的基础,文献[3]中结合了多词块技术,大大提高了识别效率,利用多词块中的关系标注、序列标注找到一个短语中的核心成分,在本质上就是分析这个短语的语义依存关系。……
登录APP查看全文
