常用现代汉语副词用法自动识别研究
2012-10-15张坤丽昝红英柴玉梅
中文信息学报 2012年6期
张坤丽,赵 丹,昝红英,柴玉梅
(郑州大学 信息工程学院,河南 郑州450001)
1 引言
现代汉语副词的研究,自《马氏文通》问世以来,始终是广大语法学者关注的一个重要的课题。尽管汉语副词绝对数量并不是很多,但其功能和用法纷繁多样,不但使用范围广、频率高,且其内部成员虚实不一,有些副词承载着语义的变化,而有些副词承载着语法功能,包括搭配关系、语用倾向以及篇章功能,大都各具特点,每一个都具有很强的个性,所以缺乏系统性和规律性[1]。因此针对具体的副词,对其用法进行自动识别,具有重要的意义。
本文中副词用法自动识别在俞士汶等[2]提出的构建三位一体汉语广义虚词知识库思路的基础上,对昝红英等[3-4]已建立的副词用法词典和副词用法规则库进行了完善和补充,对《人民日报》2000年1~6月分词与词性标注的语料进行了人工校对,并以此作为实验语料,先采用规则进行用法自动识别,实验结果显示,规则总体有较好的识别准确率,但对较为常用且用法较多的副词,效果不佳,因此,本文又采用统计的方法对这些词进行用法自动识别。
本文具体章节安排如下:第2节介绍副词用法识别的相关研究;第3节介绍副词用法词典、副词用法规则库及副词用法语料库;第4节介绍分别采用规则和统计的副词用法自动识别实验;第5节给出了实验结果,并对结果进行分析;最后给出本文的总结,并对今后的工作进行展望。
2 相关研究
针对副词的研究,综合多年来汉语语法学界的研究成果,副词的主要研究包括:对副词性质、归属、范围和分类的研究;……
登录APP查看全文
