基于Python的人机对话自然语言处理
2021-08-16李轩宇李御龙
科学技术创新 2021年24期
李轩宇 李御龙
(北京科技大学 外国语学院,北京 100089)
1 选题背景与意义
十三五期间,我国公布了《新一代人工智能发展规划》,该规划描述了三个主要发展阶段,确定了至2030年使中国成为人工智能世界主要创新中心的目标。
实现强人工智能人机对话的关键是理解并处理自然语言,但想要完成这一目标,除了语料数据的支撑,同样需要人工智能拥有情感交流的能力。根据传播学的信息交互理论,人与人之间的内容沟通大约只占20%,而情感沟通要占到80%。因此,如何深层次地理解语境并进行合适的情感交流,是人机对话领域的重点。基于Python的英语自然语言处理已存有较多研究,但语料文本多出于网络[1],在科幻类文学中的人机对话领域,目前尚无成熟的研究。
在此背景下,本文将以文学文本中的人机对话为语料,基于Python的自然语言处理功能来分析文学作品中人机对话,并结合语用学理论,以此来整合出一种强人工智能的语言模式。
2 Python自然语言处理需求分析
在对于科幻类文学中人机对话进行自然语言处理的过程中含有两个关键步骤,其一是读取文本并进行相关统计,其二是对其内容进行分析。
就第一部分而言,考虑到目标是文本分析,因此选择是在自然语言处理领域已经较为成熟的jieba库。基础编程思路是利用jieba库内置的丰富方法,如lcut函数,来进行分词与词频统计等一系列相关处理。在具体读取过程中,可利用Python的列表与字典功能对文本内容进行转存[2]。……
登录APP查看全文
