基于多维潜在语义特征的幽默识别
2021-10-12樊小超林鸿飞刁宇峰楚永贺张桐瑄
中文信息学报 2021年8期
樊小超,杨 亮,林鸿飞,刁宇峰,3,申 晨,楚永贺,张桐瑄
(1. 新疆师范大学 计算机科学技术学院,新疆 乌鲁木齐 830054;2. 大连理工大学 计算机科学与技术学院,辽宁 大连 116024;3. 内蒙古民族大学 计算机科学与技术学院,内蒙古 通辽 028043)
0 引言
幽默一词来源于英文单词humor,最早由林语堂先生引入我国,从此西方的一些幽默理论也逐渐在我国传播开来。随着人工智能的快速发展,如何利用计算机识别幽默、理解幽默、生成幽默成为了自然语言处理领域备受关注的研究内容之一,并逐渐形成了一个新兴的研究领域——幽默计算。幽默计算通常以幽默理论为依托,揭示了人类使用幽默的机制,并构建涵盖幽默机制的认知语言模型,为实现更为智能的人机交互环境奠定了研究基础。从应用层面来说,如果能让计算机理解人类语言中的幽默表达,那么计算机就将被赋予理解更深层次人类语言的能力,从而使其能够做出更人性化的决策。总之,在聊天机器人、儿童教育、机器翻译等多种人工智能应用场景中,幽默计算都有着广泛的应用前景。
幽默识别是幽默计算的重要组成部分。目前,幽默识别任务通常被认为是一个文本二分类任务,目标是判别一个句子是否包含幽默的语义表达。由于使用统一的模型来深入理解不同类型的幽默超出了现有计算机的计算能力,因此本文将研究对象聚焦于俏皮话(one-liner)形式的幽默。俏皮话是一种短句形式的幽默,它通过少量的单词引起读者的兴趣,使用特殊语义结构、句法结构或修辞手段引发笑点。……
登录APP查看全文
