一种基于目标检测与词性分析的图像描述算法
2021-03-23高逸凡
计算机与现代化 2021年3期
高逸凡,王 勇
(北京工业大学信息学部,北京 100124)
0 引 言
随着互联网技术的发展、数码设备的普及以及图像数据的迅速增长,使用纯人工手段对图像内容进行鉴别已经成为一项艰难的工作。因此,如何通过计算机自动提取图像所表达的信息,成为图像理解领域的研究热点[1]。图像描述生成是融合了自然语言处理和计算机视觉的一项较为综合的任务,目的是将视觉图像和语言文字联系起来,通过对所输入的图像进行特征提取分析,自动生成一段关于图像内容的文字描述。图像描述生成能够完成从图像到文本信息的转换,可以应用到图像检索、机器人问答、辅助儿童教育及导盲等多个领域,对图像理解的研究具有重要的现实意义[2]。
图像描述生成的核心是在图像处理分析的基础上,结合计算机视觉和自然语言处理等相关理论,进而分析、理解图像内容,并以文本语义信息的形式反馈给人类。因此计算机对图像内容理解的完成不仅需要图像标注,还需要图像描述。图像描述的任务是使用自然语言处理技术分析并产生标注词,进而将生成的标注词组合为自然语言的描述语句。近年来,图像描述引起了学术界的极大兴趣,比起传统的图像标注工作,它具有更广阔的应用前景。
1 相关工作
图像描述生成克服了人类主观认识的固有限制,借助计算机软件从一幅或多幅图像序列中生成与图像内容相关的文字描述。图像描述的质量主要取决于以下2个方面:一是对图像中所包含的物体及场景的识别能力;……
登录APP查看全文
