计算机视觉中对象检测技术综述
2021-06-28陈文云覃焕昌
科学与信息化 2021年17期
陈文云 覃焕昌
百色学院 信息工程学院 广西 百色 533000
引言
近三十年来,随着反向传播算法的发明[1]、卷积神经网络技术的问世[2-4]、计算机运算速度和存储技术不断深化,推动计算机视觉技术水平不断提高,对象检测技术是其最基础、最重要、最具挑战性的技术之一。对象检测技术是图像识别和理解的关键技术,其通过对图片中的各区域、各层特征的提取,通过机器学习检测出图片中各对象及其位置和关联。
对象检测技术[5]首先选定图像中某一特定位置,然后对该区域图像进行识别、分类,反复进行可以找出图像中所有对象及其位置,再对各对象的关联性进行分析,以完成对整张图像的理解。其已广泛地应用于日常生活中,譬如人脸检测与识别[6-7],行人检测[8],医学上的人体骨架检测[9],图像分类[10-11],人类行为分析[12]和自动驾驶[13-14]等。
1 传统对象检测技术
传统的对象检测技术由区域推荐、特征提取和对象分类等部分组成。
1.1 区域推荐
不同对象在图像中出现的位置不同、大小以及比例也不同,用不同大小和不同尺寸比例的候选滑动窗口去扫描图像是必要的,从而筛选出最佳的区域推荐。巨量的穷举候选滑动窗口会消耗大量的计算资源,同时会带来冗余候选窗口。如果过少的候选滑动窗口数量,可能找不到最佳滑动窗口。
1.2 特征提取
为了识别滑动窗口中的对象,必须对窗口中能代表图像的结构特征进行提取,对这些特征的表示是通过模拟外部刺激在大脑神经元中产生的激励[20]来完成的。……
登录APP查看全文
