基于OpenCV形态学的发票定位研究*
2021-10-09程艳云
计算机与数字工程 2021年4期
关键词:检测
谢 阳 程艳云
(南京邮电大学人工智能学院、自动化学院 南京 210000)
1 引言
通常可借助发票的两个特点来进行定位:发票矩形框和发票打印字符。其中利用发票矩形框定位可以充分利用发票表格框线规整的特点来进行表格框线检测并输出坐标进行定位。刘长松[1],白伟[2]等提出,以增值税发票矩形框作为定位基准,利用矩形框两条平行的横线和竖线,通过投影法确定它的四个顶点来实现矩形框的定位。对发票进行版面分析,根据矩形框与各项目区域相对位置固定的特点,确定各项目区域的位置。该方法容易受到印章等因素的影响,若矩形框上有印章,则使用投影法定位速度无法保证并且靠投影波形定位矩形框容易失败。为了消除印章影响,文献[3]提出,使用直线表达式,计算出矩形框四条直线的焦点,即可确定矩形框的四个顶点。通过检测发票矩形框来实现定位,方法简单容易实现,但是容易受到发票平整度的影响,并且需要计算直线方程和交点,影响检测速度。宫义山等[4~5],刘洋[6],陈超[7]等出了基于模板匹配的发票定位算法,利用母版发票对待定位发票进行平方差匹配,不过这种方法由于需要提供模板发票并计算相关系数等多个参数,在没有模板的情况下无法实现,而且在活动匹配时最佳匹配点不能完全吻合,所以会影响定位速度和准确性。
随着越来越多的学者把精力放在如何把文字从复杂场景提取出来,因此除了利用发票矩形框进行定位之外,场景文本检测技术也可被应用于发票文本提取。……
登录APP查看全文
