印刷体数字图像识别技术实现
2021-09-26广州番禺职业技术学院戴锦霞
电子世界 2021年16期
关键词:深度
广州番禺职业技术学院 戴锦霞 杨 鹏 刘 攀
数字识别在计算机视觉与图像识别领域得到了广泛的应用,深度学习算法是目前流行的图像识别算法。基于Caffe的印刷体数字识别方法能准确识别印刷体数字。通过详细介绍此方法的具体实验过程及注意事项,供后续基于深度学习的字符识别等相关领域实现提供参考。
图像识别是计算机视觉领域的一项基础研究。随着互联网的快速发展,图像识别技术在各个领域中发挥着日益重要的作用。数字识别是一种典型的图像识别,在身份证号码、发票、体检单等识别领域均利用其进行数字信息精准提取,提高工作效率。
目前主流的深度学习方法其特征提取不需要人工参与,速度快,准确率高。卷积神经网络是深度学习的算法之一,而Caffe是一个计算卷积神经网络相关算法的深度学习框架,该框架清晰、可读性高、快速,因此利用Caffe进行印刷体数字识别是目前提高数字识别准确率的一种行之有效的办法。其实现过程主要包括数据预处理、Caffe网络定义并训练、识别测试这三大步骤。
1 深度学习框架Caffe
Caffe是目前深度学习比较主流且优秀的一个开源卷积神经网络算法框架。它采用纯C++语言与CUDA实现,同时支持Python、命令行与MATLAB接口。可在CPU和GPU处理器之间实现流畅切换,易扩展,在图像分类、字符识别、语音识别等多个领域得到广泛的应用。
2 数据预处理
实验测试的样本集是选用印刷体数字0—9,每个数字的训练样本数量分别为240、测试样本为40,图像尺寸大小统一为64×64(图1所示)。……
登录APP查看全文
