APP下载

基于距离正则化的单视图三维重建

2021-05-19胡茂林李金龙

网络安全与数据管理 2021年5期
关键词:模型

胡茂林,李金龙,胡 涛

(中国科学技术大学 计算机科学与技术学院,安徽 合肥230027)

0 引言

三维重建是指给定一张或多张RGB 图像的情况下重建该RGB 图像中物体的三维形状。三维重建已经被探索了几十年,它是计算机视觉领域一个基础性任务之一,拥有大量应用场景,例如,机器人导航、虚拟现实、计算机辅助设计、无人驾驶、医学图像处理等领域。三维重建是一个非常复杂的过程,从二维图像恢复三维形状,恢复缺失的信息往往具有歧义性。为克服三维形状的歧义性,三维重建方法通常需要结合图像信息和先验形状知识。

随着大型数据集的出现,数据驱动的方法一定程度上克服歧义性问题,数据集提供三维形状先验知识。三维重建方法利用CNN 在大型数据集进行预测物体三维形状取得了巨大的成功,预测的三维形状可以被归结为三类:体素网格表示[1]、点云表示[2]、网格表示[3]。近年来,大量基于深度学习的方法被提出来进行三维重建,例如,3D-R2N2[4]、Pix2Vox、PSGN[2]和AttSets[5]。CHOY C B[4]率先提出使用长短期记忆网络(Long Short Term Memory,LSTM)[6]来融合不同视角图像的信息,一步一步重建三维物体的形状。PSGN 使用点云表示三维形状进行单视图三维重建。Pix2Vox++直接使用CNN 融合不同视角图像信息来进行三维重建。AttSets 使用一个注意力聚合模块去预测一个权重矩阵作为输入特征的注意力得分。

基于深度学习的方法围绕如何提升重建的三维物体质量问题,提出的解决方案可以概括为三类:(1)为了应对三维形状的变化,增加训练网络的参数数量,以提供更大的先验信息记忆空间,保留更多的先验信息;……

登录APP查看全文

猜你喜欢

模型
一半模型
一种去中心化的域名服务本地化模型
适用于BDS-3 PPP的随机模型
函数模型及应用
p150Glued在帕金森病模型中的表达及分布
函数模型及应用
重尾非线性自回归模型自加权M-估计的渐近分布
3D打印中的模型分割与打包
FLUKA几何模型到CAD几何模型转换方法初步研究
一个相似模型的应用