视频档案资源多层级语义标注框架构建研究*
2021-02-14吕元智
数字图书馆论坛 2021年11期
吕元智
(上海师范大学人文学院,上海 200234)
视频档案资源是一种以直观的视觉形式记录和存储社会历史活动信息的第一手资源,它在社会活动多维记录、历史原貌真实再现等方面具有不可替代的优势。进入“声屏阅读”时代[1]以后,视频档案资源以其信息接收体验的优势日益受到用户的关注和喜爱。然而,视频档案资源不同于一般的文本型档案资源,它具有非结构化、语义特征难以识别等特性,给管理和利用工作带来了不少困难和挑战。如何有效地揭示和标注视频档案资源为用户提供恰当的服务已成为当前档案服务部门亟待解决的现实问题。为此,国内外研究者展开了相关研究。在国外,早在20世纪90年代就有学者开始这一领域的探索,如1991年Sugita[2]探讨了日本国立民族学博物馆多媒体数据库系统的建设与利用问题。进入21世纪后,尤其是随着语义网、多媒体检索技术的发展,相关研究更是引起了专家学者的关注。例如:2002年Zhou等[3]研究了视频和音频内容分析、特征提取和聚类技术在视频语义概念分类中的应用,并利用视频自动分割、注释和摘要技术等构建了一种基于规则监督的视频分类系统;2010年Shibata[4]通过分析视频制作原始备忘录的描述风格,构建了视频信息描述模型,并将其应用于视频数据库建设;2017年Muehling等[5]基于深度学习方法开发出了一款集视觉概念检测、相似性搜索、人脸识别等于一体的多媒体信息处理工具,以实现视频资源的有效标注和检查。……
登录APP查看全文
