开放引文语料库实践案例及启示*
2017-08-07宋丹辉
数字图书馆论坛 2017年7期
宋丹辉
(河南科技大学图书馆,洛阳 471023)
开放引文语料库实践案例及启示*
宋丹辉
(河南科技大学图书馆,洛阳 471023)
开放引文数据作为一种新的开放关联数据,在国外已取得长足发展,而在国内还未开始建设。为缩小差距,本文以国外已发挥重要作用的开放引文项目为学习案例,深入分析其在数据规模、技术路线、元数据模型和工作流程方面的建设与实践,详细阐述其在解决引文数据不易获取、不一致、语义缺乏等问题的方法与特征,并从发展理念、关键步骤等方面总结经验,以期为我国引文数据开放关联建设提供建议。
引文数据;开放关联;开放引文语料库
1 引言
引文数据是学术交流的重要元素,也是引文分析的基础,但来源受限,大多存储在Web of Science、Scopus等少数几个商业引文数据库中,较难免费获取。Web of Science由美国科学家尤金·加菲尔德于1964年创建的科学引文索引发展而来,其主要商业对手是Scopus。二者都具有覆盖学科范围广、文献类型多样、引文数据丰富的特点。为访问其中资源,用户需花费巨额经费,还要遵守严格的保密协议。一些免费资源平台如Google Scholar、Microsoft Academic Search、百度学术、必应学术等,虽然支持文献引用统计、生成不同格式引文,或通过软件导出等,但都制定有严格的使用条款,用户无法进行大规模引文数据采集,从而无法自动构建引文网络,开展计量、评价或智能化分析等研究[1-2]。
针对上述问题,业界提出两种不同的解决方案:一是引文数据开放存取。随着一系列研究报告及政府公文的发布,推行开放存取政策已成为业界共识,学者也将研究重点逐渐聚焦到实施效果上。……
登录APP查看全文
