APP下载

开放引文语料库实践案例及启示*

2017-08-07宋丹辉

数字图书馆论坛 2017年7期
关键词:关联语义数据库

宋丹辉

(河南科技大学图书馆,洛阳 471023)

开放引文语料库实践案例及启示*

宋丹辉

(河南科技大学图书馆,洛阳 471023)

开放引文数据作为一种新的开放关联数据,在国外已取得长足发展,而在国内还未开始建设。为缩小差距,本文以国外已发挥重要作用的开放引文项目为学习案例,深入分析其在数据规模、技术路线、元数据模型和工作流程方面的建设与实践,详细阐述其在解决引文数据不易获取、不一致、语义缺乏等问题的方法与特征,并从发展理念、关键步骤等方面总结经验,以期为我国引文数据开放关联建设提供建议。

引文数据;开放关联;开放引文语料库

1 引言

引文数据是学术交流的重要元素,也是引文分析的基础,但来源受限,大多存储在Web of Science、Scopus等少数几个商业引文数据库中,较难免费获取。Web of Science由美国科学家尤金·加菲尔德于1964年创建的科学引文索引发展而来,其主要商业对手是Scopus。二者都具有覆盖学科范围广、文献类型多样、引文数据丰富的特点。为访问其中资源,用户需花费巨额经费,还要遵守严格的保密协议。一些免费资源平台如Google Scholar、Microsoft Academic Search、百度学术、必应学术等,虽然支持文献引用统计、生成不同格式引文,或通过软件导出等,但都制定有严格的使用条款,用户无法进行大规模引文数据采集,从而无法自动构建引文网络,开展计量、评价或智能化分析等研究[1-2]。

针对上述问题,业界提出两种不同的解决方案:一是引文数据开放存取。随着一系列研究报告及政府公文的发布,推行开放存取政策已成为业界共识,学者也将研究重点逐渐聚焦到实施效果上。……

登录APP查看全文

猜你喜欢

关联语义数据库
“苦”的关联
语言与语义
数据库
智趣
数据库
“上”与“下”语义的不对称性及其认知阐释
数据库
数据库
认知范畴模糊与语义模糊
语言学与修辞学:关联与互动