基于大数据技术的资源发现平台构建
——以国家图书馆“文津搜索”系统为例
2016-09-22国家图书馆北京100081
张 红(国家图书馆,北京 100081)
基于大数据技术的资源发现平台构建
——以国家图书馆“文津搜索”系统为例
张红
(国家图书馆,北京 100081)
以国家图书馆“文津搜索”系统为例,阐述应用Hadoop分布式系统架构和各类NoSQL数据库等大数据技术构建资源发现平台的策略和方法,并对基于大数据技术构建的“文津搜索”系统的技术优势、实际应用成效以及技术局限性进行分析,为大数据技术在图书馆数字资源服务领域的应用提供借鉴与参考。
大数据技术;资源发现系统;国家图书馆;文津搜索
1 引言
随着信息技术的发展和互联网应用的普及,大数据时代已然来临。大数据技术突破了传统数据管理技术的瓶颈,对于种类多样、增长迅速、蕴藏巨大价值的海量数据,在数据采集、存储、处理、分析和挖掘方面具有一定的技术优势。
在数字图书馆建设深入开展的今天,数字资源急剧增长,越来越多的图书馆推出了资源发现服务平台,为读者提供统一的检索途径,使读者能够方便、快捷地发现并获取图书馆的数字资源。目前,国际市场上主流的统一资源发现系统有Serials Solutions公司的Summon系统、Ex Libris公司的Primo Central系统、EBSCO公司的EBSCO DiscoveryService(简称EDS)系统、OCLC的WorldCat Local系统以及Innovative Interfaces公司的Encore系统[1],这些系统既有内容提供商推出的,也有系统提供商研制的,均被全球众多图书馆所引进。国内的图书馆有些引进了Summon、Primo等国外的产品,还有些采用了南京大学数图实验室和EBSCO公司联合研发的Find+知识发现平台,也有些采用超星公司的超星发现系统[2]等。……
