基于《中国中医古籍总目》的数据挖掘*
2023-03-04朱俊秀闻永毅
西部中医药 2023年4期
朱俊秀,闻永毅
陕西中医药大学人文管理学院,陕西 咸阳 712046
目前采用计算机技术研究中医古籍,主要有两种研究方向:古籍数字化研究和古籍语料库建设研究。闻永毅等[1]认为,中医语料库的建设对中医古籍的整理校勘尤为重要,并认识到普通读者能阅明中医古籍是扩大中医古籍影响力的关键要素。然而建设中医语料库需要一份关于中医古籍的详细清单资料,以明确中医古籍的数量、种类、学科分布、校勘等情况[2]。因此有必要对中医古籍做一次摸底研究。新中国成立后,先后于1958 年、1979 年、2005 年进行了3 次古籍整理,分别编撰《中医图书联合目录》《全国中医图书联合目录》及《中国中医古籍总目》[3]。本研究基于《中国中医古籍总目》进行了数据挖掘,现报道如下:
1 资料与方法
此次数据挖掘所用资料来源于《中国中医古籍总目》[3](后文均简称《总目》),该书历经3 年编纂,共收录图书13 500 余种,32 000 余个版本,重点收录了1911年以前历代流传下来的古医籍。《总目》的书目内容包含了书籍的成书年代、原著者、现存版本、存版制作者等详细信息[4-6]。依据《总目》检索古籍、指导阅读非常便捷,是目前记载当前中医古籍藏存情况最全面的大型中医古籍专科书目。
以1911年辛亥革命为时间度划分,1911之前(含1911 年)的中医药书籍定义为古籍。根据《中国中医古籍总目》建立中医古籍数据库,按著作名称、成书年代、原著者、校勘者、现存版朝代、学科类别等字段名一一录入计算机。如《总目》第一条为《黄帝内经》,对这一条进行标准化处理,抽取关键信息。……
登录APP查看全文
