我国人工智能基础数据的专门法保护研究
2021-03-04马治国胡明强
西北大学学报(哲学社会科学版) 2021年6期
关键词:人工智能
马治国,胡明强,张 磊
(西安交通大学 法学院, 陕西 西安 710049)
一、问题的提出
人工智能基础数据包括在对机器学习模型进行训练时所用的训练数据以及对机器学习模型进行测试的测试数据。与其他类型的数据相比,人工智能基础数据具有独特属性。首先,人工智能基础数据需要开源开放。人工智能基础数据作为一种数据资源可以被无限复制,一个标注好的图像或者一批被精心选定的训练数据集可以应用在多个人工智能项目之上。人工智能基础数据的制作和选取是每个人工智能项目必不可少的前期准备工作,这种前期准备工作在相当程度上具有一致性。因此,倘若为每个人工智能项目都制作和选取不同的人工智能基础数据,势必造成大量的人力和物力的浪费。为了避免不必要的浪费,人工智能基础数据需要开源开放,这也正是我国《新一代人工智能发展规划》提出“重点建设面向人工智能的公共数据资源库”的缘由所在。其次,与从互联网上直接获取的数据有所不同,人工智能基础数据往往需要通过智力劳动才能创造取得,并且极具经济价值。比如微软必应团队的研发人员曾有言:“获取足够高质量的训练数据通常是构建基于人工智能服务的最具挑战性的部分。通常,由人类标记的数据质量很高(错误相对较少),但成本高昂,无论是金钱还是时间方面。”[1]
传统理论通常仅从数据交易价值层面对普通数据进行……
登录APP查看全文
