面向大规模裁判文书结构化的文本分类算法
2021-01-08谷松原李俊良
天津大学学报(自然科学与工程技术版) 2021年4期
翁 洋,谷松原,李 静,王 枫,李俊良,李 鑫
(1. 四川大学数学学院,成都 610064;2. 四川大学法学院,成都 610207;3. 数之联科技有限公司,成都 610041)
国务院先后发布的《促进大数据发展行动纲要》、《新一代人工智能发展规划》,将大数据和人工智能发展正式上升到国家战略[1].近年来,最高人民法院积极推动人工智能在司法领域的应用向纵深处延展,为司法领域内人工智能的应用研究提供了时代契机.在国家政策的强力推动下,法院信息化建设工作蓬勃发展,法院信息化走向3.0 阶段,智慧法院已经成为中国法院组织、运行和管理的一种新的形态.法院的司法公开工作也取得重大进展,截至2019年12 月,已经有超过八千万份的裁判文书上网,为法律人工智能的实践和研究提供了海量的数据资源.
裁判文书是记载司法审判活动过程,明确当事人权利义务的司法产品[2],是司法活动成果的重要载体,也是研究法律文本信息的重要资源.裁判文书蕴含丰富的案件审判活动信息,其中案情事实、法律适用等信息尤为关键.基于案件关键审判信息,宏观层面,可以进行法律法规实施效果评估、诉讼制度改革效果评价等方面的研究;微观层面,可以进行裁判文书质量评估、案件复杂度测算等具体法律问题的研究.同时,也为基于裁判文书的类案推荐、裁判结果预测、智能问答等法律人工智能应用研究提供重要的要素指标.但是,裁判文书基本以纯文本形式公开,属于典型的非结……
登录APP查看全文
