国内刊号:11-5602/TP
国际刊号:1673-9418
发布日期:
作者:任安琪, 柳林, 王海龙, 刘静
单位:1. 内蒙古师范大学 计算机科学技术学院,呼和浩特 0100222. 内蒙古师范大学 计算机科学联合创新实验室,呼和浩特 0100223. 内蒙古大学 图书馆,呼和浩特 010021
关键词:信息抽取,实体关系抽取,句子级关系抽取,文档级关系抽取,知识图谱构建
信息抽取是知识图谱构建的基础,关系抽取作为信息抽取的关键流程和核心步骤,旨在从文本数据中定位实体并识别实体间的语义联系。因此提高关系抽取的效率可以有效提升信息抽取的质量,进而影响到知识图谱的构建以及后续的下游任务。关系抽取按照抽取文本长度可以分为句子级关系抽取和文档级关系抽取,两种级别的抽取方法在不同应用场景下各有优缺点。句子级关系抽取适用于较小规模数据集的应用场景,而文档级关系抽取适用于新闻事件分析、长篇报告或文章的关系挖掘等场景。不同于已有的关系抽取,介绍了关系抽取的基本概念以及领域内近年来的发展历程,罗列了两种级别关系抽取所采用的数据集,对数据集的特点进行概述;分别对句子级关系抽取和文档级关系抽取进行了阐述,介绍了不同级别关系抽取的优缺点,并分析了各类方法中代表模型的性能以及局限性;总结了当前研究领域中存在的问题并对关系抽取发展前景进行了展望。
来源:2024年第11期
《计算机科学与探索》期刊编辑部