国内刊号:11-5602/TP
国际刊号:1673-9418
发布日期:
作者:夏江镧, 李艳玲, 葛凤培
单位:1. 内蒙古师范大学 计算机科学技术学院,呼和浩特 0100222. 无穷维哈密顿系统及其算法应用教育部重点实验室(内蒙古师范大学),呼和浩特 0100223. 北京邮电大学 图书馆,北京 100876
关键词:大语言模型,实体关系抽取,命名实体识别
基金:国家自然科学基金(62466046,62266033,12204062);无穷维哈密顿系统及其算法应用教育部重点实验室开放课题(2023KFZD03);内蒙古自然科学基金重点项目(2023ZD10);内蒙古师范大学基本科研业务费项目(2022JBQN106, 2022JBQN111);“一区两基地”建设项目(计算科学联合创新实验室)。
实体关系抽取任务旨在从非结构化文本中识别实体对及其相互关系,是众多自然语言处理下游任务应用的基础。随着大数据和深度学习技术的发展,实体关系抽取的研究取得了显著进展。近年来,将大语言模型应用于实体关系抽取任务已成为新的研究趋势。大语言模型具备自动特征提取和强大的泛化能力,能够显著提升任务性能。对实体关系抽取的方法进行综述,并根据所使用的方法和模型的演变将其划分为两大类。介绍了命名实体识别和关系抽取任务的定义。系统回顾了实体关系抽取方法的发展历程,并对其相应模型的优缺点进行了深入分析。在此基础上,重点探讨了基于大语言模型的方法在解决实体关系抽取任务中的独特优势。整理了当前主流数据集的特点,并总结了实体关系抽取任务的常用评价指标,如精确率、召回率和F1值等。分析了当前研究中存在的挑战并对未来研究方向进行了展望。
来源:2025年第7期
《计算机科学与探索》期刊编辑部