国内刊号:11-5602/TP
国际刊号:1673-9418
发布日期:
作者:冯拓宇, 王刚亮, 乔子剑, 李伟平, 张雨松, 郭庆浪
单位:1. 北京大学 软件与微电子学院,北京 1000912. 中国电子科学研究院,北京 1000413. 西安电子科技大学 通信工程学院,西安 710126
关键词:大语言模型,子图生成,分步推理
基金:国家自然科学基金(U21B200141,U20B2047);国家重点研发计划(2021YFC3300500)。
大语言模型(LLM)自问世以来在各种任务中取得了显著的成功,尤其是在机器翻译、文本生成、问答系统等任务中的卓越表现,它们的应用也迅速扩展到了更多复杂的任务中。尽管LLM在多种任务中展现了强大的能力,但在需要深入推理和逻辑推导的任务场景中,它们仍然面临显著的挑战。由于模型训练过程中依赖大量的文本数据,往往难以全面涵盖所有领域的专业知识,导致LLM在处理特定领域问题时容易产生“幻觉”问题,即输出不准确或与实际知识不符的答案。该问题可以通过在大语言模型推理中引入外部知识图谱(KG)来辅助解决。提出基于外部子图生成的大模型分步增强推理框架(SbSER)。通过生成清晰的子图Schema引导大模型完成准确的语义解析以完成问题到逻辑查询语句的转换,将知识三元组导入图数据库中以完成准确的知识查询,通过采用直接查询推理和联合推理两种推理方式实现问题的最终增强推理输出。实验表明,提出的SbSER在多个数据集上取得优异结果,显著提升了LLM在解决复杂问题上的能力。
来源:2025年第2期
《计算机科学与探索》期刊编辑部