国内刊号:11-5602/TP
国际刊号:1673-9418
发布日期:
作者:向小伟, 申艳光, 胡明昊, 闫天伟, 罗威, 罗准辰
单位:1. 河北工程大学 信息与电气工程学院,河北 邯郸 0560382. 军事科学院 军事科学信息研究中心,北京 1001423. 国防科技大学 计算机学院,长沙 410037
关键词:大语言模型,问答数据集,低秩自适应微调,提示学习,科技政策法规,问答系统
科技政策法规问答系统(Q&A)在帮助公众理解和应用科技法规方面发挥关键作用。大语言模型(LLM)可以显著提升科技政策法规问答系统的准确性和效率。然而,基于大语言模型的科技政策法规问答系统仍然存在以下问题:缺乏大规模高质量的科技政策法规问答数据集,且现有自动构建大规模数据集的方法在引用和整合政策法规知识方面存在不足;问答系统在处理科技政策法规问题时,专业性、准确性不足且模型知识更新滞后。为解决这些问题,提出了一种检索增强自提示的问答数据集构建方法,并构建了一个大规模高质量的科技政策法规问答数据集;同时,构建了科技政策法规问答系统,该系统结合了经过低秩自适应(LoRA)微调技术优化的大语言模型与科技政策法规知识库,并运用提示学习技术,来引导系统生成准确的答案。实验结果显示,构建的问答数据集在引用和整合科技政策法规知识方面,比传统方法构建的问答数据集有显著提升;相较于通用大语言模型驱动的问答系统,该问答系统在各项指标上也有明显提高。
来源:2024年第9期
《计算机科学与探索》期刊编辑部