国内刊号:11-5602/TP
国际刊号:1673-9418
发布日期:
作者:杨跃翔, 郑怀城, 刘学文, 涂新雨
单位:中国矿业大学(北京) 管理学院,北京 100083
关键词:智能家居,知识图谱,大语言模型,知识抽取,信息安全
基金:国家重点研发计划(2022YFF0607100);中央基本科研业务经费项目(552023Y-10371)。
随着智能家居行业的发展和信息安全需求的增加,设计时需考虑的信息安全因素逐渐变得复杂。标准文本中虽包含大量智能家居信息安全的设计要求,但文本之间缺乏结构关系,无法进行有效切割来提升大语言模型的知识抽取性能。为此,针对标准文本提出了一种大语言模型结合按标题切割策略-提示工程知识抽取方法。将长文档转化为Markdown格式,通过TF-IDF方法提取领域词,进行文本过滤,并依据Markdown半结构化特征进行文本分割,构建数据层;结合专家知识与智能家居信息安全领域多源数据,构建场景-设备-部件与危害-事故-控制链路本体,形成概念层;使用大语言模型、按标题切割的文本分割策略和“领域-模板-需求”的提示工程框架进行信息抽取,构建实例层。实验结果表明,经过领域词进行文本过滤后的大语言模型需要处理的文本减少了近60%,大大降低了调用API的成本,提出模型的最佳F1分数达到83.1%,通过消融实验,验证了提出的按标题切割的文本分割方法与提示工程框架可以极大地保留文本语义关联的合理性与有效性,再通过对比实验,证明了大语言模型比传统深度学习UIE模型明显更适配所提出的抽取方法,性能提升显著,说明大语言模型结合该方法在长文本的复杂结构语境下具有明显的优势。构建的知识图谱以场景-设备-部件为基础,连接了分散的危害与事故,并从标准中抽取出了相关的应对措施,提供了可视化查询和事故致因分析功能,有助于智能家居在设计时识别和评估潜在风险,预防信息安全事故。
来源:2026年第1期
《计算机科学与探索》期刊编辑部