国内刊号:11-5602/TP
国际刊号:1673-9418
发布日期:
作者:戎璐, 喻梅, 赵东明, 王永刚, 张亚洲
单位:1. 天津大学 教育学院,天津 3003502. 天津大学 计算机科学与技术学院,天津 3003503. 天津移动 AI产业研究院,天津 3000204. 飞腾信息技术有限公司,天津 300459
关键词:大语言模型,文本分类,提示学习
基金:国家自然科学基金青年基金(62006212);河南省自然科学基金面上项目(242300421412);2024年天津市制造业高质量发展项目(24ZGZNGX00020)。
教育文本分类是智能教育的核心任务,广泛应用于教材内容分析、自动试题分类和教学资源推荐等场景。然而,与新闻、评论等通用文本相比,教育类文本具有术语密集、结构化知识丰富等特征,导致模型的语义理解与迁移学习难度显著增加。在低资源条件下,现有依赖大规模标注数据和监督微调的主流方法面临样本稀缺的困境。提出了一种适用于低资源与小样本场景的文本分类方法,基于提示调优策略引导预训练语言模型与大型语言模型的先验知识迁移。该方法设计了离散、连续与混合三类提示模板,并引入双向长短期记忆网络以建模提示词元之间的依赖关系,从而提升模型对任务语义的适配能力。在EduBooks、AGNews、MELD与IMDB四个典型文本分类数据集上的实验结果表明,该方法在F1指标上分别较八种主流基线方法提升了3.7%、3.3%、5.7%和1.1%。结果显示,所提方法在无需微调预训练模型参数的前提下,能够实现对不同类型文本的高效、准确分类,具有较强的通用性。消融实验进一步验证了冻结策略的合理性。
来源:2026年第4期
《计算机科学与探索》期刊编辑部