国内刊号:11-5602/TP
国际刊号:1673-9418
发布日期:
作者:肖增, 王斯日古楞, 斯琴图
单位:内蒙古师范大学 计算机科学技术学院,呼和浩特 010022
关键词:零样本翻译,预训练模型,双语监督训练,大语言模型,多语言神经机器翻译
基金:国家自然科学基金(61762072);内蒙古自然科学基金(2022MS06002,2024LHMS06024)。
在多语言神经机器翻译中,零样本翻译是一个重要的研究方向,旨在使模型能够翻译训练过程中从未见过的语言对,实现跨语言迁移学习。然而,现有多语言模型在处理未见过语言对时,仍面临诸如语义偏移、翻译质量不稳定、语言方向不对称等问题,严重影响了翻译效果的可靠性与一致性。为系统性梳理该领域的研究现状,围绕“多语言模型构建方式对零样本翻译性能的影响”这一核心问题展开综述,旨在为后续研究者提供理论支持和方法借鉴。零样本翻译对于训练语料匮乏的语言对翻译任务意义重大,很大程度上降低了翻译成本。从语料资源的角度出发,介绍了零样本翻译的研究背景、基本定义、核心原理及其在跨文化沟通、新语言支持等场景中的实际应用价值。针对当前主流的零样本翻译建模方法,从基于预训练模型、双语监督训练和大语言模型构建多语言神经机器翻译的三个方向进行介绍。分析了多语言神经机器翻译中零样本翻译的未来研究趋势,为该领域进一步研究提供参考。
来源:2025年第10期
《计算机科学与探索》期刊编辑部