计算机科学与探索

北大核心,INSPEC,JST,CSCD,WJCI

国内刊号:11-5602/TP

国际刊号:1673-9418

计算机科学与探索杂志2025年第7期:基于隐式通信的值分解多智能体强化学习

发布日期:

作者:邓亚男, 王秋红, 李俊杰, 顾晶晶

单位:南京航空航天大学 计算机科学与技术学院,南京 211106

关键词:值分解,多智能体强化学习,部分可观测性,不确定性,隐式通信

基金:国家自然科学基金(62072235)。

在多智能体系统中,智能体通常只能观察到部分状态信息,导致每个智能体在作决策时缺乏对其他智能体行为和环境动态的完整理解,进而增加了协作的难度。虽然基于值函数分解的多智能体强化学习方法对解决局部可观测性问题有一定的优势,但由于状态-动作空间维度高、模型结构复杂等问题,多智能体系统中仍然存在着协作不确定性的影响,从而导致奖励分配不公平的问题。提出了一种基于隐式通信的值分解多智能体强化学习方法(VFRL-IC),通过挖掘智能体之间的局部关系,缓解环境不确定性问题带来的影响:提出隐式通信框架,在训练阶段使智能体共享局部观测信息以训练局部策略;基于局部观测信息构建全局影响的评估模型,求解智能体间影响值;设计了一种类多头注意力机制的网络结构,融合智能体间影响值,求解包含全局信息的局部动作值模型。在星际争霸环境中进行实验验证,结果表明,VFRL-IC在各场景中的平均成功率优于基线算法15~40个百分点,效率提高18%。

来源:2025年第7期

《计算机科学与探索》期刊编辑部

查看计算机科学与探索杂志2025年第7期

联系我们

  • 地址:北京市海淀区北四环中路211号
  • 电话:(010)89056056
  • E-mail:fcst@vip.163.com

咨询工作人员