计算机应用研究

北大核心,JST,Pж(AJ),CSCD扩展版,WJCI

国内刊号:51-1196/TP

国际刊号:1001-3695

计算机应用研究杂志2025年第5期:基于内在奖励机制的多机器人社交编队导航

发布日期:

作者:刘伟,符浩,周帅,

单位:武汉科技大学a.计算机科学与技术学院;b.智能信息处理与实时工业系统湖北省重点实验室,武汉430081;

关键词:强化学习,多机器人,社交编队导航,内在奖励,

基金:国家自然科学基金资助项目(62303357,62173262);湖北省自然科学基金资助项目(2023AFB109);;

针对多机器人社交编队导航存在的相对过度泛化问题,通过激励机器人探索联合观测空间的方式,提出了基于内在奖励机制的多机器人社交编队导航算法。首先,将随机网络蒸馏内在奖励与椭圆回合内在奖励相结合,形成双时间尺度内在奖励,提升多机器人的探索能力,从而获得最优的多机器人联合策略;其次,通过将内外奖励设计与集中式训练分布式执行的框架相结合,采用集中式的内在奖励学习方式,激励多机器人探索联合观测空间,克服多机器人社交编队导航的相对过度泛化问题;最后,通过所提算法与基线算法的仿真对比实验,建立多机器人社交编队导航的评估机制,并进行相关的定量与定性分析。实验结果表明,从成功率、碰撞率、导航时间和队形误差等指标的定量和定性评价来看,所提算法优于基线算法。与现有的多机器人社交编队导航算法相比,所提算法能够获得更好的编队导航性能。

来源:2025年第5期

《计算机应用研究》期刊编辑部

查看计算机应用研究杂志2025年第5期

联系我们

  • 地址:四川省成都市武候区成科西路3号
  • 电话:028-85249567
  • E-mail:journal@arocmag.cn

咨询工作人员