首页 / 资料库 / 文献详情

引入反事实基线的无人机集群对抗博弈方法

Ershen WangJihao ChenChen HongFan LiuAidong ChenHongyuan Jing

2024Scientia Sinica InformationisComputer Science被引 1开放获取

出版方页面 →

摘要

无人机在军事上的应用越来越广泛和深入,尤其是无人机集群在协同探测、全域打击、战术骗扰等作战任务中,发挥着越来越重要作用,可靠高效的无人机集群博弈方法是当前的研究热点。本文将反事实基线思想引入到无人机集群对抗博弈环境,提出面向多无人机场景的反事实多智能体策略梯度(Counterfactual multi-agent policy gradients, COMA)博弈方法;在具有连续无限状态、动作的无人机作战环境中,构建基于多智能体深度强化学习的无人机集群对抗博弈模型。利用多智能体粒子群环境(Multi-agent particle environment, MPE)对红蓝双方无人机集群进行非对称性对抗实验,实验结果表明COMA方法在平均累积奖励、平均命中率和平均胜率方面均优于目前流行的深度强化学习方法。最后,通过对COMA方法的收敛性和稳定性的深入分析,保证了COMA方法在无人机集群对抗博弈任务上的实用性和鲁棒性。

引用本文(GB/T 7714)

Ershen Wang, Jihao Chen, Chen Hong, 等. 引入反事实基线的无人机集群对抗博弈方法[J]. Scientia Sinica Informationis, 2024.

引文网络

参考文献与被引分析加载中…

DOI:https://doi.org/10.1360/ssi-2023-0305

本站仅收录题录与摘要供学习参考,全文版权归属出版方;如有侵权请联系我们删除。