看过本文的还看了

相关文献

该作者的其他文献

文献详情 >基于MADDPG的多无人机协同任务决策 收藏
基于MADDPG的多无人机协同任务决策

基于MADDPG的多无人机协同任务决策

作     者:李波 越凯强 甘志刚 高佩忻 LI Bo;YUE Kai-qiang;GAN Zhi-gang;GAO Pei-xin

作者机构:西北工业大学电子信息学院西安710114 

基  金:国家自然科学基金(61573285,62003267) 陕西省自然科学基金(2020JQ-220) 航空科学基金(2017ZC53021) 数据链技术重点实验室开放基金(CLDL-20182101) 

出 版 物:《宇航学报》 (Journal of Astronautics)

年 卷 期:2021年第42卷第6期

页      码:757-765页

摘      要:针对多无人机任务决策方法研究中传统优化算法难以在短时间内得到期望结果的问题,基于深度强化学习提出一种无人机多智能体深度确定性策略梯度(MADDPG)算法,通过允许无人机在学习时使用全局信息,在应用决策的时候只使用局部信息的方法,从网络结构、状态空间、动作空间和奖励函数设计了MADDPG算法的模型结构。最后通过仿真实验,并对比深度确定性策略梯度(DDPG)算法,验证了本文提出的MADDPG算法在保证精度的基础上,学习速度大幅度提高,弥补了传统强化学习算法在多智能体领域的不足。

主 题 词:无人机 任务决策 深度强化学习 策略梯度 多智能体 

学科分类:08[工学] 0826[工学-生物医学工程类] 0802[工学-机械学] 0825[工学-环境科学与工程类] 0704[理学-天文学类] 

核心收录:

D O I:10.3873/j.issn.1000-1328.2021.06.009

馆 藏 号:203104523...

读者评论 与其他读者分享你的观点

用户名:未登录
我的评分