期刊文献+
共找到1篇文章
< 1 >
每页显示 20 50 100
基于MATD3算法的多智能体避碰控制
1
作者 郭雷 梁成庆 《计算技术与自动化》 2024年第1期9-15,共7页
使用多智能体双延迟深度确定性策略梯度(Multi-agent Twin Delayed Deep Deterministic Policy Gradient,MATD3)算法研究了多无人机的避障和到达目标点问题,首先,利用MATD3算法的优越性提高训练效率。其次,基于人工势场法的思想设计了... 使用多智能体双延迟深度确定性策略梯度(Multi-agent Twin Delayed Deep Deterministic Policy Gradient,MATD3)算法研究了多无人机的避障和到达目标点问题,首先,利用MATD3算法的优越性提高训练效率。其次,基于人工势场法的思想设计了稠密碰撞奖励函数,使得智能体在没有找到最优解决方案时也能得到积极的反馈,加快学习速度。最后,在仿真实验阶段,通过设计的三组对比实验和泛化实验验证了算法的有效性。 展开更多
关键词 多智能体 强化学习 人工势场法 避障
下载PDF
上一页 1 下一页 到第
使用帮助 返回顶部