期刊文献+
共找到1篇文章
< 1 >
每页显示 20 50 100
多Agent Q学习几点问题的研究及改进 被引量:5
1
作者 孟祥萍 王圣镔 王欣欣 《计算机工程与设计》 CSCD 北大核心 2009年第9期2274-2276,共3页
提出了一种新颖的基于Q-学习,蚁群算法和轮盘赌算法的多Agent强化学习。在强化学习算法中,当Agent数量增加到足够大时,就会出现动作空间灾难性问题,即:其交互困难,学习速度骤然下降。另外,由于Agent是利用Q值来选择下一步动作的,因此,... 提出了一种新颖的基于Q-学习,蚁群算法和轮盘赌算法的多Agent强化学习。在强化学习算法中,当Agent数量增加到足够大时,就会出现动作空间灾难性问题,即:其交互困难,学习速度骤然下降。另外,由于Agent是利用Q值来选择下一步动作的,因此,在学习早期,动作的选择严重束缚于高Q值。在这里,把蚁群算法,轮盘赌算法和强化学习三者结合起来,期望解决上述提出的问题。最后,对新算法的理论分析和实验结果都证明了改进的Q学习是可行的,并且可以有效的提高学习效率。 展开更多
关键词 多Agent强化学习算法 蚁群算法 轮盘赌算法 Q值 动作空间灾难
下载PDF
上一页 1 下一页 到第
使用帮助 返回顶部