期刊导航
期刊开放获取
河南省图书馆
退出
期刊文献
+
任意字段
题名或关键词
题名
关键词
文摘
作者
第一作者
机构
刊名
分类号
参考文献
作者简介
基金资助
栏目信息
任意字段
题名或关键词
题名
关键词
文摘
作者
第一作者
机构
刊名
分类号
参考文献
作者简介
基金资助
栏目信息
检索
高级检索
期刊导航
共找到
1
篇文章
<
1
>
每页显示
20
50
100
已选择
0
条
导出题录
引用分析
参考文献
引证文献
统计分析
检索结果
已选文献
显示方式:
文摘
详细
列表
相关度排序
被引量排序
时效性排序
稀疏奖励场景下基于个体落差情绪的多智能体协作算法
1
作者
王浩
汪京
方宝富
《模式识别与人工智能》
EI
CSCD
北大核心
2022年第5期451-460,共10页
针对在多智能体环境中强化学习面临的稀疏奖励问题,借鉴情绪在人类学习和决策中的作用,文中提出基于个体落差情绪的多智能体协作算法.对近似联合动作值函数进行端到端优化以训练个体策略,将每个智能体的个体动作值函数作为对事件的评估...
针对在多智能体环境中强化学习面临的稀疏奖励问题,借鉴情绪在人类学习和决策中的作用,文中提出基于个体落差情绪的多智能体协作算法.对近似联合动作值函数进行端到端优化以训练个体策略,将每个智能体的个体动作值函数作为对事件的评估.预测评价与实际情况的差距产生落差情绪,以该落差情绪模型作为内在动机机制,为每个智能体产生一个内在情绪奖励,作为外在奖励的有效补充,以此缓解外在奖励稀疏的问题.同时内在情绪奖励与具体任务无关,因此具有一定的通用性.在不同稀疏程度的多智能体追捕场景中验证文中算法的有效性和鲁棒性.
展开更多
关键词
稀疏奖励
多智能体协作
强化学习
个体落差情绪
内在
情绪
奖励
下载PDF
职称材料
题名
稀疏奖励场景下基于个体落差情绪的多智能体协作算法
1
作者
王浩
汪京
方宝富
机构
合肥工业大学计算机与信息学院
合肥工业大学情感计算与先进智能机器安徽省重点实验室
出处
《模式识别与人工智能》
EI
CSCD
北大核心
2022年第5期451-460,共10页
基金
国家自然科学基金项目(No.61872327)
民航飞行技术与飞行安全重点实验室开放基金项目(No.FZ2020KF07)资助。
文摘
针对在多智能体环境中强化学习面临的稀疏奖励问题,借鉴情绪在人类学习和决策中的作用,文中提出基于个体落差情绪的多智能体协作算法.对近似联合动作值函数进行端到端优化以训练个体策略,将每个智能体的个体动作值函数作为对事件的评估.预测评价与实际情况的差距产生落差情绪,以该落差情绪模型作为内在动机机制,为每个智能体产生一个内在情绪奖励,作为外在奖励的有效补充,以此缓解外在奖励稀疏的问题.同时内在情绪奖励与具体任务无关,因此具有一定的通用性.在不同稀疏程度的多智能体追捕场景中验证文中算法的有效性和鲁棒性.
关键词
稀疏奖励
多智能体协作
强化学习
个体落差情绪
内在
情绪
奖励
Keywords
Sparse Reward
Multi-agent Cooperation
Reinforcement Learning
Individual Gap Emotion
Intrinsic Emotional Reward
分类号
TP181 [自动化与计算机技术—控制理论与控制工程]
下载PDF
职称材料
题名
作者
出处
发文年
被引量
操作
1
稀疏奖励场景下基于个体落差情绪的多智能体协作算法
王浩
汪京
方宝富
《模式识别与人工智能》
EI
CSCD
北大核心
2022
0
下载PDF
职称材料
已选择
0
条
导出题录
引用分析
参考文献
引证文献
统计分析
检索结果
已选文献
上一页
1
下一页
到第
页
确定
用户登录
登录
IP登录
使用帮助
返回顶部