检索结果-维普期刊中文期刊服务平台

期刊文献⁺

任意字段

题名或关键词

题名

关键词

文摘

作者

第一作者

机构

刊名

分类号

参考文献

作者简介

基金资助

栏目信息

共找到2篇文章

< 1 >

每页显示 20 50 100

已选择0条

导出题录引用分析

统计分析

显示方式：

文摘详细列表

相关度排序被引量排序时效性排序

基于余弦相似度的多模态模仿学习方法被引量：7: 1; 作者郝少璞刘全 +2 位作者徐平安张立华黄志刚《计算机研究与发展》 EI CSCD 北大核心 2023年第6期1358-1372,共15页; 生成对抗模仿学习(generative adversarial imitation learning,GAIL)是一种基于生成对抗框架的逆向强化学习(inverse reinforcement learning,IRL)方法,旨在从专家样本中模仿专家策略.在实际任务中,专家样本往往由多模态策略产生.然而... 展开更多; 关键词逆向强化学习生成对抗模仿学习多模态模式塌缩余弦相似度; 下载PDF 职称材料

融合引力搜索的双延迟深度确定策略梯度方法: 2; 作者徐平安刘全 +1 位作者郝少璞张立华《软件学报》 EI CSCD 北大核心 2023年第11期5191-5204,共14页; 近年来,深度强化学习在复杂控制任务中取得了令人瞩目的效果,然而由于超参数的高敏感性和收敛性难以保证等原因,严重影响了其对现实问题的适用性.元启发式算法作为一类模拟自然界客观规律的黑盒优化方法,虽然能够有效避免超参数的敏感性... 展开更多; 关键词深度强化学习元启发式算法引力搜索确定策略梯度策略搜索; 下载PDF 职称材料

已选择0条

导出题录引用分析

统计分析

上一页 1 下一页到第页

使用帮助返回顶部