期刊文献+
共找到1篇文章
< 1 >
每页显示 20 50 100
可数半Markov决策过程折扣代价性能优化
1
作者 殷保群 李衍杰 +1 位作者 周亚平 奚宏生 《控制与决策》 EI CSCD 北大核心 2006年第8期933-936,共4页
讨论一类可数半M arkov决策过程(CSM DP)在折扣代价准则下的性能优化问题.运用等价M arkov过程方法,定义了折扣Po isson方程,并由该方程定义了α-势.基于α-势,导出了由最优平稳策略所满足的最优性方程.较为详细地讨论了最优性方程解的... 讨论一类可数半M arkov决策过程(CSM DP)在折扣代价准则下的性能优化问题.运用等价M arkov过程方法,定义了折扣Po isson方程,并由该方程定义了α-势.基于α-势,导出了由最优平稳策略所满足的最优性方程.较为详细地讨论了最优性方程解的存在性问题,并给出了其解存在的一些充分条件. 展开更多
关键词 可数半Markov决策过程 折扣性能准则 折扣Poisson方程 α-势 最优性方程
下载PDF
上一页 1 下一页 到第
使用帮助 返回顶部