期刊文献+

非一致有界费用MDP的强平均最优性条件

A Condition for Strong Average Optimality of MDP with Non-uniformly Bounded Costs
下载PDF
导出
摘要 研究可数状态空间任意行动空间非一致性有界费用马氏决策过程(MDP)的强平均最优,给出了使得每个常用的平均最优策略也是强平均最优的条件,并实质性的推广了Cavazos-Cadena和Fernandez-Gaucheran(Math.Meth.Oper.Res.,1996,43:281-300)的主要结果. In this paper, we consider the Markov decision processes under an average cost criterion with non-uniformly bounded cost, denumerable state and arbitrary action spaces. Some sufficient conditions are given under which every average optimal policy is strong average optimal. We improve the main results obtained by Cavazos-Cadena R.and Fernandez-Gaucheran E. (Math. Meth. Oper. Res., 1996, 43: 281-300).
出处 《运筹学学报》 CSCD 2010年第1期95-105,共11页 Operations Research Transactions
基金 湖南省自然科学基金项目(08JJ3004) 湖南省社会科学基金项目(08YBB187)的支持
关键词 运筹学 马氏决策过程(MDP) 强平均费用准则 非一致有界费用 充分条件 Operations research, Markov decision processes, strong average optimal- itv crikerion, non-uniformly bounded cost, sufficient conditions
  • 相关文献

参考文献1

二级参考文献2

相关作者

内容加载中请稍等...

相关机构

内容加载中请稍等...

相关主题

内容加载中请稍等...

浏览历史

内容加载中请稍等...
;
使用帮助 返回顶部