A policy improvement method for constrained average Markov decision processes

Citations

WEB OF SCIENCE

8
Citations

SCOPUS

10

초록

This brief paper presents a policy improvement method for constrained Markov decision processes (MDPs) with average cost criterion under an ergodicity assumption, extending Howard's policy improvement for MDPs. The improvement method induces a policy iteration-type algorithm that converges to a local optimal policy. (c) 2006 Elsevier B.V. All rights reserved.

키워드

constrained Markov decision processpolicy improvementpolicy iteration
제목
A policy improvement method for constrained average Markov decision processes
저자
Chang, Hyeong Soo
DOI
10.1016/j.orl.2006.09.003
발행일
2007-07
유형
Article
저널명
Operations Research Letters
35
4
페이지
434 ~ 438