상세 보기
A policy iteration heuristic for constrained discounted controlled Markov Chains
Citations
WEB OF SCIENCE
2Citations
SCOPUS
2초록
This brief paper presents a policy-improvement method of generating a feasible stochastic policy (pi) over tilde from a given feasible stochastic base-policy pi such that (pi) over tilde improves all of the feasible policies "induced" from pi for infinite-horizon constrained discounted controlled Markov chains (CMCs). A policy-iteration heuristic for approximately solving constrained discounted CMCs is developed from this improvement method.
키워드
Constrained Markov decision process; Policy iteration; Policy improvement
- 제목
- A policy iteration heuristic for constrained discounted controlled Markov Chains
- 저자
- Chang, Hyeong Soo
- 발행일
- 2012-10
- 유형
- Article
- 권
- 6
- 호
- 7
- 페이지
- 1573 ~ 1577