A policy iteration heuristic for constrained discounted controlled Markov Chains

Citations

WEB OF SCIENCE

2
Citations

SCOPUS

2

초록

This brief paper presents a policy-improvement method of generating a feasible stochastic policy (pi) over tilde from a given feasible stochastic base-policy pi such that (pi) over tilde improves all of the feasible policies "induced" from pi for infinite-horizon constrained discounted controlled Markov chains (CMCs). A policy-iteration heuristic for approximately solving constrained discounted CMCs is developed from this improvement method.

키워드

Constrained Markov decision processPolicy iterationPolicy improvement
제목
A policy iteration heuristic for constrained discounted controlled Markov Chains
저자
Chang, Hyeong Soo
DOI
10.1007/s11590-011-0338-7
발행일
2012-10
유형
Article
저널명
Optimization Letters
6
7
페이지
1573 ~ 1577