Multi-policy iteration with a distributed voting

Citations

WEB OF SCIENCE

3
Citations

SCOPUS

3

초록

We present a novel simulation-based algorithm, as an extension of the well-known policy iteration algorithm, by combining multi-policy improvement with a distributed simulation-based voting policy evaluation, for approximately solving Markov Decision Processes (MDPs) with infinite horizon discounted reward criterion, and analyze its performance relative to the optimal value.

키워드

policy iterationdistributed algorithmvotingMarkov decision processes
제목
Multi-policy iteration with a distributed voting
저자
Chang, HS
DOI
10.1007/s001860400362
발행일
2004-11
유형
Article
저널명
Mathematical Methods of Operations Research
60
2
페이지
299 ~ 310