Bias-Corrected Q-Learning With Multistate Extension
From MaRDI portal
Publication:5211154
DOI10.1109/TAC.2019.2912443zbMath1482.90240OpenAlexW2941439130WikidataQ127984042 ScholiaQ127984042MaRDI QIDQ5211154
Publication date: 28 January 2020
Published in: IEEE Transactions on Automatic Control (Search for Journal in Brave)
Full work available at URL: https://doi.org/10.1109/tac.2019.2912443
Markov processes: estimation; hidden Markov models (62M05) Markov and semi-Markov decision processes (90C40)
Related Items (2)
A note on generalized second-order value iteration in Markov decision processes ⋮ Q-learning with heterogeneous update strategy
This page was built for publication: Bias-Corrected Q-Learning With Multistate Extension