Optimistic reinforcement learning by forward Kullback-Leibler divergence optimization
From MaRDI portal
Publication:6077011
DOI10.1016/j.neunet.2022.04.021arXiv2105.12991WikidataQ114950179 ScholiaQ114950179MaRDI QIDQ6077011
Publication date: 17 October 2023
Published in: Neural Networks (Search for Journal in Brave)
Full work available at URL: https://arxiv.org/abs/2105.12991
reinforcement learningKullback-Leibler divergencecontrol as probabilistic inferenceoptimistic learning
Cites Work
This page was built for publication: Optimistic reinforcement learning by forward Kullback-Leibler divergence optimization