Pages that link to "Item:Q1190506"
From MaRDI portal
The following pages link to Computationally efficient algorithms for on-line optimization of Markov decision processes (Q1190506):
Displaying 4 items.
- Adaptive control of Markov chains with local updates (Q913734) (← links)
- Model-based average reward reinforcement learning (Q1128769) (← links)
- Single sample path-based optimization of Markov chains (Q1289394) (← links)
- Simple regret optimization in online planning for Markov decision processes (Q2921080) (← links)