Pages that link to "Item:Q2892321"
From MaRDI portal
The following pages link to An evolutionary random policy search algorithm for solving Markov decision processes (Q2892321):
Displaying 5 items.
- A variable neighborhood search based algorithm for finite-horizon Markov decision processes (Q613296) (← links)
- Preference-based reinforcement learning: evolutionary direct policy search using a preference-based racing algorithm (Q2514758) (← links)
- (Q4783489) (← links)
- Randomized Linear Programming Solves the Markov Decision Problem in Nearly Linear (Sometimes Sublinear) Time (Q5119845) (← links)
- Optimal Online Learning for Nonlinear Belief Models Using Discrete Priors (Q5144779) (← links)