The following pages link to (Q3148830):
Displaying 4 items.
- Model-free reinforcement learning for branching Markov decision processes (Q832301) (← links)
- A concentration bound for contractive stochastic approximation (Q2242891) (← links)
- (Q3093180) (← links)
- Approximate Q Learning for Controlled Diffusion Processes and Its Near Optimality (Q6136230) (← links)