Pages that link to "Item:Q6136230"
From MaRDI portal
The following pages link to Approximate Q Learning for Controlled Diffusion Processes and Its Near Optimality (Q6136230):
Displaying 9 items.
- Temporal difference-based policy iteration for optimal control of stochastic systems (Q467477) (← links)
- Data-driven approximate Q-learning stabilization with optimality error bound analysis (Q1737866) (← links)
- Optimal learning with \textit{Q}-aggregation (Q2448729) (← links)
- Minimax Q-learning control for linear systems using the Wasserstein metric (Q2681392) (← links)
- (Q4434172) (← links)
- Two Time-Scale Stochastic Approximation with Controlled Markov Noise and Off-Policy Temporal-Difference Learning (Q5219302) (← links)
- Reinforcement Learning for Linear-Convex Models with Jumps via Stability Analysis of Feedback Controls (Q6042790) (← links)
- Continuity of cost in Borkar control topology and implications on discrete space and time approximations for controlled diffusions under several criteria (Q6126973) (← links)
- Approximate Q Learning for Controlled Diffusion Processes and Its Near Optimality (Q6136230) (← links)