Pages that link to "Item:Q2664203"
From MaRDI portal
The following pages link to Policy iterations for reinforcement learning problems in continuous time and space -- fundamental theory and methods (Q2664203):
Displaying 11 items.
- A study of reinfrocement learning in the continuous case by the means of viscosity solutions (Q1584837) (← links)
- Adaptive-resolution reinforcement learning with polynomial exploration in deterministic domains (Q1959632) (← links)
- Policy space identification in configurable environments (Q2163245) (← links)
- On integral generalized policy iteration for continuous-time linear quadratic regulations (Q2628425) (← links)
- Policy iterations for reinforcement learning problems in continuous time and space -- fundamental theory and methods (Q2664203) (← links)
- Regularized policy iteration with nonparametric function spaces (Q2834459) (← links)
- A Class of Decision Processes Showing Policy-Improvement/Newton–Raphson Equivalence (Q3415941) (← links)
- Rejoinder: New Objectives for Policy Learning (Q4999146) (← links)
- Bellman's principle of optimality and deep reinforcement learning for time-varying tasks (Q5043501) (← links)
- Approximate Q Learning for Controlled Diffusion Processes and Its Near Optimality (Q6136230) (← links)
- Formal Policy Synthesis for Continuous-State Systems via Reinforcement Learning (Q6487919) (← links)