The following pages link to (Q4597712):
Displaying 13 items.
- Policy Mirror Descent for Regularized Reinforcement Learning: A Generalized Framework with Linear Convergence (Q6161312) (← links)
- Separation of learning and control for cyber-physical systems (Q6164023) (← links)
- A novel distributed algorithm for estimation and control of large-scale systems (Q6173492) (← links)
- Settling the sample complexity of model-based offline reinforcement learning (Q6192326) (← links)
- Dynamic programming in probability spaces via optimal transport (Q6490242) (← links)
- A kernel-based approximate dynamic programming approach: theory and application (Q6491089) (← links)
- Policy search for active fault diagnosis with partially observable state (Q6496669) (← links)
- Decomposition methods for monotone two-time-scale stochastic optimization problems (Q6538811) (← links)
- A dynamic programming approach for energy management in hybrid electric vehicles under uncertain driving conditions (Q6557208) (← links)
- Decentralized fused-learner architectures for Bayesian reinforcement learning (Q6566625) (← links)
- Lagrangian relaxation for continuous-time optimal control of coupled hydrothermal power systems including storage capacity and a cascade of hydropower systems with time delays (Q6631779) (← links)
- Discounted fully probabilistic design of decision rules (Q6645068) (← links)
- Predict globally, correct locally: parallel-in-time optimization of neural networks (Q6659267) (← links)