Pages that link to "Item:Q1961327"
From MaRDI portal
The following pages link to Exploration of multi-state environments: Local measures and back-propagation of uncertainty (Q1961327):
Displaying 8 items.
- An asymptotically optimal policy for finite support models in the multiarmed bandit problem (Q415624) (← links)
- A dynamic programming strategy to balance exploration and exploitation in the bandit problem (Q647433) (← links)
- k-Certainty Exploration Method: an action selector to identify the environment in reinforcement learning (Q1392105) (← links)
- A model for system uncertainty in reinforcement learning (Q1729066) (← links)
- Reliability of internal prediction/estimation and its application. I: Adaptive action selection reflecting reliability of value function (Q1886590) (← links)
- Uncertainty Propagation for Efficient Exploration in Reinforcement Learning (Q2999161) (← links)
- Posterior Weighted Reinforcement Learning with State Uncertainty (Q3564827) (← links)
- A novel policy based on action confidence limit to improve exploration efficiency in reinforcement learning (Q6121659) (← links)