Pages that link to "Item:Q3093949"
From MaRDI portal
The following pages link to Upper-Confidence-Bound Algorithms for Active Learning in Multi-armed Bandits (Q3093949):
Displaying 5 items.
- Exploration-exploitation tradeoff using variance estimates in multi-armed bandits (Q1017665) (← links)
- Foraging decisions as multi-armed bandit problems: applying reinforcement learning algorithms to foraging data (Q1730108) (← links)
- An Efficient Algorithm for Learning with Semi-bandit Feedback (Q2859220) (← links)
- (Q4558161) (← links)
- Sequential Design for Ranking Response Surfaces (Q5269860) (← links)