Pages that link to "Item:Q5211838"
From MaRDI portal
The following pages link to Multi-Armed Bandits: Theory and Applications to Online Learning in Networks (Q5211838):
Displaying 5 items.
- Stochastic online optimization. Single-point and multi-point non-linear multi-armed bandits. Convex and strongly-convex case (Q2397263) (← links)
- A Survey of Preference-Based Online Learning with Bandit Algorithms (Q2938721) (← links)
- Nonstochastic Multi-Armed Bandits with Graph-Structured Feedback (Q4596721) (← links)
- Online Network Revenue Management Using Thompson Sampling (Q5131540) (← links)
- Bandit Change-Point Detection for Real-Time Monitoring High-Dimensional Data Under Sampling Control (Q6631108) (← links)