The following pages link to (Q5302093):
Displaying 30 items.
- On two continuum armed bandit problems in high dimensions (Q260274) (← links)
- Robustness of stochastic bandit policies (Q391739) (← links)
- Modeling item-item similarities for personalized recommendations on Yahoo! front page (Q652346) (← links)
- Adaptive-treed bandits (Q888482) (← links)
- Context-based unsupervised ensemble learning and feature ranking (Q1689607) (← links)
- Gaussian process bandits with adaptive discretization (Q1711556) (← links)
- A derivative-free optimization algorithm for the efficient minimization of functions obtained via statistical averaging (Q1986101) (← links)
- Stochastic continuum-armed bandits with additive models: minimax regrets and adaptive algorithm (Q2091834) (← links)
- Filtered Poisson process bandit on a continuum (Q2239901) (← links)
- Random gradient-free minimization of convex functions (Q2397749) (← links)
- Truthful mechanisms with implicit payment computation (Q2796397) (← links)
- Online Learning in Markov Decision Processes with Continuous Actions (Q2835638) (← links)
- Learning to Optimize via Information-Directed Sampling (Q4969321) (← links)
- (Q4998863) (← links)
- Nonparametric Pricing Analytics with Customer Covariates (Q5003728) (← links)
- Continuous Assortment Optimization with Logit Choice Probabilities and Incomplete Information (Q5095163) (← links)
- MNL-Bandit: A Dynamic Learning Approach to Assortment Selection (Q5129205) (← links)
- Bandits with Global Convex Constraints and Objective (Q5129206) (← links)
- Nonstationary Bandits with Habituation and Recovery Dynamics (Q5144777) (← links)
- Learning in Combinatorial Optimization: What and How to Explore (Q5144784) (← links)
- Derivative-free optimization methods (Q5230522) (← links)
- Learning to Optimize via Posterior Sampling (Q5247618) (← links)
- A Primal–Dual Learning Algorithm for Personalized Dynamic Pricing with an Inventory Constraint (Q5870348) (← links)
- Satisficing in Time-Sensitive Bandit Learning (Q5870357) (← links)
- Randomized allocation with arm elimination in a bandit problem with covariates (Q5965323) (← links)
- Multi-armed bandits with censored consumption of resources (Q6097147) (← links)
- Multi-armed bandit problem with online clustering as side information (Q6099516) (← links)
- Treatment recommendation with distributional targets (Q6163253) (← links)
- Certified multifidelity zeroth-order optimization (Q6645132) (← links)
- Thompson sampling-based recursive block elimination for dynamic assignment under limited budget in pure-exploration (Q6663814) (← links)