Pages that link to "Item:Q5857153"
From MaRDI portal
The following pages link to Off-Policy Estimation of Long-Term Average Outcomes With Applications to Mobile Health (Q5857153):
Displaying 7 items.
- Batch policy learning in average reward Markov decision processes (Q2112817) (← links)
- Personalized Policy Learning Using Longitudinal Mobile Health Data (Q5857154) (← links)
- A multiagent reinforcement learning framework for off-policy evaluation in two-sided markets (Q6138596) (← links)
- Off-policy evaluation in partially observed Markov decision processes under sequential ignorability (Q6183750) (← links)
- Projected state-action balancing weights for offline reinforcement learning (Q6183753) (← links)
- Deep spectral Q-learning with application to mobile health (Q6548807) (← links)
- Evaluating Dynamic Conditional Quantile Treatment Effects with Applications in Ridesharing (Q6631669) (← links)