Off-policy evaluation for tabular reinforcement learning with synthetic trajectories (Q6190662)
From MaRDI portal
scientific article; zbMATH DE number 7800677
| Language | Label | Description | Also known as |
|---|---|---|---|
| English | Off-policy evaluation for tabular reinforcement learning with synthetic trajectories |
scientific article; zbMATH DE number 7800677 |
Statements
Off-policy evaluation for tabular reinforcement learning with synthetic trajectories (English)
0 references
6 February 2024
0 references
reinforcement learning
0 references
off-policy evaluation
0 references
synthetic trajectories
0 references
importance sampling
0 references
Markov decision process
0 references