Efficiently Breaking the Curse of Horizon in Off-Policy Evaluation with Double Reinforcement Learning (Q5060503)
From MaRDI portal
!
This is the item page for this Wikibase entity, intended for internal use and editing purposes. Please use the normal view instead:
scientific article; zbMATH DE number 7640294
| Language | Label | Description | Also known as |
|---|---|---|---|
| default for all languages | No label defined |
||
| English | Efficiently Breaking the Curse of Horizon in Off-Policy Evaluation with Double Reinforcement Learning |
scientific article; zbMATH DE number 7640294 |
Statements
Efficiently Breaking the Curse of Horizon in Off-Policy Evaluation with Double Reinforcement Learning (English)
0 references
10 January 2023
0 references
off-policy evaluation
0 references
Markov decision processes
0 references
infinite horizon
0 references
semiparametric efficiency
0 references
0 references
0 references
0.9079443
0 references
0.8322847
0 references
0.8161474
0 references
0.8119268
0 references
0.8104725
0 references
0.8005555
0 references