Distributional Off-Policy Evaluation with Deep Quantile Process Regression
From MaRDI portal
Cites work
- \(\ell_1\)-penalized quantile regression in high-dimensional sparse models
- A Bayesian decision framework for optimizing sequential combination antiretroviral therapy in people with HIV
- Deep neural networks for estimation and inference
- Distributed inference for quantile regression processes
- Distributional Reinforcement Learning
- Estimation and inference in distributional reinforcement learning
- Evaluation of viable dynamic treatment regimes in a sequentially randomized trial of advanced prostate cancer
- Finite-time bounds for fitted value iteration
- Learning near-optimal policies with Bellman-residual minimization based fitted policy iteration and a single sample path
- Nonparametric regression using deep neural networks with ReLU activation function
- Off-policy estimation of long-term average outcomes with applications to mobile health
- Optimal global rates of convergence for nonparametric regression
- Proper inference for value function in high-dimensional Q-learning for dynamic treatment regimes
This page was built for publication: Distributional Off-Policy Evaluation with Deep Quantile Process Regression
Report a bug (only for logged in users!)Click here to report a bug for this page (MaRDI item Q7320014)