Adaptive Q-learning
From MaRDI portal
Recommendations
Cited in
(11)- High-dimensional inference for personalized treatment decision
- Adaptive-resolution reinforcement learning with polynomial exploration in deterministic domains
- Self-adapting WIP parameter setting using deep reinforcement learning
- Prospect-theoretic Q-learning
- Optimal learning with \textit{Q}-aggregation
- Addressing environment non-stationarity by repeating Q-learning updates
- Penalized Q-learning for dynamic treatment regimens
- scientific article; zbMATH DE number 5957196 (Why is no real title available?)
- Robust Q-learning
- Estimating individualized treatment rules with risk constraint
- Estimating the optimal individualized treatment regime based on semiparametric model with Bernstein polynomials
This page was built for publication: Adaptive Q-learning
Report a bug (only for logged in users!)Click here to report a bug for this page (MaRDI item Q5499684)