Adaptive Q-learning
From MaRDI portal
Recommendations
Cited in
(11)- High-dimensional inference for personalized treatment decision
- Optimal learning with \textit{Q}-aggregation
- Adaptive-resolution reinforcement learning with polynomial exploration in deterministic domains
- scientific article; zbMATH DE number 5957196 (Why is no real title available?)
- Self-adapting WIP parameter setting using deep reinforcement learning
- Penalized Q-learning for dynamic treatment regimens
- Estimating the optimal individualized treatment regime based on semiparametric model with Bernstein polynomials
- Estimating individualized treatment rules with risk constraint
- Addressing environment non-stationarity by repeating Q-learning updates
- Prospect-theoretic Q-learning
- Robust Q-learning
This page was built for publication: Adaptive Q-learning
Report a bug (only for logged in users!)Click here to report a bug for this page (MaRDI item Q5499684)