Efficient Off-Policy Q-Learning for Data-Based Discrete-Time LQR Problems
From MaRDI portal
Cited in
(7)- Incremental reinforcement learning and optimal output regulation under unmeasurable disturbances
- Robust data-driven predictive control for unknown linear time-invariant systems
- Data-enabled iterative learning control: a zero-sum game design for time-scale-varying tasks
- Optimal data injection attack design for spacecraft systems via a model free Q-learning approach
- Data-driven robust linear quadratic regulator: a minimax design using reinforcement learning
- Scaling policy iteration based reinforcement learning for unknown discrete-time linear systems
- Stability-certified on-policy data-driven LQR via recursive learning and policy gradient
This page was built for publication: Efficient Off-Policy Q-Learning for Data-Based Discrete-Time LQR Problems
Report a bug (only for logged in users!)Click here to report a bug for this page (MaRDI item Q6056052)