Reinforcement \(Q\)-learning for optimal tracking control of linear discrete-time systems with unknown dynamics

From MaRDI portal
(Redirected from Publication:463893)