Heterogeneous multi-player imitation learning
From MaRDI portal
Cites work
- scientific article; zbMATH DE number 706270 (Why is no real title available?)
- scientific article; zbMATH DE number 6132668 (Why is no real title available?)
- Adaptive optimal control for continuous-time linear systems based on policy iteration
- Computational adaptive optimal control for continuous-time linear systems with completely unknown dynamics
- Convergence of a numerical algorithm for calculating optimal output feedback gains
- Discrete-time inverse optimal control for nonlinear systems
- Inverse reinforcement learning for identification of linear-quadratic zero-sum differential games
- Inverse reinforcement learning for multi-player noncooperative apprentice games
- Nonlinear dynamical systems and control. A Lyapunov-based approach
- Off-policy Q-learning: solving Nash equilibrium of multi-player games with network-induced delay and unmeasured state
- Online inverse reinforcement learning for nonlinear systems with adversarial attacks
- Optimal control
- Robust optimal tracking control for multiplayer systems by off‐policy Q‐learning approach
Cited in
(2)
This page was built for publication: Heterogeneous multi-player imitation learning
Report a bug (only for logged in users!)Click here to report a bug for this page (MaRDI item Q6061914)