Off-policy based adaptive dynamic programming method for nonzero-sum games on discrete-time system
From MaRDI portal
Publication:2198700
Recommendations
- Adaptive dynamic programming for an online solution of a zero-sum differential game
- Optimal tracking control for non-zero-sum games of linear discrete-time systems via off-policy reinforcement learning
- An iterative adaptive dynamic programming method for solving a class of nonlinear zero-sum differential games
- Output feedback adaptive dynamic programming for linear differential zero-sum games
- Off‐policy integral reinforcement learning‐based optimal tracking control for a class of nonzero‐sum game systems with unknown dynamics
- Stackelberg games for model-free continuous-time stochastic systems based on adaptive dynamic programming
- Data-driven adaptive dynamic programming for partially observable nonzero-sum games via \(Q\)-learning method
- scientific article; zbMATH DE number 4003938
- scientific article; zbMATH DE number 4045510
- A policy iteration algorithm for nonzero-sum stochastic impulse games
Cites work
- \(\mathrm{H}_\infty\) control of linear discrete-time systems: off-policy reinforcement learning
- 10.1162/1532443041827880
- A computational method for solving optimal control and parameter estimation of linear systems using Haar wavelets
- A mixed 0-1 linear programming approach to the computation of all pure-strategy Nash equilibria of a finite \(n\)-person game in normal form
- Actuator and sensor faults estimation based on proportional integral observer for TS fuzzy model
- An iterative adaptive dynamic programming method for solving a class of nonlinear zero-sum differential games
- Computational adaptive optimal control for continuous-time linear systems with completely unknown dynamics
- Computationally efficient simultaneous policy update algorithm for nonlinear \(H_{\infty }\) state feedback control with Galerkin's method
- Data-based approximate policy iteration for affine nonlinear continuous-time optimal control design
- Galerkin approximations of the generalized Hamilton-Jacobi-Bellman equation
- General value iteration based single network approach for constrained optimal controller design of partially-unknown continuous-time nonlinear systems
- Haar wavelet-based approach for optimal control of second-order linear systems in time domain
- scientific article; zbMATH DE number 1243371 (Why is no real title available?)
- Multi-player non-zero-sum games: online adaptive learning solution of coupled Hamilton-Jacobi equations
- Nearly optimal control laws for nonlinear systems with saturating actuators using a neural network HJB approach
- Observer based adaptive dynamic programming for fault tolerant control of a class of nonlinear systems
- Optimal control
- Reinforcement learning solution for HJB equation arising in constrained optimal control problem
Cited in
(10)- Off-policy Q-learning: solving Nash equilibrium of multi-player games with network-induced delay and unmeasured state
- A policy iteration algorithm for nonzero-sum games with unknown models
- Optimal tracking control for non-zero-sum games of linear discrete-time systems via off-policy reinforcement learning
- Data-driven adaptive dynamic programming for partially observable nonzero-sum games via \(Q\)-learning method
- Off‐policy integral reinforcement learning‐based optimal tracking control for a class of nonzero‐sum game systems with unknown dynamics
- Model-free finite-horizon optimal control of discrete-time two-player zero-sum games
- Zero-sum game-based optimal control for discrete-time Markov jump systems: a parallel off-policy Q-learning method
- Model-free policy iteration approach to NCE-based strategy design for linear quadratic Gaussian games
- Event‐triggered neural experience replay learning for nonzero‐sum tracking games of unknown continuous‐time nonlinear systems
- Robust hierarchical games of linear discrete-time systems based on off-policy model-free reinforcement learning
This page was built for publication: Off-policy based adaptive dynamic programming method for nonzero-sum games on discrete-time system
Report a bug (only for logged in users!)Click here to report a bug for this page (MaRDI item Q2198700)