Distributed policy gradient with variance reduction in multi-agent reinforcement learning
From MaRDI portal
Cites work
- 10.1162/1532443041827880
- An Improved Convergence Analysis for Decentralized Online Stochastic Non-Convex Optimization
- Distributed gradient tracking methods with finite data rates
- Distributed heterogeneous multi-agent optimization with stochastic sub-gradient
- Distributed Policy Evaluation Under Multiple Behavior Strategies
- Distributed stochastic gradient tracking methods
- DSA: decentralized double stochastic averaging gradient algorithm
- EXTRA: an exact first-order algorithm for decentralized consensus optimization
- Fixed-time cluster consensus for multi-agent systems with objective optimization on directed networks
- Harnessing Smoothness to Accelerate Distributed Optimization
- scientific article; zbMATH DE number 1753152 (Why is no real title available?)
- Minimizing finite sums with the stochastic average gradient
- Multi-agent reinforcement learning: a selective overview of theories and algorithms
- Multiagent Fully Decentralized Value Function Learning With Linear Convergence Rates
- Natural actor-critic algorithms
- Reinforcement learning. An introduction
- Simple statistical gradient-following algorithms for connectionist reinforcement learning
- Variance-Reduced Decentralized Stochastic Optimization With Accelerated Convergence
- Variance-Reduced Stochastic Learning by Networked Agents Under Random Reshuffling
This page was built for publication: Distributed policy gradient with variance reduction in multi-agent reinforcement learning
Report a bug (only for logged in users!)Click here to report a bug for this page (MaRDI item Q6865863)