Client selection for federated policy optimization with environment heterogeneity
From MaRDI portal
Cites work
- An analysis of model-based interval estimation for Markov decision processes
- Approximate policy iteration: a survey and some new methods
- Expected policy gradients for reinforcement learning
- Federated Offline Reinforcement Learning
- scientific article; zbMATH DE number 1321699 (Why is no real title available?)
- scientific article; zbMATH DE number 7657248 (Why is no real title available?)
- Learning and planning for time-varying MDPs using maximum likelihood estimation
- Model-based Reinforcement Learning: A Survey
- Multi-agent reinforcement learning: a selective overview of theories and algorithms
- Reinforcement learning in finite MDPs: PAC analysis
- Reinforcement learning. An introduction
- Safe policy iteration: a monotonically improving approximate policy iteration approach
This page was built for publication: Client selection for federated policy optimization with environment heterogeneity
Report a bug (only for logged in users!)Click here to report a bug for this page (MaRDI item Q7308396)