Bayesian policy gradient and actor-critic algorithms
From MaRDI portal
Recommendations
- Bayesian reinforcement learning: a survey
- Bayesian Reinforcement Learning with Exploration
- Expected policy gradients for reinforcement learning
- A Bayesian reinforcement learning approach in Markov games for computing near-optimal policies
- Variational actor-critic algorithms,
- Bayesian exploration for approximate dynamic programming
- Actor-Critic--Type Learning Algorithms for Markov Decision Processes
- Bayesian optimization for policy search via online-offline experimentation
Cited in
(10)- Natural actor-critic algorithms
- Reinforcement learning, sequential Monte Carlo and the EM algorithm
- Bayesian policy reuse
- Using trajectory data to improve Bayesian optimization for reinforcement learning
- Bayesian Reinforcement Learning with Exploration
- Variance reduction techniques for gradient estimates in reinforcement learning
- Expected policy gradients for reinforcement learning
- Hessian matrix distribution for Bayesian policy gradient reinforcement learning
- Policy Gradient Importance Sampling for Bayesian Inference
- Decentralized fused-learner architectures for Bayesian reinforcement learning
This page was built for publication: Bayesian policy gradient and actor-critic algorithms
Report a bug (only for logged in users!)Click here to report a bug for this page (MaRDI item Q2810874)