Model-free average reward multi-step reinforcement learning
From MaRDI portal
Recommendations
- scientific article; zbMATH DE number 1501821
- Model-based average reward reinforcement learning
- Average reward reinforcement learning: foundations, algorithms, and empirical results
- On average versus discounted reward temporal-difference learning
- Reinforcement learning based algorithms for average cost Markov decision processes
Cited in
(10)- Model-based average reward reinforcement learning
- A reinforcement learning algorithm based on policy iteration for average reward: Empirical results with yield management and convergence analysis
- R() imitation learning for automatic generation control of interconnected power grids
- scientific article; zbMATH DE number 1501821 (Why is no real title available?)
- scientific article; zbMATH DE number 1929166 (Why is no real title available?)
- scientific article; zbMATH DE number 7306889 (Why is no real title available?)
- Epoch-incremental reinforcement learning algorithms
- Integrating a partial model into model free reinforcement learning
- Average reward reinforcement learning: foundations, algorithms, and empirical results
- Faithful and Effective Reward Schemes for Model-Free Reinforcement Learning of Omega-Regular Objectives
This page was built for publication: Model-free average reward multi-step reinforcement learning
Report a bug (only for logged in users!)Click here to report a bug for this page (MaRDI item Q2704478)