Bounding the difference between the values of robust and non-robust Markov decision problems
From MaRDI portal
Cites work
- A concept of copula robustness and its applications in quantitative risk management
- A stability result for linear Markovian stochastic optimization problems
- A Survey of Applications of Markov Decision Processes
- Distributionally Robust Convex Optimization
- Distributionally robust Markov decision processes
- Distributionally Robust Markov Decision Processes and Their Connection to Risk Measures
- Distributionally robust optimization for sequential decision-making
- Double reinforcement learning for efficient off-policy evaluation in Markov decision processes
- How Does the Value Function of a Markov Decision Process Depend on the Transition Probabilities?
- scientific article; zbMATH DE number 4154239 (Why is no real title available?)
- Markov decision processes under model uncertainty
- Markov decision processes with applications to finance.
- Q-learning for distributionally robust Markov decision processes
- Reinforcement learning. An introduction
- Robust Q-learning algorithm for Markov decision processes under Wasserstein uncertainty
- Robust Control of Markov Decision Processes with Uncertain Transition Matrices
- Robust Markov Decision Processes
- Robust MDPs with k-rectangular uncertainty
- Robust optimal control using conditional risk mappings in infinite horizon
- Toward theoretical understandings of robust Markov decision processes: sample complexity and asymptotics
This page was built for publication: Bounding the difference between the values of robust and non-robust Markov decision problems
Report a bug (only for logged in users!)Click here to report a bug for this page (MaRDI item Q6879255)