Policy Bounds for Markov Decision Processes
From MaRDI portal
Recommendations
- scientific article; zbMATH DE number 3871063
- Approximation of Markov decision processes with general state space
- Approximating Markov decision processes using expected state transitions
- Suboptimal policy determination for large-scale Markov decision processes. I: Description and bounds
- Approximation of infinite horizon discounted cost Markov decision processes
Cited in
(15)- Approximating Markov decision processes using expected state transitions
- Piecewise affine approximations for the control of a one-reservoir hydroelectric system
- Bounds for the quality and the number of steps in Bellman's value iteration algorithm
- Bounded-parameter Markov decision processes
- Bubble-free policy feedback rules
- PAC Bounds for Discounted MDPs
- scientific article; zbMATH DE number 3961380 (Why is no real title available?)
- Markov Teams ? An analytical approach to process migration in distributed computing systems
- An Approximation of a Markov Decision Process for Resource Planning
- Bounding reward measures of Markov models using the Markov decision processes.
- Easy affine Markov decision processes
- Policy iteration for robust nonstationary Markov decision processes
- Manufacturing lead-time rules: customer retention versus tardiness costs
- Suboptimal policy determination for large-scale Markov decision processes. I: Description and bounds
- Separable value functions for infinite horizon average reward Markov decision processes
This page was built for publication: Policy Bounds for Markov Decision Processes
Report a bug (only for logged in users!)Click here to report a bug for this page (MaRDI item Q3770309)