Modified Policy Iteration Algorithms for Discounted Markov Decision Problems
From MaRDI portal
Cited in
(33)- Truncated policy iteration methods
- Reward revision and the average reward Markov decision process
- A K-step look-ahead analysis of value iteration algorithms for Markov decision processes
- Abstraction and approximate decision-theoretic planning.
- Stochastic dynamic programming with factored representations
- Modified policy iteration algorithms are not strongly polynomial for discounted dynamic programming
- Generic rank-one corrections for value iteration in Markovian decision problems
- Dynamic programming and value-function approximation in sequential decision problems: error analysis and numerical results
- A note on policy algorithms for discounted Markov decision problems
- Applications of Markov chain approximation methods to optimal control problems in economics
- Multi-step heuristic dynamic programming for optimal control of nonlinear discrete-time systems
- Admission control in a two-class loss system with periodically varying parameters and abandonments
- Accelerated modified policy iteration algorithms for Markov decision processes
- Approximate dynamic programming for stochastic \(N\)-stage optimization with application to optimal consumption under uncertainty
- On integral generalized policy iteration for continuous-time linear quadratic regulations
- Learning classifier systems: a survey
- Complexity bounds for approximately solving discounted MDPs by value iterations
- Stability and monotone convergence of generalised policy iteration for discrete-time linear quadratic regulations
- Design and evaluation of norm-aware agents based on normative Markov decision processes
- Identification of optimal policies in Markov decision processes
- (Approximate) iterated successive approximations algorithm for sequential decision processes
- Improved iterative computation of the expected discounted return in Markov and semi-Markov chains
- Adaptive policy-iteration and policy-value-iteration for discounted Markov decision processes
- A method of bisection for discounted Markov decision problems
- A semi-Lagrangian algorithm in policy space for hybrid optimal control problems
- scientific article; zbMATH DE number 7626790 (Why is no real title available?)
- Dynamic control of a single-server system when jobs change status
- Markov decision processes
- Numerical Hopf-Lax formulae for Hamilton-Jacobi equations on unstructured geometries
- A primal-dual policy iteration algorithm for constrained Markov decision processes
- Deep reinforcement learning for approximate policy iteration: convergence analysis and a post-earthquake disaster response case study
- A survey of solution techniques for the partially observed Markov decision process
- Contingent planning under uncertainty via stochastic satisfiability
This page was built for publication: Modified Policy Iteration Algorithms for Discounted Markov Decision Problems
Report a bug (only for logged in users!)Click here to report a bug for this page (MaRDI item Q4173218)