A primal-dual policy iteration algorithm for constrained Markov decision processes
From MaRDI portal
Cites work
- A decomposition algorithm for limiting average Markov decision problems.
- An actor-critic algorithm for constrained Markov decision processes
- An exact and efficient algorithm for the constrained dynamic operator staffing problem for call centers
- An online actor-critic algorithm with function approximation for constrained Markov decision processes
- Complexity of linear programming
- Constrained Markov decision processes with total cost criteria: Lagrangian approach and dual linear program
- Constrained Markov decision processes with uncertain costs
- Decomposable Markov decision processes: A fluid optimization approach
- Decomposition of systems governed by Markov chains
- Dynamic programming in constrained Markov decision processes
- Efficient Algorithms for Budget-Constrained Markov Decision Processes
- Fair Dynamic Routing in Large-Scale Heterogeneous-Server Systems
- Faster algorithm and sharper analysis for constrained Markov decision process
- Finite linear programming approximations of constrained discounted Markov decision processes
- Finite-State Approximations to Discounted and Average Cost Constrained Markov Decision Processes
- scientific article; zbMATH DE number 3128787 (Why is no real title available?)
- scientific article; zbMATH DE number 3148886 (Why is no real title available?)
- scientific article; zbMATH DE number 1348599 (Why is no real title available?)
- scientific article; zbMATH DE number 814820 (Why is no real title available?)
- Integer Programming
- Introduction to stochastic programming.
- Linear programming and sequential decisions
- MIMO Transmission Control in Fading Channels—A Constrained Markov Decision Process Formulation With Monotone Randomized Policies
- Modified Policy Iteration Algorithms for Discounted Markov Decision Problems
- Multichain Markov Decision Processes with a Sample Path Constraint: A Decomposition Approach
- Natural actor-critic algorithms
- Optimal M-switch surveillance policies for liver cancer in a hepatitis C-infected population
- Optimal policies for controlled Markov chains with a constraint
- OR forum: A POMDP approach to personalize mammography screening decisions
- Partially observed Markov decision processes. From filtering to controlled sensing
- Simplex algorithm for countable-state discounted Markov decision processes
- Stochastic approximations of constrained discounted Markov decision processes
- The Linear Programming Approach to Approximate Dynamic Programming
This page was built for publication: A primal-dual policy iteration algorithm for constrained Markov decision processes
Report a bug (only for logged in users!)Click here to report a bug for this page (MaRDI item Q6865592)