On Stationary Strategies in Borel Dynamic Programming
From MaRDI portal
Recommendations
- Stationary policies and Markov policies in Borel dynamic programming
- The existence of good Markov strategies for decision processes with general payoffs
- scientific article; zbMATH DE number 3922401
- On Stationary Strategies in Countable State Total Reward Markov Decision Processes
- scientific article; zbMATH DE number 4014480
Cited in
(8)- Stationary policies and Markov policies in Borel dynamic programming
- The existence of good Markov strategies for decision processes with general payoffs
- Finite-stage reward functions having the Markov adequacy property
- Semi-infinite Markov decision processes
- MDPs with setwise continuous transition probabilities
- Stationary Recursive Utility and Dynamic Programming under the Assumption of Biconvergence
- Q-learning and policy iteration algorithms for stochastic shortest path problems
- Sufficiency of deterministic policies for atomless discounted and uniformly absorbing MDPs with multiple criteria
This page was built for publication: On Stationary Strategies in Borel Dynamic Programming
Report a bug (only for logged in users!)Click here to report a bug for this page (MaRDI item Q4016700)