Normalized Markov Decision Chains. II: Optimality of Nonstationary Policies
From MaRDI portal
Cited in
(4)- Transient policies in discrete dynamic programming: Linear programming including suboptimality tests and additional constraints
- scientific article; zbMATH DE number 3711784 (Why is no real title available?)
- Stability and convergence in discrete convex monotone dynamical systems
- Generalized eigenvectors and sets of nonnegative matrices
This page was built for publication: Normalized Markov Decision Chains. II: Optimality of Nonstationary Policies
Report a bug (only for logged in users!)Click here to report a bug for this page (MaRDI item Q4145454)