Rate of Convergence of Empirical Measures and Costs in Controlled Markov Chains and Transient Optimality
From MaRDI portal
(Redirected from Publication:4698108)
Recommendations
- Empirical convergence rates for continuous-time Markov chains
- Convergence of the optimal values of constrained Markov control processes
- Convergence rates of Markov chain approximation methods for controlled diffusions with stopping
- A note on the convergence rate of the value iteration scheme in controlled Markov chains
- Constrained Markov control processes with randomized discounted cost criteria: occupation measures and extremal points
- Occupation measures for controlled Markov processes: Characterization and optimality
Cited in
(5)- Fast convergence to state-action frequency polytopes for MDPs
- How fast do equilibrium payoff sets converge in repeated games?
- Simulation-based optimization of Markov decision processes: an empirical process theory approach
- Risk sensitive control and large deviations for denumerable Markov decision processes
- Large deviations and optimal control for Markov decision processes
This page was built for publication: Rate of Convergence of Empirical Measures and Costs in Controlled Markov Chains and Transient Optimality
Report a bug (only for logged in users!)Click here to report a bug for this page (MaRDI item Q4698108)