Percentile performance criteria for limiting average Markov decision processes
From MaRDI portal
(Redirected from Publication:4763758)
Recommendations
- Percentile queries in multi-dimensional Markov decision processes
- Percentile queries in multi-dimensional Markov decision processes
- Percentile Optimization for Markov Decision Processes with Parameter Uncertainty
- Target-level criterion in Markov decision processes
- Markov decision processes associated with two threshold probability criteria
Cited in
(24)- Optimization models for the first arrival target distribution function in discrete time
- Minimizing risk models in Markov decision processes with policies depending on target values
- Optimal threshold probability in undiscounted Markov decision processes with a target set.
- Variance-constrained actor-critic algorithms for discounted and average reward MDPs
- Stochastic optimization of forward recursive functions
- Optimal policy for minimizing risk models in Markov decision processes
- Value iteration methods in risk minimizing stopping problems
- Efficient algorithms for risk-sensitive Markov decision processes with limited budget
- Time consistent dynamic risk measures
- STRONG AVERAGE OPTIMALITY FOR CONTROLLED NONHOMOGENEOUS MARKOV CHAINS*
- Profit criteria involving risk in price setting of virtual products
- Percentile Optimization for Markov Decision Processes with Parameter Uncertainty
- Risk-constrained reinforcement learning with percentile risk criteria
- Quantile Markov Decision Processes
- Risk-Sensitive Reinforcement Learning via Policy Gradient Search
- Variance-penalized Markov decision processes: dynamic programming and reinforcement learning techniques
- Meet your expectations with guarantees: beyond worst-case synthesis in quantitative games
- Percentile queries in multi-dimensional Markov decision processes
- Percentile queries in multi-dimensional Markov decision processes
- Inventory models with minimal service level constraints
- Threshold probability of non-terminal type in finite horizon Markov decision processes
- Stochastic games with lexicographic objectives
- Stochastic games with disjunctions of multiple objectives
- Bayesian safe policy learning with chance constrained optimization: application to military security assessment during the Vietnam War
This page was built for publication: Percentile performance criteria for limiting average Markov decision processes
Report a bug (only for logged in users!)Click here to report a bug for this page (MaRDI item Q4763758)