Constrained Markov Decision Models with Weighted Discounted Rewards
From MaRDI portal
Recommendations
- Constrained Discounted Dynamic Programming
- Markov Decision Models with Weighted Discounted Criteria
- Discounted Cost Markov Decision Processes with a Constraint
- Constrained Undiscounted Stochastic Dynamic Programming
- Constrained dynamic programming with two discount factors: applications and an algorithm
Cited in
(27)- Transfer in variable-reward hierarchical reinforcement learning
- Multiple solutions under quasi-exponential discounting
- Resource-constrained management of heterogeneous assets with stochastic deterioration
- Constrained Markovian decision processes: The dynamic programming approach
- Computation of weighted sums of rewards for concurrent MDPs
- Average-discounted equilibria in stochastic games
- Nonatomic total rewards Markov decision processes with multiple criteria
- Markov-achievable payoffs for finite-horizon decision models.
- Time consistent Markov policies in dynamic economies with quasi-hyperbolic consumers
- Constrained discounted Markov decision processes with Borel state spaces
- Markov control processes with randomized discounted cost
- Non-randomized policies for constrained Markov decision processes
- Discounted Markov decision processes with utility constraints
- Selecting malaria interventions: a top-down approach
- Constrained Discounted Markov Decision Chains
- Constrained Undiscounted Stochastic Dynamic Programming
- scientific article; zbMATH DE number 176107 (Why is no real title available?)
- Discounted Cost Markov Decision Processes with a Constraint
- Markov Decision Models with Weighted Discounted Criteria
- Constrained Discounted Dynamic Programming
- scientific article; zbMATH DE number 1465681 (Why is no real title available?)
- Constrained dynamic programming with two discount factors: applications and an algorithm
- Learning algorithms for discounted MDPs with constraints
- Discounted continuous-time constrained Markov decision processes in Polish spaces
- A policy iteration heuristic for constrained discounted controlled Markov chains
- Markov control models with unknown random state-action-dependent discount factors
- Sensitivity analysis and optimal ultimately stationary deterministic policies in some constrained discounted cost models
This page was built for publication: Constrained Markov Decision Models with Weighted Discounted Rewards
Report a bug (only for logged in users!)Click here to report a bug for this page (MaRDI item Q4848417)