Robust Control of Markov Decision Processes with Uncertain Transition Matrices
From MaRDI portal
Recommendations
- Robust control for nonlinear Markov jump systems with partially unknown transition probabilities
- Robust Markov control processes
- The optimal robust control policy for uncertain semi-Markov control processes
- Robust control for Markovian jump systems with partially known transition probabilities and nonlinearities
- Robust dynamics and control of a partially observed Markov chain
- Robust \(H_{\infty}\) control of Markovian jump systems with uncertain switching probabilities
- Robust Optimality for Discounted Infinite-Horizon Markov Decision Processes With Uncertain Transition Matrices
- A Convex Method of Robust Controller Design for Markovian Jump Systems with Uncertain Transition Rates
- Robust H₂ control for uncertain Markov jump linear systems with partly known transition rates
- RobustH2control of Markovian jump systems with uncertain switching probabilities
Cited in
(only showing first 100 items - show all)- Partially observable Markov decision processes with imprecise parameters
- Robustness inequality for Markov control processes with unbounded costs
- Ambiguous partially observable Markov decision processes: structural results and applications
- Robust optimal strategies in Markov decision problems
- Variance-constrained actor-critic algorithms for discounted and average reward MDPs
- A graph-theoretic-based method for analyzing conduction problems
- Robust topological policy iteration for infinite horizon bounded Markov decision processes
- Computation of weighted sums of rewards for concurrent MDPs
- Reinforcement learning with limited reinforcement: using Bayes risk for active learning in POMDPs
- Likelihood robust optimization for data-driven problems
- Robust response-guided dosing
- Minimax and risk averse multistage stochastic programming
- Coefficients of ergodicity for Markov chains with uncertain parameters
- Light robustness in the optimization of Markov decision processes with uncertain parameters
- Policy-based branch-and-bound for infinite-horizon multi-model Markov decision processes
- Tutorial on risk neutral, distributionally robust and risk averse multistage stochastic programming
- Time (in)consistency of multistage distributionally robust inventory models with moment constraints
- Asymptotic optimality of the generalized \(c\mu\) rule under model uncertainty
- Robust analysis of discounted Markov decision processes with uncertain transition probabilities
- Distributionally robust optimal control and MDP modeling
- Gittins' theorem under uncertainty
- Learning and planning in partially observable environments without prior domain knowledge
- Risk-averse policy optimization via risk-neutral policy optimization
- Distributionally robust modeling of optimal control
- Robust control of the multi-armed bandit problem
- Toward theoretical understandings of robust Markov decision processes: sample complexity and asymptotics
- Variable demand and multi-commodity flow in Markovian network equilibrium
- Lipschitzness is all you need to tame off-policy generative adversarial imitation learning
- Estimating permanent price impact via machine learning
- Detection-averse optimal and receding-horizon control for Markov decision processes
- Learning parametric policies and transition probability models of Markov decision processes from data
- Robust bounds and optimization at the large deviations scale for queueing models via Rényi divergence
- A survey of decision making and optimization under uncertainty
- A dynamic programming approach to adjustable robust optimization
- Algorithmic aspects of mean-variance optimization in Markov decision processes
- Dynamic programming for deterministic discrete-time systems with uncertain gain
- Reachability analysis of uncertain systems using bounded-parameter Markov decision processes
- Recursive robust estimation and control without commitment
- Partially observable Markov decision processes incorporating
- Poisoning finite-horizon Markov decision processes at design time
- Constrained Markov decision processes with uncertain costs
- Minimax Q-learning control for linear systems using the Wasserstein metric
- Robust optimization in countably infinite linear programs
- Robust control of partially observable failing systems
- Robust sensitivity analysis for stochastic systems
- Reinforcement learning in robust Markov decision processes
- Robust MDPs with k-rectangular uncertainty
- Distributionally robust Markov decision processes
- Uncertainty quantification for Markov chain models
- Robust decomposable Markov decision processes motivated by allocating school budgets
- Robust asset allocation with benchmarked objectives
- Sensitivity analysis in Markov decision processes with uncertain reward parameters
- Quantitative verification and strategy synthesis for stochastic games
- Robust dynamic pricing over infinite horizon in the presence of model uncertainty
- Tight approximations of dynamic risk measures
- Oracle-based robust optimization via online learning
- Optimal information blending with measurements in the \(L^{2}\) sphere
- IMPRECISE MARKOV CHAINS AND THEIR LIMIT BEHAVIOR
- Robust Markov control processes
- On robust multi-period pre-commitment and time-consistent mean-variance portfolio optimization
- Robust adversarial risk analysis: a level-k approach
- Robust adaptive routing under uncertainty
- Data uncertainty in Markov chains: application to cost-effectiveness analyses of medical innovations
- Robust analysis in stochastic simulation: computation and performance guarantees
- Robust Optimality for Discounted Infinite-Horizon Markov Decision Processes With Uncertain Transition Matrices
- A dynamic inventory rationing problem with uncertain demand and production rates
- Risk-averse learning by temporal difference methods with Markov risk measures
- Concurrent MDPs with Finite Markovian Policies
- Formulation and properties of a divergence used to compare probability measures without absolute continuity
- Probabilistic timed automata with one clock and initialised clock-dependent probabilities
- Scenario-based verification of uncertain MDPs
- Probabilistic timed automata with one clock and initialised clock-dependent probabilities
- scientific article; zbMATH DE number 7626725 (Why is no real title available?)
- scientific article; zbMATH DE number 7626790 (Why is no real title available?)
- Deterministic policies based on maximum regrets in MDPs with imprecise rewards
- Data-driven pricing for a new product
- Robust Markov Decision Processes with Data-Driven, Distance-Based Ambiguity Sets
- Quantile Markov Decision Processes
- Risk-Averse Stochastic Programming: Time Consistency and Optimal Stopping
- Robustness to incorrect system models in stochastic control
- Online first-order framework for robust convex optimization
- Technical note -- time inconsistency of optimal policies of distributionally robust inventory models
- Distributionally robust partially observable Markov decision process with moment-based ambiguity
- Policy iteration for robust nonstationary Markov decision processes
- Extended Laplace principle for empirical measures of a Markov chain
- Continuous-time robust dynamic programming
- Discrete approximation and quantification in distributionally robust optimization
- Quantifying distributional model risk via optimal transport
- Distributionally robust optimization for sequential decision-making
- Robust stability, ℋ2 analysis and stabilisation of discrete-time Markov jump linear systems with uncertain probability matrix
- Robust Dynamic Programming
- Rectangular sets of probability measures
- Robust Actuarial Risk Analysis
- Distributionally Robust Markov Decision Processes and Their Connection to Risk Measures
- Distributionally Robust Inventory Control When Demand Is a Martingale
- On the Complexity of Reachability in Parametric Markov Decision Processes
- Robust Control for Dynamical Systems with Non-Gaussian Noise via Formal Abstractions
- A survey of nonlinear robust optimization
- Z-relation-based multistage decision making
- Risk-aware controller for autonomous vehicles using model-based collision prediction and reinforcement learning
This page was built for publication: Robust Control of Markov Decision Processes with Uncertain Transition Matrices
Report a bug (only for logged in users!)Click here to report a bug for this page (MaRDI item Q5322137)