Towards min max generalization in reinforcement learning
From MaRDI portal
Recommendations
- Min max generalization for deterministic batch mode reinforcement learning: relaxation schemes
- Reinforcement learning in robust Markov decision processes
- Efficient reinforcement learning in deterministic systems with value function generalization
- Bayesian Reinforcement Learning with Exploration
- A generalization error for Q-learning
Cites work
- 10.1162/1532443041827907
- Bias and variance approximation in value function estimates
- Computational geometry. Algorithms and applications.
- Error bounds for convolutional codes and an asymptotically optimum decoding algorithm
- scientific article; zbMATH DE number 5957269 (Why is no real title available?)
- scientific article; zbMATH DE number 1321699 (Why is no real title available?)
- scientific article; zbMATH DE number 1342066 (Why is no real title available?)
- scientific article; zbMATH DE number 1022658 (Why is no real title available?)
- Kernel-based reinforcement learning
- Optimal Dynamic Treatment Regimes
- Percentile Optimization for Markov Decision Processes with Parameter Uncertainty
- Performance guarantees for individualized treatment rules
- Towards min max generalization in reinforcement learning
- Value function based reinforcement learning in changing Markovian environments
Cited in
(6)- Algebraic results and bottom-up algorithm for policies generalization in reinforcement learning using concept lattices
- Min max generalization for deterministic batch mode reinforcement learning: relaxation schemes
- Towards min max generalization in reinforcement learning
- Batch mode reinforcement learning based on the synthesis of artificial trajectories
- Efficient reinforcement learning in deterministic systems with value function generalization
- A Survey of Zero-shot Generalisation in Deep Reinforcement Learning
This page was built for publication: Towards min max generalization in reinforcement learning
Report a bug (only for logged in users!)Click here to report a bug for this page (MaRDI item Q3006026)