Policy-based primal-dual methods for concave CMDP with variance reduction
From MaRDI portal
Cites work
- A General Safety Framework for Learning-Based Control in Uncertain Robotic Systems
- Achieving zero constraint violation for concave utility constrained reinforcement learning via primal-dual approach
- An actor-critic algorithm for constrained Markov decision processes
- Faster algorithm and sharper analysis for constrained Markov decision process
- scientific article; zbMATH DE number 1348599 (Why is no real title available?)
- scientific article; zbMATH DE number 2107836 (Why is no real title available?)
- On the theory of policy gradient methods: optimality, approximation, and distribution shift
- Randomized linear programming solves the Markov decision problem in nearly linear (sometimes sublinear) time
- Risk-constrained reinforcement learning with percentile risk criteria
- Safety-aware apprenticeship learning
This page was built for publication: Policy-based primal-dual methods for concave CMDP with variance reduction
Report a bug (only for logged in users!)Click here to report a bug for this page (MaRDI item Q6912804)