Fisher-Rao gradient flows of linear programs and state-action natural policy gradients
From MaRDI portal
Cites work
- Algebraic foundation of mathematical statistics2
- Approximate Newton Policy Gradient Algorithms
- Asymptotic analysis of the exponential penalty trajectory in linear programming
- Computational optimal transport. With applications to data sciences
- Convergence of entropy-regularized natural policy gradient with linear function approximation
- Fast global convergence of natural policy gradient methods with entropy regularization
- Finding the Maximizers of the Information Divergence From an Exponential Family
- Finite state Markovian decision processes
- Geometry and convergence of natural policy gradient methods
- Global optimality guarantees for policy gradient methods
- Hessian informed mirror descent
- Hessian Riemannian Gradient Flows in Convex Programming
- scientific article; zbMATH DE number 2107836 (Why is no real title available?)
- scientific article; zbMATH DE number 3106666 (Why is no real title available?)
- Information geometry
- Information geometry and its applications
- Invariance properties of the natural gradient in overparametrised systems
- On linear and super-linear convergence of natural policy gradient algorithm
- On linear convergence of non-Euclidean gradient methods without strong convexity and Lipschitz gradient continuity
- On the Fisher metric of conditional probability polytopes
- On the theory of policy gradient methods: optimality, approximation, and distribution shift
- Ordinary differential equations and dynamical systems
- Policy Mirror Descent for Regularized Reinforcement Learning: A Generalized Framework with Linear Convergence
- Policy mirror descent for reinforcement learning: linear convergence, new sampling complexity, and generalized problem classes
- Relatively smooth convex optimization by first-order methods, and applications
- Survey of linear programming for standard and nonstandard Markovian control problems. Part I: Theory
- Toric geometry of entropic regularization
Cited in
(1)
This page was built for publication: Fisher-Rao gradient flows of linear programs and state-action natural policy gradients
Report a bug (only for logged in users!)Click here to report a bug for this page (MaRDI item Q6974653)