A payoff-based policy gradient method in stochastic games with long-run average payoffs

From MaRDI portal














This page was built for publication: A payoff-based policy gradient method in stochastic games with long-run average payoffs

Report a bug (only for logged in users!)Click here to report a bug for this page (MaRDI item Q6897257)