Policy Evaluation in Continuous MDPs With Efficient Kernelized Gradient Temporal Difference

From MaRDI portal















This page was built for publication: Policy Evaluation in Continuous MDPs With Efficient Kernelized Gradient Temporal Difference

Report a bug (only for logged in users!)Click here to report a bug for this page (MaRDI item Q4990298)