General value function networks
From MaRDI portal
Recommendations
- Recurrent policy gradients
- scientific article; zbMATH DE number 1843097
- Totally model-free actor-critic recurrent neural-network reinforcement learning in non-Markovian domains
- Task-aware verifiable RNN-based policies for partially observable Markov decision processes
- Efficient reinforcement learning in deterministic systems with value function generalization
Cites work
- A spectral algorithm for learning hidden Markov models
- scientific article; zbMATH DE number 786738 (Why is no real title available?)
- Neural networks and physical systems with emergent collective computational abilities
- Planning and acting in partially observable stochastic domains
- Statistical Inference for Probabilistic Functions of Finite State Markov Chains
This page was built for publication: General value function networks
Report a bug (only for logged in users!)Click here to report a bug for this page (MaRDI item Q5856468)