On Solving Finite State Multi-Armed Bandit Problem by Linear Programming
From MaRDI portal
Recommendations
- Linear Programming for Finite State Multi-Armed Bandit Problems
- Finite-time analysis of the multiarmed bandit problem
- Finite state multi-armed bandit problems: Sensitive-discount, average-reward and average-overtaking optimality
- Linearly parameterized bandits
- The Multi-Armed Bandit Problem: Decomposition and Computation
- A Structured Multiarmed Bandit Problem and the Greedy Policy
- Finite linear programming approximations of constrained discounted Markov decision processes
- The multi-armed bandit problem: an efficient nonparametric solution
- The Nonstochastic Multiarmed Bandit Problem
Cites work
This page was built for publication: On Solving Finite State Multi-Armed Bandit Problem by Linear Programming
Report a bug (only for logged in users!)Click here to report a bug for this page (MaRDI item Q3360683)