Finite state multi-armed bandit problems: Sensitive-discount, average-reward and average-overtaking optimality (Q2564701)
From MaRDI portal
!
This is the item page for this Wikibase entity, intended for internal use and editing purposes. Please use the normal view instead:
scientific article; zbMATH DE number 967066
| Language | Label | Description | Also known as |
|---|---|---|---|
| default for all languages | No label defined |
||
| English | Finite state multi-armed bandit problems: Sensitive-discount, average-reward and average-overtaking optimality |
scientific article; zbMATH DE number 967066 |
Statements
Finite state multi-armed bandit problems: Sensitive-discount, average-reward and average-overtaking optimality (English)
0 references
15 January 1997
0 references
Gittins indices
0 references
multi-armed bandit problems
0 references
Laurent expansions
0 references
0 references
0 references
0.8536596298217773
0 references
0.8466542959213257
0 references
0.8305884599685669
0 references
0.8280773758888245
0 references