On iterative optimization ol structured Markov decision processes with discounted rewards (Q3221982)
From MaRDI portal
!
This is the item page for this Wikibase entity, intended for internal use and editing purposes. Please use the normal view instead:
scientific article; zbMATH DE number 3887467
| Language | Label | Description | Also known as |
|---|---|---|---|
| default for all languages | No label defined |
||
| English | On iterative optimization ol structured Markov decision processes with discounted rewards |
scientific article; zbMATH DE number 3887467 |
Statements
On iterative optimization ol structured Markov decision processes with discounted rewards (English)
0 references
1984
0 references
survey on solution techniques
0 references
total reward criterion
0 references
optimal policy
0 references
iterative methods
0 references
test problems
0 references
successive approximation
0 references
0.8047061562538147
0 references
0.8040645122528076
0 references
0.8040645122528076
0 references
0.8000003695487976
0 references
0.7921659350395203
0 references