Policy gradient in continuous time (Q3093369)

From MaRDI portal

!

This is the item page for this Wikibase entity, intended for internal use and editing purposes. Please use the normal view instead:

scientific article; zbMATH DE number 5957346
Language Label Description Also known as
default for all languages
No label defined
    English
    Policy gradient in continuous time
    scientific article; zbMATH DE number 5957346

      Statements

      0 references
      12 October 2011
      0 references
      optimal control
      0 references
      reinforcement learning
      0 references
      policy search
      0 references
      sensitivity analysis
      0 references
      parametric optimization
      0 references
      gradient estimate
      0 references
      likelihood ratio method
      0 references
      pathwise derivation
      0 references

      Identifiers

      0 references
      0 references
      0 references
      0 references