• Produktbild: Reinforcement Learning and Dynamic Programming Using Function Approximators
  • Produktbild: Reinforcement Learning and Dynamic Programming Using Function Approximators

Reinforcement Learning and Dynamic Programming Using Function Approximators Approximator

187,99 €

inkl. gesetzl. MwSt., Versandkostenfrei


Beschreibung

Produktdetails

Einband

Gebundene Ausgabe

Erscheinungsdatum

29.04.2010

Abbildungen

schwarz-weiss Illustrationen, Tabellen, schwarz-weiss

Verlag

Taylor & Francis

Seitenzahl

280

Maße (L/B/H)

24/16,1/2 cm

Gewicht

521 g

Sprache

Englisch

ISBN

978-1-4398-2108-4

Beschreibung

Produktdetails

Einband

Gebundene Ausgabe

Erscheinungsdatum

29.04.2010

Abbildungen

schwarz-weiss Illustrationen, Tabellen, schwarz-weiss

Verlag

Taylor & Francis

Seitenzahl

280

Maße (L/B/H)

24/16,1/2 cm

Gewicht

521 g

Sprache

Englisch

ISBN

978-1-4398-2108-4

Noch keine Bewertungen vorhanden

Verfassen Sie die erste Bewertung zu diesem Artikel

Helfen Sie anderen Kundinnen und Kunden durch Ihre Meinung.

Kundinnen und Kunden meinen

Bewertungen (0)

Die Leseprobe wird geladen.
  • Produktbild: Reinforcement Learning and Dynamic Programming Using Function Approximators
  • Produktbild: Reinforcement Learning and Dynamic Programming Using Function Approximators
  • Introduction. Dynamic programming and reinforcement learning. Focus of this book. Book outline. Basics of dynamic programming and reinforcement learning. Introduction. Markov decision processes. Value iteration. Policy iteration. Direct policy search. Conclusions. Bibliographical notes. Dynamic programming and reinforcement learning in large and continuous spaces. Introduction. The need for approximation in large and continuous spaces. Approximate value iteration. Approximate policy iteration. Finding value function approximators automatically. Approximate policy search. Comparison of approximate value iteration, policy iteration, and policy search. Conclusions. Bibliographical notes. Q-value iteration with fuzzy approximation. Introduction. Fuzzy Q-iteration. Analysis of fuzzy Q-iteration. Optimizing the membership functions. Experimental studies. Conclusions. Bibliographical notes. Online and continuous-action least-squares policy iteration. Introduction. Least-squares policy iteration. LSPI with continuous-action approximation. Online LSPI. Using prior knowledge in online LSPI. Experimental studies. Conclusions. Bibliographical notes. Direct policy search with adaptive basis functions. Introduction. Policy search with adaptive basis functions. Experimental studies. Conclusions. Bibliographical notes. References. Glossary.