Kapitel 20: Blackbox-Optimierung beim Reinforcement Learning

In diesem Kapitel wechseln wir ein weiteres Mal die Perspektive auf das Training beim Reinforcement Learning (RL) und werden uns mit zwei sogenannten Blackbox-Optimierungen befassen:

  • Evolutionsstrategien

  • Genetische Algorithmen

Diese Verfahren sind schon mindestens ein Jahrzehnt alt, aber in jüngster Zeit wurden Studien durchgeführt, die gezeigt haben, dass sie sich auf umfangreiche RL-Aufgaben anwenden lassen und dass sie der Wertiteration und den Policy-Gradienten-Verfahren ebenbürtig sind.

20.1  Blackbox-Verfahren

Zunächst einmal erörtere ich die gesamte Gruppe von Verfahren und wie sie sich von dem unterscheiden, was Sie bislang kennengelernt haben. Blackbox-Optimierungsverfahren ...

Get Deep Reinforcement Learning -- Das umfassende Praxis-Handbuch now with the O’Reilly learning platform.

O’Reilly members experience books, live events, courses curated by job role, and more from O’Reilly and nearly 200 top publishers.