Lernen durch Verstärkung (Reinforcement Learning)
摘要
Beim Lernen mit Lehrer werden immer gelabelte Daten benötigt. Wenn diese nicht vorhanden sind, wie etwa wenn ein Roboter das Greifen lernen soll, dann bleibt nur noch das Lernen durch Verstärkung. Das heißt, der Roboter optimiert seine Motorik mittels Versuch und Irrtum, basierend auf positiver und negativer Verstärkung. Einige einfach derartige Algorithmen und deren Anwendung werden hier vorgestellt.