Was ist Verstärkungslernen („reinforcement learning“)?
摘要
Ein Beispiel für das Verstärkungslernen („reinforcement learning“) kommt aus der Robotik: Ein Roboter führt seine Aufgaben aus und lernt gleichzeitig aus den Ergebnissen seiner Handlungen. Wenn das Ergebnis gut ist, begünstigt – also verstärkt – der Lernalgorithmus die Handlungen, die dazu geführt haben.