Ein Beispiel für das Verstärkungslernen („reinforcement learning“) kommt aus der Robotik: Ein Roboter führt seine Aufgaben aus und lernt gleichzeitig aus den Ergebnissen seiner Handlungen. Wenn das Ergebnis gut ist, begünstigt – also verstärkt – der Lernalgorithmus die Handlungen, die dazu geführt haben.

错误:搜索内容不能为空,请输入英文关键词
错误:关键词超出字数限制,请精简
高级检索

Was ist Verstärkungslernen („reinforcement learning“)?

  • Hannu Toivonen,
  • Stefan Kramer

摘要

Ein Beispiel für das Verstärkungslernen („reinforcement learning“) kommt aus der Robotik: Ein Roboter führt seine Aufgaben aus und lernt gleichzeitig aus den Ergebnissen seiner Handlungen. Wenn das Ergebnis gut ist, begünstigt – also verstärkt – der Lernalgorithmus die Handlungen, die dazu geführt haben.