← Review lesson

Quiz dossier / Reinforcement Learning

Reinforcement Learning: Umfassende Grundlagen (Deutsch)

Umfassender Selbsttest auf Deutsch zu RL-Grundlagen, PPO, AlphaStar und League-Training, verteiltem RL mit Ray/RLlib, MLOps und simulationsbasiertem Lernen.

27 questionsEstimated 50 min0 flagged

Session status

0%

Draft

Answered
0/27
Score
0/27

Question 1

1 point(s)

Wie ist ein Markov-Entscheidungsprozess (MDP) formal definiert?

RL-Probleme werden häufig als MDP formuliert. Identifiziere zuerst die formalen Komponenten und das Optimierungsziel.