← Review lesson
Quiz dossier / Reinforcement Learning
Reinforcement Learning: Umfassende Grundlagen (Deutsch)
Umfassender Selbsttest auf Deutsch zu RL-Grundlagen, PPO, AlphaStar und League-Training, verteiltem RL mit Ray/RLlib, MLOps und simulationsbasiertem Lernen.
27 questionsEstimated 50 min0 flagged
Session status
0%
Draft
- Answered
- 0/27
- Score
- 0/27
Question 1
1 point(s)
Wie ist ein Markov-Entscheidungsprozess (MDP) formal definiert?
RL-Probleme werden häufig als MDP formuliert. Identifiziere zuerst die formalen Komponenten und das Optimierungsziel.