Établissement
INP - ENSEEIHT
Description
CM1 : Introduction – Processus de décision markoviens – Équations de Bellman
CM2 : Planification / RL avec modèle : Itération de la valeur – Itération de politique
CM3 : RL sans modèle : Monte Carlo – Apprentissage TD – Q-learning
CM4 : Approximation et Deep RL : Approximation de fonction – DQN
CM5 : Sujets avancés : Bandits multi-bras – RL multi-agents
TD : Discussion sur la modélisation des MDP et les aspects théoriques

