Contrôle et Apprentissage

  • Établissement

    INP - ENSEEIHT

Description

CM1 : Introduction – Processus de décision markoviens – Équations de Bellman

CM2 : Planification / RL avec modèle : Itération de la valeur – Itération de politique

CM3 : RL sans modèle : Monte Carlo – Apprentissage TD – Q-learning

CM4 : Approximation et Deep RL : Approximation de fonction – DQN

CM5 : Sujets avancés : Bandits multi-bras – RL multi-agents

TD : Discussion sur la modélisation des MDP et les aspects théoriques

Lire plus