Odalric-Ambrym Maillard
Mots clés
FR |
EN
Apprentissage par renforcement (intelligence artificielle)
Apprentissage automatique
Apprentissage par renforcement
Problème du bandit manchot
Prise de décision (statistique)
Apprentissage statistique
Réseaux neuronaux (informatique)
Processus de Markov
Intelligence artificielle
Bandits stochastiques
Apprentissage séquentiel
Algorithmes en ligne
Optimisation mathématique
Analyse de régression
Bandits manchots
Aversion au risque
Apprentissage en ligne
Théorie des jeux
Gestion de flexibilités électriques
Prévision de la demande électrique