0% ont trouvé ce document utile (0 vote)
4 vues2 pages

Arbres d'Apprentissage par Renforcement

Transféré par

dhia
Copyright
© All Rights Reserved
Nous prenons très au sérieux les droits relatifs au contenu. Si vous pensez qu’il s’agit de votre contenu, signalez une atteinte au droit d’auteur ici.
Formats disponibles
Téléchargez aux formats DOCX, PDF, TXT ou lisez en ligne sur Scribd
0% ont trouvé ce document utile (0 vote)
4 vues2 pages

Arbres d'Apprentissage par Renforcement

Transféré par

dhia
Copyright
© All Rights Reserved
Nous prenons très au sérieux les droits relatifs au contenu. Si vous pensez qu’il s’agit de votre contenu, signalez une atteinte au droit d’auteur ici.
Formats disponibles
Téléchargez aux formats DOCX, PDF, TXT ou lisez en ligne sur Scribd

Section Description

Titre de
Reinforcement Learning Trees (RLT)
l'Article

Introduction d'une nouvelle méthode basée sur les arbres


pour améliorer significativement la performance des arbres
Idée Générale et forêts (comme les Random Forests) dans des
environnements de grande dimension et de grande
rareté (high-dimensional sparse settings).

* Améliorer la performance des méthodes à base d'arbres


lorsque le signal réel est porté par un petit sous-
Objectifs ensemble de variables
* Estimer de manière cohérente la fonction de régression
ou de classification

* Exemples de données réelles (10 ensembles de


données de référence tels que concrete, parkinson-
Datasets Oxford, Boston housing, sonar, breast cancer, etc.).
Utilisés

Link : [Link]

L'approche intègre trois innovations clés dans la


construction de l'arbre : 1. Apprentissage par
Renforcement (RL) : Un modèle intégré (embedded
model) est ajusté à chaque nœud pour évaluer la
contribution potentielle future de chaque variable
(Variable Importance - VI) afin d'optimiser le gain à long
Approche
terme. 2. Procédure de Variable Muting : Élimine
Suivie
progressivement les variables de bruit (noise variables)
pour forcer les séparations sur les variables fortement
informatives. 3. Séparation par Combinaison Linéaire
(Linear Combination Split) : Utilisation optionnelle d'une
séparation basée sur une combinaison linéaire des
variables avec un VI élevé.

Algorithmes * Modèle Principal : Reinforcement Learning Trees


et Modèles (RLT), un ensemble d'arbres binaires. * Algorithme clé :
Utilisés Application de l'Apprentissage par Renforcement (RL)
pour la sélection des variables. * Modèle Intégré : Une
modification des Extremely Randomized Trees (ET),
utilisé pour calculer la mesure d'importance des variables
Section Description

(VI) à chaque nœud.

* Empiriques/Numériques : RLT a montré une


amélioration significative et une meilleure stabilité par
rapport aux concurrents. RLT a obtenu les meilleures
Résultats performances dans 7 des 10 ensembles de données réelles
Obtenus testés. * Théoriques : La méthode est cohérente et le
taux de convergence est indépendant de la dimension
totale (p), dépendant uniquement du nombre de
variables fortes ($p_1$).

* Coût Computationnel : RLT a un coût de calcul


significativement plus élevé que les concurrents car il
Limites de nécessite d'ajuster plusieurs modèles intégrés pour le
l'Approche calcul de l'importance des variables. * Hypothèses
Proposée Théoriques : Les résultats théoriques reposent sur
l'hypothèse de covariables indépendantes, ce qui est
une forte restriction en pratique.

Intégrer l’IA expliquée (exemple : Le modèle RLT pourrait


Proposition générer une carte thermique des variables (Feature
d’amélioratio Heatmap) pour chaque prédiction, montrant les variables
n qui ont poussé le résultat dans une certaine direction,
pondérées par le gain de l'agent RL.)

Vous aimerez peut-être aussi