Master: MLD
Module: Industrie 5.0 et IA
Professeur: M. RABI
TP3 Machine Learning
Ce TP vise à :
• Appliquer différents modèles Machine Learning sur des données économiques et financières.
• Comprendre les concepts fondamentaux de la régression, la classification et le clustering.
• Évaluer les performances des modèles.
Exercice 1 : Régression Linéaire Multiple
Objectif : Prédire le prix de l'immobilier en fonction de plusieurs variables économiques.
• Dataset: California Housing
Énoncé:
1. Charger le dataset et explorer les principales statistiques.
2. Sélectionner les variables explicatives et la variable cible.
3. Séparer les données en ensemble d'entraînement et de test.
4. Implémenter une régression linéaire multiple avec sklearn.
5. Évaluer la performance du modèle avec R² et RMSE.
6. Interpréter les coefficients de la régression.
Exercice 2 : Régression Logistique
Objectif : Prédire si un client contractera un prêt bancaire.
• Dataset : Bank Marketing Dataset
Énoncé :
1. Charger le dataset et effectuer un prétraitement des données.
2. Séparer les données en ensemble d'entraînement et de test.
3. Appliquer une régression logistique pour prédire si un client souscrit à un prêt.
4. Évaluer le modèle avec une matrice de confusion, l'accuracy et le F1-score.
5. Tracer et analyser la courbe ROC et calculer l’AUC.
Exercice 3: K-Means
Objectif : Segmenter les clients en groupes basés sur leur comportement financier.
• Dataset : Customer Segmentation Dataset
Énoncé :
1. Effectuer une analyse exploratoire des données.
2. Déterminer le nombre optimal de clusters avec la méthode du coude.
1/2
Master: MLD
Module: Industrie 5.0 et IA
Professeur: M. RABI
3. Appliquer K-Means pour segmenter les clients en clusters.
4. Visualiser et analyser les clusters.
Exercice 4 : Arbres de Décision et KNN
Objectif : Classifier les clients selon leur solvabilité.
• Dataset : Credit Score Dataset
Énoncé:
1. Prétraiter les données et sélectionner les variables pertinentes.
2. Appliquer un arbre de décision pour classer les clients en solvables et non-solvables.
3. Implémenter un modèle KNN et comparer ses performances avec l’arbre de décision.
4. Optimiser l'hyperparamètre k de KNN.
5. Visualiser les résultats avec un diagramme de décision.
2/2