0% ont trouvé ce document utile (0 vote)
2 vues9 pages

Presentation Dataset

Le projet vise à prédire la consommation énergétique des bâtiments en utilisant le Machine Learning, en se basant sur leurs caractéristiques physiques. Les résultats montrent que l'arbre de décision est le modèle le plus performant pour prédire à la fois le Heating Load et le Cooling Load. Ce travail souligne l'importance de la géométrie des bâtiments sur leurs performances énergétiques et ouvre la voie à des applications dans le génie civil.

Transféré par

amira
Copyright
© All Rights Reserved
Nous prenons très au sérieux les droits relatifs au contenu. Si vous pensez qu’il s’agit de votre contenu, signalez une atteinte au droit d’auteur ici.
Formats disponibles
Téléchargez aux formats DOCX, PDF, TXT ou lisez en ligne sur Scribd
0% ont trouvé ce document utile (0 vote)
2 vues9 pages

Presentation Dataset

Le projet vise à prédire la consommation énergétique des bâtiments en utilisant le Machine Learning, en se basant sur leurs caractéristiques physiques. Les résultats montrent que l'arbre de décision est le modèle le plus performant pour prédire à la fois le Heating Load et le Cooling Load. Ce travail souligne l'importance de la géométrie des bâtiments sur leurs performances énergétiques et ouvre la voie à des applications dans le génie civil.

Transféré par

amira
Copyright
© All Rights Reserved
Nous prenons très au sérieux les droits relatifs au contenu. Si vous pensez qu’il s’agit de votre contenu, signalez une atteinte au droit d’auteur ici.
Formats disponibles
Téléchargez aux formats DOCX, PDF, TXT ou lisez en ligne sur Scribd

DIAPO 1 — PAGE DE GARDE

Ce que tu dis :

Bonjour à tous.
Aujourd’hui, nous allons vous présenter notre projet intitulé :
“Prédiction de la consommation énergétique des bâtiments par
apprentissage automatique supervisé”.

L’objectif principal de notre projet est d’utiliser le Machine Learning afin de


prédire les besoins énergétiques des bâtiments à partir de leurs
caractéristiques physiques.

DIAPO 2 — POURQUOI CE PROJET

Ce que tu dis :

Nous avons choisi ce sujet car le secteur du bâtiment représente une part
très importante de la consommation énergétique mondiale.

Les besoins de chauffage et de climatisation augmentent continuellement,


ce qui pose des enjeux économiques et environnementaux importants.

Les méthodes classiques de simulation thermique sont souvent complexes


et demandent beaucoup de temps.

Grâce au Machine Learning, il devient possible de réaliser des prédictions


rapides et efficaces, afin d’aider à concevoir des bâtiments plus
intelligents et plus économes en énergie.

DIAPO 3 — PROBLÉMATIQUE ET OBJECTIFS

Ce que tu dis :

Dans ce projet, nous avons cherché à répondre à plusieurs questions


importantes.

Tout d’abord : peut-on prédire efficacement la consommation énergétique


d’un bâtiment uniquement à partir de ses caractéristiques physiques ?

Nous avons également étudié quels paramètres influencent le plus la


consommation énergétique, et quel modèle de Machine Learning donne
les meilleurs résultats.

Notre objectif principal est donc de prédire les charges énergétiques des
bâtiments.
Pour cela, nous avons utilisé plusieurs modèles supervisés, comparé leurs
performances et interprété les résultats obtenus d’un point de vue
physique et énergétique.

DIAPO 4 — PRÉSENTATION DU DATASET

Ce que tu dis :

Pour réaliser ce projet, nous avons utilisé le “Energy Efficiency Dataset”,


provenant du UCI Machine Learning Repository.

Ce dataset contient 768 bâtiments simulés thermiquement avec le logiciel


Ecotect.

Nous disposons de :

 8 variables d’entrée,

 2 variables cibles,

 et aucune valeur manquante.

Toutes les données sont numériques continues, ce qui rend ce dataset


particulièrement adapté aux modèles de régression.

DIAPO 5 — VARIABLES DU DATASET

Ce que tu dis :

Les variables d’entrée décrivent principalement les caractéristiques


géométriques et thermiques du bâtiment.

Par exemple :

 la compacité relative,

 la surface totale,

 la hauteur,

 l’orientation,

 ou encore la surface vitrée.

Les variables de sortie sont :

 le Heating Load, c’est-à-dire l’énergie nécessaire pour le chauffage,

 et le Cooling Load, correspondant à l’énergie nécessaire pour le


refroidissement.
On remarque déjà que ces paramètres peuvent fortement influencer les
performances énergétiques du bâtiment.

DIAPO 6 — ENVIRONNEMENT DE TRAVAIL

Ce que tu dis :

Notre projet a été réalisé avec le langage Python sur Jupyter Notebook.

Nous avons utilisé plusieurs bibliothèques importantes :

 pandas pour manipuler les données,

 numpy pour les calculs numériques,

 matplotlib pour les visualisations,

 et sklearn pour les modèles de Machine Learning.

Le type d’apprentissage utilisé est l’apprentissage supervisé, car les


valeurs cibles sont déjà connues dans le dataset.

Comme les sorties sont des valeurs numériques continues, il s’agit d’un
problème de régression.

DIAPO 7 — PIPELINE GÉNÉRAL

Ce que tu dis :

Cette diapo présente les principales étapes suivies dans notre projet.

Nous avons commencé par charger les données, puis réaliser une analyse
exploratoire afin de comprendre le dataset.

Ensuite, nous avons effectué le prétraitement et la séparation des données


en ensembles d’entraînement et de test.

Après cela, nous avons entraîné les modèles, effectué les prédictions, puis
évalué leurs performances à l’aide de différentes métriques.

DIAPO 8 — CHARGEMENT DES DONNÉES

Ce que tu dis :

Pour lire le dataset, nous avons utilisé la fonction pd.read_excel() de la


bibliothèque pandas.

Cette fonction permet de charger un fichier Excel et de le convertir en


DataFrame pandas.
Le DataFrame facilite énormément la manipulation, l’analyse et le
nettoyage des données.

En entrée, la fonction reçoit principalement le chemin du fichier, et elle


retourne un tableau structuré contenant toutes les données du dataset.

DIAPO 9 — ANALYSE EXPLORATOIRE

Ce que tu dis :

Après le chargement des données, nous avons réalisé une analyse


exploratoire.

Nous avons utilisé plusieurs fonctions importantes :

 head() pour afficher les premières lignes,

 info() pour connaître les types des colonnes,

 describe() pour obtenir les statistiques principales,

 et isnull().sum() pour vérifier les valeurs manquantes.

Cette étape nous a permis de mieux comprendre la structure du dataset


avant l’entraînement des modèles.

DIAPO 10 — SÉPARATION DES VARIABLES

Ce que tu dis :

Ensuite, nous avons séparé les variables d’entrée et les variables de


sortie.

Pour cela, nous avons utilisé la fonction drop() afin de retirer les colonnes
cibles du DataFrame principal.

Ainsi :

 X contient les caractéristiques physiques du bâtiment,

 tandis que y contient les charges énergétiques à prédire.

DIAPO 11 — DIVISION TRAIN / TEST

Ce que tu dis :

Nous avons ensuite séparé les données en deux ensembles grâce à la


fonction train_test_split().
80% des données ont été utilisées pour l’entraînement, et 20% pour le
test.

Le paramètre random_state=42 permet d’obtenir les mêmes résultats à


chaque exécution, ce qui garantit la reproductibilité du projet.

Cette étape est très importante car elle permet d’évaluer les
performances du modèle sur des données qu’il n’a jamais vues
auparavant.

DIAPO 12 — NORMALISATION DES DONNÉES

Ce que tu dis :

Les variables du dataset possèdent des échelles différentes.

Par exemple, certaines surfaces ont de grandes valeurs alors que


l’orientation possède de petites valeurs.

Nous avons donc utilisé StandardScaler() pour standardiser les données.

Les méthodes :

 fit(),

 transform(),

 et fit_transform()
permettent de calculer puis appliquer la normalisation.

Cette étape améliore généralement la stabilité et les performances des


modèles.

DIAPO 13 — RÉGRESSION LINÉAIRE

Ce que tu dis :

Le premier modèle utilisé est la régression linéaire.

Ce modèle cherche à établir une relation linéaire entre les variables


d’entrée et la variable cible.

Nous avons utilisé la classe LinearRegression() de sklearn.

La méthode fit() entraîne le modèle sur les données d’apprentissage,


tandis que predict() génère les prédictions sur les données de test.

Ce modèle est simple, rapide et facilement interprétable, mais il peut être


limité lorsque les relations deviennent complexes et non linéaires.
DIAPO 14 — ARBRE DE DÉCISION

Ce que tu dis :

Le second modèle utilisé est l’arbre de décision.

Ce modèle fonctionne en divisant les données sous forme de règles


hiérarchiques successives.

Nous avons utilisé DecisionTreeRegressor().

Contrairement à la régression linéaire, ce modèle peut capturer des


relations non linéaires complexes entre les variables.

Les paramètres comme max_depth permettent de contrôler la profondeur


de l’arbre afin d’éviter le surapprentissage.

DIAPO 15 — ÉVALUATION DES MODÈLES

Ce que tu dis :

Pour évaluer les performances des modèles, nous avons utilisé deux
métriques principales :

 le MSE,

 et le coefficient R².

Le MSE mesure l’erreur moyenne entre les valeurs réelles et les valeurs
prédites.

Le coefficient R² indique la qualité globale du modèle.

Plus le MSE est faible et plus le R² est proche de 1, meilleur est le modèle.

DIAPO 16 — RÉSULTATS HEATING LOAD

Ce que tu dis :

Voici les résultats obtenus pour la prédiction du Heating Load.

Nous observons que l’arbre de décision obtient de meilleures


performances que la régression linéaire :

 un MSE beaucoup plus faible,

 et un R² proche de 0.99.
Cela montre que les relations entre les variables sont principalement non
linéaires.

Nous avons également analysé l’importance des variables grâce à


feature_importances_.

La compacité relative apparaît comme la variable la plus influente avec


environ 88% d’importance.

Cela est logique physiquement, car les bâtiments compacts perdent moins
de chaleur.

DIAPO 17 — RÉSULTATS COOLING LOAD

Ce que tu dis :

Pour le Cooling Load, l’arbre de décision reste également le modèle le plus


performant.

Cependant, les résultats sont légèrement moins précis que pour le


chauffage.

Cela s’explique par le fait que le refroidissement dépend de plusieurs


facteurs plus complexes comme :

 le vitrage,

 l’orientation,

 et les apports solaires.

DIAPO 18 — RÉGRESSION MULTI-SORTIES

Ce que tu dis :

Nous avons également testé une régression multi-sorties afin de prédire


simultanément le Heating Load et le Cooling Load.

L’avantage principal est qu’un seul modèle peut gérer plusieurs sorties en
même temps.

Les performances obtenues restent très proches de celles du mode mono-


sortie, ce qui montre que le modèle conserve une excellente précision.

DIAPO 19 — VISUALISATIONS

Ce que tu dis :
Afin de mieux interpréter les résultats, nous avons réalisé plusieurs
visualisations avec matplotlib.

Nous avons utilisé :

 plot() pour tracer des courbes,

 scatter() pour comparer les valeurs réelles et prédites,

 et bar() pour comparer les performances des modèles et


l’importance des variables.

Ces graphiques facilitent énormément l’analyse et l’interprétation des


résultats.

DIAPO 20 — INTERPRÉTATION GÉNIE CIVIL

Ce que tu dis :

Ce projet montre clairement que la géométrie du bâtiment influence


fortement ses performances énergétiques.

Par exemple, le vitrage impacte fortement les besoins de refroidissement,


tandis que la compacité influence surtout les pertes thermiques.

Le Machine Learning peut donc devenir un outil très utile pour :

 les ingénieurs civils,

 les architectes,

 et les concepteurs énergétiques.

Les applications possibles incluent :

 les bâtiments intelligents,

 l’optimisation énergétique,

 et la conception durable.

DIAPO 21 — PERSPECTIVES ET CONCLUSION

Ce que tu dis :

Pour améliorer ce travail, nous pourrions tester des modèles plus avancés
comme :

 Random Forest,

 XGBoost,
 ou les réseaux de neurones.

Nous pourrions également utiliser des données climatiques réelles afin


d’obtenir des prédictions encore plus précises.

En conclusion, ce projet montre que le Machine Learning permet de


prédire efficacement la consommation énergétique des bâtiments.

Parmi les modèles étudiés, l’arbre de décision a donné les meilleurs


résultats.

Ce travail illustre également le fort potentiel de l’intelligence artificielle


dans le domaine du génie civil.

DIAPO 22 — MERCI

Ce que tu dis :

Merci pour votre attention.


Nous sommes maintenant prêts à répondre à vos questions.

Vous aimerez peut-être aussi