DIAPO 1 — PAGE DE GARDE
Ce que tu dis :
Bonjour à tous.
Aujourd’hui, nous allons vous présenter notre projet intitulé :
“Prédiction de la consommation énergétique des bâtiments par
apprentissage automatique supervisé”.
L’objectif principal de notre projet est d’utiliser le Machine Learning afin de
prédire les besoins énergétiques des bâtiments à partir de leurs
caractéristiques physiques.
DIAPO 2 — POURQUOI CE PROJET
Ce que tu dis :
Nous avons choisi ce sujet car le secteur du bâtiment représente une part
très importante de la consommation énergétique mondiale.
Les besoins de chauffage et de climatisation augmentent continuellement,
ce qui pose des enjeux économiques et environnementaux importants.
Les méthodes classiques de simulation thermique sont souvent complexes
et demandent beaucoup de temps.
Grâce au Machine Learning, il devient possible de réaliser des prédictions
rapides et efficaces, afin d’aider à concevoir des bâtiments plus
intelligents et plus économes en énergie.
DIAPO 3 — PROBLÉMATIQUE ET OBJECTIFS
Ce que tu dis :
Dans ce projet, nous avons cherché à répondre à plusieurs questions
importantes.
Tout d’abord : peut-on prédire efficacement la consommation énergétique
d’un bâtiment uniquement à partir de ses caractéristiques physiques ?
Nous avons également étudié quels paramètres influencent le plus la
consommation énergétique, et quel modèle de Machine Learning donne
les meilleurs résultats.
Notre objectif principal est donc de prédire les charges énergétiques des
bâtiments.
Pour cela, nous avons utilisé plusieurs modèles supervisés, comparé leurs
performances et interprété les résultats obtenus d’un point de vue
physique et énergétique.
DIAPO 4 — PRÉSENTATION DU DATASET
Ce que tu dis :
Pour réaliser ce projet, nous avons utilisé le “Energy Efficiency Dataset”,
provenant du UCI Machine Learning Repository.
Ce dataset contient 768 bâtiments simulés thermiquement avec le logiciel
Ecotect.
Nous disposons de :
8 variables d’entrée,
2 variables cibles,
et aucune valeur manquante.
Toutes les données sont numériques continues, ce qui rend ce dataset
particulièrement adapté aux modèles de régression.
DIAPO 5 — VARIABLES DU DATASET
Ce que tu dis :
Les variables d’entrée décrivent principalement les caractéristiques
géométriques et thermiques du bâtiment.
Par exemple :
la compacité relative,
la surface totale,
la hauteur,
l’orientation,
ou encore la surface vitrée.
Les variables de sortie sont :
le Heating Load, c’est-à-dire l’énergie nécessaire pour le chauffage,
et le Cooling Load, correspondant à l’énergie nécessaire pour le
refroidissement.
On remarque déjà que ces paramètres peuvent fortement influencer les
performances énergétiques du bâtiment.
DIAPO 6 — ENVIRONNEMENT DE TRAVAIL
Ce que tu dis :
Notre projet a été réalisé avec le langage Python sur Jupyter Notebook.
Nous avons utilisé plusieurs bibliothèques importantes :
pandas pour manipuler les données,
numpy pour les calculs numériques,
matplotlib pour les visualisations,
et sklearn pour les modèles de Machine Learning.
Le type d’apprentissage utilisé est l’apprentissage supervisé, car les
valeurs cibles sont déjà connues dans le dataset.
Comme les sorties sont des valeurs numériques continues, il s’agit d’un
problème de régression.
DIAPO 7 — PIPELINE GÉNÉRAL
Ce que tu dis :
Cette diapo présente les principales étapes suivies dans notre projet.
Nous avons commencé par charger les données, puis réaliser une analyse
exploratoire afin de comprendre le dataset.
Ensuite, nous avons effectué le prétraitement et la séparation des données
en ensembles d’entraînement et de test.
Après cela, nous avons entraîné les modèles, effectué les prédictions, puis
évalué leurs performances à l’aide de différentes métriques.
DIAPO 8 — CHARGEMENT DES DONNÉES
Ce que tu dis :
Pour lire le dataset, nous avons utilisé la fonction pd.read_excel() de la
bibliothèque pandas.
Cette fonction permet de charger un fichier Excel et de le convertir en
DataFrame pandas.
Le DataFrame facilite énormément la manipulation, l’analyse et le
nettoyage des données.
En entrée, la fonction reçoit principalement le chemin du fichier, et elle
retourne un tableau structuré contenant toutes les données du dataset.
DIAPO 9 — ANALYSE EXPLORATOIRE
Ce que tu dis :
Après le chargement des données, nous avons réalisé une analyse
exploratoire.
Nous avons utilisé plusieurs fonctions importantes :
head() pour afficher les premières lignes,
info() pour connaître les types des colonnes,
describe() pour obtenir les statistiques principales,
et isnull().sum() pour vérifier les valeurs manquantes.
Cette étape nous a permis de mieux comprendre la structure du dataset
avant l’entraînement des modèles.
DIAPO 10 — SÉPARATION DES VARIABLES
Ce que tu dis :
Ensuite, nous avons séparé les variables d’entrée et les variables de
sortie.
Pour cela, nous avons utilisé la fonction drop() afin de retirer les colonnes
cibles du DataFrame principal.
Ainsi :
X contient les caractéristiques physiques du bâtiment,
tandis que y contient les charges énergétiques à prédire.
DIAPO 11 — DIVISION TRAIN / TEST
Ce que tu dis :
Nous avons ensuite séparé les données en deux ensembles grâce à la
fonction train_test_split().
80% des données ont été utilisées pour l’entraînement, et 20% pour le
test.
Le paramètre random_state=42 permet d’obtenir les mêmes résultats à
chaque exécution, ce qui garantit la reproductibilité du projet.
Cette étape est très importante car elle permet d’évaluer les
performances du modèle sur des données qu’il n’a jamais vues
auparavant.
DIAPO 12 — NORMALISATION DES DONNÉES
Ce que tu dis :
Les variables du dataset possèdent des échelles différentes.
Par exemple, certaines surfaces ont de grandes valeurs alors que
l’orientation possède de petites valeurs.
Nous avons donc utilisé StandardScaler() pour standardiser les données.
Les méthodes :
fit(),
transform(),
et fit_transform()
permettent de calculer puis appliquer la normalisation.
Cette étape améliore généralement la stabilité et les performances des
modèles.
DIAPO 13 — RÉGRESSION LINÉAIRE
Ce que tu dis :
Le premier modèle utilisé est la régression linéaire.
Ce modèle cherche à établir une relation linéaire entre les variables
d’entrée et la variable cible.
Nous avons utilisé la classe LinearRegression() de sklearn.
La méthode fit() entraîne le modèle sur les données d’apprentissage,
tandis que predict() génère les prédictions sur les données de test.
Ce modèle est simple, rapide et facilement interprétable, mais il peut être
limité lorsque les relations deviennent complexes et non linéaires.
DIAPO 14 — ARBRE DE DÉCISION
Ce que tu dis :
Le second modèle utilisé est l’arbre de décision.
Ce modèle fonctionne en divisant les données sous forme de règles
hiérarchiques successives.
Nous avons utilisé DecisionTreeRegressor().
Contrairement à la régression linéaire, ce modèle peut capturer des
relations non linéaires complexes entre les variables.
Les paramètres comme max_depth permettent de contrôler la profondeur
de l’arbre afin d’éviter le surapprentissage.
DIAPO 15 — ÉVALUATION DES MODÈLES
Ce que tu dis :
Pour évaluer les performances des modèles, nous avons utilisé deux
métriques principales :
le MSE,
et le coefficient R².
Le MSE mesure l’erreur moyenne entre les valeurs réelles et les valeurs
prédites.
Le coefficient R² indique la qualité globale du modèle.
Plus le MSE est faible et plus le R² est proche de 1, meilleur est le modèle.
DIAPO 16 — RÉSULTATS HEATING LOAD
Ce que tu dis :
Voici les résultats obtenus pour la prédiction du Heating Load.
Nous observons que l’arbre de décision obtient de meilleures
performances que la régression linéaire :
un MSE beaucoup plus faible,
et un R² proche de 0.99.
Cela montre que les relations entre les variables sont principalement non
linéaires.
Nous avons également analysé l’importance des variables grâce à
feature_importances_.
La compacité relative apparaît comme la variable la plus influente avec
environ 88% d’importance.
Cela est logique physiquement, car les bâtiments compacts perdent moins
de chaleur.
DIAPO 17 — RÉSULTATS COOLING LOAD
Ce que tu dis :
Pour le Cooling Load, l’arbre de décision reste également le modèle le plus
performant.
Cependant, les résultats sont légèrement moins précis que pour le
chauffage.
Cela s’explique par le fait que le refroidissement dépend de plusieurs
facteurs plus complexes comme :
le vitrage,
l’orientation,
et les apports solaires.
DIAPO 18 — RÉGRESSION MULTI-SORTIES
Ce que tu dis :
Nous avons également testé une régression multi-sorties afin de prédire
simultanément le Heating Load et le Cooling Load.
L’avantage principal est qu’un seul modèle peut gérer plusieurs sorties en
même temps.
Les performances obtenues restent très proches de celles du mode mono-
sortie, ce qui montre que le modèle conserve une excellente précision.
DIAPO 19 — VISUALISATIONS
Ce que tu dis :
Afin de mieux interpréter les résultats, nous avons réalisé plusieurs
visualisations avec matplotlib.
Nous avons utilisé :
plot() pour tracer des courbes,
scatter() pour comparer les valeurs réelles et prédites,
et bar() pour comparer les performances des modèles et
l’importance des variables.
Ces graphiques facilitent énormément l’analyse et l’interprétation des
résultats.
DIAPO 20 — INTERPRÉTATION GÉNIE CIVIL
Ce que tu dis :
Ce projet montre clairement que la géométrie du bâtiment influence
fortement ses performances énergétiques.
Par exemple, le vitrage impacte fortement les besoins de refroidissement,
tandis que la compacité influence surtout les pertes thermiques.
Le Machine Learning peut donc devenir un outil très utile pour :
les ingénieurs civils,
les architectes,
et les concepteurs énergétiques.
Les applications possibles incluent :
les bâtiments intelligents,
l’optimisation énergétique,
et la conception durable.
DIAPO 21 — PERSPECTIVES ET CONCLUSION
Ce que tu dis :
Pour améliorer ce travail, nous pourrions tester des modèles plus avancés
comme :
Random Forest,
XGBoost,
ou les réseaux de neurones.
Nous pourrions également utiliser des données climatiques réelles afin
d’obtenir des prédictions encore plus précises.
En conclusion, ce projet montre que le Machine Learning permet de
prédire efficacement la consommation énergétique des bâtiments.
Parmi les modèles étudiés, l’arbre de décision a donné les meilleurs
résultats.
Ce travail illustre également le fort potentiel de l’intelligence artificielle
dans le domaine du génie civil.
DIAPO 22 — MERCI
Ce que tu dis :
Merci pour votre attention.
Nous sommes maintenant prêts à répondre à vos questions.