Machine Learning Avec Python
Machine Learning Avec Python
Code…
Equipe pédagogique
Administration Base de Données (ABD)
1
Titre du Cours : Introduction à l'Apprentissage Automatique
Description du Cours :
Objectifs du Cours :
Plan du Cours :
Méthodes d'Évaluation :
• Quiz et examens
• Devoirs et exercices pratiques
• Présentation finale du projet
Manuels Recommandés :
Sommaire
i
E.S.G.A.E la Grande Ecole Administration Base de Données (ABD)
ii
E.S.G.A.E la Grande Ecole Administration Base de Données (ABD)
Introduction
L’apprentissage automatique est aujourd’hui au cœur des innovations technologiques et
scientifiques. Il permet aux machines d’apprendre à partir des données, de s’améliorer avec
l’expérience et de prendre des décisions sans être explicitement programmées pour chaque
tâche. Ce cours a pour objectif de donner aux étudiants une compréhension claire et progressive
des principes fondamentaux, des algorithmes essentiels et des applications pratiques de
l’apprentissage automatique.
Au fil des chapitres, les étudiants découvrent comment les données sont préparées, comment
les modèles sont construits et évalués, et comment les techniques avancées comme les réseaux
de neurones ou l’apprentissage par renforcement ouvrent de nouvelles perspectives.
L’approche pédagogique combine théorie, pratique et réflexion critique, afin de former des
compétences solides et transférables.
Ce cours ne se limite pas à l’aspect technique : il met également en lumière les enjeux éthiques
et sociétaux liés à l’utilisation de l’intelligence artificielle. Les étudiants sont ainsi encouragés
à développer une vision responsable et équilibrée de l’IA, en tenant compte des biais, de
l’équité et de la transparence.
Ce cours est conçu comme une porte d’entrée vers l’univers de l’intelligence artificielle. Il
offre aux étudiants les moyens de comprendre, d’expérimenter et d’appliquer l’apprentissage
automatique dans des contextes variés, tout en les préparant à relever les défis technologiques
et éthiques de demain.
iii
E.S.G.A.E la Grande Ecole Administration Base de Données (ABD)
Un modèle de Machine Learning est une fonction ( f(x) ) qui prend des entrées (features) et
produit des sorties (labels ou prédictions). Ce modèle est entraîné sur un ensemble de
données d’apprentissage et évalué sur un ensemble de test pour vérifier sa capacité à
généraliser.
Analogie : C’est comme apprendre à cuisiner. Plutôt que de suivre une recette fixe, on goûte
plusieurs plats, on observe les ingrédients, et on finit par savoir préparer un plat similaire sans
avoir la recette exacte.
Le Machine Learning est né dans les années 1950 avec les premiers travaux sur les neurones
artificiels. Voici les grandes étapes :
• Années 1950 : Alan Turing propose le test de Turing. Frank Rosenblatt invente le
perceptron, premier modèle de neurone artificiel.
• Années 1960-70 : développement des premiers algorithmes de classification comme
k-Nearest Neighbors.
• Années 1980-90 : essor des réseaux de neurones multicouches et des arbres de décision.
• Années 2000 : explosion des données et puissance de calcul, apparition des SVM
(Support Vector Machines) et Random Forest.
1
E.S.G.A.E la Grande Ecole Administration Base de Données (ABD)
• Années 2010-2020 : révolution du Deep Learning grâce aux GPU et aux big data.
CNN et RNN deviennent incontournables.
• Aujourd’hui : le Machine Learning est utilisé partout : santé, finance, transport,
industrie, divertissement.
Illustration réelle : Courbe montrant l’évolution des performances des modèles en parallèle
avec la croissance des données disponibles (ex. ImageNet Challenge où les CNN ont surpassé
les humains en reconnaissance d’images).
L’apprentissage supervisé utilise des données étiquetées. Chaque exemple est associé à une
réponse connue. Le modèle apprend à prédire l’étiquette d’un nouvel exemple.
• Régression linéaire : prédit une valeur numérique en traçant une droite qui s’ajuste aux
données. Exemple : prédire le prix d’une maison en fonction de sa surface.
• Régression polynomiale : utilise une courbe plus complexe pour mieux représenter les
données. Exemple : prédire la croissance d’une population.
• k-Nearest Neighbors (k-NN) : classe un nouvel élément selon les catégories de ses
voisins les plus proches. Exemple : reconnaître un fruit selon sa couleur et sa forme.
• Arbres de décision : posent des questions successives (“taille > 1,70 m ?”) pour arriver
à une classe. Exemple : prédire si une personne est éligible à un prêt.
• Random Forest : combinent plusieurs arbres pour améliorer la précision. Exemple :
prédire la probabilité de défaut de paiement.
• Support Vector Machines (SVM) : séparent les classes avec une frontière optimale.
Exemple : distinguer spam et non spam.
2
E.S.G.A.E la Grande Ecole Administration Base de Données (ABD)
Analogie : C’est comme un élève qui révise avec un corrigé : il apprend en comparant ses
réponses avec celles du professeur.
Illustration réelle : Graphique montrant une droite de régression ajustée à des points
représentant surface vs prix d’une maison.
L’apprentissage non supervisé utilise des données non étiquetées. Le modèle cherche des
structures cachées (groupes, motifs).
3
E.S.G.A.E la Grande Ecole Administration Base de Données (ABD)
Analogie : C’est comme un explorateur qui découvre des tribus inconnues sans savoir à
l’avance qui elles sont.
Illustration réelle : Diagramme montrant des points regroupés en clusters par K-Means.
• Q-Learning : apprend une table de valeurs Q pour choisir la meilleure action. Exemple
: un robot qui apprend à se déplacer.
• Deep Q-Networks (DQN) : utilisent des réseaux de neurones pour approximer la
fonction Q. Exemple : un agent qui joue à des jeux vidéo.
• Policy Gradient : optimisent directement la politique d’action. Exemple : un drone qui
apprend à voler.
• Actor-Critic : combinent une politique (actor) et une fonction de valeur (critic).
Exemple : un robot qui apprend à marcher.
4
E.S.G.A.E la Grande Ecole Administration Base de Données (ABD)
Analogie : C’est comme dresser un chien : il apprend par essais et erreurs, récompensé par
des friandises.
Illustration réelle : Schéma montrant un agent dans un environnement de jeu vidéo recevant
des récompenses pour ses actions.
Analogie : C’est comme donner des super-pouvoirs aux ordinateurs : voir, lire,
comprendre, prédire et agir.
Exercice pratique :
Vous disposez d’un petit jeu de données contenant des fruits avec leurs caractéristiques :
5
E.S.G.A.E la Grande Ecole Administration Base de Données (ABD)
1. Explication générale
L’algorithme d’apprentissage supervisé reçoit les données avec leurs étiquettes. Il apprend les
relations entre les caractéristiques (couleur, forme) et les étiquettes (fruit).
Analogie : C’est comme un professeur qui montre des exemples corrigés à ses élèves.
L’élève comprend que “rouge et rond” correspond toujours à une pomme, et il peut appliquer
cette règle à de nouveaux cas.
Illustration réelle : Imaginez une application mobile qui scanne un fruit avec la caméra et
affiche son nom. Elle a été entraînée avec des milliers d’images de fruits étiquetés.
• k-Nearest Neighbors (k-NN) : Compare un nouvel exemple avec les plus proches
voisins dans le dataset. Si la majorité des voisins sont des bananes, le nouvel exemple
est classé comme banane. Exemple réel : reconnaissance de chiffres manuscrits
(MNIST dataset).
• Arbre de décision : Pose des questions successives : “Couleur = Jaune ?” → Oui →
“Forme = Longue ?” → Oui → Banane. Exemple réel : prédire si un client est éligible
à un crédit bancaire.
• Support Vector Machines (SVM) : Trouve une frontière optimale qui sépare les
classes. Exemple réel : distinguer spam et non spam dans les emails.
6
E.S.G.A.E la Grande Ecole Administration Base de Données (ABD)
Analogie :
• k-NN : comme demander l’avis des voisins pour savoir si une maison est belle.
• Arbre de décision : comme jouer à 20 questions pour deviner un objet.
• SVM : comme tracer une ligne dans le sable pour séparer deux groupes d’enfants.
• Régression logistique : comme prendre une décision oui/non (acheter ou ne pas
acheter).
Illustration réelle : Graphiques montrant un arbre de décision, une frontière SVM, et des
clusters k-NN.
7
E.S.G.A.E la Grande Ecole Administration Base de Données (ABD)
Analogie : C’est comme jouer au jeu des devinettes : “Si c’est jaune et long, c’est une
banane !”
Illustration réelle : Application de reconnaissance d’images qui identifie une banane à partir
d’une photo.
import pandas as pd
from [Link] import KNeighborsClassifier
# Dataset
data = {
"Couleur": ["Rouge", "Jaune", "Orange"],
"Forme": ["Ronde", "Longue", "Ronde"],
"Fruit": ["Pomme", "Banane", "Orange"]
}
df = [Link](data)
# Modèle k-NN
model = KNeighborsClassifier(n_neighbors=1)
[Link](X, y)
prediction = [Link](new_fruit_encoded)
print("Fruit prédit :", prediction[0])
Résultat :
8
E.S.G.A.E la Grande Ecole Administration Base de Données (ABD)
Analogie finale : C’est comme un enfant qui a appris avec des exemples. Dès qu’il voit un
fruit jaune et long, il dit immédiatement “Banane !”.
Illustration réelle : Un système de caisse automatique dans un supermarché qui reconnaît les
fruits au scanner et affiche “Banane” sans que le client ait besoin de le préciser.
9
E.S.G.A.E la Grande Ecole Administration Base de Données (ABD)
Analogie : Un dataset est comme le registre d’une école : chaque élève est une ligne, chaque
colonne une information (nom, âge, notes). Si le registre est incomplet ou mal rempli, il sera
difficile d’évaluer correctement les élèves.
10
E.S.G.A.E la Grande Ecole Administration Base de Données (ABD)
Illustration réelle : Un fichier Excel contenant les informations de clients d’une banque :
colonnes “Nom”, “Âge”, “Revenu”, “Ville”. Chaque ligne correspond à un client.
• Valeurs manquantes : certaines cellules sont vides (ex. âge non renseigné).
• Doublons : une même personne apparaît deux fois.
• Incohérences : “M” et “Masculin” mélangés.
• Valeurs aberrantes : un revenu de 1 000 000 FCFA pour un étudiant.
Techniques de nettoyage :
Analogie : C’est comme corriger une copie d’examen : on complète les trous, on efface les
ratures, et on harmonise l’écriture pour que tout soit lisible.
Illustration réelle : Un dataset médical où certains patients n’ont pas renseigné leur âge. On
remplace les valeurs manquantes par la moyenne des âges des autres patients.
3.1 Problème
11
E.S.G.A.E la Grande Ecole Administration Base de Données (ABD)
Si on ne les ajuste pas, les variables avec grandes valeurs dominent les calculs.
3.2 Normalisation
La normalisation ramène toutes les valeurs dans une plage fixe, généralement entre 0 et 1.
𝑥−𝑚𝑖𝑛
Formule : 𝑥_𝑛𝑜𝑟𝑚 = max − 𝑚𝑖𝑛
On soustrait la valeur minimale pour ramener la plus petite valeur à 0. Ensuite, on divise par
l’écart entre max et min pour ramener la plus grande valeur à 1. Toutes les autres valeurs se
retrouvent proportionnellement entre 0 et 1.
Analogie : C’est comme mettre tous les coureurs sur la même ligne de départ : chacun
commence au même niveau, peu importe sa taille ou son poids.
Illustration réelle : Graphique montrant des revenus bruts (2000–100000) puis normalisés
entre 0 et 1 pour que chaque valeur soit comparable.
3.3 Standardisation
• µ = moyenne de la colonne.
• σ = écart-type de la colonne.
• x = valeur à standardiser.
12
E.S.G.A.E la Grande Ecole Administration Base de Données (ABD)
On soustrait la moyenne pour que la nouvelle moyenne soit 0. Ensuite, on divise par
l’écart-type pour que la dispersion des valeurs soit comparable.
Analogie : C’est comme ramener toutes les notes d’une classe autour de la moyenne pour
comparer équitablement les élèves.
Illustration réelle : Graphique montrant des notes brutes puis standardisées autour de la
moyenne.
L’écart-type est une mesure statistique qui indique à quel point les valeurs d’un ensemble
de données s’écartent de la moyenne.
• Si l’écart-type est petit, cela signifie que les valeurs sont proches de la moyenne.
• Si l’écart-type est grand, cela signifie que les valeurs sont dispersées, éloignées de la
moyenne.
1. On calcule la moyenne :
∑𝑛𝑖=1 𝑥𝑖
𝜇=
𝑛
(𝑥𝑖 −𝜇)
13
E.S.G.A.E la Grande Ecole Administration Base de Données (ABD)
(𝑥𝑖 −𝜇)2
5. Enfin, on prend la racine carrée de la variance pour revenir à l’échelle des données :
𝜎 = √𝜎 2
1. Moyenne :
10 + 12 + 13 + 15 + 20
𝜇= = 14
5
2. Écarts à la moyenne :
• (10 – 14) = –4
• (12 – 14) = –2
• (13 – 14) = –1
• (15 – 14) = +1
• (20 – 14) = +6
• (–4)² = 16
• (–2)² = 4
• (–1)² = 1
• (+1)² = 1
• (+6)² = 36
4. Variance :
16 + 4 + 1 + 1 + 36 58
𝜎2 = = = 11,6
5 5
5. Écart-type :
𝜎 = √11,6 ≈ 3,4
Cela signifie que les notes s’écartent en moyenne de 3,4 points autour de la moyenne (14).
14
E.S.G.A.E la Grande Ecole Administration Base de Données (ABD)
• Analogie scolaire : Imagine une classe où la moyenne des notes est 14.
o Si tous les élèves ont entre 13 et 15, l’écart-type est petit (les élèves sont
homogènes).
o Si certains ont 5 et d’autres 20, l’écart-type est grand (les élèves sont très
différents).
• Analogie sportive : Dans une course de 100 m, si tous les coureurs franchissent la ligne
entre 10,1 et 10,3 secondes, l’écart-type est petit. Mais si certains mettent 9,8 secondes
et d’autres 12 secondes, l’écart-type est grand.
Illustration réelle :
• Sélection : garder les variables pertinentes (ex. âge, revenu) et supprimer les inutiles
(ex. numéro de dossier).
• Extraction : créer de nouvelles variables à partir des existantes (ex. taille + poids →
IMC).
15
E.S.G.A.E la Grande Ecole Administration Base de Données (ABD)
Analogie : C’est comme préparer une recette : on choisit les bons ingrédients et parfois on
les transforme (farine + eau → pâte).
Illustration réelle : Dans un dataset de santé, on ajoute une colonne “IMC” calculée à partir
de “taille” et “poids”.
Exercice pratique :
Solution :
Code Python :
import pandas as pd
data = {
"Nom": ["Alice", "Bob", "Clara", "David"],
"Age": [25, None, 30, 28],
16
E.S.G.A.E la Grande Ecole Administration Base de Données (ABD)
df = [Link](data)
print([Link]()) # détecter les valeurs manquantes
Analogie : C’est comme vérifier les copies d’examen et repérer celles où une réponse est
manquante.
Illustration réelle : Un tableau Excel avec une cellule vide dans la colonne “Âge”.
Remplacer l’âge de Bob par la moyenne des autres (25+30+28)/3 = 27,7 ≈ 28.
Code Python :
df["Age"].fillna(df["Age"].mean(), inplace=True)
print(df)
17
E.S.G.A.E la Grande Ecole Administration Base de Données (ABD)
Analogie : C’est comme remplir une case vide dans un formulaire avec une valeur moyenne
pour ne pas laisser de trou.
La normalisation est une étape cruciale pour mettre toutes les variables sur une même échelle.
Sans cela, une variable avec des valeurs très grandes (comme le revenu en euros) peut dominer
les calculs et fausser les résultats du modèle.
Formule de la normalisation :
𝑥 − 𝑚𝑖𝑛
𝑥𝑛𝑜𝑟𝑚 =
𝑚𝑎𝑥 − 𝑚𝑖𝑛
Code Python :
python
df["Revenu_normalise"] = (df["Revenu"] - df["Revenu"].min()) / (df["Revenu"].max() -
df["Revenu"].min())
print(df[["Nom", "Revenu", "Revenu_normalise"]])
Résultats attendus :
• Alice : 0
• Bob : ≈ 0,005
• Clara : 1
• David : ≈ 0,003
18
E.S.G.A.E la Grande Ecole Administration Base de Données (ABD)
Analogie : C’est comme mettre tous les joueurs sur le même terrain de football. Peu
importe qu’un joueur vienne d’un petit club ou d’un grand club, une fois sur le terrain, ils sont
comparés équitablement.
Les modèles de Machine Learning bénéficient souvent de variables dérivées. Ici, on peut
transformer la variable “Âge” en une catégorie qualitative : “Jeune” ou “Adulte”.
Règle de transformation :
Code Python :
python
df["Categorie_age"] = df["Age"].apply(lambda x: "Jeune" if x < 30 else "Adulte")
print(df[["Nom", "Age", "Categorie_age"]])
Résultats attendus :
19
E.S.G.A.E la Grande Ecole Administration Base de Données (ABD)
Analogie : C’est comme classer les élèves en deux groupes : les juniors et les seniors. Cela
simplifie la comparaison et permet d’adapter les analyses à chaque catégorie.
Illustration réelle : Un tableau médical qui regroupe les patients en catégories d’âge pour une
étude : “Jeunes” pour les moins de 30 ans, “Adultes” pour les 30 ans et plus. Cela permet de
comparer les comportements ou les risques selon les tranches d’âge.
20
E.S.G.A.E la Grande Ecole Administration Base de Données (ABD)
Analogie : C’est comme un élève qui révise avec un corrigé. On lui donne des exercices avec
les réponses. En comparant ses essais avec les corrections, il apprend à résoudre de nouveaux
exercices.
La régression est utilisée quand la sortie est une valeur numérique continue.
a) Régression linéaire
La régression linéaire cherche à modéliser la relation entre une variable indépendante (x) et
une variable dépendante (y) en traçant une droite qui s’ajuste au mieux aux données.
Formule : y=a*x+b
Cas d’usage
21
E.S.G.A.E la Grande Ecole Administration Base de Données (ABD)
Exemple :
Dataset :
Code Python :
import pandas as pd
from sklearn.linear_model import LinearRegression
model = LinearRegression()
[Link](X, y)
prediction = [Link]([[70]])
print("Prix prédit pour 70 m² :", prediction[0])
Analogie : C’est comme tracer une ligne de tendance sur un graphique de notes scolaires
pour estimer la note d’un nouvel élève.
Illustration réelle : Graphique montrant les points (surface vs prix) et la droite de régression
passant au milieu des points.
b) Régression polynomiale
22
E.S.G.A.E la Grande Ecole Administration Base de Données (ABD)
La régression polynomiale est une extension de la régression linéaire. Elle utilise une courbe
polynomiale pour mieux représenter les données lorsque la relation n’est pas linéaire.
Formule : y=a0+a1x+a2x2+...+anxn
Cas d’usage
Exemple :
Code Python :
import numpy as np
from [Link] import PolynomialFeatures
from sklearn.linear_model import LinearRegression
X = [Link]([1,2,3,4,5]).reshape(-1,1) # années
y = [Link]([100,150,300,600,1200]) # population
poly = PolynomialFeatures(degree=2)
X_poly = poly.fit_transform(X)
model = LinearRegression()
[Link](X_poly, y)
prediction = [Link]([Link]([[6]]))
print("Population prédite pour l'année 6 :", prediction[0])
23
E.S.G.A.E la Grande Ecole Administration Base de Données (ABD)
Analogie : C’est comme dessiner une courbe qui suit les montagnes et vallées d’un paysage
au lieu d’une simple ligne droite.
Illustration réelle : Graphique montrant une courbe polynomiale épousant les points de
croissance.
Le k-NN classe un nouvel élément selon les catégories de ses voisins les plus proches. On
calcule la distance entre le nouvel élément et les autres, puis on regarde la majorité des voisins.
Cas d’usage
Exemple :
Code Python :
import pandas as pd
from [Link] import KNeighborsClassifier
data = {
"Couleur": ["Rouge", "Jaune", "Orange"],
"Forme": ["Ronde", "Longue", "Ronde"],
"Fruit": ["Pomme", "Banane", "Orange"]
}
df = [Link](data)
X = pd.get_dummies(df[["Couleur","Forme"]])
y = df["Fruit"]
model = KNeighborsClassifier(n_neighbors=1)
[Link](X, y)
new_fruit = [Link]({"Couleur":["Jaune"],"Forme":["Longue"]})
new_fruit_encoded = pd.get_dummies(new_fruit).reindex(columns=[Link], fill_value=0)
prediction = [Link](new_fruit_encoded)
24
E.S.G.A.E la Grande Ecole Administration Base de Données (ABD)
Résultat : Banane.
Analogie : C’est comme demander l’avis des voisins pour savoir si une maison est belle.
b) Arbres de décision
Les arbres de décision posent des questions successives (“Couleur = Jaune ?”) pour arriver à
une classe. Chaque nœud correspond à une condition, chaque feuille à une classe.
Cas d’usage
Exemple :
Code Python :
X = [[25,2500],[30,4000],[40,5000],[20,1000]]
y = ["Oui","Oui","Oui","Non"]
model = DecisionTreeClassifier()
[Link](X,y)
prediction = [Link]([[28,3000]])
print("Prêt accordé :", prediction[0])
25
E.S.G.A.E la Grande Ecole Administration Base de Données (ABD)
Résultat : Oui.
Illustration réelle : Diagramme d’arbre avec branches “Âge > 25 ?”, “Revenu > 2000 ?”.
c) Random Forest
Le Random Forest combine plusieurs arbres de décision pour améliorer la précision. Chaque
arbre vote, et la majorité détermine la classe finale.
Cas d’usage
Exemple :
Code Python :
X = [[25,2500],[30,4000],[40,5000],[20,1000]]
y = ["Oui","Oui","Oui","Non"]
model = RandomForestClassifier(n_estimators=10)
[Link](X,y)
prediction = [Link]([[28,3000]])
print("Prêt accordé :", prediction[0])
Résultat : Oui.
26
E.S.G.A.E la Grande Ecole Administration Base de Données (ABD)
Illustration réelle : Graphique montrant plusieurs arbres votant pour une décision finale.
Les SVM (Support Vector Machines) cherchent à séparer les classes en traçant une frontière
optimale. Cette frontière est appelée hyperplan. L’idée est de trouver l’hyperplan qui
maximise la marge, c’est-à-dire la distance entre la frontière et les points les plus proches de
chaque classe (appelés vecteurs de support).
1
min ∣∣ 𝑤 ∣∣2 sous contrainte que 𝑦𝑖 (𝑤 ⋅ 𝑥𝑖 + 𝑏) ≥ 1
2
Cas d’usage :
Exemple :
Supposons un dataset avec deux variables : longueur du texte et nombre de mots suspects.
Code Python :
python
from sklearn import svm
27
E.S.G.A.E la Grande Ecole Administration Base de Données (ABD)
model = [Link](kernel='linear')
[Link](X,y)
prediction = [Link]([[25,7]])
print("Email :", prediction[0])
Résultat : Spam.
Analogie : C’est comme tracer une ligne dans le sable pour séparer deux groupes d’enfants
qui jouent. On place la ligne de manière à ce qu’elle soit la plus éloignée possible des enfants
de chaque groupe, pour éviter toute confusion.
Illustration réelle : Un graphique montrant deux groupes de points (Spam vs Non Spam)
séparés par une ligne droite avec une marge maximale.
Les réseaux de neurones artificiels sont inspirés du cerveau humain. Ils sont constitués de
couches de neurones reliés entre eux. Chaque neurone reçoit des entrées, applique une
fonction d’activation, et transmet une sortie.
𝑦 = 𝑓(∑𝑤𝑖 𝑥𝑖 + 𝑏)
où 𝑤𝑖 sont les poids, 𝑥𝑖 les entrées, 𝑏 le biais, et 𝑓 la fonction d’activation (sigmoïde, ReLU,
etc.).
Cas d’usage
Exemple :
28
E.S.G.A.E la Grande Ecole Administration Base de Données (ABD)
Code Python :
python
from sklearn.neural_network import MLPClassifier
from [Link] import load_digits
from sklearn.model_selection import train_test_split
digits = load_digits()
X_train, X_test, y_train, y_test = train_test_split([Link], [Link], test_size=0.3)
Résultat : précision ≈ 95 %.
Analogie : C’est comme un cerveau artificiel qui apprend à reconnaître des motifs. Chaque
neurone est comme un petit “décideur” qui transmet son avis aux autres, et ensemble ils
prennent une décision finale.
Illustration réelle : Un schéma montrant une couche d’entrée (pixels d’une image), une
couche cachée (neurones intermédiaires), et une couche de sortie (chiffre reconnu).
29
E.S.G.A.E la Grande Ecole Administration Base de Données (ABD)
𝑉𝑟𝑎𝑖𝑠 𝑝𝑜𝑠𝑖𝑡𝑖𝑓𝑠
𝑅𝑒𝑐𝑎𝑙𝑙 =
𝑉𝑟𝑎𝑖𝑠 𝑝𝑜𝑠𝑖𝑡𝑖𝑓𝑠 + 𝐹𝑎𝑢𝑥 𝑛é𝑔𝑎𝑡𝑖𝑓𝑠
𝑃𝑟𝑒𝑐𝑖𝑠𝑖𝑜𝑛 ∗ 𝑅𝑒𝑐𝑎𝑙𝑙
𝐹1 = 2 ∗
𝑃𝑟𝑒𝑐𝑖𝑠𝑖𝑜𝑛 + 𝑅𝑒𝑐𝑎𝑙𝑙
Exercice pratique :
1. Utilisez une régression linéaire pour prédire le prix d’une maison de 70 m².
2. Évaluez la précision du modèle.
3. Expliquez le résultat avec une analogie.
4. Comparez avec un arbre de décision et un k-NN.
30
E.S.G.A.E la Grande Ecole Administration Base de Données (ABD)
1. Régression linéaire
import pandas as pd
from sklearn.linear_model import LinearRegression
model = LinearRegression()
[Link](X, y)
prediction = [Link]([[70]])
print("Prix prédit pour 70 m² :", prediction[0])
2. Évaluation du modèle
y_pred = [Link](X)
score = r2_score(y, y_pred)
print("Score R² :", score)
tree = DecisionTreeRegressor()
[Link](X,y)
prediction_tree = [Link]([[70]])
print("Prix prédit par arbre de décision :", prediction_tree[0])
Résultat : environ 180000 FCFA (car l’arbre prend la valeur du voisinage le plus proche).
knn = KNeighborsRegressor(n_neighbors=2)
[Link](X,y)
prediction_knn = [Link]([[70]])
print("Prix prédit par k-NN :", prediction_knn[0])
31
E.S.G.A.E la Grande Ecole Administration Base de Données (ABD)
Analogie finale
Illustration réelle : Graphique comparant les trois méthodes sur le même dataset.
32
E.S.G.A.E la Grande Ecole Administration Base de Données (ABD)
• Pas d’étiquettes : on ne dit pas au modèle “ceci est un chat” ou “ceci est un chien”.
• Objectif : trouver des regroupements, des motifs ou des représentations utiles.
• Résultat : le modèle organise les données en catégories ou réduit leur complexité.
Analogie : C’est comme entrer dans une bibliothèque sans catalogue. Tu dois toi-même
regrouper les livres par thèmes (romans, sciences, histoire) en observant leurs contenus.
a) k-Means Clustering
Le k-Means est l’algorithme de clustering le plus connu. Il divise les données en (k) groupes
(clusters).
Étapes :
33
E.S.G.A.E la Grande Ecole Administration Base de Données (ABD)
𝑑(𝑥, 𝑦) = √∑( 𝑥𝑖 − 𝑦𝑖 )2
𝑖=1
Cette formule calcule la distance entre deux points (x) et (y). Plus la distance est petite, plus
les points sont proches.
Cas d’usage
Exemple :
Code Python :
import numpy as np
from [Link] import KMeans
X = [Link]([[25,2500],[30,4000],[40,5000],[20,1000],[35,4500],[50,8000]])
Analogie : C’est comme séparer les élèves en deux groupes : ceux qui ont de bonnes notes
et ceux qui ont des notes plus faibles.
34
E.S.G.A.E la Grande Ecole Administration Base de Données (ABD)
Illustration réelle : Graphique montrant deux nuages de points regroupés autour de leurs
centres.
b) Clustering hiérarchique
Le clustering hiérarchique construit une hiérarchie de groupes. On peut visualiser cela avec un
dendrogramme.
Étapes :
Cas d’usage
Exemple :
Code Python :
import numpy as np
from [Link] import linkage, dendrogram
import [Link] as plt
X = [Link]([[25,2500],[30,4000],[40,5000],[20,1000],[35,4500],[50,8000]])
Z = linkage(X, 'ward')
dendrogram(Z)
[Link]()
35
E.S.G.A.E la Grande Ecole Administration Base de Données (ABD)
Analogie : C’est comme un arbre généalogique qui montre comment les familles se
regroupent.
Formule clé : Un point appartient à un cluster si au moins MinPts voisins se trouvent dans un
rayon 𝜀.
Cas d’usage
Exemple :
Code Python :
X = [Link]([[1,2],[2,2],[2,3],[8,7],[8,8],[25,80]])
36
E.S.G.A.E la Grande Ecole Administration Base de Données (ABD)
Analogie : C’est comme repérer les groupes d’élèves qui discutent ensemble et ignorer celui
qui est seul dans un coin.
Illustration réelle : Graphique montrant des clusters denses et des points isolés.
Formule :
1
𝐶= ∑(𝑥𝑖 − 𝜇)(𝑥𝑖 − 𝜇)𝑇
𝑛
Puis on trouve les vecteurs propres (directions principales) et valeurs propres (importance).
Cas d’usage :
Exemple :
Code Python :
digits = load_digits()
X = [Link]
pca = PCA(n_components=2)
X_reduced = pca.fit_transform(X)
37
E.S.G.A.E la Grande Ecole Administration Base de Données (ABD)
Analogie : C’est comme résumer un livre en quelques phrases tout en gardant l’essentiel.
Le t-SNE est une méthode de réduction non linéaire. Il projette les données dans un espace de
faible dimension tout en préservant les relations de voisinage.
Cas d’usage :
Exemple :
Code Python :
X_embedded = TSNE(n_components=2).fit_transform(X[:500])
[Link](X_embedded[:,0], X_embedded[:,1])
[Link]()
38
E.S.G.A.E la Grande Ecole Administration Base de Données (ABD)
Analogie : C’est comme dessiner une carte simplifiée d’une ville où les quartiers proches
restent proches.
a) Indice de silhouette
Cet indice mesure à quel point les points d’un cluster sont cohésifs et bien séparés des autres
clusters.
𝑏−𝑎
Formule : 𝑆𝑖𝑙ℎ𝑜𝑢𝑒𝑡𝑡𝑒 = max (𝑎,𝑏)
• (a) = distance moyenne entre un point et les autres points de son cluster.
• (b) = distance moyenne entre ce point et les points du cluster le plus proche.
Valeurs possibles :
b) Inertie (k-Means)
L’inertie mesure la somme des distances des points à leur centre de cluster. Plus l’inertie est
faible, plus les clusters sont compacts.
39
E.S.G.A.E la Grande Ecole Administration Base de Données (ABD)
Analogie : C’est comme évaluer un groupe d’élèves : on regarde si les élèves d’un même
groupe se ressemblent et si les groupes sont bien distincts.
L’apprentissage non supervisé est aussi utilisé pour détecter des anomalies, c’est-à-dire des
points qui ne ressemblent pas aux autres.
Une anomalie est un point isolé ou très éloigné des clusters principaux.
a) Algorithmes utilisés
• Isolation Forest : construit des arbres qui isolent les points. Les anomalies sont isolées
plus rapidement.
• One-Class SVM : apprend une frontière autour des données normales et considère les
points extérieurs comme anomalies.
Chaque arbre sépare les données en sous-ensembles. La longueur moyenne du chemin pour
isoler un point est utilisée comme score d’anomalie.
𝐸(ℎ(𝑥))
−
𝑆𝑐𝑜𝑟𝑒(𝑥) = 2 𝑐(𝑛)
Où 𝐸(ℎ(𝑥)) est la longueur moyenne du chemin pour isoler 𝑥, et 𝑐(𝑛) est une constante de
normalisation.
Cas d’usage :
40
E.S.G.A.E la Grande Ecole Administration Base de Données (ABD)
Exemple :
Code Python :
import numpy as np
from [Link] import IsolationForest
model = IsolationForest(contamination=0.2)
[Link](X)
predictions = [Link](X)
print("Résultats :", predictions)
Analogie : C’est comme repérer un élève qui a une note de 0 alors que tous les autres ont
entre 10 et 15.
Illustration réelle : Graphique montrant un nuage de points avec un point isolé loin des autres.
Exercice pratique :
41
E.S.G.A.E la Grande Ecole Administration Base de Données (ABD)
import numpy as np
import [Link] as plt
from [Link] import KMeans
from [Link] import silhouette_score
from [Link] import IsolationForest
# Dataset
X = [Link]([[25,2500],[30,4000],[40,5000],[20,1000],[35,4500],[50,8000],[60,20000]])
# 1. Clustering k-Means
model = KMeans(n_clusters=2, random_state=0)
labels = model.fit_predict(X)
centers = model.cluster_centers_
# 2. Visualisation
[Link](X[:,0], X[:,1], c=labels)
[Link](centers[:,0], centers[:,1], c='red', marker='x')
[Link]("Âge")
[Link]("Revenu (FCFA)")
[Link]("Clustering k-Means")
[Link]()
# 3. Évaluation silhouette
score = silhouette_score(X, labels)
print("Indice de silhouette :", score)
# 4. Détection d'anomalies
iso = IsolationForest(contamination=0.2)
anomalies = iso.fit_predict(X)
print("Anomalies détectées :", anomalies)
Résultats attendus :
• Deux clusters : jeunes avec revenus faibles/moyens et plus âgés avec revenus élevés.
• Indice de silhouette positif (clusters bien séparés).
• Le point (60, 20000) est détecté comme anomalie.
42
E.S.G.A.E la Grande Ecole Administration Base de Données (ABD)
Analogie : C’est comme séparer les clients d’un supermarché en deux catégories : ceux qui
achètent des produits bon marché et ceux qui achètent des produits premium. L’anomalie est
un client exceptionnel qui dépense énormément, très différent des autres.
Illustration réelle : Graphique montrant deux clusters distincts avec un point isolé.
43
E.S.G.A.E la Grande Ecole Administration Base de Données (ABD)
Les réseaux de neurones artificiels sont inspirés du fonctionnement du cerveau humain. Dans
notre cerveau, les neurones biologiques reçoivent des signaux, les pondèrent, et transmettent
une réponse. Les réseaux artificiels imitent ce principe avec des neurones mathématiques
reliés en couches.
Chaque neurone artificiel reçoit des entrées (features), applique des poids pour mesurer leur
importance, ajoute un biais pour ajuster la décision, puis applique une fonction d’activation
pour produire une sortie.
𝑦 = 𝑓 (∑ 𝑤𝑖 ⋅ 𝑥𝑖 + 𝑏)
𝑖=1
Analogie : Imagine un élève qui reçoit plusieurs conseils (entrées). Il accorde plus ou moins
d’importance à chaque conseil (poids), ajoute son propre jugement (biais), puis prend une
décision finale (fonction d’activation).
Illustration réelle : Un schéma montrant une couche d’entrée (pixels), une couche cachée
(neurones intermédiaires), et une couche de sortie (classe prédite).
L’apprentissage profond (Deep Learning) est une extension des réseaux de neurones,
utilisant plusieurs couches cachées pour apprendre des représentations complexes.
44
E.S.G.A.E la Grande Ecole Administration Base de Données (ABD)
Les données passent de la couche d’entrée à la couche de sortie en traversant les couches
cachées. Chaque neurone calcule sa sortie avec la formule précédente.
b) Rétropropagation (Backpropagation)
∂𝐿
𝑤𝑛𝑒𝑤 = 𝑤𝑜𝑙𝑑 − 𝜂 ⋅
∂𝑤
Analogie : C’est comme un élève qui corrige ses erreurs après avoir reçu la correction d’un
examen.
Les CNN sont utilisés principalement pour les images. Un CNN applique des filtres (kernels)
sur l’image pour détecter des motifs (bords, textures, formes).
Formule de convolution :
45
E.S.G.A.E la Grande Ecole Administration Base de Données (ABD)
• 𝐼= image.
• 𝐾= filtre.
• 𝑆= sortie (feature map).
b) Cas d’usage
Analogie : C’est comme passer une loupe sur une image pour repérer des détails précis.
model = Sequential([
Conv2D(32, (3,3), activation='relu', input_shape=(64,64,3)),
MaxPooling2D(pool_size=(2,2)),
Flatten(),
Dense(128, activation='relu'),
Dense(1, activation='sigmoid')
])
46
E.S.G.A.E la Grande Ecole Administration Base de Données (ABD)
ℎ𝑡 = 𝑓(𝑊 ⋅ 𝑥𝑡 + 𝑈 ⋅ ℎ𝑡−1 + 𝑏)
Cas d’usage :
Analogie : C’est comme un élève qui se souvient des phrases précédentes pour comprendre la
suite d’un texte.
Illustration réelle : Un schéma montrant une séquence de mots passant à travers un RNN.
model = Sequential([
Dense(10, activation='relu', input_shape=(5,)),
Dense(1, activation='sigmoid')
])
47
E.S.G.A.E la Grande Ecole Administration Base de Données (ABD)
Exercice pratique :
Construisons un réseau de neurones pour reconnaître les chiffres manuscrits (dataset MNIST).
y_train = to_categorical(y_train)
y_test = to_categorical(y_test)s
model = Sequential([
Dense(128, activation='relu', input_shape=(28*28,)),
Dense(10, activation='softmax')
])
Le réseau de neurones a appris à reconnaître les chiffres manuscrits en ajustant ses poids.
48
E.S.G.A.E la Grande Ecole Administration Base de Données (ABD)
Analogie : C’est comme un élève qui s’entraîne à lire des écritures manuscrites. Au début, il
fait des erreurs, mais après avoir vu des milliers d’exemples, il devient capable de reconnaître
presque tous les chiffres correctement.
49
E.S.G.A.E la Grande Ecole Administration Base de Données (ABD)
Analogie : Imagine un élève qui révise pour un examen. Il ne suffit pas de réussir les exercices
du manuel : il faut vérifier ses réponses avec différents tests, ajuster sa méthode de travail, et
éviter de trop mémoriser les exemples (surapprentissage) ou de rester trop superficiel
(sous-apprentissage).
Formule
𝑘
1
𝑆𝑐𝑜𝑟𝑒 = ∑ 𝑃𝑒𝑟𝑓𝑜𝑟𝑚𝑎𝑛𝑐 𝑒𝑖
𝑘
𝑖=1
Cela signifie que l’on calcule la performance sur chaque fold, puis on fait la moyenne.
Exemple pratique :
50
E.S.G.A.E la Grande Ecole Administration Base de Données (ABD)
Commentaires :
Analogie : C’est comme un élève qui révise avec 5 séries de questions différentes pour
s’assurer qu’il est prêt à affronter n’importe quel examen.
Les hyperparamètres sont des paramètres fixés avant l’entraînement (par exemple,
profondeur d’un arbre, nombre de neurones, taux d’apprentissage).
a) Grid Search
b) Random Search
51
E.S.G.A.E la Grande Ecole Administration Base de Données (ABD)
𝐶𝑜𝑚𝑏𝑖𝑛𝑎𝑖𝑠𝑜𝑛𝑠 = 𝑚𝑛
Exemple :
# Créer un GridSearchCV
grid = GridSearchCV(SVC(), param_grid, cv=3)
Commentaires :
52
E.S.G.A.E la Grande Ecole Administration Base de Données (ABD)
Analogie : C’est comme essayer toutes les recettes possibles pour trouver la meilleure façon
de cuisiner un plat.
Critères de comparaison :
Analogie : C’est comme choisir un moyen de transport : la voiture est rapide mais coûteuse, le
vélo est lent mais économique, le train est équilibré.
a) Surapprentissage (Overfitting)
53
E.S.G.A.E la Grande Ecole Administration Base de Données (ABD)
Le modèle apprend trop bien les données d’entraînement et échoue sur les nouvelles données.
b) Sous-apprentissage (Underfitting)
Illustration réelle :
c) Solutions
Exercice pratique :
Solution :
54
E.S.G.A.E la Grande Ecole Administration Base de Données (ABD)
Commentaires :
Résultats attendus :
Analogie : C’est comme un élève qui révise avec plusieurs méthodes (validation croisée),
ajuste sa stratégie (hyperparamètres), et choisit la meilleure technique pour réussir son examen
(sélection du modèle).
55
E.S.G.A.E la Grande Ecole Administration Base de Données (ABD)
Analogie : C’est comme passer du vélo à la voiture : les bases du déplacement sont les mêmes,
mais les outils sont plus sophistiqués et permettent d’aller plus loin, plus vite et avec plus de
confort.
Illustration réelle : Un schéma montrant un étudiant qui passe des bases (livres scolaires) aux
outils avancés (laboratoire, logiciels, projets réels).
On entraîne plusieurs modèles sur des sous-ensembles de données obtenus par tirage aléatoire
avec remise. Les prédictions sont ensuite combinées.
Formule :
𝑛
1
𝑃𝑟𝑒𝑑𝑖𝑐𝑡𝑖𝑜𝑛 = ∑ 𝑀𝑜𝑑𝑒 𝑙𝑖 (𝑥)
𝑛
𝑖=1
56
E.S.G.A.E la Grande Ecole Administration Base de Données (ABD)
Commentaires :
Analogie : C’est comme demander l’avis de 100 médecins et prendre la majorité de leurs
recommandations.
Illustration réelle : Un diagramme montrant plusieurs arbres de décision votant ensemble pour
une prédiction finale.
b) Boosting
On entraîne des modèles successifs. Chaque nouveau modèle se concentre sur les erreurs du
précédent.
57
E.S.G.A.E la Grande Ecole Administration Base de Données (ABD)
Commentaires :
Analogie : C’est comme un élève qui corrige ses erreurs à chaque révision, en mettant plus
d’attention sur les questions qu’il a ratées.
Illustration réelle : Un schéma montrant une série d’arbres corrigeant progressivement les
erreurs des précédents.
c) Stacking
58
E.S.G.A.E la Grande Ecole Administration Base de Données (ABD)
# Définir le méta-modèle
stack = StackingClassifier(
estimators=base_estimators,
final_estimator=RandomForestClassifier(n_estimators=50),
cv=5
)
Commentaires :
Analogie : C’est comme une équipe composée de spécialistes différents (médecin, ingénieur,
avocat) qui donnent chacun leur avis, puis un chef d’équipe prend la décision finale.
Illustration réelle : Un schéma montrant plusieurs modèles de base envoyant leurs résultats à
un modèle final qui prend la décision.
a) Concepts clés
59
E.S.G.A.E la Grande Ecole Administration Base de Données (ABD)
b) Formule (Q-Learning)
import numpy as np
# Initialiser la table Q
Q = [Link]((len(states), len(actions)))
# Paramètres
alpha = 0.1 # taux d'apprentissage
gamma = 0.9 # facteur de discount
episodes = 100
# Simulation simple
for ep in range(episodes):
state = 0
while state < 3:
action = [Link](actions)
if action == 1: # aller à droite
next_state = state + 1
reward = 1 if next_state == 3 else 0
else: # aller à gauche
next_state = max(0, state - 1)
reward = 0
# Mise à jour Q
Q[state, action] = Q[state, action] + alpha * (
reward + gamma * [Link](Q[next_state]) - Q[state, action]
)
state = next_state
Commentaires :
60
E.S.G.A.E la Grande Ecole Administration Base de Données (ABD)
Analogie : C’est comme un enfant qui apprend à traverser un labyrinthe en essayant différentes
directions et en recevant des points quand il trouve la sortie.
Analogie : C’est comme un étudiant qui a appris le français et qui utilise ses connaissances
pour apprendre l’espagnol plus rapidement. Les bases (grammaire, vocabulaire) sont
transférées, et il ne reste qu’à adapter les détails.
Illustration réelle : Imagine un chirurgien qui a appris à opérer le cœur. Lorsqu’il doit opérer
les poumons, il ne repart pas de zéro : il transfère ses connaissances médicales générales et
adapte ses gestes.
61
E.S.G.A.E la Grande Ecole Administration Base de Données (ABD)
# Compiler le modèle
[Link](optimizer='adam',loss='sparse_categorical_crossentropy',metrics=['accuracy']
)
# Entraîner le modèle
history = [Link](X_train, y_train, epochs=3, batch_size=64, validation_split=0.1)
Commentaires :
62
E.S.G.A.E la Grande Ecole Administration Base de Données (ABD)
Un modèle peut reproduire des discriminations si les données d’entraînement sont biaisées.
Exemple : Un algorithme de recrutement qui favorise les hommes parce que les données
historiques contiennent plus de CV masculins.
Analogie : C’est comme un professeur qui corrige les copies en fonction de ses préjugés : le
résultat est injuste.
Illustration réelle : Un graphique montrant deux groupes (hommes/femmes) avec des scores
différents à cause d’un biais dans les données.
b) Transparence
Exemple : Dans la santé, un médecin doit comprendre pourquoi un modèle prédit une maladie.
63
E.S.G.A.E la Grande Ecole Administration Base de Données (ABD)
Illustration réelle : Un schéma montrant un modèle complexe avec une “boîte noire” et des
outils d’explication qui éclairent ses décisions.
c) Équité
Exemple : Un modèle de crédit qui refuse systématiquement les demandes d’un quartier
défavorisé.
Analogie : C’est comme une banque qui juge les clients uniquement sur leur adresse, sans
regarder leur situation réelle.
Illustration réelle : Un diagramme montrant une balance de justice, avec des données
équilibrées d’un côté et biaisées de l’autre.
Exercice pratique :
64
E.S.G.A.E la Grande Ecole Administration Base de Données (ABD)
Solution :
Commentaires :
Résultats attendus :
65
E.S.G.A.E la Grande Ecole Administration Base de Données (ABD)
Analogie : C’est comme comparer un seul médecin (régression logistique) avec une équipe de
médecins (Random Forest). L’équipe donne généralement un meilleur diagnostic car elle
combine plusieurs avis.
Illustration réelle : Un schéma montrant un médecin seul face à un patient, puis une équipe
de médecins discutant ensemble pour donner un diagnostic plus fiable.
66
E.S.G.A.E la Grande Ecole Administration Base de Données (ABD)
Analogie : C’est comme apprendre à conduire : après avoir étudié le code de la route et la
mécanique, il faut monter dans la voiture et rouler sur de vraies routes.
# Reshape et normaliser
X_train = X_train.reshape(-1,28,28,1).astype('float32')/255
X_test = X_test.reshape(-1,28,28,1).astype('float32')/255
67
E.S.G.A.E la Grande Ecole Administration Base de Données (ABD)
y_train = to_categorical(y_train)
y_test = to_categorical(y_test)
[Link](optimizer='adam',loss='categorical_crossentropy',metrics=['accuracy'])
[Link](X_train,y_train,epochs=3,batch_size=128,validation_split=0.1)
Commentaires :
Illustration réelle : Un schéma montrant des images de chiffres manuscrits passant dans un
CNN et produisant une prédiction.
# Exemple de dataset
68
E.S.G.A.E la Grande Ecole Administration Base de Données (ABD)
texts = ["J'adore ce film", "Ce produit est horrible", "Très bon service", "Je déteste cette
expérience"]
labels = [1,0,1,0] # 1 = positif, 0 = négatif
# Construire un pipeline
model = make_pipeline(CountVectorizer(), MultinomialNB())
# Entraîner
[Link](texts, labels)
# Tester
print([Link](["Ce restaurant est excellent"]))
print([Link](["Je n'aime pas ce livre"]))
Commentaires :
Illustration réelle : Un schéma montrant des phrases passant dans un modèle qui les classe en
“positif” ou “négatif”.
import numpy as np
from [Link] import Sequential
from [Link] import LSTM, Dense
69
E.S.G.A.E la Grande Ecole Administration Base de Données (ABD)
# Construire un LSTM
model = Sequential([
LSTM(50, activation='relu', input_shape=(3,1)),
Dense(1)
])
[Link](optimizer='adam', loss='mse')
[Link](X,y,epochs=200,verbose=0)
# Prédire
print("Prédiction pour [97,98,99] :", [Link]([Link]([[[97],[98],[99]]])))
Commentaires :
Illustration réelle : Un graphique montrant une série temporelle avec une courbe prédite par
le modèle.
70
E.S.G.A.E la Grande Ecole Administration Base de Données (ABD)
Illustration réelle : Un schéma montrant une caméra détectant des visages et les identifiant.
71
E.S.G.A.E la Grande Ecole Administration Base de Données (ABD)
app = Flask(__name__)
@[Link]('/predict', methods=['POST'])
def predict():
data = [Link]['features']
prediction = [Link]([data])
return jsonify({'prediction': int(prediction[0])})
if __name__ == '__main__':
[Link](debug=True)
Commentaires :
72
E.S.G.A.E la Grande Ecole Administration Base de Données (ABD)
Illustration réelle : Un schéma montrant un utilisateur envoyant des données à une API et
recevant une prédiction.
Exercice pratique :
(Nous avons déjà vu les étapes 1–3 plus haut. L’étape 4 montre le déploiement.)
73
E.S.G.A.E la Grande Ecole Administration Base de Données (ABD)
Analogie finale : C’est comme construire une maison : on ne se contente pas des plans
(théorie), on assemble les briques (projets pratiques), on installe l’électricité et l’eau
(applications réelles), puis on ouvre la porte pour y vivre (déploiement).
74
E.S.G.A.E la Grande Ecole Administration Base de Données (ABD)
Conclusion
Ce parcours à travers l’apprentissage automatique a permis de construire une compréhension
progressive, allant des fondements théoriques aux applications pratiques et aux enjeux
éthiques. Les étudiants ont découvert non seulement les algorithmes et les techniques, mais
aussi la manière dont ces outils transforment la recherche, l’industrie et la société.
L’apprentissage automatique n’est pas une discipline figée : c’est un domaine en constante
évolution, où chaque avancée ouvre de nouvelles perspectives. En maîtrisant les concepts vus
dans ce cours, les étudiants disposent désormais d’une base solide pour explorer des projets
plus complexes, contribuer à des innovations et réfléchir aux implications de leurs choix
technologiques.
Au-delà des formules et des modèles, ce cours a insisté sur l’importance de l’esprit critique, de
l’expérimentation et de la responsabilité. L’IA n’est pas seulement une question de
performance technique : elle doit être conçue et utilisée avec équité, transparence et sens
éthique.
En conclusion, ce cours a été conçu comme un voyage progressif : partir des bases, construire
des compétences pratiques, explorer des techniques avancées et réfléchir aux enjeux éthiques.
Les étudiants sont désormais mieux préparés à appliquer l’IA dans des contextes réels, à
poursuivre leurs apprentissages et à contribuer de manière responsable au développement
de cette discipline en pleine expansion.
75
E.S.G.A.E la Grande Ecole Administration Base de Données (ABD)
Bibliographie
Ouvrages fondamentaux
Manuels pratiques
Lectures complémentaires
• Hastie, T., Tibshirani, R., & Friedman, J. (2009). The Elements of Statistical Learning.
Springer. Approche statistique avancée des modèles d’apprentissage.
• Sutton, R. S., & Barto, A. G. (2018). Reinforcement Learning: An Introduction. MIT
Press. Référence pour comprendre les bases et applications de l’apprentissage par
renforcement.
• Mitchell, T. M. (1997). Machine Learning. McGraw-Hill. Texte classique qui introduit
les concepts fondamentaux de manière accessible.
• Russell, S., & Norvig, P. (2021). Artificial Intelligence: A Modern Approach. Pearson.
Ouvrage généraliste sur l’IA, incluant l’apprentissage automatique dans un cadre plus
large.
a
E.S.G.A.E la Grande Ecole Administration Base de Données (ABD)
b
E.S.G.A.E la Grande Ecole Administration Base de Données (ABD)
c
E.S.G.A.E la Grande Ecole Administration Base de Données (ABD)
d
E.S.G.A.E la Grande Ecole Administration Base de Données (ABD)