Intelligence Artificielle en actuariat
Chapitre 1 : Fondements et Concepts de Base
Pr. Abdallah Abarda
27 février 2025
Pr. Abdallah Abarda Intelligence Artificielle en actuariat 27 février 2025 1 / 21
Qu’est-ce que l’Intelligence Artificielle ?
Définition : L’IA est un ensemble de technologies et d’algorithmes
permettant de reproduire des processus habituellement réalisés par
l’être humain.
Objectif : Permettre aux machines de penser et d’agir de manière
intelligente.
Applications : Santé, finance, cybersécurité, actuariat, etc.
Pr. Abdallah Abarda Intelligence Artificielle en actuariat 27 février 2025 2 / 21
Les Trois Piliers de l’IA
Data Science : Gestion et analyse des données.
Machine Learning : Apprentissage automatique à partir des données.
Deep Learning : Réseaux de neurones pour des tâches complexes.
Pr. Abdallah Abarda Intelligence Artificielle en actuariat 27 février 2025 3 / 21
Les Origines de l’IA
1950 : Alan Turing propose le Test de Turing dans son essai
”Computing Machinery and Intelligence”.
1956 : Conférence de Dartmouth College, considérée comme la
naissance officielle de l’IA.
1959 : Allen Newell et Herbert A. Simon développent Logic
Theorist, un programme pionnier en IA.
Pr. Abdallah Abarda Intelligence Artificielle en actuariat 27 février 2025 4 / 21
Évolution de l’IA
1966 : Joseph Weizenbaum crée ELIZA, un programme de
traitement du langage naturel.
1969 : Terry Winograd conçoit SHRDLU, un programme capable de
manipuler des objets virtuels.
Années 1980 : Période de ralentissement due à des résultats
décevants et un financement limité.
Pr. Abdallah Abarda Intelligence Artificielle en actuariat 27 février 2025 5 / 21
Les Grandes Étapes Modernes
1997 : Deep Blue (IBM) bat le champion du monde d’échecs Garry
Kasparov.
2011 : IBM Watson remporte le jeu télévisé Jeopardy !.
2012 : AlexNet remporte le défi ImageNet, marquant le début de
l’ère du deep learning.
2014 : Facebook développe DeepFace, un système de reconnaissance
faciale de haute précision.
Pr. Abdallah Abarda Intelligence Artificielle en actuariat 27 février 2025 6 / 21
Domaine d’Application de l’IA
Santé : Diagnostic de maladies, imagerie médicale.
Transport : Voitures autonomes, optimisation des trafics.
Finance : Détection de fraudes, trading algorithmique.
Actuariat : Prédiction des risques, tarification des assurances.
Divertissement : Recommandation de films, jeux vidéo.
Pr. Abdallah Abarda Intelligence Artificielle en actuariat 27 février 2025 7 / 21
Exemples Concrets
Reconnaissance d’images : Détection de visages, classification
d’objets.
Traitement du langage naturel : Chatbots, traduction automatique.
Prédiction : Prévisions météorologiques, tendances de marché.
Pr. Abdallah Abarda Intelligence Artificielle en actuariat 27 février 2025 8 / 21
Types d’Intelligence Artificielle
IA Forte : Machines capables de raisonner comme un humain
(objectif à long terme).
IA Faible : Machines conçues pour des tâches spécifiques (ex :
reconnaissance vocale).
IA Connexionniste : Réseaux de neurones inspirés du cerveau
humain.
Pr. Abdallah Abarda Intelligence Artificielle en actuariat 27 février 2025 9 / 21
IA Faible vs IA Forte
IA Faible :
Exemples : Siri, Alexa, voitures autonomes.
Limites : Ne peut pas généraliser à d’autres domaines.
IA Forte :
Objectif : Créer une machine consciente et autonome.
Défis : Complexité du raisonnement humain.
Pr. Abdallah Abarda Intelligence Artificielle en actuariat 27 février 2025 10 / 21
Types d’Apprentissage
Pr. Abdallah Abarda Intelligence Artificielle en actuariat 27 février 2025 11 / 21
Types d’Apprentissage automatique
Pr. Abdallah Abarda Intelligence Artificielle en actuariat 27 février 2025 12 / 21
Qu’est-ce que le Machine Learning ?
Définition : Méthode permettant aux machines d’apprendre à partir
de données sans être explicitement programmées.
Objectif : Automatiser des tâches et effectuer des prédictions.
Pr. Abdallah Abarda Intelligence Artificielle en actuariat 27 février 2025 13 / 21
Types d’Apprentissage automatique
Apprentissage Supervisé : Données étiquetées (ex : classification,
régression).
Apprentissage Non-Supervisé : Données non étiquetées (ex :
clustering).
Apprentissage par Renforcement : Apprentissage par essais et
erreurs (ex : jeux vidéo).
Pr. Abdallah Abarda Intelligence Artificielle en actuariat 27 février 2025 14 / 21
Types d’Apprentissage automatique
Pr. Abdallah Abarda Intelligence Artificielle en actuariat 27 février 2025 15 / 21
Points Clés à Retenir
L’IA vise à reproduire l’intelligence humaine à travers des machines.
Elle repose sur trois piliers : Data Science, Machine Learning, Deep
Learning.
Les applications de l’IA sont vastes et touchent presque tous les
domaines, en particulier celui de l’actuariat et assurance.
Le Machine Learning est au cœur de l’IA moderne.
Pr. Abdallah Abarda Intelligence Artificielle en actuariat 27 février 2025 16 / 21
IA et transformation des métiers de l’assurance
Secteur assurance dommages en mutation numérique
Enjeux : rapidité, fraude, personnalisation
IA = système apprenant avec différents niveaux d’autonomie
Objectif : Moderniser les processus assurance-indemnisation
Pr. Abdallah Abarda Intelligence Artificielle en actuariat 27 février 2025 17 / 21
Principales applications
Traitement des réclamations :
Dépôt automatisé via chatbots
Analyse d’images (dommages véhicules/maisons)
Estimation automatisée des indemnisations
Détection de fraude :
Analyse de cohérence des déclarations
Détection de documents falsifiés
Prévention des risques :
Analyse prédictive (données historiques)
Nudging via objets connectés
Pr. Abdallah Abarda Intelligence Artificielle en actuariat 27 février 2025 18 / 21
Enjeux critiques
Données :
Besoin massif de données représentatives
Partage inter-organisations
Éthique :
Protection vie privée (RGPD)
Biais algorithmiques (ex : discrimination géographique)
Mutualisation :
Risque de segmentation excessive
Nécessité de garder aléa mutualisé
Pr. Abdallah Abarda Intelligence Artificielle en actuariat 27 février 2025 19 / 21
Impacts professionnels
Nouvelles pratiques :
Recentrage sur cas complexes
Relation client augmentée
Décisions assistées par IA
Compétences :
Maı̂trise outils IA
Littératie algorithmique
Compétences relationnelles renforcées
Pr. Abdallah Abarda Intelligence Artificielle en actuariat 27 février 2025 20 / 21
Synthèse
Avantages majeurs :
Gain d’efficacité (temps/coûts)
Prévention améliorée
Expérience client optimisée
Conditions de succès :
Éthique
Formation continue
Collaboration humain-machine
Pr. Abdallah Abarda Intelligence Artificielle en actuariat 27 février 2025 21 / 21
Machine learning
Pr. Abdallah Abarda
FEG SETTAT
V0
Pr. Abdallah Abarda (FEG SETTAT) Machine learning V0 1 / 21
Fondations du ML
Définition ML
Pr. Abdallah Abarda (FEG SETTAT) Machine learning V0 2 / 21
Fondations du ML
Définition ML
Le ”machine learning” est une branche de l’intelligence artificielle qui
consiste à donner à une machine la possibilité d’apprendre partir de
données.
Pr. Abdallah Abarda (FEG SETTAT) Machine learning V0 2 / 21
Fondations du ML
Définition ML
Le ”machine learning” est une branche de l’intelligence artificielle qui
consiste à donner à une machine la possibilité d’apprendre partir de
données.
Il consiste à la mise en place d’algorithmes capables d’apprendre une
règle de décision ou d’inférence à partir d’un jeu de données souvent
compliqué à modéliser.
Pr. Abdallah Abarda (FEG SETTAT) Machine learning V0 2 / 21
Fondations du ML
Définition ML
Le ”machine learning” est une branche de l’intelligence artificielle qui
consiste à donner à une machine la possibilité d’apprendre partir de
données.
Il consiste à la mise en place d’algorithmes capables d’apprendre une
règle de décision ou d’inférence à partir d’un jeu de données souvent
compliqué à modéliser.
Types d’apprentissage
Pr. Abdallah Abarda (FEG SETTAT) Machine learning V0 2 / 21
Fondations du ML
Définition ML
Le ”machine learning” est une branche de l’intelligence artificielle qui
consiste à donner à une machine la possibilité d’apprendre partir de
données.
Il consiste à la mise en place d’algorithmes capables d’apprendre une
règle de décision ou d’inférence à partir d’un jeu de données souvent
compliqué à modéliser.
Types d’apprentissage
Supervisé (classification/régression),
Pr. Abdallah Abarda (FEG SETTAT) Machine learning V0 2 / 21
Fondations du ML
Définition ML
Le ”machine learning” est une branche de l’intelligence artificielle qui
consiste à donner à une machine la possibilité d’apprendre partir de
données.
Il consiste à la mise en place d’algorithmes capables d’apprendre une
règle de décision ou d’inférence à partir d’un jeu de données souvent
compliqué à modéliser.
Types d’apprentissage
Supervisé (classification/régression),
Non supervisé (clustering),
Pr. Abdallah Abarda (FEG SETTAT) Machine learning V0 2 / 21
Fondations du ML
Définition ML
Le ”machine learning” est une branche de l’intelligence artificielle qui
consiste à donner à une machine la possibilité d’apprendre partir de
données.
Il consiste à la mise en place d’algorithmes capables d’apprendre une
règle de décision ou d’inférence à partir d’un jeu de données souvent
compliqué à modéliser.
Types d’apprentissage
Supervisé (classification/régression),
Non supervisé (clustering),
Par renforcement.
Pr. Abdallah Abarda (FEG SETTAT) Machine learning V0 2 / 21
Apprentissage supervisé et non supervisé
Pr. Abdallah Abarda (FEG SETTAT) Machine learning V0 3 / 21
Apprentissage supervisé
Apprentissage supervisé
Il consiste à superviser l’apprentissage de la machine, de la même
manière qu’un professeur supervise l’apprentissage de ses étudiants en
leur montrant des exemples de questions et des réponses qu’ils
doivent apprendre.
Figure – Représentation schématique
Pr. Abdallah Abarda (FEG SETTAT) du problème
Machine learning standard d’apprentissage
V0 4 / 21
Apprentissage supervisé
Figure – Représentation schématique du problème standard d’apprentissage de
reconnaissance d’images de chiens et de chats (R. COUILLET)
Pr. Abdallah Abarda (FEG SETTAT) Machine learning V0 5 / 21
Apprentissage supervisé
Figure – Classification par machines à vecteurs de support (SVM), Supervised
Machine Learning (R. COUILLET)
Pr. Abdallah Abarda (FEG SETTAT) Machine learning V0 6 / 21
Apprentissage supervisé
Définition ML
Pr. Abdallah Abarda (FEG SETTAT) Machine learning V0 7 / 21
Apprentissage supervisé
Définition ML
La Machine étudie les exemples qu’on lui donne, et grâce à un modèle
mathématique statistique (d’auto-évaluation et d’auto-amélioration), elle
parviendra à apprendre à réaliser la tâche qu’on lui demande d’effectuer.
Pr. Abdallah Abarda (FEG SETTAT) Machine learning V0 7 / 21
Apprentissage supervisé
Définition ML
La Machine étudie les exemples qu’on lui donne, et grâce à un modèle
mathématique statistique (d’auto-évaluation et d’auto-amélioration), elle
parviendra à apprendre à réaliser la tâche qu’on lui demande d’effectuer.
Pr. Abdallah Abarda (FEG SETTAT) Machine learning V0 7 / 21
Apprentissage supervisé
Type de problème supervisé
Selon la nature de la tâche à réaliser, on distingue deux types de
problèmes :
Pr. Abdallah Abarda (FEG SETTAT) Machine learning V0 8 / 21
Apprentissage supervisé
Type de problème supervisé
Selon la nature de la tâche à réaliser, on distingue deux types de
problèmes :
Figure – Source : G. SAINT-CIRGUE, Apprendre le Machine learning
Pr. Abdallah Abarda (FEG SETTAT) Machine learning V0 8 / 21
Apprentissage supervisé
Exemple : Problème de régression
Pr. Abdallah Abarda (FEG SETTAT) Machine learning V0 9 / 21
Apprentissage supervisé
Exemple : Problème de régression
Prédire le prix d’une maison en fonction de sa surface habitable :
Pr. Abdallah Abarda (FEG SETTAT) Machine learning V0 9 / 21
Apprentissage supervisé
Exemple : Problème de régression
Prédire le prix d’une maison en fonction de sa surface habitable :
Dans l’apprentissage supervisé, ces exemples de questions/réponses sont
présentés à la machine sous forme de jeu de données (X ; y ), où X
représente les variables d’entrée, et y la sortie attendue.
Pr. Abdallah Abarda (FEG SETTAT) Machine learning V0 9 / 21
Apprentissage supervisé
Exemple : Problème de régression
Prédire le prix d’une maison en fonction de sa surface habitable :
Dans l’apprentissage supervisé, ces exemples de questions/réponses sont
présentés à la machine sous forme de jeu de données (X ; y ), où X
représente les variables d’entrée, et y la sortie attendue.
Pr. Abdallah Abarda (FEG SETTAT) Machine learning V0 9 / 21
Apprentissage supervisé
Problème de régression
Grâce à ce jeu de données, la Machine est capable de développer
(apprendre) un modèle permettant de prédire la valeur de y en fonction de
X.
Pr. Abdallah Abarda (FEG SETTAT) Machine learning V0 10 / 21
Apprentissage supervisé
Problème de régression
Grâce à ce jeu de données, la Machine est capable de développer
(apprendre) un modèle permettant de prédire la valeur de y en fonction de
X.
Pr. Abdallah Abarda (FEG SETTAT) Machine learning V0 10 / 21
Apprentissage supervisé
Problème de régression
Une fois ce modèle développé, il est possible de s’en servir pour faire de
futures prédictions.
Pr. Abdallah Abarda (FEG SETTAT) Machine learning V0 11 / 21
Apprentissage supervisé
Problème de régression
Une fois ce modèle développé, il est possible de s’en servir pour faire de
futures pré[Link] exemple, si on veut prédire le prix d’une nouvelle
maison dont la surface habitable est de 105 m2 :
Pr. Abdallah Abarda (FEG SETTAT) Machine learning V0 11 / 21
Apprentissage supervisé
Problème de régression
Une fois ce modèle développé, il est possible de s’en servir pour faire de
futures pré[Link] exemple, si on veut prédire le prix d’une nouvelle
maison dont la surface habitable est de 105 m2 :
Pr. Abdallah Abarda (FEG SETTAT) Machine learning V0 11 / 21
Apprentissage supervisé
Problème de régression
Une fois ce modèle développé, il est possible de s’en servir pour faire de
futures pré[Link] exemple, si on veut prédire le prix d’une nouvelle
maison dont la surface habitable est de 105 m2 :
Pr. Abdallah Abarda (FEG SETTAT) Machine learning V0 11 / 21
Apprentissage supervisé
Problème de classification
Imaginez que vous souhaitiez apprendre à reconnaı̂tre un chien ou un chat
en vous basant sur sa taille et son poids. Pour cela, il est nécessaire de
fournir à la machine un jeu de données (X ; y) afin qu’elle s’entraı̂ne dessus.
Pr. Abdallah Abarda (FEG SETTAT) Machine learning V0 12 / 21
Apprentissage supervisé
Problème de classification
Imaginez que vous souhaitiez apprendre à reconnaı̂tre un chien ou un chat
en vous basant sur sa taille et son poids. Pour cela, il est nécessaire de
fournir à la machine un jeu de données (X ; y) afin qu’elle s’entraı̂ne dessus.
Pr. Abdallah Abarda (FEG SETTAT) Machine learning V0 12 / 21
Apprentissage supervisé
Problème de classification
Imaginez que vous souhaitiez apprendre à reconnaı̂tre un chien ou un chat
en vous basant sur sa taille et son poids. Pour cela, il est nécessaire de
fournir à la machine un jeu de données (X ; y) afin qu’elle s’entraı̂ne dessus.
Pr. Abdallah Abarda (FEG SETTAT) Machine learning V0 12 / 21
Apprentissage supervisé
Problème de classification
Avec ce modèle, la machine peut faire de nouvelles prédictions.
Pr. Abdallah Abarda (FEG SETTAT) Machine learning V0 13 / 21
Apprentissage supervisé
Problème de classification
Avec ce modèle, la machine peut faire de nouvelles pré[Link]
exemple, ci-dessous, un animal qu’elle n’a jamais était vu auparavant.
Pr. Abdallah Abarda (FEG SETTAT) Machine learning V0 13 / 21
Apprentissage supervisé
Problème de classification
Avec ce modèle, la machine peut faire de nouvelles pré[Link]
exemple, ci-dessous, un animal qu’elle n’a jamais était vu auparavant.
Pr. Abdallah Abarda (FEG SETTAT) Machine learning V0 13 / 21
Apprentissage supervisé
Problème de classification
Avec ce modèle, la machine peut faire de nouvelles pré[Link]
exemple, ci-dessous, un animal qu’elle n’a jamais était vu auparavant.
Pr. Abdallah Abarda (FEG SETTAT) Machine learning V0 13 / 21
Apprentissage non supervisé
Définition
Il consiste à laisser la machine apprendre par elle-même certaines
structures présentes dans les données, sans la contraindre à apprendre une
simple relation d’entrée / sortie X −→ y .
Pr. Abdallah Abarda (FEG SETTAT) Machine learning V0 14 / 21
Apprentissage non supervisé
Définition
Il consiste à laisser la machine apprendre par elle-même certaines
structures présentes dans les données, sans la contraindre à apprendre une
simple relation d’entrée / sortie X −→ y .
Par exemple, nous pouvons lui présenter les groupes d’animaux vus
précédemment, sans préciser sa nature, et lui demander simplement de les
regrouper selon leur ressemblance.
Pr. Abdallah Abarda (FEG SETTAT) Machine learning V0 14 / 21
Apprentissage non supervisé
Définition
Il consiste à laisser la machine apprendre par elle-même certaines
structures présentes dans les données, sans la contraindre à apprendre une
simple relation d’entrée / sortie X −→ y .
Par exemple, nous pouvons lui présenter les groupes d’animaux vus
précédemment, sans préciser sa nature, et lui demander simplement de les
regrouper selon leur ressemblance. Autrement dit, nous fournissons
uniquement les attributs X, sans indiquer la sortie y attendue.
Pr. Abdallah Abarda (FEG SETTAT) Machine learning V0 14 / 21
Apprentissage non supervisé
Définition
Il consiste à laisser la machine apprendre par elle-même certaines
structures présentes dans les données, sans la contraindre à apprendre une
simple relation d’entrée / sortie X −→ y .
Par exemple, nous pouvons lui présenter les groupes d’animaux vus
précédemment, sans préciser sa nature, et lui demander simplement de les
regrouper selon leur ressemblance. Autrement dit, nous fournissons
uniquement les attributs X, sans indiquer la sortie y attendue.
Pr. Abdallah Abarda (FEG SETTAT) Machine learning V0 14 / 21
Apprentissage non supervisé
Définition
Il consiste à laisser la machine apprendre par elle-même certaines
structures présentes dans les données, sans la contraindre à apprendre une
simple relation d’entrée / sortie X −→ y .
Par exemple, nous pouvons lui présenter les groupes d’animaux vus
précédemment, sans préciser sa nature, et lui demander simplement de les
regrouper selon leur ressemblance. Autrement dit, nous fournissons
uniquement les attributs X, sans indiquer la sortie y attendue.
Pr. Abdallah Abarda (FEG SETTAT) Machine learning V0 14 / 21
Apprentissage non supervisé
Définition
Il consiste à laisser la machine apprendre par elle-même certaines
structures présentes dans les données, sans la contraindre à apprendre une
simple relation d’entrée / sortie X −→ y .
Par exemple, nous pouvons lui présenter les groupes d’animaux vus
précédemment, sans préciser sa nature, et lui demander simplement de les
regrouper selon leur ressemblance. Autrement dit, nous fournissons
uniquement les attributs X, sans indiquer la sortie y attendue.
Pr. Abdallah Abarda (FEG SETTAT) Machine learning V0 14 / 21
Apprentissage non supervisé
Définition
Il consiste à laisser la machine apprendre par elle-même certaines
structures présentes dans les données, sans la contraindre à apprendre une
simple relation d’entrée / sortie X −→ y .
Par exemple, nous pouvons lui présenter les groupes d’animaux vus
précédemment, sans préciser sa nature, et lui demander simplement de les
regrouper selon leur ressemblance. Autrement dit, nous fournissons
uniquement les attributs X, sans indiquer la sortie y attendue.
Pr. Abdallah Abarda (FEG SETTAT) Machine learning V0 14 / 21
Apprentissage non supervisé
Problème de Clustering
Ce type d’application porte de le nom de clustering. Il s’agit de l’une des
nombreuses applications de l’apprentissage non supervisé et démontre
parfaitement son utilité. En effet,
Pr. Abdallah Abarda (FEG SETTAT) Machine learning V0 15 / 21
Apprentissage non supervisé
Problème de Clustering
Ce type d’application porte de le nom de clustering. Il s’agit de l’une des
nombreuses applications de l’apprentissage non supervisé et démontre
parfaitement son utilité. En effet,dans la pratique, il peut être très
intéressant de laisser la machine proposer sa propre manière de faire les
choses, plutôt que de la contraindre, de manière supervisée, à reproduire
notre façon de faire.
Pr. Abdallah Abarda (FEG SETTAT) Machine learning V0 15 / 21
Apprentissage non supervisé
Problème de Clustering
Ce type d’application porte de le nom de clustering. Il s’agit de l’une des
nombreuses applications de l’apprentissage non supervisé et démontre
parfaitement son utilité. En effet,dans la pratique, il peut être très
intéressant de laisser la machine proposer sa propre manière de faire les
choses, plutôt que de la contraindre, de manière supervisée, à reproduire
notre façon de [Link] par exemple un panier d’objets achetés par
différents consommateurs sur un site de vente en ligne.
Pr. Abdallah Abarda (FEG SETTAT) Machine learning V0 15 / 21
Apprentissage non supervisé
Problème de Clustering
Ce type d’application porte de le nom de clustering. Il s’agit de l’une des
nombreuses applications de l’apprentissage non supervisé et démontre
parfaitement son utilité. En effet,dans la pratique, il peut être très
intéressant de laisser la machine proposer sa propre manière de faire les
choses, plutôt que de la contraindre, de manière supervisée, à reproduire
notre façon de [Link] par exemple un panier d’objets achetés par
différents consommateurs sur un site de vente en ligne.
Pr. Abdallah Abarda (FEG SETTAT) Machine learning V0 15 / 21
Apprentissage par renforcement
Problème de Clustering
Il consiste à laisser la machine générer ses propres données issues de son
expérience et à apprendre à partir de celles-ci.
Pr. Abdallah Abarda (FEG SETTAT) Machine learning V0 16 / 21
Apprentissage par renforcement
Problème de Clustering
Il consiste à laisser la machine générer ses propres données issues de son
expérience et à apprendre à partir de celles-ci.L’idée est de créer un agent,
libre d’entreprendre des actions au sein d’un environnement, et de
récompenser cet agent lorsque les actions qu’il choisit de prendre le
mènent au résultat souhaité.
Pr. Abdallah Abarda (FEG SETTAT) Machine learning V0 16 / 21
Apprentissage par renforcement
Problème de Clustering
Il consiste à laisser la machine générer ses propres données issues de son
expérience et à apprendre à partir de celles-ci.L’idée est de créer un agent,
libre d’entreprendre des actions au sein d’un environnement, et de
récompenser cet agent lorsque les actions qu’il choisit de prendre le
mènent au résultat souhaité.Par exemple, l’agent pourrait être un petit
personnage et l’environnement, un labyrinthe dont il doit trouver la sortie.
Pour cela, il est libre de se déplacer dans toutes les directions qu’il souhaite
Pr. Abdallah Abarda (FEG SETTAT) Machine learning V0 16 / 21
Apprentissage par renforcement
Problème de Clustering
Il consiste à laisser la machine générer ses propres données issues de son
expérience et à apprendre à partir de celles-ci.L’idée est de créer un agent,
libre d’entreprendre des actions au sein d’un environnement, et de
récompenser cet agent lorsque les actions qu’il choisit de prendre le
mènent au résultat souhaité.Par exemple, l’agent pourrait être un petit
personnage et l’environnement, un labyrinthe dont il doit trouver la sortie.
Pour cela, il est libre de se déplacer dans toutes les directions qu’il souhaite
Pr. Abdallah Abarda (FEG SETTAT) Machine learning V0 16 / 21
Apprentissage par renforcement
Problème de Clustering
Il consiste à laisser la machine générer ses propres données issues de son
expérience et à apprendre à partir de celles-ci.L’idée est de créer un agent,
libre d’entreprendre des actions au sein d’un environnement, et de
récompenser cet agent lorsque les actions qu’il choisit de prendre le
mènent au résultat souhaité.Par exemple, l’agent pourrait être un petit
personnage et l’environnement, un labyrinthe dont il doit trouver la sortie.
Pour cela, il est libre de se déplacer dans toutes les directions qu’il souhaite
Pr. Abdallah Abarda (FEG SETTAT) Machine learning V0 16 / 21
Apprentissage par renforcement
Problème de Clustering
Il consiste à laisser la machine générer ses propres données issues de son
expérience et à apprendre à partir de celles-ci.L’idée est de créer un agent,
libre d’entreprendre des actions au sein d’un environnement, et de
récompenser cet agent lorsque les actions qu’il choisit de prendre le
mènent au résultat souhaité.Par exemple, l’agent pourrait être un petit
personnage et l’environnement, un labyrinthe dont il doit trouver la sortie.
Pour cela, il est libre de se déplacer dans toutes les directions qu’il souhaite
Pr. Abdallah Abarda (FEG SETTAT) Machine learning V0 16 / 21
Principe : deux phases du processus ML
Pr. Abdallah Abarda (FEG SETTAT) Machine learning V0 17 / 21
Principe : deux phases du processus ML
Phase 1 : Prédiction
Phase 2 : apprentissage
Pr. Abdallah Abarda (FEG SETTAT) Machine learning V0 18 / 21
Modélisation ML
Prédiction W,x y
Entrée : paramètres-données Sortie
Apprentissage Caractéristiques
D Paramètres
Poids
Estime
Prototypes
W ..
.
Pr. Abdallah Abarda (FEG SETTAT) Machine learning V0 19 / 21
Fonction paramétrique de prédiction
Apprentissage
y = F (x; W )
Trouver le W qui optimise un critère L :
W = arg min0 L(D, W 0 )
W
À partir d’une base d’apprentissage :
D = {(xi , yi )}ni=1
Pr. Abdallah Abarda (FEG SETTAT) Machine learning V0 20 / 21
Références/Sources principales
Guillaume SAINT-CIRGUE (2024), Apprendre le Machine learning,
https ://[Link]
Romain Cuillet (), Principes de l’apprentissage statistique supervisé
(Supervised Machine Learning),
https ://[Link]/[Link]/docs/courses/ML/ML-
[Link]
Stéphane Herbin, Apprentissage automatique, ONERA
Pr. Abdallah Abarda (FEG SETTAT) Machine learning V0 21 / 21
ML: Regression
Pr. Abdallah Abarda
FEG SETTAT
V0
Pr. Abdallah Abarda (FEG SETTAT) ML: Regression V0 1 / 28
Type de modèles de régression en ML
Pr. Abdallah Abarda (FEG SETTAT) ML: Regression V0 2 / 28
Régression
cas de Régression linéaire simple
Dans un modèle de régression, on montre à la machine des exemples de
données (X ; y ) afin qu’elle développe un modèle permettant de relier X et
y (manière supervisée)
Pr. Abdallah Abarda (FEG SETTAT) ML: Regression V0 3 / 28
Régression
cas de Régression linéaire simple
Dans un modèle de régression, on montre à la machine des exemples de
données (X ; y ) afin qu’elle développe un modèle permettant de relier X et
y (manière supervisée)
Pr. Abdallah Abarda (FEG SETTAT) ML: Regression V0 3 / 28
Régression
cas de Régression linéaire simple
Dans un modèle de régression, on montre à la machine des exemples de
données (X ; y ) afin qu’elle développe un modèle permettant de relier X et
y (manière supervisée)
Pr. Abdallah Abarda (FEG SETTAT) ML: Regression V0 3 / 28
cas de Régression linéaire simple
Régression linéaire simple
Le modèle de régression linéaire peut être décrit avec la formule bien
connue
f (x) = wx + b
.
Pr. Abdallah Abarda (FEG SETTAT) ML: Regression V0 4 / 28
cas de Régression linéaire simple
Régression linéaire simple
Le modèle de régression linéaire peut être décrit avec la formule bien
connue
f (x) = wx + b
.
Pr. Abdallah Abarda (FEG SETTAT) ML: Regression V0 4 / 28
cas de Régression linéaire simple
cas de la Régression linéaire simple
les paramètres w et b contrôlent l’allure de la droite du modèle : w
détermine son inclinaison, et b son ordonnée à l’origine.
Pr. Abdallah Abarda (FEG SETTAT) ML: Regression V0 5 / 28
cas de Régression linéaire simple
cas de la Régression linéaire simple
les paramètres w et b contrôlent l’allure de la droite du modèle : w
détermine son inclinaison, et b son ordonnée à l’origine.
Pr. Abdallah Abarda (FEG SETTAT) ML: Regression V0 5 / 28
cas de Régression linéaire simple
cas de la Régression linéaire simple
les paramètres w et b contrôlent l’allure de la droite du modèle : w
détermine son inclinaison, et b son ordonnée à l’origine.
Pr. Abdallah Abarda (FEG SETTAT) ML: Regression V0 5 / 28
1- Régression
Régression linéaire
Objectif : trouver les paramètres w et b qui ajustent au mieux les données
(X ; y ).
Pr. Abdallah Abarda (FEG SETTAT) ML: Regression V0 6 / 28
1- Régression
Régression linéaire
Objectif : trouver les paramètres w et b qui ajustent au mieux les données
(X ; y ).
La machine va optimiser et minimiser les erreurs le modèle (f (x)) et les
points de données(y ), grâce à un algorithme d’optimisation.
Pr. Abdallah Abarda (FEG SETTAT) ML: Regression V0 6 / 28
1- Régression
Régression linéaire
Objectif : trouver les paramètres w et b qui ajustent au mieux les données
(X ; y ).
La machine va optimiser et minimiser les erreurs le modèle (f (x)) et les
points de données(y ), grâce à un algorithme d’optimisation. On définit la
fonction coût.
Pr. Abdallah Abarda (FEG SETTAT) ML: Regression V0 6 / 28
1- Régression
Régression linéaire
Objectif : trouver les paramètres w et b qui ajustent au mieux les données
(X ; y ).
La machine va optimiser et minimiser les erreurs le modèle (f (x)) et les
points de données(y ), grâce à un algorithme d’optimisation. On définit la
fonction coût.
Pr. Abdallah Abarda (FEG SETTAT) ML: Regression V0 6 / 28
1- Régression
Régression linéaire
Objectif : trouver les paramètres w et b qui ajustent au mieux les données
(X ; y ).
La machine va optimiser et minimiser les erreurs le modèle (f (x)) et les
points de données(y ), grâce à un algorithme d’optimisation. On définit la
fonction coût.
Pr. Abdallah Abarda (FEG SETTAT) ML: Regression V0 6 / 28
1- Régression
Erreur
Objectif : mesurer l’erreur entre chaque point de données et notre modèle.
R (i) = f (x (i) ) − y (i)
Pr. Abdallah Abarda (FEG SETTAT) ML: Regression V0 7 / 28
1- Régression
Erreur
Objectif : mesurer l’erreur entre chaque point de données et notre modèle.
R (i) = f (x (i) ) − y (i)
Pr. Abdallah Abarda (FEG SETTAT) ML: Regression V0 7 / 28
1- Régression
Erreur
Objectif : mesurer l’erreur entre chaque point de données et notre modèle.
R (i) = f (x (i) ) − y (i)
Pr. Abdallah Abarda (FEG SETTAT) ML: Regression V0 7 / 28
1- Régression
Fonction coût (perte-LOSS)
On cherche à minimiser la Fonction coût (avec m est le nombre
1 P (i)
d’exemples) : Loss = 2m (y − f (x (i) ))2
Pr. Abdallah Abarda (FEG SETTAT) ML: Regression V0 8 / 28
1- Régression
Fonction coût (perte-LOSS)
On cherche à minimiser la Fonction coût (avec m est le nombre
1 P (i)
d’exemples) : Loss = 2m (y − f (x (i) ))2
Pr. Abdallah Abarda (FEG SETTAT) ML: Regression V0 8 / 28
1- Régression
Fonction coût (perte-LOSS)
On cherche à minimiser la Fonction coût (avec m est le nombre
1 P (i)
d’exemples) : Loss = 2m (y − f (x (i) ))2
Pr. Abdallah Abarda (FEG SETTAT) ML: Regression V0 8 / 28
Entrainement d’un modèle de régression
Training set (ensemble d’entrainement)
L’ensemble d’apprentissage est un ensemble de couple entrée-sortie A =
(x (i) , y (i) ), i = 1, m que nous observons et que nous utilisons pour
déterminer les poids du modèle.
Pr. Abdallah Abarda (FEG SETTAT) ML: Regression V0 9 / 28
Entrainement d’un modèle de régression
Training set (ensemble d’entrainement)
L’ensemble d’apprentissage est un ensemble de couple entrée-sortie A =
(x (i) , y (i) ), i = 1, m que nous observons et que nous utilisons pour
déterminer les poids du modèle.
Training (entrainement)
L’apprentissage (Training) est le processus permettant de déterminer les
poids w tels que les écarts entre la sortie estimée f (x (i) ) et la sortie
observée y (i) soient les plus petit possible.
Pr. Abdallah Abarda (FEG SETTAT) ML: Regression V0 9 / 28
Entrainement d’un modèle de régression
Training set (ensemble d’entrainement)
L’ensemble d’apprentissage est un ensemble de couple entrée-sortie A =
(x (i) , y (i) ), i = 1, m que nous observons et que nous utilisons pour
déterminer les poids du modèle.
Training (entrainement)
L’apprentissage (Training) est le processus permettant de déterminer les
poids w tels que les écarts entre la sortie estimée f (x (i) ) et la sortie
observée y (i) soient les plus petit possible.
Test set (ensemble de test)
L’ensemble de test est un ensemble de données qui permettent de s’assurer
que le modèle a fait de bonnes prédictions pour de nouvelles observations.
Pr. Abdallah Abarda (FEG SETTAT) ML: Regression V0 9 / 28
Évaluation d’un modèle de Régression
Root Mean Square Error (RMSE)
q Pi=m
1
RMSE doit être très faible : RMSE = m i=1 (f (x (i) ) − y (i) )2
Pr. Abdallah Abarda (FEG SETTAT) ML: Regression V0 10 / 28
Évaluation d’un modèle de Régression
Root Mean Square Error (RMSE)
q Pi=m
1
RMSE doit être très faible : RMSE = m i=1 (f (x (i) ) − y (i) )2
Relative Squared Error (RSE)
Pi=m
(f (x (i) )−y (i) )2
RSE doit être faible : RSE = i=1
Pi=m (i) 2
i=1 (ȳ −y )
Pr. Abdallah Abarda (FEG SETTAT) ML: Regression V0 10 / 28
Évaluation d’un modèle de Régression
Root Mean Square Error (RMSE)
q Pi=m
1
RMSE doit être très faible : RMSE = m i=1 (f (x (i) ) − y (i) )2
Relative Squared Error (RSE)
Pi=m
(f (x (i) )−y (i) )2
RSE doit être faible : RSE = i=1
Pi=m (i) 2
i=1 (ȳ −y )
Coefficient of détermination (R 2 )
Coefficient of détermination (R 2 ∈ [0, 1]) doit être proche de 1.
R 2 = 1 − RSE
Pr. Abdallah Abarda (FEG SETTAT) ML: Regression V0 10 / 28
Régression
L’algorithme de descente de gradient permettra de chercher les paramètres
(w ; b) qui minimisent la fonction coût LOSS.
Pr. Abdallah Abarda (FEG SETTAT) ML: Regression V0 11 / 28
L’algorithme de la descente de gradient
L’algorithme de la descente de gradient
est l’un des algorithmes d’apprentissage les plus utilisés en machine
learning.
Pr. Abdallah Abarda (FEG SETTAT) ML: Regression V0 12 / 28
L’algorithme de la descente de gradient
L’algorithme de la descente de gradient
est l’un des algorithmes d’apprentissage les plus utilisés en machine
learning. Il consiste à calculer le gradient de la fonction coût,
Pr. Abdallah Abarda (FEG SETTAT) ML: Regression V0 12 / 28
L’algorithme de la descente de gradient
L’algorithme de la descente de gradient
est l’un des algorithmes d’apprentissage les plus utilisés en machine
learning. Il consiste à calculer le gradient de la fonction coût,
trouver comment elle évolue si w et b varient légèrement,
Pr. Abdallah Abarda (FEG SETTAT) ML: Regression V0 12 / 28
L’algorithme de la descente de gradient
L’algorithme de la descente de gradient
est l’un des algorithmes d’apprentissage les plus utilisés en machine
learning. Il consiste à calculer le gradient de la fonction coût,
trouver comment elle évolue si w et b varient légèrement, pour
ensuite faire un pas dans la direction où la fonction coût diminue.
Pr. Abdallah Abarda (FEG SETTAT) ML: Regression V0 12 / 28
L’algorithme de la descente de gradient
L’algorithme de la descente de gradient
est l’un des algorithmes d’apprentissage les plus utilisés en machine
learning. Il consiste à calculer le gradient de la fonction coût,
trouver comment elle évolue si w et b varient légèrement, pour
ensuite faire un pas dans la direction où la fonction coût diminue.
Pr. Abdallah Abarda (FEG SETTAT) ML: Regression V0 12 / 28
L’algorithme de la descente de gradient
L’algorithme de la descente de gradient
est l’un des algorithmes d’apprentissage les plus utilisés en machine
learning. Il consiste à calculer le gradient de la fonction coût,
trouver comment elle évolue si w et b varient légèrement, pour
ensuite faire un pas dans la direction où la fonction coût diminue.
Pr. Abdallah Abarda (FEG SETTAT) ML: Regression V0 12 / 28
L’algorithme de la descente de gradient
L’algorithme de la descente de gradient
est l’un des algorithmes d’apprentissage les plus utilisés en machine
learning. Il consiste à calculer le gradient de la fonction coût,
trouver comment elle évolue si w et b varient légèrement, pour
ensuite faire un pas dans la direction où la fonction coût diminue.
Pr. Abdallah Abarda (FEG SETTAT) ML: Regression V0 12 / 28
L’algorithme de la descente de gradient
L’algorithme de la descente de gradient
Pr. Abdallah Abarda (FEG SETTAT) ML: Regression V0 13 / 28
L’algorithme de la descente de gradient
L’algorithme de la descente de gradient
Pr. Abdallah Abarda (FEG SETTAT) ML: Regression V0 13 / 28
L’algorithme de la descente de gradient
L’algorithme de la descente de gradient
Pr. Abdallah Abarda (FEG SETTAT) ML: Regression V0 14 / 28
L’algorithme de la descente de gradient
Formules d’optimisation : L’algorithme de la descente de gradient
∂L
wt+1 = wt − η ×
∂wt
∂L
bt+1 = bt − η ×
∂bt
η : (vitesse) taux d’apprentissage (fixé à 1)
wt , bt : paramètres actuels
∂L
∂wt : gradient pour le poids
∂L
∂bt : gradient pour b
Important
La descente de gradient minimise la perte L en suivant la direction
opposée aux gradients.
L’algorithme de la descente de gradient
Formules d’optimisation : L’algorithme de la descente de gradient
∂L
wt+1 = wt − η ×
∂wt
∂L
bt+1 = bt − η ×
∂bt
η : (vitesse) taux d’apprentissage (fixé à 1)
wt , bt : paramètres actuels
∂L
∂wt : gradient pour le poids
∂L
∂bt : gradient pour b
Pr. Abdallah Abarda (FEG SETTAT) ML: Regression V0 15 / 28
L’algorithme de la descente de gradient
Formules d’optimisation : L’algorithme de la descente de gradient
∂L
wt+1 = wt − η ×
∂wt
∂L
bt+1 = bt − η ×
∂bt
η : (vitesse) taux d’apprentissage (fixé à 1)
wt , bt : paramètres actuels
∂L
∂wt : gradient pour le poids
∂L
∂bt : gradient pour b
Important
La descente de gradient minimise la perte L en suivant la direction
opposée aux gradients.
Pr. Abdallah Abarda (FEG SETTAT) ML: Regression V0 15 / 28
L’algorithme de la descente de gradient
L’algorithme de la descente de gradient
∂L
Si on calcul le gradient ∂b , on aura une valeur négative (ce qui est logique,
car la fonction diminue lorsque la on augmente la valeur de b). supposons
∂L
que ∂b = −2
Pr. Abdallah Abarda (FEG SETTAT) ML: Regression V0 16 / 28
L’algorithme de la descente de gradient
L’algorithme de la descente de gradient
Après initialisation de b0 , A l’étape 1, la formule donne :
∂L
b1 = b0 − η × ∂b 0
b1 = b0 − 1 × (−2)
b1 = b0 + 2
b1 est donc supérieur à b0
Pr. Abdallah Abarda (FEG SETTAT) ML: Regression V0 17 / 28
L’algorithme de la descente de gradient
Pr. Abdallah Abarda (FEG SETTAT) ML: Regression V0 18 / 28
Régression
Régression sur PYTHON
Pour développer un modèle de régression linéaire avec Python, nous allons
utiliser le package scikit-learn, très populaire pour faire du machine
learning.
Pour commencer, simulons des données avec la librairie Numpy. Nous
avons ici 50 points, distribués en suivant une relation y = 1, 5x + 3
Pr. Abdallah Abarda (FEG SETTAT) ML: Regression V0 19 / 28
Régression
Régression sur PYTHON
Pour développer un modèle de régression linéaire avec Python, nous allons
utiliser le package scikit-learn, très populaire pour faire du machine
learning.
Pour commencer, simulons des données avec la librairie Numpy. Nous
avons ici 50 points, distribués en suivant une relation y = 1, 5x + 3
Pr. Abdallah Abarda (FEG SETTAT) ML: Regression V0 19 / 28
Régression
Pr. Abdallah Abarda (FEG SETTAT) ML: Regression V0 20 / 28
Régression
Régression sur Python
- 1- On utilise LinearRegression de scikit-learn. Ce modèle n’utilise pas la
descente de gradient, mais une autre méthode d’optimisation.
Pr. Abdallah Abarda (FEG SETTAT) ML: Regression V0 21 / 28
Régression
Régression sur Python
- 1- On utilise LinearRegression de scikit-learn. Ce modèle n’utilise pas la
descente de gradient, mais une autre méthode d’optimisation.
- 2- Nous utilisons la méthode fit() pour entraı̂ner le modèle sur les
données (X ; y).
Pr. Abdallah Abarda (FEG SETTAT) ML: Regression V0 21 / 28
Régression
Régression sur Python
- 1- On utilise LinearRegression de scikit-learn. Ce modèle n’utilise pas la
descente de gradient, mais une autre méthode d’optimisation.
- 2- Nous utilisons la méthode fit() pour entraı̂ner le modèle sur les
données (X ; y).
- 3- Une fois le modèle entraı̂né, il suffit de l’utiliser pour faire des
prédictions à l’aide de la méthode predict()
Pr. Abdallah Abarda (FEG SETTAT) ML: Regression V0 21 / 28
Régression
Pr. Abdallah Abarda (FEG SETTAT) ML: Regression V0 22 / 28
Machine learning en assurance : Régression
Modèle 1
la prédiction de la prime d’assurance en fonction de l’âge du
conducteur et du nombre d’accidents passés.
Pr. Abdallah Abarda (FEG SETTAT) ML: Regression V0 23 / 28
Machine learning en assurance : Régression
Modèle 1
la prédiction de la prime d’assurance en fonction de l’âge du
conducteur et du nombre d’accidents passés.
On considère un jeu de données où :
âge : l’âge du conducteur
Pr. Abdallah Abarda (FEG SETTAT) ML: Regression V0 23 / 28
Machine learning en assurance : Régression
Modèle 1
la prédiction de la prime d’assurance en fonction de l’âge du
conducteur et du nombre d’accidents passés.
On considère un jeu de données où :
âge : l’âge du conducteur
accidents : le nombre d’accidents passés
Pr. Abdallah Abarda (FEG SETTAT) ML: Regression V0 23 / 28
Machine learning en assurance : Régression
Modèle 1
la prédiction de la prime d’assurance en fonction de l’âge du
conducteur et du nombre d’accidents passés.
On considère un jeu de données où :
âge : l’âge du conducteur
accidents : le nombre d’accidents passés
prime : la prime d’assurance à payer
Code
Cliquer ci : Code régression linéaire en Actuariat
Pr. Abdallah Abarda (FEG SETTAT) ML: Regression V0 23 / 28
Machine learning en assurance : Régression
Modèle 1 : prédiction de la prime d’assurance en fonction de l’âge du
conducteur et du nombre d’accidents passés
Pr. Abdallah Abarda (FEG SETTAT) ML: Regression V0 24 / 28
Machine learning en assurance
Pr. Abdallah Abarda (FEG SETTAT) ML: Regression V0 25 / 28
Machine learning en assurance : Régression
Modèle 2
la détermination du Coût annuel des sinistres en fonction de l’Âge du
conducteur et le Kilométrage annuel
Pr. Abdallah Abarda (FEG SETTAT) ML: Regression V0 26 / 28
Machine learning en assurance
Pr. Abdallah Abarda (FEG SETTAT) ML: Regression V0 27 / 28
Références/Sources principales
Guillaume SAINT-CIRGUE (2024), Apprendre le Machine learning,
https ://[Link]
Romain Cuillet (), Principes de l’apprentissage statistique supervisé
(Supervised Machine Learning),
https ://[Link]/[Link]/docs/courses/ML/ML-
[Link]
Stéphane Herbin, Apprentissage automatique, ONERA
Pr. Abdallah Abarda (FEG SETTAT) ML: Regression V0 28 / 28
Classification : KNN
Pr. Abdallah Abarda
FEG SETTAT
V0
Pr. Abdallah Abarda (FEG SETTAT) Classification : KNN V0 1 / 24
2- Classification
Classification
Ces modèles sont créés de manière supervisée, c’est-à-dire que l’on montre
à la machine des exemples de données (X ; y) afin qu’elle développe un
modèle permettant de relier X et y, cela permet d’apprendre à séparer les
différentes classes du jeu de données.
Pr. Abdallah Abarda (FEG SETTAT) Classification : KNN V0 2 / 24
2- Classification
Exemple de Classification
On cherche à Prédire si un email est un spam ou non, en vous basant sur
le nombre de liens et le nombre de fautes d’orthographe qu’il contient.
Pr. Abdallah Abarda (FEG SETTAT) Classification : KNN V0 3 / 24
2- Classification
Exemple de Classification
Notre email, quant à lui, se situe ici dans notre espace de points. À votre
avis, s’agit-il d’un spam ou non ?
Pr. Abdallah Abarda (FEG SETTAT) Classification : KNN V0 4 / 24
2- Classification
Exemple de Classification : plus proches voisins
Si vous répondez spam, vous avez probablement raison. En effet, il semble
plus logique de prédire que cet email soit un spam, car il est plus proche
des points correspondant à cette classe.
Pr. Abdallah Abarda (FEG SETTAT) Classification : KNN V0 5 / 24
2- Classification
Exemple de Classification : plus proches voisins
Si vous répondez spam, vous avez probablement raison. En effet, il semble
plus logique de prédire que cet email soit un spam, car il est plus proche
des points correspondant à cette [Link] méthode employée ici pour faire
cette prédiction est celle des plus proches voisins (nearest neighbors).
Pr. Abdallah Abarda (FEG SETTAT) Classification : KNN V0 5 / 24
Classification
Modèles de classification
Il existe de nombreux modèles de classification en machine learning, parmi
lesquels on retrouve :
Pr. Abdallah Abarda (FEG SETTAT) Classification : KNN V0 6 / 24
Classification
Modèles de classification
Il existe de nombreux modèles de classification en machine learning, parmi
lesquels on retrouve :
1 Les plus proches voisins (KNN : k-nearest neighbors)
Pr. Abdallah Abarda (FEG SETTAT) Classification : KNN V0 6 / 24
Classification
Modèles de classification
Il existe de nombreux modèles de classification en machine learning, parmi
lesquels on retrouve :
1 Les plus proches voisins (KNN : k-nearest neighbors)
2 La Régression Logistique
Pr. Abdallah Abarda (FEG SETTAT) Classification : KNN V0 6 / 24
Classification
Modèles de classification
Il existe de nombreux modèles de classification en machine learning, parmi
lesquels on retrouve :
1 Les plus proches voisins (KNN : k-nearest neighbors)
2 La Régression Logistique
3 Les Support Vector Machines (SVM)
Pr. Abdallah Abarda (FEG SETTAT) Classification : KNN V0 6 / 24
Classification
Modèles de classification
Il existe de nombreux modèles de classification en machine learning, parmi
lesquels on retrouve :
1 Les plus proches voisins (KNN : k-nearest neighbors)
2 La Régression Logistique
3 Les Support Vector Machines (SVM)
4 Les Arbres de décision
Pr. Abdallah Abarda (FEG SETTAT) Classification : KNN V0 6 / 24
Classification
Modèles de classification
Il existe de nombreux modèles de classification en machine learning, parmi
lesquels on retrouve :
1 Les plus proches voisins (KNN : k-nearest neighbors)
2 La Régression Logistique
3 Les Support Vector Machines (SVM)
4 Les Arbres de décision
5 Les Random Forest
6 ...
Pr. Abdallah Abarda (FEG SETTAT) Classification : KNN V0 6 / 24
Modèle du Nearest Neighbors (NN,KNN)
Modèle du Nearest Neighbors (NN)
On calcule la distance entre ce point et tous les autres points du jeu
de données (la distance euclidienne).
En classant chaque distance de la plus petite à la plus grande, on
identifie le point du jeu de données le plus proche.
Malgré sa simplicité, cet algorithme est encore largement utilisé
aujourd’hui dans de nombreuses applications, y compris chez Spotify,
Netflix, Amazon, ...
Pr. Abdallah Abarda (FEG SETTAT) Classification : KNN V0 7 / 24
Modèle du Nearest Neighbors (NN,KNN)
Modèle du Nearest Neighbors (NN)
Nous pouvons généraliser cette approche en appliquant cette
opération à tous les points de notre espace.
Pr. Abdallah Abarda (FEG SETTAT) Classification : KNN V0 8 / 24
Modèle du Nearest Neighbors (NN,KNN)
Modèle du Nearest Neighbors (NN)
Nous pouvons généraliser cette approche en appliquant cette
opération à tous les points de notre espace.
Ce qui permet de mettre en avant la frontière de décision, c’est-à-dire
la frontière qui sépare les deux classes.
Pr. Abdallah Abarda (FEG SETTAT) Classification : KNN V0 8 / 24
Modèle du Nearest Neighbors (NN,KNN)
Modèle du Nearest Neighbors (NN)
Nous pouvons généraliser cette approche en appliquant cette
opération à tous les points de notre espace.
Ce qui permet de mettre en avant la frontière de décision, c’est-à-dire
la frontière qui sépare les deux classes.
Pr. Abdallah Abarda (FEG SETTAT) Classification : KNN V0 8 / 24
Généralisation : Le modèle du K-Nearest Neighbors
Généralisation : Le modèle du K-Nearest Neighbors
Dans sa forme la plus simple, l’algorithme du plus proche voisin, dans
sa version à 1 voisin, n’est pas très robuste.
Pr. Abdallah Abarda (FEG SETTAT) Classification : KNN V0 9 / 24
Généralisation : Le modèle du K-Nearest Neighbors
Généralisation : Le modèle du K-Nearest Neighbors
Dans sa forme la plus simple, l’algorithme du plus proche voisin, dans
sa version à 1 voisin, n’est pas très robuste.
En effet, voyons ce qu’il se produit lorsqu’on fait face à un jeu de
données un peu plus complexe en présence de valeurs aberrantes.
Notre email maintenant classé parmi les emails non-spams bien qu’il
semble plus proche du groupe des spams.
Pr. Abdallah Abarda (FEG SETTAT) Classification : KNN V0 9 / 24
Généralisation : Le modèle du K-Nearest Neighbors
Généralisation : Le modèle du K-Nearest Neighbors
Pour éviter ce problème, on utilise généralement les k-voisins plus proches,
pour ensuite assimiler notre point à la classe majoritaire parmi ces
k-voisins.
Pr. Abdallah Abarda (FEG SETTAT) Classification : KNN V0 10 / 24
Généralisation : Le modèle du K-Nearest Neighbors
Généralisation : Le modèle du K-Nearest Neighbors
Pour éviter ce problème, on utilise généralement les k-voisins plus proches,
pour ensuite assimiler notre point à la classe majoritaire parmi ces
[Link] un exemple avec k=3. Ici, notre point compte parmi ses 3
voisins les plus proches, 2 points de la classe Orange et 1 point de la classe
Gris foncé. Il est donc assimilé à la classe Orange.
Pr. Abdallah Abarda (FEG SETTAT) Classification : KNN V0 10 / 24
Généralisation : Le modèle du K-Nearest Neighbors
5NN
voici un exemple avec K=5.
Comme on peut le constater, plus le nombre de voisins augmente,
moins la frontière de décision est sensible aux valeurs aberrantes.
Augmenter le K implique : trop lisser la frontière de décision !
Pr. Abdallah Abarda (FEG SETTAT) Classification : KNN V0 11 / 24
Généralisation : Le modèle du K-Nearest Neighbors
KNN
L’exemple ci-dessous montre un jeu de données dans lequel les deux
classes prennent une forme de croissant, avec une légère superposition
de certains points.
Pr. Abdallah Abarda (FEG SETTAT) Classification : KNN V0 12 / 24
Généralisation : Le modèle du K-Nearest Neighbors
Classification multiple
On se limite pas toujours à la classification binaire.
Pr. Abdallah Abarda (FEG SETTAT) Classification : KNN V0 13 / 24
Généralisation : Le modèle du K-Nearest Neighbors
Classification multiple
On se limite pas toujours à la classification binaire.
En machine learning, il est possible de travailler avec autant de
classes que l’on souhaite.
Pr. Abdallah Abarda (FEG SETTAT) Classification : KNN V0 13 / 24
Généralisation : Le modèle du K-Nearest Neighbors
Classification multiple
On se limite pas toujours à la classification binaire.
En machine learning, il est possible de travailler avec autant de
classes que l’on souhaite.
L’algorithme des k-voisins les plus proches fonctionne parfaitement
dans ce genre de situation
Pr. Abdallah Abarda (FEG SETTAT) Classification : KNN V0 13 / 24
Formulation : modèle du K-Nearest Neighbors
Formulation de l’algorithme KNN
Pour un nouveau point x, on définit alors l’ensemble de ses k-plus
proches voisins Vk (x) au sens de de la distance euclidienne (par
exemple).
Calcul des distances : pour chaque x ∈ Rd et pour chaque
i = 1, . . . , n, on note dip
(x)Pla distance entre x et
xi : di (x) = d (xi , x) = (xi − x)2 .
Détermination du plus proche voisin : On définit la première
statistique de rang r1 (x) comme l’indice du plus proche voisin de x
parmi x1 , . . . , xn , c’est-à-dire r1 (x) = i ∗ si et seulement si
di ∗ (x) = min1≤i≤n di (x).
Remarque
S’il y a plusieurs candidats pour la minimisation ci-dessus, on les ordonne
de manière arbitraire (généralement aléatoirement).
Pr. Abdallah Abarda (FEG SETTAT) Classification : KNN V0 14 / 24
Résumé : modèle du K-Nearest Neighbors
Résumé : Étapes de l’algorithme KNN
Etape 1 : Choisissez k, le nombre de voisins à regarder.
Etape 2 : Calculez la distance entre le point à classer et tous les
autres points .
Etape 3 : Identifiez les k voisins les plus proches.
Etape 4 : Regardez à quel groupe appartiennent ces voisins et classez
le point selon la majorité.
Astuce : Le choix de k est important :
Si k est trop petit, la classification peut être sensible au bruit.
Si k est trop grand, cela peut diluer l’information locale.
Pr. Abdallah Abarda (FEG SETTAT) Classification : KNN V0 15 / 24
Implémentation Python : KNN
Implémentation Python : KNN
Pour cela, nous avons besoin de la librairie de scikit-learn et de son
module neighbors. Au sein de ce module, on retrouve le modèle
KNeighborsClassifier.
Pour générer des données, nous allons également utiliser la fonction
make blobs provenant de scikit learn.
Pr. Abdallah Abarda (FEG SETTAT) Classification : KNN V0 16 / 24
Implémentation Python : KNN
Implémentation Python : KNN
simulation de 2 classes y et avec 50 points et deux variables X). Nous
générons des points dont la classe est inconnue.
Pr. Abdallah Abarda (FEG SETTAT) Classification : KNN V0 17 / 24
Implémentation Python : KNN
Pour entraı̂ner le modèle de KNeighborsClassifier, nous allons
l’initialiser avec une valeur k=3, puis utiliser la méthode fit() comme
vu dans la régression.
Enfin, pour effectuer des prédictions et classer les nouveaux points de
notre jeu de données, on utilise la méthode predict(). On arrive ainsi à
classer les nouveaux points du jeu de données
Pr. Abdallah Abarda (FEG SETTAT) Classification : KNN V0 18 / 24
Implémentation Python : KNN
Pr. Abdallah Abarda (FEG SETTAT) Classification : KNN V0 19 / 24
Classification en actuariat sur Python
Modèle 1
Objectif : modéliser et prédire le niveau de risque d’un assuré (haut risque
ou faible risque) en utilisant un modèle de classification KNN, basé
uniquement sur deux caractéristiques.
Données :
Deux variables : Age Conducteur et Kilometrage Annuel.
Cible binaire Haut Risque : 1 si âge < 30 et kilométrage > 20000, 0
sinon.
Modèle KNN :
Utilise k = 5 voisins (modifiable).
Visualisations :
Répartition des données : Nuage de points montrant les données
brutes avec Haut Risque en couleur (bleu = 0, rouge = 1).
Frontières de décision : Graphique montrant les zones de classification
prédites par le modèle KNN, avec les données superposées.
Pr. Abdallah Abarda (FEG SETTAT) Classification : KNN V0 20 / 24
Classification en actuariat sur Python
Prédire le niveau de risque d’un assuré (haut risque ou faible risque
Pr. Abdallah Abarda (FEG SETTAT) Classification : KNN V0 21 / 24
Classification en actuariat sur Python
Prédire le niveau de risque d’un assuré (haut risque ou faible risque
Pr. Abdallah Abarda (FEG SETTAT) Classification : KNN V0 22 / 24
Prédire le niveau de risque d’un assuré (haut risque ou
faible risque
Cliquer sur : Code Classification
Exemple de données réelles en assurance
Pr. Abdallah Abarda (FEG SETTAT) Classification : KNN V0 23 / 24
Références/Sources principales
Guillaume SAINT-CIRGUE (2024), Apprendre le Machine learning,
https ://[Link]
Romain Cuillet (), Principes de l’apprentissage statistique supervisé
(Supervised Machine Learning),
https ://[Link]/[Link]/docs/courses/ML/ML-
[Link]
Stéphane Herbin, Apprentissage automatique, ONERA
Pr. Abdallah Abarda (FEG SETTAT) Classification : KNN V0 24 / 24
Clustering: K-Means
Pr. Abdallah Abarda
FEG SETTAT
21 mars 2025
Pr. Abdallah Abarda (FEG SETTAT) Clustering: K-Means 21 mars 2025 1 / 30
Clustering
Clustering
Il est utilisé pour classer les données de manière non supervisées.
Pr. Abdallah Abarda (FEG SETTAT) Clustering: K-Means 21 mars 2025 2 / 30
Clustering
Clustering
Il est utilisé pour classer les données de manière non supervisées.
Il consiste donc à regrouper nos données en nous basant uniquement
sur leur ressemblance sans fournir la classe de réponse.
Pr. Abdallah Abarda (FEG SETTAT) Clustering: K-Means 21 mars 2025 2 / 30
Clustering
Clustering
Il est utilisé pour classer les données de manière non supervisées.
Il consiste donc à regrouper nos données en nous basant uniquement
sur leur ressemblance sans fournir la classe de réponse.
Est une méthode intéressante lorsqu’on souhaite laisser à la machine
le pouvoir de proposer sa propre solution, et ainsi découvrir une
approche différente de la nôtre.
Pr. Abdallah Abarda (FEG SETTAT) Clustering: K-Means 21 mars 2025 2 / 30
Clustering
Clustering
Il est utilisé pour classer les données de manière non supervisées.
Il consiste donc à regrouper nos données en nous basant uniquement
sur leur ressemblance sans fournir la classe de réponse.
Est une méthode intéressante lorsqu’on souhaite laisser à la machine
le pouvoir de proposer sa propre solution, et ainsi découvrir une
approche différente de la nôtre.
Exemple
Classer des images ou des objets selon leur ressemblance
Segmenter une base de données de clients, selon leurs habitudes de
consommation
Regrouper des documents selon leur contenu.
Pr. Abdallah Abarda (FEG SETTAT) Clustering: K-Means 21 mars 2025 2 / 30
Clustering
L’objectif est de regrouper ces formes selon leur ressemblance, afin de
créer trois groupes distincts. La grande majorité des gens formeraient les
trois groupes suivants :
Pr. Abdallah Abarda (FEG SETTAT) Clustering: K-Means 21 mars 2025 3 / 30
Clustering
Clustering
Les caractéristiques qui permettent de trier ces objets sont :
la taille de l’objet
nombre de branches de chaque forme
En mesurant ces attributs et en les plaçant sur un graphique, on obtient :
Pr. Abdallah Abarda (FEG SETTAT) Clustering: K-Means 21 mars 2025 4 / 30
Clustering
Clustering
Les caractéristiques qui permettent de trier ces objets sont :
la taille de l’objet
nombre de branches de chaque forme
En mesurant ces attributs et en les plaçant sur un graphique, on obtient :
Pr. Abdallah Abarda (FEG SETTAT) Clustering: K-Means 21 mars 2025 4 / 30
Clustering
Clustering
Le principe du clustering est d’analyser les différentes variables X qui
caractérisent nos données, afin de regrouper les points en clusters, sans
pour autant connaı̂tre la nature de ces points.
Pr. Abdallah Abarda (FEG SETTAT) Clustering: K-Means 21 mars 2025 5 / 30
Clustering
Clustering
Le principe du clustering est d’analyser les différentes variables X qui
caractérisent nos données, afin de regrouper les points en clusters, sans
pour autant connaı̂tre la nature de ces [Link] nombreux algorithmes
permettent de réaliser du clustering :
K-Means Clustering
Clustering hierarchique
DBSCAN
GMM (Gaussian Mixture Models)
OPTICS, ect
Pr. Abdallah Abarda (FEG SETTAT) Clustering: K-Means 21 mars 2025 5 / 30
Clustering
Clustering
Le principe du clustering est d’analyser les différentes variables X qui
caractérisent nos données, afin de regrouper les points en clusters, sans
pour autant connaı̂tre la nature de ces [Link] nombreux algorithmes
permettent de réaliser du clustering :
K-Means Clustering
Clustering hierarchique
DBSCAN
GMM (Gaussian Mixture Models)
OPTICS, ect
Pr. Abdallah Abarda (FEG SETTAT) Clustering: K-Means 21 mars 2025 5 / 30
Clustering
Chaque méthode de clustering est adaptée à des besoins spécifiques.
Pr. Abdallah Abarda (FEG SETTAT) Clustering: K-Means 21 mars 2025 6 / 30
Clustering
Chaque méthode de clustering est adaptée à des besoins spécifiques.
Elles diffèrent selon leur capacité à traiter des formes de clusters
variées, ou encore leur gestion des anomalies.
Pr. Abdallah Abarda (FEG SETTAT) Clustering: K-Means 21 mars 2025 6 / 30
Clustering
Chaque méthode de clustering est adaptée à des besoins spécifiques.
Elles diffèrent selon leur capacité à traiter des formes de clusters
variées, ou encore leur gestion des anomalies.
Cette diversité est essentielle car les caractéristiques des données,
comme leur volume, leur complexité ou leur structure, influencent
fortement le choix de l’algorithme le plus adapté.
Pr. Abdallah Abarda (FEG SETTAT) Clustering: K-Means 21 mars 2025 6 / 30
Clustering
Exemples
Dans le cas d’une analyse de clientèle : Une entreprise souhaite segmenter
ses clients en fonction de leur comportement d’achat
Pr. Abdallah Abarda (FEG SETTAT) Clustering: K-Means 21 mars 2025 7 / 30
Clustering
Exemples
Dans le cas d’une analyse de clientèle : Une entreprise souhaite segmenter
ses clients en fonction de leur comportement d’achat
K-means pour regrouper les clients en clusters simples basés sur des
critères comme la fréquence d’achat et le montant dépensé.
Pr. Abdallah Abarda (FEG SETTAT) Clustering: K-Means 21 mars 2025 7 / 30
Clustering
Exemples
Dans le cas d’une analyse de clientèle : Une entreprise souhaite segmenter
ses clients en fonction de leur comportement d’achat
K-means pour regrouper les clients en clusters simples basés sur des
critères comme la fréquence d’achat et le montant dépensé.
DBSCAN pour identifier des groupes de clients atypiques ou isolés,
comme ceux effectuant des achats à des périodes inhabituelles
(anomalies).
Pr. Abdallah Abarda (FEG SETTAT) Clustering: K-Means 21 mars 2025 7 / 30
Clustering
Exemples
Dans le cadre d’une étude génétique, les chercheurs veulent regrouper des
individus en fonction du nombre de similarités dans leurs profils ADN.
Pr. Abdallah Abarda (FEG SETTAT) Clustering: K-Means 21 mars 2025 8 / 30
Clustering
Exemples
Dans le cadre d’une étude génétique, les chercheurs veulent regrouper des
individus en fonction du nombre de similarités dans leurs profils ADN.
Le clustering hiérarchique sera plus adapté, car il est utilisé pour
visualiser les relations complexes entre les échantillons sous forme d’un
dendrogramme, permettant d’explorer les niveaux de regroupement.
Pr. Abdallah Abarda (FEG SETTAT) Clustering: K-Means 21 mars 2025 8 / 30
Clustering
Applications
En marketing, le cluster analysis est utilisé pour segmenter les clients
et personnaliser les campagnes.
Pr. Abdallah Abarda (FEG SETTAT) Clustering: K-Means 21 mars 2025 9 / 30
Clustering
Applications
En marketing, le cluster analysis est utilisé pour segmenter les clients
et personnaliser les campagnes.
Dans le domaine de la santé, il aide à identifier des sous-groupes de
patients présentant des caractéristiques communes.
Pr. Abdallah Abarda (FEG SETTAT) Clustering: K-Means 21 mars 2025 9 / 30
Clustering
Applications
En marketing, le cluster analysis est utilisé pour segmenter les clients
et personnaliser les campagnes.
Dans le domaine de la santé, il aide à identifier des sous-groupes de
patients présentant des caractéristiques communes.
En finance, il permet de détecter des anomalies ou de regrouper des
transactions similaires pour mieux comprendre les comportements de
risque des investisseurs.
Pr. Abdallah Abarda (FEG SETTAT) Clustering: K-Means 21 mars 2025 9 / 30
Application : Segmentation et Tarification
Segmentation des assurés : Identification des groupes homogènes
selon âge, profession, localisation, etc.
Pr. Abdallah Abarda (FEG SETTAT) Clustering: K-Means 21 mars 2025 10 / 30
Application : Segmentation et Tarification
Segmentation des assurés : Identification des groupes homogènes
selon âge, profession, localisation, etc.
Permet d’adapter les offres commerciales et mieux cibler les produits.
Pr. Abdallah Abarda (FEG SETTAT) Clustering: K-Means 21 mars 2025 10 / 30
Application : Segmentation et Tarification
Segmentation des assurés : Identification des groupes homogènes
selon âge, profession, localisation, etc.
Permet d’adapter les offres commerciales et mieux cibler les produits.
Tarification des primes : Identification des profils de risques
similaires.
Pr. Abdallah Abarda (FEG SETTAT) Clustering: K-Means 21 mars 2025 10 / 30
Application : Segmentation et Tarification
Segmentation des assurés : Identification des groupes homogènes
selon âge, profession, localisation, etc.
Permet d’adapter les offres commerciales et mieux cibler les produits.
Tarification des primes : Identification des profils de risques
similaires.
Exemple : Utilisation du k-means ou de l’algorithme de Ward pour
classifier selon la fréquence de sinistre et l’exposition au risque.
Pr. Abdallah Abarda (FEG SETTAT) Clustering: K-Means 21 mars 2025 10 / 30
Application : Détection de la Fraude et Analyse des
Comportements
Détection de la fraude : Segmentation des demandes
d’indemnisation pour repérer les comportements suspects.
Pr. Abdallah Abarda (FEG SETTAT) Clustering: K-Means 21 mars 2025 11 / 30
Application : Détection de la Fraude et Analyse des
Comportements
Détection de la fraude : Segmentation des demandes
d’indemnisation pour repérer les comportements suspects.
Exemple : Sinistres fréquents avec des montants similaires.
Pr. Abdallah Abarda (FEG SETTAT) Clustering: K-Means 21 mars 2025 11 / 30
Application : Détection de la Fraude et Analyse des
Comportements
Détection de la fraude : Segmentation des demandes
d’indemnisation pour repérer les comportements suspects.
Exemple : Sinistres fréquents avec des montants similaires.
Analyse des comportements de résiliation : Identification des
assurés à risque de résiliation via l’historique des paiements et
interactions.
Pr. Abdallah Abarda (FEG SETTAT) Clustering: K-Means 21 mars 2025 11 / 30
Application : Optimisation et Algorithmes de Clustering
Optimisation de la gestion des sinistres : Classification selon la
gravité et la probabilité d’indemnisation.
Pr. Abdallah Abarda (FEG SETTAT) Clustering: K-Means 21 mars 2025 12 / 30
Application : Optimisation et Algorithmes de Clustering
Optimisation de la gestion des sinistres : Classification selon la
gravité et la probabilité d’indemnisation.
Segmentation des contrats santé : Profilage des patients pour
ajuster les primes.
Pr. Abdallah Abarda (FEG SETTAT) Clustering: K-Means 21 mars 2025 12 / 30
Application : Optimisation et Algorithmes de Clustering
Optimisation de la gestion des sinistres : Classification selon la
gravité et la probabilité d’indemnisation.
Segmentation des contrats santé : Profilage des patients pour
ajuster les primes.
Analyse du parcours client : Recommandations personnalisées.
Pr. Abdallah Abarda (FEG SETTAT) Clustering: K-Means 21 mars 2025 12 / 30
K-Means
Principe de K-Means
Le K-Means Clustering est un algorithme itératif, dans lequel on
demande à notre machine de trouver un nombre K de clusters au sein
de notre jeu de données.
Pr. Abdallah Abarda (FEG SETTAT) Clustering: K-Means 21 mars 2025 13 / 30
K-Means
Principe de K-Means
Le K-Means Clustering est un algorithme itératif, dans lequel on
demande à notre machine de trouver un nombre K de clusters au sein
de notre jeu de données.
elle place au hasard K points dans l’espace, puis déplace ces points
pour qu’ils deviennent les barycentres de nos clusters.
Pr. Abdallah Abarda (FEG SETTAT) Clustering: K-Means 21 mars 2025 13 / 30
K-Means
Principe de K-Means
Prenons un exemple avec K=3 clusters
Pour commencer, on place trois points aléatoires au sein de nos
données.
Pr. Abdallah Abarda (FEG SETTAT) Clustering: K-Means 21 mars 2025 14 / 30
K-Means
Principe de K-Means
Prenons un exemple avec K=3 clusters
Pour commencer, on place trois points aléatoires au sein de nos
données.
Ces points sont appelés centroı̈des et sont les futurs centres de masse
des clusters que l’on veut former.
Pr. Abdallah Abarda (FEG SETTAT) Clustering: K-Means 21 mars 2025 14 / 30
K-Means
Principe de K-Means
Ensuite, on associe chaque point de notre jeu de données au centroı̈de
dont il est le plus proche, en calculant la distance euclidienne.
Pr. Abdallah Abarda (FEG SETTAT) Clustering: K-Means 21 mars 2025 15 / 30
K-Means
Principe de K-Means
Ensuite, on déplace chaque centroı̈de au centre de son groupe, ce qui
explique son nom de ”centroı̈de”. Pour ce faire, on calcule la moyenne des
points du cluster, et cette moyenne depuis la nouvelle position du
centroı̈de, d’où le nom de ”K-Means”.
Pr. Abdallah Abarda (FEG SETTAT) Clustering: K-Means 21 mars 2025 16 / 30
K-Means
Principe de K-Means
Comme la position de chaque centroı̈de a changé, les centroı̈des ont
désormais des plus proches voisins différents. Ainsi, nous réitérons notre
algorithme...
Pr. Abdallah Abarda (FEG SETTAT) Clustering: K-Means 21 mars 2025 17 / 30
K-Means
Principe de K-Means
... Nous réassignons chaque point à son centroı̈de le plus proche (notez
bien que cela produit des résultats différents de ceux de la première
itération !).
Pr. Abdallah Abarda (FEG SETTAT) Clustering: K-Means 21 mars 2025 18 / 30
K-Means
Principe de K-Means
... Puis on déplace chaque centroı̈de au centre de son groupe.
Pr. Abdallah Abarda (FEG SETTAT) Clustering: K-Means 21 mars 2025 19 / 30
K-Means
Principe de K-Means
... Puis on déplace chaque centroı̈de au centre de son groupe.
Pr. Abdallah Abarda (FEG SETTAT) Clustering: K-Means 21 mars 2025 20 / 30
K-Means
Principe de K-Means
Et cet algorithme se répète ainsi jusqu’à ce que les centroı̈des ne bougent
plus.
Pr. Abdallah Abarda (FEG SETTAT) Clustering: K-Means 21 mars 2025 21 / 30
K-Means
Principe de K-Means
Et cet algorithme se répète ainsi jusqu’à ce que les centroı̈des ne bougent
plus.C’est alors que l’algorithme se termine. c’est ainsi que fonctionne
l’algorithme du K-Means clustering. Il vous suffit de déclarer le nombre de
clusters que vous souhaitez obtenir, et l’algorithme s’occupe du reste.
Pr. Abdallah Abarda (FEG SETTAT) Clustering: K-Means 21 mars 2025 21 / 30
Détermination du nombre de cluster en K-Means
Méthode du coude
La méthode du coude consiste à tester différentes valeurs de K pour
l’algorithme du K-Means Clustering
Pr. Abdallah Abarda (FEG SETTAT) Clustering: K-Means 21 mars 2025 22 / 30
Détermination du nombre de cluster en K-Means
Méthode du coude
La méthode du coude consiste à tester différentes valeurs de K pour
l’algorithme du K-Means Clustering
Mesurer à chaque fois la variance finale (V) de chaque clustering
tracer l’évolution de cette variance en focntion de K pour identifier
une forme de coude dans le graphique.
Pr. Abdallah Abarda (FEG SETTAT) Clustering: K-Means 21 mars 2025 22 / 30
Détermination du nombre de cluster en K-Means
Méthode du coude
K=1
La variance est maximale (graphique droite)
Pr. Abdallah Abarda (FEG SETTAT) Clustering: K-Means 21 mars 2025 23 / 30
Détermination du nombre de cluster en K-Means
Méthode du coude
K=2
La variance diminue
Pr. Abdallah Abarda (FEG SETTAT) Clustering: K-Means 21 mars 2025 24 / 30
Détermination du nombre de cluster en K-Means
Méthode du coude
K=3
La variance diminue encore plus
Pr. Abdallah Abarda (FEG SETTAT) Clustering: K-Means 21 mars 2025 25 / 30
Détermination du nombre de cluster en K-Means
Méthode du coude
K=4
La variance diminue encore plus, mais la diminution n’est pas
significative
Pr. Abdallah Abarda (FEG SETTAT) Clustering: K-Means 21 mars 2025 26 / 30
Détermination du nombre de cluster en K-Means
Méthode du coude
K=5
La variance diminue encore plus, mais la diminution n’est pas
significative
Pr. Abdallah Abarda (FEG SETTAT) Clustering: K-Means 21 mars 2025 27 / 30
Détermination du nombre de cluster en K-Means
Méthode du coude (The Elbow Method)
En continuant ainsi jusqu’à K=9, on observe sur notre graphique
l’apparition d’une forme de coude. C’est à ce point que K semble être
optimal, ce qui est cohérent avec nos données.
Pr. Abdallah Abarda (FEG SETTAT) Clustering: K-Means 21 mars 2025 28 / 30
Implémentation de K-Means sur Python
code Python
Cliquer ici
Pr. Abdallah Abarda (FEG SETTAT) Clustering: K-Means 21 mars 2025 29 / 30
Références/Sources principales
Guillaume SAINT-CIRGUE (2024), Apprendre le Machine learning,
https ://[Link]
Romain Cuillet (), Principes de l’apprentissage statistique supervisé
(Supervised Machine Learning),
https ://[Link]/[Link]/docs/courses/ML/ML-
[Link]
Stéphane Herbin, Apprentissage automatique, ONERA
Pr. Abdallah Abarda (FEG SETTAT) Clustering: K-Means 21 mars 2025 30 / 30
Clustering: Classification Hiérarchique
Pr. Abdallah Abarda
FEG SETTAT
24 avril 2025
Pr. Abdallah Abarda (FEG SETTAT) Clustering: Classification Hiérarchique 24 avril 2025 1 / 20
Classification Hiérarchique
Classification Hiérarchique
Classification Hiérarchique ascendante (CHA)
Pr. Abdallah Abarda (FEG SETTAT) Clustering: Classification Hiérarchique 24 avril 2025 2 / 20
Classification Hiérarchique
Classification Hiérarchique
Classification Hiérarchique ascendante (CHA)
Classification Hiérarchique descendante (CHD)
Pr. Abdallah Abarda (FEG SETTAT) Clustering: Classification Hiérarchique 24 avril 2025 2 / 20
Classification Hiérarchique
Classification Hiérarchique
Classification Hiérarchique ascendante (CHA)
Classification Hiérarchique descendante (CHD)
Exemple
La CHA est une technique de clustering qui regroupe progressivement
les individus ou les observations par similitudes.
Pr. Abdallah Abarda (FEG SETTAT) Clustering: Classification Hiérarchique 24 avril 2025 2 / 20
Classification Hiérarchique
Classification Hiérarchique
Classification Hiérarchique ascendante (CHA)
Classification Hiérarchique descendante (CHD)
Exemple
La CHA est une technique de clustering qui regroupe progressivement
les individus ou les observations par similitudes.
Contrairement à la méthode K-means, la CHA n’exige pas de spécifier
à l’avance le nombre de clusters que l’on souhaite obtenir.
Pr. Abdallah Abarda (FEG SETTAT) Clustering: Classification Hiérarchique 24 avril 2025 2 / 20
Classification Hiérarchique
Classification Hiérarchique
Classification Hiérarchique ascendante (CHA)
Classification Hiérarchique descendante (CHD)
Exemple
La CHA est une technique de clustering qui regroupe progressivement
les individus ou les observations par similitudes.
Contrairement à la méthode K-means, la CHA n’exige pas de spécifier
à l’avance le nombre de clusters que l’on souhaite obtenir.
La CHA est particulièrement utile pour visualiser les relations entre les
groupes et identifier des clusters naturels dans des données complexes.
Pr. Abdallah Abarda (FEG SETTAT) Clustering: Classification Hiérarchique 24 avril 2025 2 / 20
Classification Hiérarchique
Classification Hiérarchique
Classification Hiérarchique ascendante (CHA)
Classification Hiérarchique descendante (CHD)
Exemple
La CHA est une technique de clustering qui regroupe progressivement
les individus ou les observations par similitudes.
Contrairement à la méthode K-means, la CHA n’exige pas de spécifier
à l’avance le nombre de clusters que l’on souhaite obtenir.
La CHA est particulièrement utile pour visualiser les relations entre les
groupes et identifier des clusters naturels dans des données complexes.
Elle est recommandée lorsque le nombre de clusters est inconnu ou
pour des petits ensembles de données
Pr. Abdallah Abarda (FEG SETTAT) Clustering: Classification Hiérarchique 24 avril 2025 2 / 20
Classification Hiérarchique
Classification Hiérarchique ascendante
la CHA considère au début chaque individu comme une classe séparée.
puis fusionne progressivement les classes les plus similaires jusqu’à ce
qu’il ne reste qu’une seule classe englobant l’ensemble des données.
Pr. Abdallah Abarda (FEG SETTAT) Clustering: Classification Hiérarchique 24 avril 2025 3 / 20
Classification Hiérarchique
Classification Hiérarchique ascendante
la CHA considère au début chaque individu comme une classe séparée.
puis fusionne progressivement les classes les plus similaires jusqu’à ce
qu’il ne reste qu’une seule classe englobant l’ensemble des données.
La structuration hiérarchique des données est représentée
graphiquement sous la forme d’un dendrogramme (regroupements
successifs et leur degré de similarité).
Pr. Abdallah Abarda (FEG SETTAT) Clustering: Classification Hiérarchique 24 avril 2025 3 / 20
Classification Hiérarchique
Classification Hiérarchique ascendante
la CHA considère au début chaque individu comme une classe séparée.
puis fusionne progressivement les classes les plus similaires jusqu’à ce
qu’il ne reste qu’une seule classe englobant l’ensemble des données.
La structuration hiérarchique des données est représentée
graphiquement sous la forme d’un dendrogramme (regroupements
successifs et leur degré de similarité).
Ce regroupement s’opère en fonction de la distance mesurée soit entre
deux individus (notamment au début), soit entre deux groupes
d’individus, soit entre un groupe et un individu isolé.
Pr. Abdallah Abarda (FEG SETTAT) Clustering: Classification Hiérarchique 24 avril 2025 3 / 20
Classification Hiérarchique
Classification Hiérarchique ascendante
la CHA considère au début chaque individu comme une classe séparée.
puis fusionne progressivement les classes les plus similaires jusqu’à ce
qu’il ne reste qu’une seule classe englobant l’ensemble des données.
La structuration hiérarchique des données est représentée
graphiquement sous la forme d’un dendrogramme (regroupements
successifs et leur degré de similarité).
Ce regroupement s’opère en fonction de la distance mesurée soit entre
deux individus (notamment au début), soit entre deux groupes
d’individus, soit entre un groupe et un individu isolé.
Le processus s’arrête lorsqu’ajouter un nouveau regroupement ne
permet plus d’améliorer la capacité discriminatoire de l’analyse(donc
avoir la meilleure hiérarchie finale).
Pr. Abdallah Abarda (FEG SETTAT) Clustering: Classification Hiérarchique 24 avril 2025 3 / 20
Classification Hiérarchique ascendante (CHA)
Figure – Exemple d’une CHA
Pr. Abdallah Abarda (FEG SETTAT) Clustering: Classification Hiérarchique 24 avril 2025 4 / 20
Classification Hiérarchique ascendante (CHA)
Figure – Exemple de dendrogramme (avec segement)
Pr. Abdallah Abarda (FEG SETTAT) Clustering: Classification Hiérarchique 24 avril 2025 5 / 20
Classification Hiérarchique
Algorithme : Classification Hiérarchique ascendante
1 1ère phase : Initialisation de l’algorithme.
Les classes initiales = n singletons individus.
Calcul de la matrice des distances des individus 2 à 2
Pr. Abdallah Abarda (FEG SETTAT) Clustering: Classification Hiérarchique 24 avril 2025 6 / 20
Classification Hiérarchique
Algorithme : Classification Hiérarchique ascendante
1 1ère phase : Initialisation de l’algorithme.
Les classes initiales = n singletons individus.
Calcul de la matrice des distances des individus 2 à 2
2 2ème phase : Itération des étapes suivantes.
Regrouper les 2 éléments (individus ou groupes) les plus proches au
sens d’un critère chosi.
Mise à jour du tableau des distances en remplaçant les deux éléments
regroupés par le nouveau et en recalculant sa distance avec les autres
classes.
Pr. Abdallah Abarda (FEG SETTAT) Clustering: Classification Hiérarchique 24 avril 2025 6 / 20
Classification Hiérarchique
Algorithme : Classification Hiérarchique ascendante
1 1ère phase : Initialisation de l’algorithme.
Les classes initiales = n singletons individus.
Calcul de la matrice des distances des individus 2 à 2
2 2ème phase : Itération des étapes suivantes.
Regrouper les 2 éléments (individus ou groupes) les plus proches au
sens d’un critère chosi.
Mise à jour du tableau des distances en remplaçant les deux éléments
regroupés par le nouveau et en recalculant sa distance avec les autres
classes.
3 Fin de l’itération : agrégation de tous les individus en une seule classe.
Pr. Abdallah Abarda (FEG SETTAT) Clustering: Classification Hiérarchique 24 avril 2025 6 / 20
Classification Hiérarchique ascendante
Réflexions pré-algorithme : Classification Hiérarchique ascendante
1 Préparation des données
Pr. Abdallah Abarda (FEG SETTAT) Clustering: Classification Hiérarchique 24 avril 2025 7 / 20
Classification Hiérarchique ascendante
Réflexions pré-algorithme : Classification Hiérarchique ascendante
1 Préparation des données
2 Choix de l’indice de dissimilarité entre les individus : Nécessité de
définir une distance entre les individus
Pr. Abdallah Abarda (FEG SETTAT) Clustering: Classification Hiérarchique 24 avril 2025 7 / 20
Classification Hiérarchique ascendante
Réflexions pré-algorithme : Classification Hiérarchique ascendante
1 Préparation des données
2 Choix de l’indice de dissimilarité entre les individus : Nécessité de
définir une distance entre les individus
3 Choix de l’indice d’agrégation : Définir un critère de regroupement
des individus à minimiser aussi appelé stratégie d’agrégation.
Pr. Abdallah Abarda (FEG SETTAT) Clustering: Classification Hiérarchique 24 avril 2025 7 / 20
Classification Hiérarchique ascendante
Réflexions pré-algorithme : Classification Hiérarchique ascendante
1 Préparation des données
2 Choix de l’indice de dissimilarité entre les individus : Nécessité de
définir une distance entre les individus
3 Choix de l’indice d’agrégation : Définir un critère de regroupement
des individus à minimiser aussi appelé stratégie d’agrégation.
4 Choix de la partition finale : Stratégie pour définir la meilleure
typologie finale.
Pr. Abdallah Abarda (FEG SETTAT) Clustering: Classification Hiérarchique 24 avril 2025 7 / 20
Classification Hiérarchique ascendante
Choix de l’indice de dissimilarité entre les individus
1 Distance Euclidienne : le type de distance le plus couramment utilisé.
Il s’agit d’une distance géométrique dans un espace
multidimensionnel. d(x, y ) = (Σi (xi − yi )2 )1/2
2 Distance Euclidienne au carré : Permet de ”sur-pondérer” les objets
atypiques (éloignés), en élevant la distance euclidienne au carré.
d(x, y ) = i (xi − yi )2
P
3 Distance du City-block (Manhattan) : cette distance est Psimplement
la somme des différences entre les dimension. d(x, y ) = i |xi − yi |
Pr. Abdallah Abarda (FEG SETTAT) Clustering: Classification Hiérarchique 24 avril 2025 8 / 20
Classification Hiérarchique ascendante
Choix de l’indice d’agrégation
On regroupe les éléments en minimisant l’indice d’agrégation, Il existe
plusieurs méthodes, mais la méthode la plus connu : Méthode de ward ;
Pr. Abdallah Abarda (FEG SETTAT) Clustering: Classification Hiérarchique 24 avril 2025 9 / 20
Classification Hiérarchique ascendante
Choix de l’indice d’agrégation
On regroupe les éléments en minimisant l’indice d’agrégation, Il existe
plusieurs méthodes, mais la méthode la plus connu : Méthode de ward ;
Autre stratégies :
1 stratégie du saut minimum ou single linkage : On regroupe les 2
éléments présentant la plus petite distance entre éléments des deux
classes.
Pr. Abdallah Abarda (FEG SETTAT) Clustering: Classification Hiérarchique 24 avril 2025 9 / 20
Classification Hiérarchique ascendante
Choix de l’indice d’agrégation
On regroupe les éléments en minimisant l’indice d’agrégation, Il existe
plusieurs méthodes, mais la méthode la plus connu : Méthode de ward ;
Autre stratégies :
1 stratégie du saut minimum ou single linkage : On regroupe les 2
éléments présentant la plus petite distance entre éléments des deux
classes.
2 stratégie du saut maximum ou du diamètre ou complete linkage : On
regroupe les 2 éléments présentant la plus grande distance entre
éléments des deux classes.
Pr. Abdallah Abarda (FEG SETTAT) Clustering: Classification Hiérarchique 24 avril 2025 9 / 20
Classification Hiérarchique ascendante
Choix de l’indice d’agrégation : Méthode de Ward
Objectif : gain minimum d’inertie intra-classe à chaque agrégation
perte d’inertie interclasse due à cette agrégation
Calcul :
La méthode de Ward utilise une analyse de la variance approchée afin
d’évaluer les distances entre classes
Minimisation de la Somme des Carrés (SC) de tous les couples
hypothétiques de classes : agrégation
Les indices d’agrégation sont recalculés : si une classe M est obtenue
en regroupant les classes K et L, sa distance à la classe J est donnée
par la distance entre les barycentres de la classe M et de J.
Pr. Abdallah Abarda (FEG SETTAT) Clustering: Classification Hiérarchique 24 avril 2025 10 / 20
Classification Hiérarchique ascendante
Choix de la partition finale
On défini un ensemble de parties, ou classes de l’ensemble des individus
tq :
toute classe soit non vide
deux classes distinctes sont disjointes
tout individu appartient à une classe.
Pr. Abdallah Abarda (FEG SETTAT) Clustering: Classification Hiérarchique 24 avril 2025 11 / 20
Choix de la partition finale : Classification Hiérarchique
ascendante
Graphique de l’Indice de niveau
on doit repérer des sauts extrêmement importants dans les valeurs, en
analysant l’histogramme des indices de niveau
Si ces sauts concernent les k derniers nœuds de l’arbre, alors un
découpage en (k+1) classes sera pertinent.
La hauteur d’une branche est proportionnelle à la distance entre 2 classes
On coupe au niveau d’une longue branche
coupé avant une forte perte d’inertie dans le cas de la méthode de
Ward
Pr. Abdallah Abarda (FEG SETTAT) Clustering: Classification Hiérarchique 24 avril 2025 12 / 20
Classification Hiérarchique ascendante
Exemple
On dispose des données de 20 régions de France métropolitaine
5 variables : Densité ; Criminalité ; Espérance de vie ; Pauvreté ;
Enseignement
Pr. Abdallah Abarda (FEG SETTAT) Clustering: Classification Hiérarchique 24 avril 2025 13 / 20
Classification Hiérarchique ascendante
Pr. Abdallah Abarda (FEG SETTAT) Clustering: Classification Hiérarchique 24 avril 2025 14 / 20
Classification Hiérarchique ascendante
Exemple de calcul de la distance
distance euclidienne Vs distance de Manhattan entre Alsace et Aquitaine
Euclidiennep:
d(x; y ) = (0, 41 − (−0.34))2 + (−0.45 − (−0.07))2 = 0, 84
Manhattan :
d(x; y ) = |0, 41 − (−0, 34)| + | − 0, 45 − (−0, 07)| = 1, 13
Pr. Abdallah Abarda (FEG SETTAT) Clustering: Classification Hiérarchique 24 avril 2025 15 / 20
Classification Hiérarchique ascendante
Pr. Abdallah Abarda (FEG SETTAT) Clustering: Classification Hiérarchique 24 avril 2025 16 / 20
Classification Hiérarchique ascendante
Pr. Abdallah Abarda (FEG SETTAT) Clustering: Classification Hiérarchique 24 avril 2025 17 / 20
Classification Hiérarchique ascendante
Pr. Abdallah Abarda (FEG SETTAT) Clustering: Classification Hiérarchique 24 avril 2025 18 / 20
Classification Hiérarchique ascendante
Pr. Abdallah Abarda (FEG SETTAT) Clustering: Classification Hiérarchique 24 avril 2025 19 / 20
Classification Hiérarchique ascendante
Pr. Abdallah Abarda (FEG SETTAT) Clustering: Classification Hiérarchique 24 avril 2025 20 / 20
Réseaux de neurones artificielles: Artificial Neural
Networks (ANN)
Pr. Abdallah Abarda
FEG SETTAT
11 mai 2025
Pr. Abdallah Abarda (FEG SETTAT) Réseaux de neurones artificielles: Artificial Neural Networks11(ANN)
mai 2025 1 / 27
Introduction aux réseaux de neurones artificielles(ANN)
Réseaux de neurones
Un réseau neuronal est l’association, en un graphe plus ou moins
complexe, d’objets élémentaires, les neurones formels.
Pr. Abdallah Abarda (FEG SETTAT) Réseaux de neurones artificielles: Artificial Neural Networks11(ANN)
mai 2025 2 / 27
Introduction aux réseaux de neurones artificielles(ANN)
Neurones formels
De façon très réductrice, un neurone biologique est qui est composé de
dendrites, d’un corps cellulaire et d’axone, et qui se caractérise par :
des synapses, les points de connexion avec les autres neurones, fibres
nerveuses ou musculaires ;
des dentrites ou entrées du neurones ;
les axones, ou sorties du neurone vers d’autres neurones ou fibres
musculaires ;
le noyau qui active les sorties en fonction des stimulations en entrée.
Pr. Abdallah Abarda (FEG SETTAT) Réseaux de neurones artificielles: Artificial Neural Networks11(ANN)
mai 2025 3 / 27
Introduction aux réseaux de neurones artificielles (ANN)
Neurone
Biologiquement, chaque neurone reçoit d’un ensemble de dendrites issues
d’autres neurones un potentiel électrique qui, sommé au sein du neurone,
s’il dépasse un seuil, dépolarise et propage alors le signal le long de
l’axone qui part en direction d’autres neurones :
Pr. Abdallah Abarda (FEG SETTAT) Réseaux de neurones artificielles: Artificial Neural Networks11(ANN)
mai 2025 4 / 27
Introduction aux réseaux de neurones artificielles (ANN)
modèle simple du neurone
Un modèlePsimple du neurone consiste en : une fonction de sommation
(linéaire) pi=1 wi xi des signaux x1 , . . . , xp reçus au niveau des p
dendrites, possiblement pondérés par des coefficients d’intensité
w1 , . . . , wp , à laquelle on applique alors une fonction d’activation f ou
σ ; par exemple σ(t) : t 7→ 1t>seuil :Threshold Function (fonction de
seuillage) ; on obtient alors une sortie y associée, fonction non-linéaire des
entrées, de la forme :
p
!
X
y =σ wi xi .
i=1
Pr. Abdallah Abarda (FEG SETTAT) Réseaux de neurones artificielles: Artificial Neural Networks11(ANN)
mai 2025 5 / 27
Introduction aux réseaux de neurones artificielles (ANN)
Exemples de fonction d’activation
Pr. Abdallah Abarda (FEG SETTAT) Réseaux de neurones artificielles: Artificial Neural Networks11(ANN)
mai 2025 6 / 27
Introduction aux réseaux de neurones artificielles (ANN)
Exemples de fonction d’activation
Pr. Abdallah Abarda (FEG SETTAT) Réseaux de neurones artificielles: Artificial Neural Networks11(ANN)
mai 2025 7 / 27
Introduction aux réseaux de neurones artificielles (ANN)
Exemples de fonction d’activation
Les différents types de neurones se distinguent par la nature σ (noté aussi
f ) de leur fonction d’activation. Les principaux types sont :
linéaire σ est la fonction identité,
seuil : σ(x) = 1[0,+∞[ (x),
sigmoüde : σ(x) = 1/ (1 + e x ),
ReLU : σ(x) = max(0, x) (rectified linear unit),
xj
softmax : σ(x)j = PKe xk pour tout k ∈ {1 . . . K },
k=1 e
2
radiale : σ(x) = 1/2πe −x /2 ,
p
stochastique : σ(x) = 1 avec la probabilité 1/ 1 + e −x/H , 0 sinon (
H intervient comme une température dans un algorithme de recuit
simulé),
Pr. Abdallah Abarda (FEG SETTAT) Réseaux de neurones artificielles: Artificial Neural Networks11(ANN)
mai 2025 8 / 27
Introduction aux réseaux de neurones artificielles (ANN)
Figure – Représentation d’un neurone et sa modélisation mathématique
Pr. Abdallah Abarda (FEG SETTAT) Réseaux de neurones artificielles: Artificial Neural Networks11(ANN)
mai 2025 9 / 27
Introduction aux réseaux de neurones artificielles (ANN)
Le perceptron
En 1950, Rosenblatt a proposé ”perceptron” : un premier réseau de
neurones consiste en deux couches de neurones :
la première couche contient les signaux d’entrée x1 ; ...; xp que l’on
rassemblera en un vecteur x = [x1 ; ...; xp ]t ∈ R p .
la seconde consiste en N neurones activés parallèlement P par les p
entrées, et dont les sorties y1 ; ...; yN vérifient yj = σ( i=p
i=1 wji xi ) où
wji est le poids liant le neurone j à l’entrée xi . En définissant
également le vecteur y = [y1 ; ...; yN ]t ∈ R p , on obtient alors la forme
vectorielle.
y = σ(Wx)
Pr. Abdallah Abarda (FEG SETTAT) Réseaux de neurones artificielles: Artificial Neural Networks11(ANN)
mai 2025 10 / 27
Introduction aux réseaux de neurones artificielles (ANN)
Fonction de seuillage σ
Le fait d’avoir une seule fonction de seuillage (fonction d’activation) réduit
la flexibilité du réseau, et on ajoute communément une variable bj
supplémentaire au niveau de chaque neurone j, qui permet de déplacer le
seuil, et donc d’obtenir plutôt :
i=p
X
yj = σ( wji xi )
i=1
ou sous forme vectorielle y = σ(Wx + b) avec b = [b1 ; ...; bN ]T ∈ R N .
Pr. Abdallah Abarda (FEG SETTAT) Réseaux de neurones artificielles: Artificial Neural Networks11(ANN)
mai 2025 11 / 27
Introduction aux réseaux de neurones artificielles (ANN)
Exemple
Perceptron à deux entrées/ Il est défini par les poids w1 = 2 et w2 = 3.
Notons x et y les deux réels en entrée. La fonction linéaire f est donc
f (x, y ) = 2x + 3y .
La valeur en sortie est donc : F (x, y ) = 1 si 2x + 3y >= 0 ; F (x, y ) = 0
sinon.
Pr. Abdallah Abarda (FEG SETTAT) Réseaux de neurones artificielles: Artificial Neural Networks11(ANN)
mai 2025 12 / 27
Introduction aux réseaux de neurones artificielles (ANN)
Exemple : Valeurs de la fonction
La fonction F prend seulement deux valeurs : 0 ou 1. La frontière
correspond aux points (x, y ) tels que f (x, y ) = 0, c’est-à-dire à la droite
2x + 3y = 0. Pour les points au-dessus de la droite (ou sur la droite) la
fonction F prend la valeur 1 ; pour les points en-dessous de la droite, la
fonction F vaut 0.
Pr. Abdallah Abarda (FEG SETTAT) Réseaux de neurones artificielles: Artificial Neural Networks11(ANN)
mai 2025 13 / 27
Nombre de couche : réseaux de neurones artificielles (ANN)
Pr. Abdallah Abarda (FEG SETTAT) Réseaux de neurones artificielles: Artificial Neural Networks11(ANN)
mai 2025 14 / 27
Perceptron mono-couche (single-layer perceptrons SLP)
Limites des perceptrons mono-couches
Utilise uniquement la fonction d’activation binaire
Utilisable uniquement pour les réseaux linéaires
Grâce à l’apprentissage supervisé, une solution optimale est fournie
Le temps d’apprentissage est plus long
Impossible de résoudre un problème linéaire inséparable
Pr. Abdallah Abarda (FEG SETTAT) Réseaux de neurones artificielles: Artificial Neural Networks11(ANN)
mai 2025 15 / 27
Perceptron multi-couches (Multilayer perceptron MLP)
Pr. Abdallah Abarda (FEG SETTAT) Réseaux de neurones artificielles: Artificial Neural Networks11(ANN)
mai 2025 16 / 27
Perceptron mono-couche (single-layer perceptrons SLP)
Perceptrons Multi-couches
Chacun des neurones d’une couche est connecté à tous les neurones
de la couche suivante.
Chaque connexion a un poids aij .
L’information se propage alors de couche en couche sans retour en
arrière possible.
Pour chaque couche du réseau, il y a un terme de biais.
Pr. Abdallah Abarda (FEG SETTAT) Réseaux de neurones artificielles: Artificial Neural Networks11(ANN)
mai 2025 17 / 27
Perceptron mono-couche (single-layer perceptrons SLP)
Exemple : Perceptrons Multi-couches
Sachant que la fonction d’activation de la couche cachée est le tangent
hyperbolique (th) et celle de la couche de sortie est l’identité. Quelle est la
sortie de ce réseau de neurones ?
Pr. Abdallah Abarda (FEG SETTAT) Réseaux de neurones artificielles: Artificial Neural Networks11(ANN)
mai 2025 18 / 27
Perceptron mono-couche (single-layer perceptrons SLP)
Exemple : Perceptrons Multi-couches
Sachant que la fonction d’activation de la couche cachée est le tangent
hyperbolique (th) et celle de la couche de sortie est l’identité. Quelle est la
sortie de ce réseau de neurones ?
y (x) = −2th(10x + 5) + 3th(x + 0.25) − 2th(3x − 0.25) + 0, 5
Pr. Abdallah Abarda (FEG SETTAT) Réseaux de neurones artificielles: Artificial Neural Networks11(ANN)
mai 2025 18 / 27
Perceptron mono-couche (single-layer perceptrons SLP)
Exemple : Perceptrons Multi-couches
Sachant que la fonction d’activation de la couche cachée est la fonction
sigmoı̈de et celle de la couche de sortie est ReLu. Quelle est la sortie de ce
réseau de neurones ?
Pr. Abdallah Abarda (FEG SETTAT) Réseaux de neurones artificielles: Artificial Neural Networks11(ANN)
mai 2025 19 / 27
Perceptron mono-couche (single-layer perceptrons SLP)
Exemple : Perceptrons Multi-couches
Sachant que la fonction d’activation de la couche cachée est la fonction
sigmoı̈de et celle de la couche de sortie est ReLu. Quelle est la sortie de ce
réseau de neurones ?
1 1 1
y (x) = max 0, −2 · 1+e −10x−5
+3· 1+e −x−0.25
−2· 1+e −3x+0.25
+ 0.5
Pr. Abdallah Abarda (FEG SETTAT) Réseaux de neurones artificielles: Artificial Neural Networks11(ANN)
mai 2025 19 / 27
Retropropagation (Backpropagation)
Backpropagation
L’algorithme d’apprentissage tel que la rétropropagation est appliqué pour
ajuster les poids en réduisant au minimum une fonction d’erreur qui est, en
général, la somme des erreurs quadratiques entre la sortie du réseau de
neurones et la sortie attendue
Pr. Abdallah Abarda (FEG SETTAT) Réseaux de neurones artificielles: Artificial Neural Networks11(ANN)
mai 2025 20 / 27
Retropropagation (Backpropagation)
Backpropagation
La création d’un perceptron multicouche pour résoudre un problème
passe par l’inférence de la meilleure application possible telle que
définie par un en semble de données d’apprentissage constituées de
paires de vecteurs d’entrées et de sorties désirées.
Cette inférence peut se faire par l’algorithme dit de rétro-propagation.
L’algorithme de rétro-propagation, va réaliser l’apprentissage du
réseau en modifiant les poids des connexions neurone par neurone en
commençant par la couche de sortie.
Le critère d’apprentissage étant la minimisation de la racine de
l’erreur quadratique moyenne
Pr. Abdallah Abarda (FEG SETTAT) Réseaux de neurones artificielles: Artificial Neural Networks11(ANN)
mai 2025 21 / 27
Retropropagation (Backpropagation)
Backpropagation
Pr. Abdallah Abarda (FEG SETTAT) Réseaux de neurones artificielles: Artificial Neural Networks11(ANN)
mai 2025 22 / 27
Retropropagation (Backpropagation)
Backpropagation
Pr. Abdallah Abarda (FEG SETTAT) Réseaux de neurones artificielles: Artificial Neural Networks11(ANN)
mai 2025 23 / 27
Retropropagation (Backpropagation)
Backpropagation
Pr. Abdallah Abarda (FEG SETTAT) Réseaux de neurones artificielles: Artificial Neural Networks11(ANN)
mai 2025 24 / 27
Validation croisée
Validation croisée
La validation croisée est une procédure de rééchantillonnage permettant
d’évaluer un modèle d’apprentissage automatique et de tester sa capacité
de faire des prédictions sur des données de test indépendant. Elle permet
ainsi de choisir lequel entre deux modèles représente mieux le vrai modèle
de nos données.
Division de données
La performance dépend de la division des données ”data splitting” en
apprentissage et test.
Pr. Abdallah Abarda (FEG SETTAT) Réseaux de neurones artificielles: Artificial Neural Networks11(ANN)
mai 2025 25 / 27
Validation croisée
Leave-P-Out Cross Validation
On utilise des échantillons de taille p pour la validation et les n-p
échantillons qui restent comme ensemble d’apprentissage. On considère
toutes les combinaisons possibles. Le nombre d’itérations est alors Cpn .
Leave-P-Out
Cette méthode est couteuse lorsqu’il s’agit d’un nombre très grand
d’échatillons
Pr. Abdallah Abarda (FEG SETTAT) Réseaux de neurones artificielles: Artificial Neural Networks11(ANN)
mai 2025 26 / 27
Validation croisée
K-Fold Cross Validation
Les données sont divisées en K sous-ensembles. Pour chaque itération, un
sous-ensemble est utilisé pour la validation et les autres pour
l’entrainement. Le nombre d’itérations est alors égale à K (souvent on
choisit K=5 à 10).
Stratified K-Fold Cross Validation
Cette méthode de validation croisée est une légère variation de K-Fold, de
sorte que chaque ‘fold’ contient approximativement le même pourcentage
d’échantillons de chaque classe cible, ou en cas de problèmes de
prédiction, la valeur de réponse moyenne est approximativement égale dans
tous les ‘folds’.
Pr. Abdallah Abarda (FEG SETTAT) Réseaux de neurones artificielles: Artificial Neural Networks11(ANN)
mai 2025 27 / 27