0% ont trouvé ce document utile (0 vote)
6 vues77 pages

Introduction à l'Intelligence Artificielle

Transféré par

Med Reda Elmoktadi
Copyright
© All Rights Reserved
Nous prenons très au sérieux les droits relatifs au contenu. Si vous pensez qu’il s’agit de votre contenu, signalez une atteinte au droit d’auteur ici.
Formats disponibles
Téléchargez aux formats PDF, TXT ou lisez en ligne sur Scribd
0% ont trouvé ce document utile (0 vote)
6 vues77 pages

Introduction à l'Intelligence Artificielle

Transféré par

Med Reda Elmoktadi
Copyright
© All Rights Reserved
Nous prenons très au sérieux les droits relatifs au contenu. Si vous pensez qu’il s’agit de votre contenu, signalez une atteinte au droit d’auteur ici.
Formats disponibles
Téléchargez aux formats PDF, TXT ou lisez en ligne sur Scribd

Introduction à L’Intelligence Artificielle

[Link]

CPGE Mohammedia

Février 2024

[Link] (CPGE Mohammedia) Introduction à L’Intelligence Artificielle Février 2024 1 / 77


Vue d’ensemble

Qu’est-ce que intelligence artificielle ?


Types de l’IA
Historique de l’IA
Programmation classique vs IA
De l’IA au Machine Learning
Machine Learning
L’apprentissage supervisé (Supervised Learning)
L’apprentissage non supervisé (Unsupervised Learning)
L’apprentissage par renforcement (Reinforcement Learning)
Machine Learning: Quelques algorithmes
L’apprentissage supervisé (Supervised Learning)
L’apprentissage non supervisé (Unsupervised Learning)
L’apprentissage par renforcement (Reinforcement Learning)

[Link] (CPGE Mohammedia) Introduction à L’Intelligence Artificielle Février 2024 2 / 77


Qu’est-ce que intelligence artificielle ?

Définition
L’Intelligence Artificielle (IA) consiste à mettre en œuvre un certain
nombre de techniques visant à permettre aux machines d’imiter une forme
d’intelligence réelle.

[Link] (CPGE Mohammedia) Introduction à L’Intelligence Artificielle Février 2024 3 / 77


Qu’est-ce que intelligence artificielle ?

La notion voit le jour dans les années 1950 grâce au mathématicien Alan
Turing.
Il se posait la question qui allait bouleverser le monde : Les machine
peuvent-elles faire preuve de signes d’intelligence humaine ?
=> Il décrit un test connu actuellement sous le nom Test de Turing

[Link] (CPGE Mohammedia) Introduction à L’Intelligence Artificielle Février 2024 4 / 77


Test de Turing

C’est un test dans lequel un humain interagit à l’aveugle avec un autre


humain, puis avec une machine programmée pour formuler des réponses
sensées.
Si le sujet n’est pas capable de faire la différence, alors la machine a réussi
le test et, selon Alan Turing, peut être considérée comme ”intelligente”.

[Link] (CPGE Mohammedia) Introduction à L’Intelligence Artificielle Février 2024 5 / 77


Types de l’IA

L’IA faible
C’est un programme informatique qui peut aider aux activités mentales
humaines.

L’IA forte ou généralisée


Elle désigne tout système capable d’apprendre et d’effectuer n’importe
quelle tâche qu’un humain serait capable de faire. Ce sont des machines
qui pensent, avec une conscience de soi et qui ont des sentiments.

[Link] (CPGE Mohammedia) Introduction à L’Intelligence Artificielle Février 2024 6 / 77


À quel stade en est l’IA forte ?

L’IA forte est encore loin de devenir une réalité.

Les machines les plus intelligentes échouent complètement lorsqu’on leur


demande d’exécuter de nouvelles tâches.

[Link] (CPGE Mohammedia) Introduction à L’Intelligence Artificielle Février 2024 7 / 77


L’IA en quelques dates

1940 : La cybernétique : comme science du fonctionnement de


l’esprit humain. (Mathématicien Norbert Wiener).
1943 : Premier modèle mathématique du neurone biologique, le
neurone formel (Neurologues Warren McCulloch, et Walter
Pitts)

[Link] (CPGE Mohammedia) Introduction à L’Intelligence Artificielle Février 2024 8 / 77


L’IA en quelques dates

1949 : Invention la règle qui permet de doter les neurones formels de


capacités d’apprentissage (Neuropsychologue Donald Hebb)
1950 : Test Turing
1956 : Naissance de terme Intelligence Artificielle John McCarthy.
1960 : Rosenblatt’s Perceptron, premier ordinateur à utiliser un
réseau de neurones permettant à la machine d’apprendre en fonction
de ses réussites et ses échecs.

[Link] (CPGE Mohammedia) Introduction à L’Intelligence Artificielle Février 2024 9 / 77


L’IA en quelques dates

1997 : Victoire de Deep Blue sur Kasparov


2009 : La voiture autonome de Google
2011 : Le programme Watson d’IBM gagne au Jeopardy
2012 : Deep learning
2016 : Le programme AlphaGo de Google gagne en jeu de GO.

[Link] (CPGE Mohammedia) Introduction à L’Intelligence Artificielle Février 2024 10 / 77


L’IA : Pourquoi maintenant ?

Trois facteurs expliquent le nouvel essor de l’IA aux alentours de 2010 :

1 Big Data : Réaliser des algorithmes de classification nécessite de


grandes masses de données chose qui n’était pas possible à l’époque.
2 Capacités de calculs avec la nouvelle génération des processeurs et
des cartes graphiques.
3 Réduction des coûts financiers.

[Link] (CPGE Mohammedia) Introduction à L’Intelligence Artificielle Février 2024 11 / 77


Domaines de l’IA

L’intelligence artificielle s’est déjà glissée dans notre vie :

Nos voitures,
Nos téléphones,
Nos ordinateurs,
Nos armes de défense
Nos systèmes de transport.
La santé
etc.

[Link] (CPGE Mohammedia) Introduction à L’Intelligence Artificielle Février 2024 12 / 77


Programmation classique vs IA

Les machines ne sont plus programmées ; elles apprennent.

Il ne s’agit plus de coder les règles explicitement comme auparavant, mais


de laisser les machines les découvrir seules sur la base d’une quantité
massive de données.

[Link] (CPGE Mohammedia) Introduction à L’Intelligence Artificielle Février 2024 13 / 77


De l’IA au Machine Learning

Au paravant, l’IA n’a pas toujours considéré l’apprentissage comme


essentiel à l’intelligence.
Depuis quelques années, on associe presque toujours l’intelligence aux
capacités d’apprentissage, grâce auquel un système intelligent :
Peut améliorer ses performances avec l’expérience.
Peut apprendre à exécuter de nouvelles tâches.
Peut acquérir de nouvelles compétences.

Naissance du Machine Learning.

[Link] (CPGE Mohammedia) Introduction à L’Intelligence Artificielle Février 2024 14 / 77


Les sous-domaines de l’IA

[Link] (CPGE Mohammedia) Introduction à L’Intelligence Artificielle Février 2024 15 / 77


Machine Learning

Machine learning
L’apprentissage automatique, (en anglais : machine learning), est un
champ d’étude de l’intelligence artificielle qui se fonde sur des approches
mathématiques et statistiques pour donner aux ordinateurs la capacité
d’”apprendre” à partir de données.

[Link] (CPGE Mohammedia) Introduction à L’Intelligence Artificielle Février 2024 16 / 77


Deep learning
Deep learning (apprentissage profond)
Le deep learning est un type d’intelligence artificielle dérivé du
machine learning où la machine est capable d’apprendre par
elle-même.
Il s’appuie sur un réseau de neurones artificiels s’inspirant du cerveau
humain. Ce réseau peut être composé de dizaines voire de centaines
de ”couches” de neurones chacune recevant et interprétant les
informations de la couche précédente.

[Link] (CPGE Mohammedia) Introduction à L’Intelligence Artificielle Février 2024 17 / 77


Machine Learning
Types d’apprentissage ?

Pour donner à un ordinateur la capacité d’apprendre, on utilise des


méthodes d’apprentissage inspirées de la façon dont nous, les êtres
humains, apprennent à faire des choses.
Parmi ces méthodes :

L’apprentissage supervisé (Supervised Learning)


L’apprentissage non supervisé (Unsupervised Learning)
L’apprentissage par renforcement (Reinforcement Learning)

[Link] (CPGE Mohammedia) Introduction à L’Intelligence Artificielle Février 2024 18 / 77


Machine Learning
L’apprentissage supervisé (Supervised Learning)

L’apprentissage supervisé est lorsque l’on fournit à une machine


beaucoup d’exemples qu’elle doit étudier.
Quatre notions à connaitre en apprentissage supervisé :

1 Le Dataset : L’Algorithme d’apprentissage démarre d’un Dataset qui


contient nos données.
2 Le modèle et ses paramètres : A partir de ce Dataset, on crée un
modèle, qui n’est autre qu’une fonction mathématique dont les
coefficients sont les paramètres du modèle.
3 La Fonction Coût : C’est l’ensemble des erreurs donné par le
modèle.
4 L’Algorithme d’apprentissage : Laisser la machine trouver quels
sont les paramètres du modèle qui minimisent la Fonction Coût.

[Link] (CPGE Mohammedia) Introduction à L’Intelligence Artificielle Février 2024 19 / 77


Machine Learning
L’apprentissage supervisé (Supervised Learning)

Dataset :
L’ensemble des exemples (x,y) sont regroupés dans un tableau que l’on
appelle Dataset :
La variable y porte le nom de target (la cible). C’est la valeur que l’on
cherche à prédire.
La variable x porte le nom de feature (facteur). Un facteur influence
la valeur de y.

[Link] (CPGE Mohammedia) Introduction à L’Intelligence Artificielle Février 2024 20 / 77


Machine Learning
L’apprentissage supervisé (Supervised Learning)

Exemple : Ci-dessous, un dataset qui regroupe des exemples


d’appartements avec leur prix y ainsi que certaines de leurs
caractéristiques xi (features).

[Link] (CPGE Mohammedia) Introduction à L’Intelligence Artificielle Février 2024 21 / 77


Machine Learning
L’apprentissage supervisé (Supervised Learning)

Supposons que nous voulons que la machine


apprenne la relation qui relie x à y . Supposons que
notre dataset donne le nuage de point suivant :

[Link] (CPGE Mohammedia) Introduction à L’Intelligence Artificielle Février 2024 22 / 77


Machine Learning
L’apprentissage supervisé (Supervised Learning)

Développer un modèle à partir du Dataset : Nous pouvons


tracer le modèle linaire (à gauche) ou polynomiale (à droite)

[Link] (CPGE Mohammedia) Introduction à L’Intelligence Artificielle Février 2024 23 / 77


Machine Learning
L’apprentissage supervisé (Supervised Learning)

Les erreurs du modèle - la Fonction Coût


Un modèle retourne toujours des erreurs par rapport au Dataset. On
appelle Fonction Coût l’ensemble de ces erreurs (le plus souvent on
prend la moyenne quadratique des erreurs).

[Link] (CPGE Mohammedia) Introduction à L’Intelligence Artificielle Février 2024 24 / 77


Machine Learning
L’apprentissage supervisé (Supervised Learning)

Un bon modèle, c’est un modèle qui donne de petites erreurs, donc une
petite Fonction Coût.

[Link] (CPGE Mohammedia) Introduction à L’Intelligence Artificielle Février 2024 25 / 77


Machine Learning
L’apprentissage supervisé (Supervised Learning)

Entrainer le modèle => Minimiser la Fonction Coût L’objectif


central en Supervised Learning, c’est de trouver les paramètres du
modèle qui minimisent la Fonction Coût.
=> Algorithme d’apprentissage.
L’exemple le plus courant étant l’algorithme de Gradient Descent.

[Link] (CPGE Mohammedia) Introduction à L’Intelligence Artificielle Février 2024 26 / 77


Machine Learning
L’apprentissage supervisé (Supervised Learning)

Les applications du Supervised Learning


Avec le Supervised Learning on peut développer des modèles pour
résoudre deux types de problèmes :
Les problèmes de Régression
Les problèmes de Classification

[Link] (CPGE Mohammedia) Introduction à L’Intelligence Artificielle Février 2024 27 / 77


Machine Learning
L’apprentissage supervisé (Supervised Learning)

La Régression :
Dans la régression, on cherche à prédire la valeur d’une variable
continue, c’est-à-dire une variable qui peut prendre une infinité de
valeurs.

Exemple :

Prédire le prix d’un appartement (y ) selon sa surface habitable (x1 ),


localisation (x2 ) sa qualité (x3 ) sa proximité avec un parc (x4 ) etc.
Prédire la quantité d’essence consommée (y ) selon la distance
parcourue (x1 ), la vitesse (x2 ), l’état du véhicule (x3 ), etc.

[Link] (CPGE Mohammedia) Introduction à L’Intelligence Artificielle Février 2024 28 / 77


Machine Learning
L’apprentissage supervisé (Supervised Learning)

La Classification :
Dans la classification, on cherche à classer un objet dans différentes
classes, c’est-à-dire que l’on cherche à prédire la valeur d’une variable
discrète (qui ne prend qu’un nombre fini de valeurs).

Exemple :

Prédire si un email est un spam (classe y = 1) ou non (classe y = 0)


selon le nombre de liens présent dans l’email (x1 ) et le nombre de
fautes d’orthographe (x2 ), etc.
Prédire si une tumeur est maligne (y = 1) ou bénigne (y = 0) selon la
taille de la tumeur (x1 ), l’âge du patient (x2 ), les antécédent dans la
famille (x3 ), etc

[Link] (CPGE Mohammedia) Introduction à L’Intelligence Artificielle Février 2024 29 / 77


Machine Learning
L’apprentissage non supervisé (Supervised Learning)

L’apprentissage non supervisé (Supervised Learning)

[Link] (CPGE Mohammedia) Introduction à L’Intelligence Artificielle Février 2024 30 / 77


Machine Learning
L’apprentissage non supervisé (Supervised Learning)

L’apprentissage non supervisé est principalement utilisé dans la


segmentation (clustering), pour regrouper un ensemble d’éléments
hétérogènes sous forme de sous groupes homogènes ou liés par des
caractéristiques communes.
La qualité d’une méthode de classification est mesurée par sa capacité à :

Découvrir certains ou tous les motifs cachés.


Maximiser l’homogénéité des données au sein des groupes
Former des groupes aussi distincts que possible.

[Link] (CPGE Mohammedia) Introduction à L’Intelligence Artificielle Février 2024 31 / 77


Machine Learning
L’apprentissage non supervisé (Supervised Learning)

[Link] (CPGE Mohammedia) Introduction à L’Intelligence Artificielle Février 2024 32 / 77


Machine Learning
L’apprentissage non supervisé (Supervised Learning)

L’apprentissage supervisé vs L’apprentissage non supervisé


L’apprentissage supervisé : classer un nouvel individu parmi un
ensemble de classes prédéfinies : on connaı̂t les classes a priori
L’apprentissage non supervisé : le nombre et la définition des classes
ne sont pas donnés a priori

[Link] (CPGE Mohammedia) Introduction à L’Intelligence Artificielle Février 2024 33 / 77


Machine Learning
L’apprentissage par renforcement (Reinforcement Learning))

Cette dernière méthode s’inspire de la façon dont nous éduquons nos


animaux de compagnie, en leur offrant une friandise quand ils font
une bonne action.
Elle consiste , en général, à laisser les ordinateurs apprendre de leurs
expériences grâce à un système de récompense ou de pénalité.
Pour y parvenir, l’ordinateur essaye toutes les façons possibles et
apprend de ses erreurs tout en essayant de trouver la méthode qui lui
permet de maximiser sa récompense.

[Link] (CPGE Mohammedia) Introduction à L’Intelligence Artificielle Février 2024 34 / 77


Machine Learning
Quelques algorithmes

[Link] (CPGE Mohammedia) Introduction à L’Intelligence Artificielle Février 2024 35 / 77


L’apprentissage supervisé

[Link] (CPGE Mohammedia) Introduction à L’Intelligence Artificielle Février 2024 36 / 77


La régression linéaire

[Link] (CPGE Mohammedia) Introduction à L’Intelligence Artificielle Février 2024 37 / 77


Régression Linéaire
Le modèle

[Link] (CPGE Mohammedia) Introduction à L’Intelligence Artificielle Février 2024 38 / 77


Régression Linéaire
LA FONCTION COUT

[Link] (CPGE Mohammedia) Introduction à L’Intelligence Artificielle Février 2024 39 / 77


Régression Linéaire
L’ALGORITHME D’APPRENTISSAGE

L’algorithme d’apprentissage consiste à minimiser la fonction coût dont


l’allure est la suivante :

[Link] (CPGE Mohammedia) Introduction à L’Intelligence Artificielle Février 2024 40 / 77


Régression Linéaire
L’ALGORITHME D’APPRENTISSAGE

DESCENTE DE GRADIENT
La Descente de Gradient, (ou Gradient Descent en anglais) est un des
algorithmes les plus importants de tout le Machine Learning et de tout le
Deep Learning. il s’agit d’un algorithme d’optimisation extrêmement
puissant qui permet d’entraı̂ner les modèles de régression linéaire,
régression logistiques ou encore les réseaux de neurones.

[Link] (CPGE Mohammedia) Introduction à L’Intelligence Artificielle Février 2024 41 / 77


Régression Linéaire
DESCENTE DE GRADIENT

DESCENTE DE GRADIENT
La Descente de Gradient est un algorithme d’optimisation qui permet de
trouver le minimum de n’importe quelle fonction convexe en convergeant
progressivement vers celui-ci.

[Link] (CPGE Mohammedia) Introduction à L’Intelligence Artificielle Février 2024 42 / 77


Régression Linéaire
DESCENTE DE GRADIENT

Exemple :

Une fonction convexe présente un seul minimum global.


Une fonction non-convexe présente plusieurs minimums locaux.
L’algorithme de descente de gradient ne doit pas être utilisé sur des
fonctions non-convexe, au risque de se bloquer au premier minima
rencontré.

[Link] (CPGE Mohammedia) Introduction à L’Intelligence Artificielle Février 2024 43 / 77


LA CLASSIFICATION : K-Nearst
Neighbor (KNN)

[Link] (CPGE Mohammedia) Introduction à L’Intelligence Artificielle Février 2024 44 / 77


Classification
KNN : K-Nearst Neighbor

K Nearest Neighbors (KNN)


C’est un algorithme d’apprentissage supervisé. Il peut être utilisé aussi
bien pour la régression que pour la classification. Son fonctionnement peut
être assimilé à l’analogie suivante ”dis moi qui sont tes voisins, je te dirais
qui tu es”.

[Link] (CPGE Mohammedia) Introduction à L’Intelligence Artificielle Février 2024 45 / 77


Classification
KNN : K-Nearst Neighbor

Pour effectuer une prédiction, l’algorithme KNN ne va pas calculer un


modèle prédictif à partir d’un Training Set comme c’est le cas pour la
régression logistique ou la régression linéaire.

Pas besoin de construire un modèle prédictif.


Pas de phase d’apprentissage proprement dite.
Il ne nécessite que le stockage de jeu de données d’apprentissage.

[Link] (CPGE Mohammedia) Introduction à L’Intelligence Artificielle Février 2024 46 / 77


KNN : K-Nearst Neighbor
Principe de l’algorithme

Cet algorithme est qualifiée comme paresseux (Lazy Learning) car il n’ap-
prend rien pendant la phase d’entraı̂nement.
En effet, pour prédire la classe d’une nouvelle donnée d’entrée, il cherche
ses k voisins les plus proches (en utilisant une fonction distance) et choisi
la classe des voisins majoritaires.

[Link] (CPGE Mohammedia) Introduction à L’Intelligence Artificielle Février 2024 47 / 77


KNN : K-Nearst Neighbor
Principe de l’algorithme

[Link] (CPGE Mohammedia) Introduction à L’Intelligence Artificielle Février 2024 48 / 77


KNN : K-Nearst Neighbor
Principe de l’algorithme

Données en entrée :

Un ensemble de données D .
Une fonction de définition distance d.
Un nombre entier K .

Pour une nouvelle observation x dont on veut prédire sa variable de sortie


y:

1 Calculer toutes les distances de cette observation x avec les autres


observations du jeu de données D.
2 Retenir les k données du jeu de données E les plus proches de x.
3 Attribuer à x la classe qui est la plus fréquente parmi les k données
les plus proches.

[Link] (CPGE Mohammedia) Introduction à L’Intelligence Artificielle Février 2024 49 / 77


KNN : K-Nearst Neighbor
Choix de K

[Link] (CPGE Mohammedia) Introduction à L’Intelligence Artificielle Février 2024 50 / 77


KNN : K-Nearst Neighbor
Distances

Soit x = x1 , x2 , ..., xn et y = y1 , y2 , ..., yn deux observations :

1 Distance Euclidienne :
v
u n
uX
d(x, y ) = t (xi − yi )2
i=0

2 Distance de Manhattan :
n
X
d(x, y ) = |xi − yi |
i=0

3 Distance de Minkowski :
v
u n
uX
q
d(x, y ) = t |xi − yi |q
i=0
[Link] (CPGE Mohammedia) Introduction à L’Intelligence Artificielle Février 2024 51 / 77
KNN : K-Nearst Neighbor

Propriétés d’une distances

1 d(x, y ) ≥ 0
2 d(x, x) = 0
3 d(x, y ) = d(y , x)
4 d(x, z) ≤ d(x, y ) + d(y , z)

[Link] (CPGE Mohammedia) Introduction à L’Intelligence Artificielle Février 2024 52 / 77


KNN : K-Nearst Neighbor
Exemples de domaines d’application

Il est utilisé pour prédire si la banque doit accorder un prêt à un


particulier. Il tentera d’évaluer si l’individu donné correspond aux
critères des personnes qui avaient précédemment fait défaut ou ne
fera pas défaut à son prêt.
Elaboration d’un profil pour proposer des films appropriés (Netflix,
Youtube, ...).
Classer un électeur potentiel dans les catégories ”votera” ou ”ne
votera pas” pour tel ou tel candidat.

[Link] (CPGE Mohammedia) Introduction à L’Intelligence Artificielle Février 2024 53 / 77


KNN : K-Nearst Neighbor

Avantages :

1 Simple et facile à mettre en œuvre.


2 Il n’est pas nécessaire de créer un modèle ou de régler plusieurs
paramètres.
3 Il est polyvalent et peut être utilisé pour la classification ou la
régression.

Inconvénients :

1 Le coût en termes de temps de réponse et de l’espace mémoire peut


devenir important. En effet, il doit garder en mémoire l’ensemble des
observations pour pouvoir effectuer sa prédiction.
2 Le choix de la méthode de calcul de la distance ainsi que le nombre
de voisins k peut ne pas être évident.

[Link] (CPGE Mohammedia) Introduction à L’Intelligence Artificielle Février 2024 54 / 77


APPRENTISSAGE NON-SUPERVISÉ

[Link] (CPGE Mohammedia) Introduction à L’Intelligence Artificielle Février 2024 55 / 77


Apprentissage Non-Supervisé vs Apprentissage Supervisé

Apprentissage Supervisé :
On montre à la machine des exemples (X,y) de ce quelle doit apprendre.

[Link] (CPGE Mohammedia) Introduction à L’Intelligence Artificielle Février 2024 56 / 77


Apprentissage Non-Supervisé vs Apprentissage Supervisé
Apprentissage Non-Supervisé :
La machine analyse la structure des données X pour apprendre toute seule
à réaliser certaines taches.

[Link] (CPGE Mohammedia) Introduction à L’Intelligence Artificielle Février 2024 57 / 77


Apprentissage Non-Supervisé

Applications de l’apprentissage Non-Supervisé :

1 Clustering
2 Détection d’anomalies
3 Réduction de dimensions

[Link] (CPGE Mohammedia) Introduction à L’Intelligence Artificielle Février 2024 58 / 77


Apprentissage Non-Supervisé

Clustering : Regrouper les données en se basant sur leurs ressemblances :

[Link] (CPGE Mohammedia) Introduction à L’Intelligence Artificielle Février 2024 59 / 77


Apprentissage Non-Supervisé

Détection d’anomalies : Trouver les échantillons dont les


caractéristiques (X ) sont très éloignées de celles des autres échantillons.

=>Algorithme : Isolation Forest.

[Link] (CPGE Mohammedia) Introduction à L’Intelligence Artificielle Février 2024 60 / 77


Apprentissage Non-Supervisé

Détection d’anomalies :Applications

Système de sécurité.
Défaillance dans une usine.
Détection de fraudes bancaires.
etc

[Link] (CPGE Mohammedia) Introduction à L’Intelligence Artificielle Février 2024 61 / 77


Apprentissage Non-Supervisé
Réduction de dimensions : En analysant la structure de nos données, la
machine apprend à la simplifier tout en conservant les principales
informations.

Pour réaliser cela, la machine apprend à projeter le mieux possible nos


données dans des espaces de plus petite dimensions.
=> Algorithme : Analyse en Composante Principale (PCA).
[Link] (CPGE Mohammedia) Introduction à L’Intelligence Artificielle Février 2024 62 / 77
Apprentissage Non-Supervisé

Le clustering
K-Means

[Link] (CPGE Mohammedia) Introduction à L’Intelligence Artificielle Février 2024 63 / 77


Clustering
K-Means

Définition
K-means is one of the most popular Unsupervised Machine Learning
Algorithms Used for Solving clustering Problems.
K-Means segregates the unlabeled data into various groups, called clusters,
based on having similar features, common patterns.

[Link] (CPGE Mohammedia) Introduction à L’Intelligence Artificielle Février 2024 64 / 77


Clustering
K-Means

Principe : Imaginons que nous voulons regrouper les données suivantes en


trois clusters.

[Link] (CPGE Mohammedia) Introduction à L’Intelligence Artificielle Février 2024 65 / 77


Clustering
K-Means

Étape 1 : On place K (ici K = 3) centroides au hasard dans le


dataset.

[Link] (CPGE Mohammedia) Introduction à L’Intelligence Artificielle Février 2024 66 / 77


Clustering
K-Means

Étape 2 : On calcule la distance de chaque point de dataset aux


différents centroids et on l’affecte au centroid le plus proche.

[Link] (CPGE Mohammedia) Introduction à L’Intelligence Artificielle Février 2024 67 / 77


Clustering
K-Means

Étape 3 : On déplacer (on recalcule) chaque centroid au milieu de


son cluster (la où se situe la moyenne des points).

[Link] (CPGE Mohammedia) Introduction à L’Intelligence Artificielle Février 2024 68 / 77


Clustering
K-Means

Étape 4 : On recommence l’étape 2. On calcule la distance de


chaque point de dataset aux différents centroids et on l’affecte au
centroid le plus proche.

[Link] (CPGE Mohammedia) Introduction à L’Intelligence Artificielle Février 2024 69 / 77


Clustering
K-Means

Étape 5 : On recommence l’étape 3. On déplacer (on recalcule)


chaque centroid au milieu de son cluster (la où se situe la moyenne
des points).

[Link] (CPGE Mohammedia) Introduction à L’Intelligence Artificielle Février 2024 70 / 77


Clustering
K-Means

Étape 6 : On continue ainsi jusqu’à ce que les centroids convergent


vers une position d’équilibre.

[Link] (CPGE Mohammedia) Introduction à L’Intelligence Artificielle Février 2024 71 / 77


Clustering
K-Means

En gros : : K-Means est un algorithme itératif qui fonctionne en


deux étapes répétitifs :

[Link] (CPGE Mohammedia) Introduction à L’Intelligence Artificielle Février 2024 72 / 77


Clustering
K-Means

Mauvais centroids : : Selon les postions initiales des centroids il est


possible qu’il converge vers de mauvaises positions.

[Link] (CPGE Mohammedia) Introduction à L’Intelligence Artificielle Février 2024 73 / 77


Clustering
K-Means

La fonction coût Inertie= kj=1 ni=1 |xi − µj |2


P P

[Link] (CPGE Mohammedia) Introduction à L’Intelligence Artificielle Février 2024 74 / 77


Clustering
K-Means

Comment choisir la bonne valeur de K ?

Facile à définir le nombre de clusters (ici k = 3)

[Link] (CPGE Mohammedia) Introduction à L’Intelligence Artificielle Février 2024 75 / 77


Clustering
K-Means

Comment choisir la bonne valeur de K ?

1 Le dataset est à plusieurs dimensions


2 Difficile de voir les clusters à l’œil.
3 etc.
[Link] (CPGE Mohammedia) Introduction à L’Intelligence Artificielle Février 2024 76 / 77
Clustering
K-Means

Solution : La méthode Elbow Pour trouver le bon nombre de clusters, la


méthode elbow détecte une zone de coude dans la minimisation de coût
inertie.

[Link] (CPGE Mohammedia) Introduction à L’Intelligence Artificielle Février 2024 77 / 77

Vous aimerez peut-être aussi