0% ont trouvé ce document utile (0 vote)
2 vues23 pages

Solution TD2and

Le document présente un exercice d'analyse en composantes principales (ACP) sur un ensemble de six individus, en utilisant à la fois la méthode normalisée et non normalisée. Il détaille les étapes de l'ACP, y compris le centrage et la réduction des données, le calcul de la matrice de corrélation, la recherche des axes principaux, et la représentation graphique des résultats. Enfin, il propose plusieurs partitions des individus basées sur les résultats de l'ACP.

Transféré par

seddikifouzia204
Copyright
© All Rights Reserved
Nous prenons très au sérieux les droits relatifs au contenu. Si vous pensez qu’il s’agit de votre contenu, signalez une atteinte au droit d’auteur ici.
Formats disponibles
Téléchargez aux formats PDF, TXT ou lisez en ligne sur Scribd
0% ont trouvé ce document utile (0 vote)
2 vues23 pages

Solution TD2and

Le document présente un exercice d'analyse en composantes principales (ACP) sur un ensemble de six individus, en utilisant à la fois la méthode normalisée et non normalisée. Il détaille les étapes de l'ACP, y compris le centrage et la réduction des données, le calcul de la matrice de corrélation, la recherche des axes principaux, et la représentation graphique des résultats. Enfin, il propose plusieurs partitions des individus basées sur les résultats de l'ACP.

Transféré par

seddikifouzia204
Copyright
© All Rights Reserved
Nous prenons très au sérieux les droits relatifs au contenu. Si vous pensez qu’il s’agit de votre contenu, signalez une atteinte au droit d’auteur ici.
Formats disponibles
Téléchargez aux formats PDF, TXT ou lisez en ligne sur Scribd

USTO-MB/FMI/Dept.

Informatique/Master
Matière : AND 2025–2026

TD N°2 :
Analyse en composante principale

Exercise 1 :
Soit un ensemble de six individus dont on a mesuré le poids et la taille.

Poids Taille
I1 20 15
I2 5 2
I3 12 21
I4 21 13
I5 2 7
I6 12 20

Appliquer une ACP.

Solution:

Méthode 1 : ACP Normée


Étapes de l’Analyse en Composantes Principales (ACP Normée)
1. Centrage et réduction des données
q P
Xc = σx avec σx = N1 ni=1 (xi − x̄)2
X−X̄

20 + 5 + 12 + 21 + 2 + 12
X̄1 = = 12
6
15 + 2 + 21 + 13 + 7 + 20
X̄2 = = 13
r 6 r
(20 − 12)2 + (5 − 12)2 + (12 − 12)2 + (21 − 12)2 + (2 − 12)2 + (12 − 12)2 294
σpoids = = =7
6 6
r r
(15 − 13)2 + (2 − 13)2 + (21 − 13)2 + (13 − 13)2 + (7 − 13)2 + (20 − 13)2 274
σtaille = = ≈ 6.7577
6 6

1
Matrice centrée-réduite Xc :
 20−12 15−13
  
7 6.7577
1.1429 0.2960
 5−12 2−13  −1.0000 −1.6278
7
 12−12 6.7577   
21−13   0.0000

7 6.7577 
1.1840 
Xc =  21−12 13−13  =
 1.2857


7
 2−12 6.7577   0.0000 

 7−13  −1.4286 −0.8880
7 6.7577
12−12 20−13
7 6.7577
0.0000 1.0360

2. Calcul de la matrice de corrélation R


1
R= X tX
N c c

 
1.1429 0.2960
 −1.0000 −1.6278
 

1.1429 −1.0000 0.0000 1.2857 −1.4286 0.0000  0.0000
 1.1840 
Xct Xc = 
0.2960 −1.6278 1.1840 0.0000 −0.8880 1.0360  1.2857 0.0000 

−1.4286 −0.8880
0.0000 1.0360
 
6.0000 3.2600
=
3.2600 6.0000

   
1 6.0000 3.2600 1.0000 0.5433
R= =
6 3.2600 6.0000 0.5433 1.0000

3. Recherche des axes principaux


Calcul des valeurs propres de la matrice R :

1 − λ 0.5433
det(R − λI) = =0
0.5433 1 − λ
(1 − λ)2 − (0.5433)2 = 0
λ2 − 2λ + 1 − 0.2952 = 0
λ2 − 2λ + 0.7048 = 0

∆ = 4 − 4 × 0.7048 = 1.1808

2 + 1.1808 2 + 1.0866
λ1 = = = 1.5433
√2 2
2 − 1.1808 2 − 1.0866
λ2 = = = 0.4567
2 2

4. Calcul des vecteurs propres


Pour l’axe U1 (λ1 = 1.5433) :

2
R · U1 = λ1 U1
    
1 0.5433 x x
= 1.5433
0.5433 1 y y
( (
x + 0.5433y = 1.5433x −0.5433x + 0.5433y = 0
⇒ ⇒x=y
0.5433x + y = 1.5433y 0.5433x − 0.5433y = 0

 
1
U1∗ =
1

√ √
∥U1 ∥ = 12 + 12 = 2
 
1 1
U1 = √
2 1
Pour l’axe U2 (λ2 = 0.4567) :

R · U2 = λ2 U2
    
1 0.5433 x x
= 0.4567
0.5433 1 y y
( (
x + 0.5433y = 0.4567x 0.5433x + 0.5433y = 0
⇒ ⇒ x = −y
0.5433x + y = 0.4567y 0.5433x + 0.5433y = 0

 
−1
U2∗ =
1
p √
∥U2∗ ∥ = (−1)2 + 12 = 2
 
1 −1
U2 = √
2 1

5. Calcul des composantes principales


Ck = Xc · Uk
Composante principale 1 :

 
1.1429 0.2960
−1.0000 −1.6278
   
 0.0000 1.1840  1 1
C1 = Xc · U1 = 
  ·√
 1.2857 0.0000 
 2 1
−1.4286 −0.8880
0.0000 1.0360
   
1.4389 1.0175
−2.6278 −1.8582
   
1  1.1840   0.8373 
=√  = 
2 1.2857   0.9091 
  
−2.3166 −1.6381
1.0360 0.7326

3
Composante principale 2 :

 
1.1429 0.2960
−1.0000 −1.6278
   
 0.0000 1.1840  1 −1
C2 = Xc · U2 =  · √
 1.2857 0.0000  2 1
 
−1.4286 −0.8880
0.0000 1.0360
   
−0.8469 −0.5988
−0.6278 −0.4439
   
1  1.1840   0.8373 
=√    =  
2 −1.2857 
  −0.9091 

 0.5406   0.3823 
1.0360 0.7326

6. Représentation graphique des individus

1.5

1 I6 I3
Composante principale 2

I5
0.5

0
I2
I1
−0.5

−1
I4
−1.5

−3 −2.5 −2 −1.5 −1 −0.5 0 0.5 1 1.5 2 2.5 3


Composante principale 1

7. Représentation des variables à l’aide du coefficient de corrélation


Calcul des corrélations entre variables et composantes principales :
1
j Cov(X j , Ck ) N
(X j )t Ck p
Cor(X , Ck ) = = √ = λk · Uk
σX j · σCk σX j · λk
Corrélation Poids et Taille avec CP1 :

   
p 1 1 0.8783
Cor(Poids, Taille, C1 ) = λ1 · U1 = 1.5433 · √ =
2 1 0.8783

4
Corrélation Poids et Taille avec CP2 :

   
p 1 −1 −0.4779
Cor(Poids, Taille, C2 ) = λ2 · U2 = 0.4567 · √ =
2 1 0.4779

Matrice de corrélation entre les variables originales et les composantes principales :

CP1 CP2
Poids 0.8783 -0.4779
Taille 0.8783 0.4779

Composante principale 2

CP2
1

0.5
Taille

Composante principale 1
−1 −0.5 0.5 1 CP1
Poids
−0.5

−1

Comparaison et Partitions
Partitions possibles et interprétation
D’après l’analyse des composantes principales (ACP Normée et Non Normée), on peut proposer les
partitions suivantes :

1. Partition P1 en 4 classes :

5
ˆ Classe 1 : I1, I4 (poids et taille importants / poids ¿ taille)
ˆ Classe 2 : I3, I6 (poids et taille importants / poids ¡ taille)
ˆ Classe 3 : I2 (poids et taille petits / poids ¿ taille)
ˆ Classe 4 : I5 (poids et taille petits / poids ¡ taille)

2. Partition P2 en 2 classes selon le contraste poids/taille :


ˆ Classe 1 : I1, I2, I4 (poids ¿ taille)
ˆ Classe 2 : I3, I5, I6 (poids ¡ taille)

3. Partition P3 en 2 classes selon la dimension globale :


ˆ Classe 1 : I1, I3, I4, I6 (poids et taille importants)
ˆ Classe 2 : I2, I5 (poids et taille petits)

4. Partition P4 en 3 classes :
ˆ Classe 1 : I1, I4 (poids et taille importants / poids ¿ taille)
ˆ Classe 2 : I3, I6 (poids et taille importants / poids ¡ taille)
ˆ Classe 3 : I2, I5 (poids et taille petits)

5. Partition P5 en 3 classes :
ˆ Classe 1 : I1, I3, I4, I6 (poids et taille importants)
ˆ Classe 2 : I2 (poids et taille petits / poids ¿ taille)
ˆ Classe 3 : I5 (poids et taille petits / poids ¡ taille)

Interprétation physique :
ˆ Axe 1 représente la dimension globale ”taille-poids” (plus la valeur est positive, plus l’individu
est grand et lourd)
ˆ Axe 2 représente le contraste entre poids et taille (valeurs positives : taille prédominante, valeurs
négatives : poids prédominant)

Méthode 2 : ACP Non Normée


Étapes de l’Analyse en Composantes Principales (ACP Non Normée)
1. Centrage des données
Calcul du centre de gravité :
Pn
i=1 pi · xi 1
g= P n avec pi = , i = 1, . . . , 6; j = 1, 2
i=1 pi 6

1
g1 = (20 + 5 + 12 + 21 + 2 + 12) = 12
6
1
g2 = (15 + 2 + 21 + 13 + 7 + 20) = 13
6

6
Tableau centré X :
   
20 − 12 15 − 13 8 2
 5 − 12 2 − 13 
  −7 −11
 

12 − 12 21 − 13  0
  8 
X=
21 − 12 = 
 13 − 13 
 9 0 

 2 − 12 7 − 13  −10 −6 
12 − 12 20 − 13 0 7

2. Calcul de la matrice variance-covariance


1
V = N
X tX

 
8 2
  −7 −11
 

8 −7 0 9 −10 0  0 8 
X tX = 
2 −11 8 0 −6 7  9 0 

−10 −6 
0 7
 
294 153
=
153 274

   
1 294 153 49 25.5
V = =
6 153 274 25.5 45.667

3. Détermination de la métrique
Les données sont hétérogènes (Poids en kg, Taille en m), donc on utilise la métrique :
 6   
0 0.0204 0
M = D1/σj2 = 294 6 =
0 274 0 0.0219

4. Recherche des axes principaux


Calcul des valeurs propres de la matrice V M :

    
49 25.5 0.0204 0 1.000 0.558
VM = =
25.5 45.667 0 0.0219 0.520 1.000

Calcul des valeurs propres :

1 − λ 0.558
det(V M − λI) = =0
0.520 1 − λ
(1 − λ)2 − (0.558)(0.520) = 0
λ2 − 2λ + 1 − 0.2902 = 0
λ2 − 2λ + 0.7098 = 0

7
∆ = (−2)2 − 4(1)(0.7098) = 1.1608

∆ = 1.0774
2 + 1.0774
λ1 = = 1.5387
2
2 − 1.0774
λ2 = = 0.4613
2
Trier les valeurs propres par ordre décroissant : λ1 = 1.54 > λ2 = 0.46

5. Qualité de représentation

λ1 1.54
Q1 = = = 0.77 = 77% < 80%
λ1 + λ2 1.54 + 0.46
λ1 + λ2
Q2 = = 1 = 100% ≥ 80%
λ1 + λ2
Il y a deux axes principaux U1 , U2 relatifs aux valeurs propres λ1 , λ2 .

6. Calcul des vecteurs propres


Pour l’axe U1 (λ1 = 1.54) :

V M · U1 = λ1 U1
    
1 0.558 x x
= 1.54
0.520 1 y y
( (
x + 0.558y = 1.54x −0.54x + 0.558y = 0
⇒ ⇒ x = 1.04y
0.520x + y = 1.54y 0.520x − 0.54y = 0

 
1.04
U1∗ =
1
  
 0.0204 0 1.04
∥U1∗ ∥2M = (U1∗ )t ·M · U1∗ = 1.04 1 = 0.04
0 0.0219 1
∥U1∗ ∥M = 0.2
U1∗
 
5.2
U1 = ∗
=
∥U1 ∥M 5

Pour l’axe U2 (λ2 = 0.46) :

V M · U2 = λ2 U2
    
1 0.558 x x
= 0.46
0.520 1 y y
( (
x + 0.558y = 0.46x 0.54x + 0.558y = 0
⇒ ⇒ x = −1.04y
0.520x + y = 0.46y 0.520x + 0.54y = 0

8
 
−1.04
U2∗ =
1
  
 0.0204 0 −1.04
∥U2∗ ∥2M = (U2∗ )t ·M · U2∗ = −1.04 1 = 0.04
0 0.0219 1
∥U2∗ ∥M = 0.2
U2∗
 
−5.2
U2 = =
∥U2∗ ∥M 5

7. Calcul des composantes principales


Ck = X · M · Uk
Composante principale 1 :
  
8 2 1.03
 −7 −11
   −1.83
 
 
 0 8  0.0204 0 5.2  0.80 
  
C1 = X · M · U1 = 
 9 =
 0 
 0 0.0219 5  0.90 
 
−10 −6  −1.64
0 7 0.70

Composante principale 2 :
  
8 2 −0.63
 −7 −11
 −0.37
 
  
 0 8 
 0.0204 0 −5.2  0.80 
C2 = X · M · U2 = 
 9 = 
−0.90

 0 
 0 0.0219 5  
−10 −6   0.44 
0 7 0.70

CP1 CP2
I1 1.03 -0.63
I2 -1.83 -0.37
I3 0.80 0.80
I4 0.90 -0.90
I5 -1.64 0.44
I6 0.70 0.70

9
8. Représentation graphique des individus (ACP Non Normée)

1.5

1
I6 I3
Composante principale 2

I5
0.5

0
I2
−0.5 I1

−1
I4
−1.5

−3 −2.5 −2 −1.5 −1 −0.5 0 0.5 1 1.5 2 2.5 3


Composante principale 1

9. Représentation des variables à l’aide du coefficient de corrélation


Corrélation entre variables et composantes principales :
1
Cov(X j , Ck ) (X j )t Ck
Cor(X j , Ck ) = = N √
σX j · σCk σX j · λk
Corrélation Poids avec CP1 :
 
1.03
−1.83
 
1
  0.80 
6
8 −7 0 9 −10 0  
 0.90 
 
−1.64
0.70
Cor(Poids, C1 ) = p √
294/6 · 1.54
1
(8.24 + 12.81 + 0 + 8.10 + 16.40 + 0)
= 6
7 · 1.241
1
× 45.55 7.592
= 6 = = 0.874
8.687 8.687

10
Corrélation Poids avec CP2 :
 
−0.63
−0.37
 
1
  0.80 
8 −7 0 9 −10 0   
6
−0.90 

 0.44 
0.70
Cor(Poids, C2 ) = p √
294/6 · 0.46
1
(−5.04 + 2.59 + 0 − 8.10 − 4.40 + 0)
= 6
7 · 0.678
1
× (−14.95) −2.492
= 6 = = −0.525
4.746 4.746
Corrélation Taille avec CP1 :
 
1.03
−1.83
 
1
  0.80 
6
2 −11 8 0 −6 7   
 0.90 

−1.64
0.70
Cor(Taille, C1 ) = p √
274/6 · 1.54
1
(2.06 + 20.13 + 6.40 + 0 + 9.84 + 4.90)
= 6
6.7577 · 1.241
1
× 43.33 7.222
= 6 = = 0.862
8.383 8.383
Corrélation Taille avec CP2 :
 
−0.63
−0.37
 
1
  0.80 
6
2 −11 8 0 −6 7  −0.90

 
 0.44 
0.70
Cor(Taille, C2 ) = p √
274/6 · 0.46
1
(−1.26 + 4.07 + 6.40 + 0 − 2.64 + 4.90)
= 6
6.7577 · 0.678
1
× 11.47 1.912
= 6 = = 0.417
4.580 4.580

CP1 CP2
Poids 0.874 -0.525
Taille 0.862 0.417

11
Composante principale 2

CP2
1

0.5 Taille

Composante principale 1
−1 −0.5 0.5 1 CP1

−0.5
Poids

−1

Comparaison et Partitions
Partitions possibles et interprétation
D’après l’analyse des composantes principales (ACP Normée et Non Normée), on peut proposer les
partitions suivantes :

1. Partition en 2 classes selon l’axe 1 :

ˆ Classe 1 (valeurs positives sur CP1) : I1, I3, I4, I6 (individus avec poids et taille importants)
ˆ Classe 2 (valeurs négatives sur CP1) : I2, I5 (individus avec poids et taille faibles)

2. Partition en 2 classes selon l’axe 2 :

ˆ Classe 1 (valeurs positives sur CP2) : I3, I5, I6 (individus avec taille relativement plus
importante que le poids)
ˆ Classe 2 (valeurs négatives sur CP2) : I1, I2, I4 (individus avec poids relativement plus
important que la taille)

3. Partition en 4 classes :

12
ˆ Classe 1 (CP1+, CP2-) : I1, I4 (poids et taille importants, poids supérieur à taille)
ˆ Classe 2 (CP1+, CP2+) : I3, I6 (poids et taille importants, taille supérieure à poids)
ˆ Classe 3 (CP1-, CP2-) : I2 (poids et taille faibles, poids supérieur à taille)
ˆ Classe 4 (CP1-, CP2+) : I5 (poids et taille faibles, taille supérieure à poids)

Interprétation physique :
ˆ Axe 1 représente la dimension globale ”taille-poids” (plus la valeur est positive, plus l’individu
est grand et lourd)
ˆ Axe 2 représente le contraste entre poids et taille (valeurs positives : taille prédominante, valeurs
négatives : poids prédominant)

Comparaison des méthodes :


ˆ ACP Normée : Utilise des données centrées-réduites, donne le même poids à chaque variable
ˆ ACP Non Normée : Utilise des données centrées seulement, tient compte des unités de mesure
différentes via la métrique M
ˆ Les deux méthodes donnent des résultats similaires mais avec des échelles différentes

Comparaison des méthodes :


ˆ ACP Normée : Utilise des données centrées-réduites, donne le même poids à chaque variable
ˆ ACP Non Normée : Utilise des données centrées seulement, tient compte des unités de mesure
différentes via la métrique M
ˆ Les deux méthodes donnent des résultats similaires mais avec des échelles différentes

Exercise 2 :
Soit X le tableau de données quantitatives suivant :
 t
−8 6 −2 8 0 −6 0 2
X=
−1 10 −10 1 3 −6 −3 6
Regroupant les observations de 8 individus par 2 variables. Les individus ont le même poids 1/8.
a) Le tableau est-il centré ?
b) Calculer la matrice de variances-covariances V
c) Montrer que u′1 = (3, 4) et u′2 = (4, −3) sont vecteurs propres de V relativement à 2 valeurs propres
λ1 et λ2 dans l’ordre que l’on déterminera. Compléter les résultats en appliquant l’ACP.
d) Quels sont les axes principaux d’inertie ?
e) Calculer la contribution relative de I1 à l’inertie expliquée du premier axe principal d’inertie.

Solution:

13
1. Vérification si le tableau est centré
 
−8 −1
6 10 
 
−2 −10
 
8 1 
X=
0

 3 

−6 −6 
 
 0 −3 
2 6
Calcul des moyennes :
−8 + 6 − 2 + 8 + 0 − 6 + 0 + 2
moy(V ar1 ) = =0
8
−1 + 10 − 10 + 1 + 3 − 6 − 3 + 6
moy(V ar2 ) = =0
8
Donc le tableau est centré.

2. Calcul de la matrice variance-covariance


1
V = N
X tX

 
−8 −1
6 10 
 
−2 −10
  
t −8 6 −2 8 0 −6 0 2  8 1 
XX=  
−1 10 −10 1 3 −6 −3 6 
0 3 

−6 −6 
 
 0 −3 
2 6
 
208 144
=
144 292

   
1 208 144 26 18
V = =
8 144 292 18 36.5

3. Vérification des vecteurs propres


   
3 4
Montrer que U1 = et U2 = sont des vecteurs propres de V.
4 −3
Avant il faut normaliser les vecteurs :

   
2 t
 3 1 3
∥U1 ∥ = U1 · U1 = 3 4 = 25 ⇒ ∥U1 ∥ = 25 ̸= 1 ⇒ U1 = √
4 25 4

   
2 t
 4 1 4
∥U2 ∥ = U2 · U2 = 4 −3 = 25 ⇒ ∥U2 ∥ = 25 ̸= 1 ⇒ U2 = √
−3 25 −3

Les deux vecteurs sont orthogonaux : ⟨U1 , U2 ⟩ = U1t · U2 = 0

14
Pour U1 :
V · U1 = λ1 U1
     
1 208 144 1 3 1 3
·√ = λ1 · √
8 144 292 25 4 25 4
    
1 208 144 3 3
= λ1
8 144 292 4 4
( ( (
208 × 3 + 144 × 4 = 8 × 3 × λ1 1200 = 24λ1 λ1 = 50
⇒ ⇒
144 × 3 + 292 × 4 = 8 × 4 × λ1 1600 = 32λ1 λ1 = 50
λ1 = 50 pour les 2 équations donc U1 est vecteur propre de V.
Pour U2 :
V · U2 = λ2 U2
     
1 208 144 1 4 1 4
·√ = λ2 · √
8 144 292 25 −3 25 −3
    
1 208 144 4 4
= λ2
8 144 292 −3 −3
( ( (
208 × 4 + 144 × (−3) = 8 × 4 × λ2 400 = 32λ2 λ2 = 12.5
⇒ ⇒
144 × 4 + 292 × (−3) = 8 × (−3) × λ2 −300 = −24λ2 λ2 = 12.5
λ2 = 12.5 pour les 2 équations donc U2 est vecteur propre de V.

4. Axes principaux d’inertie


Calcul de la qualité de représentation :
λ1 = 50 et λ2 = 12.5
λ1 50
Q1 = = = 0.8 = 80%
λ1 + λ2 50 + 12.5
Un axe relatif à la valeur propre λ1 = 50 suffit pour représenter 80% de l’inertie totale.

5. Contribution relative de I1
La contribution relative :
pi (Cki )2 pi (Cki )2 pi (Cki )2
pik = Pn i 2
= =
i=1 pi (Ck ) Var(Ck ) λk
 
 1 3 −28
C1I1 = ⟨I1 , U1 ⟩ = I1t · U1 = −8 −1 · √ =√
25 4 25
 2
1 −28
√ 1
8 25 8
× 784
25 39.2
pI1 1 = = = = 0.0784
50 50 50
 
 1 4 −29
C1I1 = ⟨I1 , U2 ⟩ = I1t · U2 = −8 −1 · √ =√
25 −3 25
 2
1 −29
√ 1
8 25 8
× 841
25 42.05
pI1 2 = = = = 0.3364
12.5 12.5 12.5
15
Résumé des résultats
ˆ Valeurs propres : λ1 = 50, λ2 = 12.5
   
3 4
ˆ Vecteurs propres normalisés : U1 = 1 1
, U2 = 5
4 5 −3
ˆ Qualité de représentation : Q1 = 80%, Q2 = 100%

ˆ Contribution de I1 : pI1 1 = 0.0784, pI1 2 = 0.3364

Exercise 3 :
Nous avons appliqué une ACP sur un ensemble de 100 individus caractérisé par 2 variables hétérogènes
V1 et V2. Les résultats obtenus sont :
     ′
12 6 X X
V = , U1 = , U2 = , λ1 = a et λ2 = b
6 12 Y Y′

a) Quels sont les axes principaux d’inertie ?

b) Déduire U1 et U2
 
38
c) Soit l’individu I = . Calculer ses contributions relatives aux inerties expliquées des axes U1 et
22
U2

Solution:

1. Axes principaux d’inertie


Pj
λ
i
Calcul de la qualité de représentation : Qj = Pi=1 p ≥ 80%, mais avant il faut calculer les valeurs
i=1 λi
propres λ. Pn
Données de l’exercice : λ1 = a,
 λ 2 = b.
 Nous avons une propriété de l’ACP : Trace(V · M ) = i=1 λi
12 6
Données de l’exercice : V = , données hétérogènes donc M = D1/σj2 où σj est l’écart type
6 12
et D est la matrice diagonale.  
2 2 1/12 0
De la matrice V (matrice variance-covariance) : σ1 = 12, σ2 = 12 ⇒ M =
0 1/12
     
12 6 1/12 0 1 1/2
V ·M = · =
6 12 0 1/12 1/2 1

Calcul des valeurs propres :


 
1 − λ 1/2
det = (1 − λ)2 − (1/2)2 = (1 − λ − 1/2)(1 − λ + 1/2)
1/2 1 − λ
1 − λ − 1/2 = 0 ⇒ 1/2 − λ = 0 ⇒ λ = 1/2 = 0.5
1 − λ + 1/2 = 0 ⇒ 3/2 − λ = 0 ⇒ λ = 3/2 = 1.5

16
NB : Dans le cas des données hétérogènes Trace(V · M ) = Nombre des variables = 2
Calcul de la qualité de représentation :
P1
λi λ1 1.5
Q1 = Pi=1 2 = = = 0.75 = 75% < 80%
λ i λ1 + λ 2 1.5 + 0.5
Pi=1
2
λi λ1 + λ2
Q2 = P2i=1 = = 1 = 100% > 80%
i=1 λ i λ1 + λ 2

Pas de réduction, il existe deux axes principaux relatifs aux deux valeurs propres λ1 = 1.5 et λ2 = 0.5.

2. Détermination des vecteurs propres U1 et U2


Calcul des vecteurs propres de la matrice (V · M ) : V · M · Uk = λk Uk
Pour l’axe U1 (λ1 = 1.5) :

V · M · U1 = λ1 U1
    
1 1/2 x x
= 1.5
1/2 1 y y
(
x + 21 y = 32 x
 
∗ 1
⇒ x = y ⇒ U1 =
1
x + y = 2y3 1
2

  
 1/12 0 1
∥U1∗ ∥2M= (U1∗ )t
·M · U1∗
= 1 1
0 1/12 1
 
 1 1 1
= 1/12 1/12 = ⇒ ∥U1∗ ∥M = √
1 6 6

√ 
U1 6
U1 = ∗
= √
∥U1 ∥M 6

Pour l’axe U2 (λ2 = 0.5) :

V · M · U2 = λ2 U2
    
1 1/2 x x
= 0.5
1/2 1 y y
(
x + 21 y = 12 x
 
∗ 1
⇒ x = −y ⇒ U2 =
1
x + y = 2y1 −1
2

  
 1/12 0 1
∥U2∗ ∥2M= (U2∗ )t
·M · U2∗
= 1 −1
0 1/12 −1
 
 1 1 1
= 1/12 −1/12 = ⇒ ∥U2∗ ∥M = √
−1 6 6

√ 
U2
U2 = = √6
∗ − 6
∥U2 ∥M

17
3. Contributions relatives de l’individu I

Soit I t = 38 22 . Calculer ses contributions aux inerties expliquées U1 et U2 .
(Cki )2
Les contributions aux inerties : Part d’inertie de Xi prise en compte par l’axe Uk = cos2 (θik ) = ∥Xi ∥2M
Pour l’axe U1 :
  √ 
 1/12 0
I t
C1 = ⟨I, U1 ⟩M = I · M · U1 = 38 22 √6
0 1/12 6
38 √ 22 √ 60 √ √
√ 
6
= 38/12 22/12 √

= 6+ 6= 6=5 6
6 12 12 12

1
√ 1
pi (C1I )2 100
(5 6)2 100
× 150 1.5
p11 = = = = =1
λ1 1.5 1.5 1.5
Pour l’axe U2 :
  √ 
 1/12 0
C2I t
= ⟨I, U2 ⟩M = I · M · U2 = 38 22 √6
0 1/12 − 6
√ 
38 − 22 √ 16 √ 4√
√6 =

= 38/12 22/12 6= 6= 6
− 6 12 12 3

1 4
√ 2 1
pi (C2I )2 100 3
6 100
× 16
9
×6 1
100
× 96
9 0.1067
p12 = = = = = = 0.2133
λ2 0.5 0.5 0.5 0.5

Résumé des résultats


ˆ Valeurs propres : λ1 = 1.5, λ2 = 0.5
√  √ 
6 √6
ˆ Vecteurs propres normalisés : U1 = √ , U2 =
6 − 6
ˆ Qualité de représentation : Q1 = 75%, Q2 = 100%
ˆ Contribution de l’individu I : p11 = 1, p12 = 0.2133
p (C i )2
Remarque : Si l’individu a une contribution relative pik = i λkk → 1, nous pouvons supprimer
l’individu Ii de la liste des individus car il influence trop l’analyse.

Exercise 4 :
Nous avons appliqué une ACP sur un ensemble d’individus caractérisés par des variables homogènes.
Les résultats obtenus sont les suivants :
1 1
U1t = (u1 , u2 , u3 ), U2t = √ (1, 1, 1), U3t = √ (1, −1, 0)
3 2
λ1 = a, λ2 = b, λ3 = c, avec a, b, c ∈ R
Les composantes principales sont :
1
C1t = (x, 2, y, −1, z, −3), C2t = (0, 1, t, 3, 1, −3), C3t = (e, 2, 2, −13, 20, −7)
10
avec x, y, z, t, e ∈ R

18
a) Compléter les résultats (calculer a, b, c, x, y, z, t, e, u1 , u2 et u3 ).
b) Quels sont les axes principaux d’inertie ? Calculer la contribution relative du troisième individu aux
inerties expliquées de ces axes.

Solution:

1. Complétion des résultats


Calcul de U1 = (u1 , u2 , u3 )
Nous avons 3 inconnus u1 , u2 , u3 et nous avons besoin de 3 équations. Selon les propriétés des vecteurs
propres d’une ACP, nous avons deux propriétés importantes : normalisation et orthogonalité.

∥U1 ∥2M = 1 et ⟨U1 , U2 ⟩M = 0, ⟨U1 , U3 ⟩M = 0


2
∥U1 ∥M = 1
 −→ (1)
⟨U1 , U2 ⟩M = 0 −→ (2)

⟨U1 , U3 ⟩M = 0 −→ (3)

Équation (1) : Normalisation


⟨U1 , U1 ⟩M = U1t · M · U1 = U1t · U1
 
 u1
= u1 u2 u3 u2  = u21 + u22 + u23 = 1
u3

Équation (2) : Orthogonalité avec U2


⟨U1 , U2 ⟩M = U1t · M · U2 = U1t · U2
 
 1 1
1
= u1 u2 u3 · √ 1 = √ (u1 + u2 + u3 ) = 0
3 1 3
⇒ u1 + u2 + u3 = 0

Équation (3) : Orthogonalité avec U3


⟨U1 , U3 ⟩M = U1t · M · U3 = U1t · U3
 
 1 1
1
= u1 u2 u3 · √  −1 = √ (u1 − u2 ) = 0
2 0 2
⇒ u1 − u2 = 0
Nous avons donc le système :

2 2 2
u1 + u2 + u3 = 1 −→ (1)

u1 + u2 + u3 = 0 −→ (2)

u1 − u2 = 0 −→ (3)

19
De (3) : u1 = u2
Substituons dans (2) :

u1 + u1 + u3 = 0 ⇒ 2u1 + u3 = 0 ⇒ u3 = −2u1 −→ (4)

Substituons (3) et (4) dans (1) :

u21 + u21 + (−2u1 )2 = 1


u21 + u21 + 4u21 = 1
6u21 = 1
1
u1 = √
6
Donc :
1 1 2
u1 = √ , u2 = √ , u3 = − √
6 6 6
 
1
1
U1 = √  1 
6 −2

Calcul de t et e
Pour C2 :
0 + 1 + t + 3 + 1 + (−3) t+2
Moy(C2 ) = = =0
6 6
⇒ t + 2 = 0 ⇒ t = −2

Pour C3 :
1 e + 2 + 2 − 13 + 20 − 7 1 e+4
Moy(C3 ) = · = · =0
10 6 10 6
⇒ e + 4 = 0 ⇒ e = −4

Calcul de x, y, z
Nous avons 3 inconnus x, y, z et nous avons besoin de 3 équations :
Équation (1) : Moyenne de C1 nulle

x + 2 + y + (−1) + z + (−3) x+y+z−2


Moy(C1 ) = = =0
6 6
⇒x+y+z =2

20
Équation (2) : Orthogonalité C1 ⊥ C2
 
0
1
 
1 t 1  −2
Cov(C1 , C2 ) = C1 · C2 = x 2 y −1 z −3  3

N 6  
1
−3
1
= (x · 0 + 2 · 1 + y · (−2) + (−1) · 3 + z · 1 + (−3) · (−3))
6
1 1
= (2 − 2y − 3 + z + 9) = (−2y + z + 8) = 0
6 6
⇒ −2y + z = −8

Équation (3) : Orthogonalité C1 ⊥ C3


 
−4
 2 
 
1 t 1  1  2 
Cov(C1 , C3 ) = C1 · C3 = x 2 y −1 z −3 ·  
N 6 10 
 −13

 20 
−7
1
= (−4x + 4 + 2y + 13 + 20z + 21)
60
1
= (−4x + 2y + 20z + 38) = 0
60
⇒ −4x + 2y + 20z + 38 = 0
⇒ −2x + y + 10z = −19

Nous avons le système :



x + y + z = 2
 −→ (1)
−2y + z = −8 −→ (2)

−2x + y + 10z = −19 −→ (3)

De (2) : z = 2y − 8
Substituons dans (1) :

x + y + (2y − 8) = 2
x + 3y = 10
x = 10 − 3y −→ (4)

Substituons (2) et (4) dans (3) :

−2(10 − 3y) + y + 10(2y − 8) = −19


−20 + 6y + y + 20y − 80 = −19
27y − 100 = −19
27y = 81
y=3

21
Puis :

x = 10 − 3(3) = 1
z = 2(3) − 8 = −2

Donc :
x = 1, y = 3, z = −2

Calcul de a, b, c (λ1 , λ2 , λ3 )
Les valeurs propres sont les variances des composantes principales :
Pour λ1 :
 
1
2
 
1 t 1  3 
λ1 = Var(C1 ) = C1 · C1 = 1 2 3 −1 −2 −3 −1

N 6  
−2
−3
1
= (12 + 22 + 32 + (−1)2 + (−2)2 + (−3)2 )
6
1 28
= (1 + 4 + 9 + 1 + 4 + 9) = = 4.6667
6 6
Pour λ2 :

0
1
 
1 t 1  −2
λ2 = Var(C2 ) = C2 · C2 = 0 1 −2 3 1 −3 3

N 6  
1
−3
1
= (02 + 12 + (−2)2 + 32 + 12 + (−3)2 )
6
1 24
= (0 + 1 + 4 + 9 + 1 + 9) = =4
6 6
Pour λ3 :
 
−4
 2 
 
1 t 1 1  1  2 
λ3 = Var(C3 ) = C3 · C3 = · −4 2 2 −13 20 −7 ·  
N 6 10 10 
 −13

 20 
−7
1
= [(−4)2 + 22 + 22 + (−13)2 + 202 + (−7)2 ]
600
1 642
= (16 + 4 + 4 + 169 + 400 + 49) = = 1.07
600 600

22
2. Axes principaux d’inertie et contribution du troisième individu
Axes principaux d’inertie
Calcul de la qualité de représentation :
Pj
λi
Qj = Pi=1
p ≥ 80%
i=1 λi

P1
λi λ1 4.6667 4.6667
Q1 = Pi=1
3 = = = = 0.48 = 48% < 80%
i=1 λi
λ1 + λ2 + λ3 4.6667 + 4 + 1.07 9.7367
P2
λi λ1 + λ2 4.6667 + 4 8.6667
Q2 = Pi=1
3 = = = = 0.89 = 89% > 80%
i=1 λi
λ1 + λ2 + λ3 9.7367 9.7367
Il existe deux axes principaux relatifs aux deux valeurs propres λ1 = 4.6667 et λ2 = 4.

Contribution relative du troisième individu


La contribution relative du troisième individu aux inerties expliquées :
(Ck3 )2
p3k =
λk
Pour l’axe U1 :
(C13 )2 32 9
p31 = = = = 1.9286
λ1 4.6667 4.6667
Pour l’axe U2 :
(C23 )2 (−2)2 4
p32 = = = =1
λ2 4 4
Pour l’axe U3 :
(C33 )2 (2/10)2 0.04
p33 = = = = 0.0374
λ3 1.07 1.07

Résumé des résultats complets


ˆ Vecteur propre U1 : U1 = √1 (1, 1, −2)
6

ˆ Valeurs propres : λ1 = 4.6667, λ2 = 4, λ3 = 1.07


ˆ Composantes principales complètes :
C1 = (1, 2, 3, −1, −2, −3)
C2 = (0, 1, −2, 3, 1, −3)
1
C3 = (−4, 2, 2, −13, 20, −7)
10
ˆ Paramètres : x = 1, y = 3, z = −2, t = −2, e = −4
ˆ Axes principaux : U1 et U2 (qualité de représentation 89%)
ˆ Contribution du troisième individu : p31 = 1.9286, p32 = 1, p33 = 0.0374
Note : Les contributions relatives supérieures à 1 indiquent que le troisième individu a une influence
très importante sur ces axes principaux.

23

Vous aimerez peut-être aussi