Introduction à l'analyse descriptive en biostatistiques
Introduction à l'analyse descriptive en biostatistiques
31 octobre 2017
SEQUENCE 1 :
ANALYSE DESCRIPTIVE UNIVARIEE ET
BIVARIEE
Présenter /ressortir les principales tendances issues des données pour que l'on
puisse en prendre connaissance facilement.
• Peut concerner :
Page 1 sur 28
Cours de Biostatistiques - Licence en sciences de la santé (SI & AM)
31 octobre 2017
1.1. Introduction
La phase préliminaire à toute approche statistique vise à déterminer et identifier le
problème par un ensemble de questionnements qui permettront de délimiter les
investigations et les différentes approches. Nous appellerons données les valeurs obtenus et
référencées suite à une investigation ou une étude réalisée (mesures, observations,
enquêtes,…).
Dès l’instant où une série de données est recueillie sur une population et que les données
sont trop nombreuses pour être présentées de manière exhaustive, il importe de réfléchir à
la synthèse de cette information. Comment peut-on et doit-on transmettre ces nouvelles
données ? Le défi doit donc être relevé : synthétiser l’information sans la dénaturer. Il faut
donc réussir à traduire les données recueillies sur des dizaines, des centaines voire des
milliers de sujets en quelques chiffres, ou en quelques graphiques pertinents et
compréhensibles de tous, traduisant correctement le phénomène observé sur les données.
Pour choisir la meilleure représentation possible des données, il est nécessaire de pouvoir
définir correctement l’information recueillie et de connaître les outils de la statistique
descriptive. Ainsi, la statistique descriptive vise à représenter des données dont on veut
connaître les principales caractéristiques quantifiant leur variabilité.
Page 2 sur 28
Cours de Biostatistiques - Licence en sciences de la santé (SI & AM)
31 octobre 2017
Par exemple pour la question « quel est votre âge ? » posée à un individu souffrant de l’HTA,
on définit la variable "AGE", c’est à dire, une fonction dont la valeur obtenue varie d’un sujet
à l’autre et mesure l’âge de l’individu considéré.
La modalité est définie comme une valeur quelconque prise par la variable. "55 ans"
constitue une modalité de la variable "AGE".
Dans la plupart des situations, les informations recueillies auprès des sujets d’une enquête le
sont par le biais d’un questionnaire. A chaque question, une variable ou plus, selon les cas
sera définie. Il s’agit de définir par un nom la fonction qui recueille les réponses possibles.
Pour analyser convenablement les données d'une variable, il est nécessaire de savoir
distinguer son type. Il existe deux grands groupes de variables, les variables quantitatives et
les variables qualitatives.
De même, toute information pouvant être recueillie par le biais d’une question commençant
par l’adverbe « combien » est une variable quantitative.
Page 3 sur 28
Cours de Biostatistiques - Licence en sciences de la santé (SI & AM)
31 octobre 2017
Exemples :
Ces variables sont souvent accompagnées d’une unité de mesure ; par exemple,
«kilogramme » pour la deuxième question. L’unité de la première question est l’enfant.
Il faut remarquer que les variables mesurées par le biais des questions précédentes ne sont
pas exactement de même nature, certaines sont continues et d’autres discrètes.
exhaustives car toutes les modalités possibles sont citées. Si l’exhaustivité est
impossible alors une modalité « autre » est proposée englobant l’ensemble des
modalités non citées en clair),
mutuellement exclusives car chaque sujet peut être classé dans une catégorie et une
seule.
Les variables qualitatives peuvent également être subdivisées en plusieurs types : elle peut
être nominale ou ordinale.
Page 4 sur 28
Cours de Biostatistiques - Licence en sciences de la santé (SI & AM)
31 octobre 2017
Les différentes variables issues des questions ci-dessous ne sont pas exactement du même
type. La première question offre deux choix de réponse, elle va donc définir une variable
binaire. Les modalités de réponse à la seconde question suggèrent une intensité de
satisfaction plus ou moins importante, qui permettra de définir une variable dont les
modalités de réponses peuvent être ordonnées selon un ordre logique, on parle alors de
variable ordinale.
Exemples :
1. Variable qualitative ordinale : "satisfaction par rapport à la qualité des soins reçus"
Êtes-vous satisfait de la qualité des soins reçus ?
Très satisfait
satisfait
moyennement satisfait
peu satisfait
pas du tout satisfait
Sans opinion
2. Variable qualitative nominale : "profession"
Quelle est votre profession ?
Ouvrier
Cadre
artisan
femme au foyer
autre.
Remarque
Une variable qualitative est qualifiée de binaire si elle ne peut prendre que deux modalités.
Page 5 sur 28
Cours de Biostatistiques - Licence en sciences de la santé (SI & AM)
31 octobre 2017
ni
On appelle fréquence de la modalité xi , le nombre fi tel que fi
n
Remarques
Le pourcentage est une fréquence exprimée en pourcent. Il est égal à 100 fi .
L’emploi des fréquences ou fréquences relatives s’avère utile pour comparer deux
distributions de fréquences établies à partir d’échantillons de tailles différentes.
* Fréquences cumulées
Soit S une série statistique à une variable de type quantitatif et xi une modalité de S. La
fréquence cumulée croissante associée à xi est la somme des fréquences de toutes les
modalités inférieures ou égales à xi dans la série S.
Dans le cas d'une série S dont les modalités sont regroupées en classes, la fréquence
cumulée croissante de la classe [a ; b[ est la somme des fréquences de cette classe et des
classes qui précèdent (c'est-à-dire dont les éléments sont strictement inférieurs à a).
Remarques
La fréquence cumulée croissante de la plus petite modalité ou de la classe à laquelle
appartiennent les plus petites modalités est égale à la fréquence de cette modalité
ou de cette classe ;
La fréquence cumulée croissante de la plus grande modalité ou de la classe à laquelle
appartiennent les plus grandes modalités est égale à 1 (ou à 100 % pour les
fréquences exprimées en pourcentages).
Page 6 sur 28
Cours de Biostatistiques - Licence en sciences de la santé (SI & AM)
31 octobre 2017
Exemples
Tableau 1: Répartition des 402 sujets âgés de plus de 18 ans ayant participé à l’enquête «
hypertension artérielle » à l’Ile Maurice selon le statut professionnel (X)
Page 7 sur 28
Cours de Biostatistiques - Licence en sciences de la santé (SI & AM)
31 octobre 2017
Tableau 2: Répartition des 402 sujets âgés de plus de 18 ans ayant participé à l’enquête «
hypertension artérielle » à l’Ile Maurice selon le nombre de frères et sœurs (Y)
Nombre de frères et effectif fréquence (%) Fréquences Fréquences
sœurs (Y) cumulées cumulées
croissantes (%) décroissantes (%)
0 63 15,7 15,7 100,0
1 125 31,1 46,8 84,3
2 98 24,4 71,2 53,2
3 63 15,7 86,9 28,8
4 27 6,7 93,6 13,1
5 9 2,2 95,8 6,4
6 9 2,2 98,0 4,2
7 8 2,0 100,0 2,0
Total 402 100,0 - -
Source : Enquête "HTA", Ile Maurice, Avril 1999
Cas d'une variable continue avec un nombre de valeurs distinctes élevé ou d'une
variable continue
Remarques
– Les classes sont mutuellement exclusives. Leurs valeurs extrêmes sont appelées bornes
des classes.
Page 8 sur 28
Cours de Biostatistiques - Licence en sciences de la santé (SI & AM)
31 octobre 2017
Toutes les distributions relatives à des variables continues doivent être considérées comme
des distributions groupées, puisque l'infinité de valeurs admissibles est condensée en un
nombre fini de mesures en fonction de la précision de la méthode de mesure utilisée.
De plus, la fréquence étant proportionnelle à l’effectif, les graphiques obtenus lorsque l’on
représente la distribution des effectifs conservent la même allure que ceux obtenus avec la
distribution des fréquences. La seule différence observée entre les deux graphiques se situe
au niveau de l’échelle de l’axe des ordonnées.
i) Variable qualitative
Les deux types de représentation les plus couramment utilisés sont le diagramme à barres et
le diagramme circulaire.
Page 9 sur 28
Cours de Biostatistiques - Licence en sciences de la santé (SI & AM)
31 octobre 2017
Graphique 1: Répartition des 402 sujets âgés de plus de 18 ans ayant participé à l’enquête «
hypertension artérielle » à l’Ile Maurice selon le statut professionnel
140 133
120
100 89
Nb de sujets
80 68
60 48
40 28 32
20 4
0
Dans le but d’améliorer la lisibilité, notamment dans le cas ou l’on a observé un grand
nombre de modalités, on peut représenter un diagramme à barres horizontales. Le
graphique ci-dessous est donc équivalent au suivant.
Graphique 2: Répartition des 402 sujets âgés de plus de 18 ans ayant participé à l’enquête «
hypertension artérielle » à l’Ile Maurice selon le statut professionnel
Autre 89
Ouvrier usine 68
Employé 48
Artisan / commerçant 32
Ouvrier agricole 28
Cadre 4
Nb de sujets
Page 10 sur 28
Cours de Biostatistiques - Licence en sciences de la santé (SI & AM)
31 octobre 2017
D’autres modifications peuvent être proposées afin de mettre en évidence les modalités les
plus représentées. Une des solutions est d’ordonner les modalités selon un ordre croissant
ou décroissant, le choix dépendant de l’information que l’on souhaite mettre en évidence.
Chaque modalité est représentée par un secteur angulaire dont l’angle au centre (et par
conséquent l’aire) est proportionnelle à l’effectif de la modalité.
Graphique 3: Répartition des 402 sujets âgés de plus de 18 ans ayant participé à l’enquête «
hypertension artérielle » à l’Ile Maurice selon le statut professionnel
Sujet au foyer
Autre 133
89 33%
22%
Cadre
4
1%
Page 11 sur 28
Cours de Biostatistiques - Licence en sciences de la santé (SI & AM)
31 octobre 2017
Diagrammes différentiels
Chaque valeur de la variable est représentée par un bâton dont la longueur représente soit
son effectif, soit sa fréquence.
Graphique 4: Répartition des 402 sujets âgés de plus de 18 ans ayant participé à l’enquête
"HTA" à l’Ile Maurice selon le nombre de frères et sœurs (Y)
140
120
100
Nb de sujets
80
60
40
20
0
0 1 2 3 4 5 6 7
Nb de frères et sœurs
C'est la courbe qui relie l'ensemble des points de coordonnées la valeur de la variable et la
fréquence associée.
Graphique 5: Répartition des 402 sujets âgés de plus de 18 ans ayant participé à l’enquête «
HTA » à l’Ile Maurice selon le nombre de frères et sœurs (Y)
Page 12 sur 28
Cours de Biostatistiques - Licence en sciences de la santé (SI & AM)
31 octobre 2017
35,0
30,0
25,0
% de sujets
20,0
15,0
10,0
5,0
0,0
0 1 2 3 4 5 6 7 8
Nb de frères et sœurs
25
20
15
10
5
0
[150-160[ [160-170[ [170-180[ [180-190[ [190-200[
Taille (en cm)
Page 13 sur 28
Cours de Biostatistiques - Licence en sciences de la santé (SI & AM)
31 octobre 2017
45
40
35
fréquence (%)
30
25
20
15
10
5
0
140 150 160 170 180 190 200
Taille (en cm)
Remarques
Diagramme intégral
Il est plus courant de représenter les fréquences cumulées en fonction des valeurs de la
variable. Ce graphique par exemple, comme on le verra dans la section suivante, servir à
déterminer graphiquement un paramètre de position appelé médiane.
Il convient de remarquer que dans le cas d’une variable continue, les amplitudes des classes
n’ont pas d’influence pour la courbe cumulative.
Page 14 sur 28
Cours de Biostatistiques - Licence en sciences de la santé (SI & AM)
31 octobre 2017
100
90
80
% cumulé de sujets
70
60
50
40 Croissant
30 Décroissant
20
10
0
0 20 40 60 80 100
Age (ans)
Remarques
Il existe beaucoup d’autres types de graphiques que nous n’avons pas présentés ici à
l'instar du diagramme "tiges et feuilles" (steam-and-leaf, en anglais), le diagramme
en boîte (boxplot, en anglais), etc. Le lecteur intéressé pourra se référer à la
littérature.
Caractère quantitatif continu : Les modalités étant en nombre infini, il est peu probable que
deux éléments aient la même valeur. Dans ce cas, le mode ne peut pas être défini
directement, il faut au préalable établir une partition en classes. Le mode est alors le centre
de la classe modale, c'est à dire de la classe qui a la fréquence moyenne la plus élevée.
APPLICATIONS
- Cas 1 : Données rangées : le mode est la valeur de la donnée qui apparaît le plus
fréquemment (celle qui a le plus d’occurrences) :140 ; 141 ; 144 ; 144 ; 148 ; 148
; 152 ; 152 ;152 ; 154 ; 155 ; 158 ; 158 ; 161 ; 170 ; 172
Le mode est 152 car il possède le plus grand nombre d’occurrences (il est référencé 3 fois)
Effectifs 5 12 10 8 11 7 3 56
- Cas 3 : Données groupées en classes : la classe modale est la classe ayant la plus
haute fréquence (relative ou absolue).
Page 16 sur 28
Cours de Biostatistiques - Licence en sciences de la santé (SI & AM)
31 octobre 2017
ii. Moyenne
xi
i 1
X (Calcul à partir du tableau élémentaire) : f 1
n
Ou encore
p
ni xi
i 1
X (Calcul à partir du tableau de dénombrement) : f 2
n
APPLICATION
(1 2 0 ) (8 1) ( 7 2 ) (1 3 3 ) (5 4 )
Le nombre moyen d’enfants par sujet est X 1, 8
45
Remarques :
Si les données ont été regroupées en classes, on ne peut calculer la valeur exacte de
la moyenne. On peut toutefois en déterminer une bonne approximation en
remplaçant chaque classe par son centre.
p
Page 17 sur 28
Cours de Biostatistiques - Licence en sciences de la santé (SI & AM)
31 octobre 2017
Au-delà de 30, la distribution des moyennes suit une loi normale sans condition sur la
distribution de la variable.
La moyenne de l'échantillon est le meilleur estimateur de la moyenne de la
population.
EXERCICE
Valeurs 12 13 14 15 16
Fréquences relatives 0.05 0.17 0.43 0.3 0.05
- Si la variable est discrète, la médiane est la plus petite valeur de la variable associée a
une fréquence cumulée supérieure ou égale a 50%, ou bien, a un effectif cumulé
n
supérieur ou égal a .
2
- Si la variable est continue, la médiane est déterminée par la technique d’interpolation
linéaire en deux étapes.
On détermine d’abord la classe médiane ; il s'agit de la classe de la variable qui a la
plus petite fréquence cumulée supérieure ou égale à 0,5 (ou 50%), ou bien le plus
n
petit effectif cumulé supérieur ou égal à . Notons [𝑎, 𝑏[ la classe médiane trouvée.
2
Page 18 sur 28
Cours de Biostatistiques - Licence en sciences de la santé (SI & AM)
31 octobre 2017
(𝑏 − 𝑎) × (0,5 − 𝐹𝑎 )
𝑀𝑒 = 𝑎 +
𝐹𝑏 − 𝐹𝑎
(𝑏 − 𝑎) × (𝐹𝑏 − 0,5)
𝑀𝑒 = 𝑏 −
𝐹𝑏 − 𝐹𝑎
𝑛
(𝑏 − 𝑎) × ( − 𝑁𝑎 )
2
𝑀𝑒 = 𝑎 +
𝑁𝑏 − 𝑁𝑎
𝑛
(𝑏 − 𝑎) × (𝑁𝑏 − )
2
𝑀𝑒 = 𝑏 −
𝑁𝑏 − 𝑁𝑎
Avec
𝐹𝑎 est la fréquence cumulée croissante associée à 𝑎, c'est-à-dire, celle de la ligne précédant
la classe [𝑎, 𝑏[
𝐹𝑏 est la fréquence cumulée croissante associée à 𝑏, c'est-à-dire, celle de la ligne
correspondant à la classe [𝑎, 𝑏[
𝑁𝑎 est l'effectif cumulé croissant associé à 𝑎, c'est-à-dire, celui de la ligne précédant la classe
[𝑎, 𝑏[
𝑁𝑏 est l'effectif cumulé croissant associé à 𝑏, c'est-à-dire, celui de la ligne correspondant à la
classe [𝑎, 𝑏[
APPLICATION
Page 19 sur 28
Cours de Biostatistiques - Licence en sciences de la santé (SI & AM)
31 octobre 2017
On a donc :
𝑛
𝑛 = 200 → = 100
2
𝐹𝑎 = 0,3 (= 30%)
𝐹𝑏 = 0,725 (= 72,5%)
𝑁𝑎 = 60
𝑁𝑏 = 145
Donc la moitié des individus ont une taille inférieure à 174,7 cm.
iv. Quartiles
Il existe trois quartiles qui partagent la distribution ordonnée en 4 sous-échantillons
d'effectifs égaux.
– Q1: xi tel que Fi = 0,25 => 1/4 des valeurs lui sont inférieures, 3/4 lui sont supérieures.
– Q2 = Médiane
– Q3 : xi tel que Fi = 0,75 => 3/4 des valeurs lui sont inférieures, 1/4 lui sont supérieures.
Dans le cas de données groupées en classes, la détermination des quartiles peut être faite,
comme la médiane graphiquement ou par interpolation linéaire.
Pour déterminer par le premier quartile (𝑄1 ) par interpolation, on procède comme suit :
(𝑏 − 𝑎) × (0,25 − 𝐹𝑎 )
𝑄1 = 𝑎 +
𝐹𝑏 − 𝐹𝑎
(𝑏 − 𝑎) × (𝐹𝑏 − 0,25)
𝑄1 = 𝑏 −
𝐹𝑏 − 𝐹𝑎
𝑛
(𝑏 − 𝑎) × ( − 𝑁𝑎 )
4
𝑄1 = 𝑎 +
𝑁𝑏 − 𝑁𝑎
Page 20 sur 28
Cours de Biostatistiques - Licence en sciences de la santé (SI & AM)
31 octobre 2017
𝑛
(𝑏 − 𝑎) × (𝑁𝑏 − )
4
𝑄1 = 𝑏 −
𝑁𝑏 − 𝑁𝑎
Pour déterminer par le troisième quartile (𝑄3 ) par interpolation, on procède comme suit :
(𝑏 − 𝑎) × (0,75 − 𝐹𝑎 )
𝑄3 = 𝑎 +
𝐹𝑏 − 𝐹𝑎
(𝑏 − 𝑎) × (𝐹𝑏 − 0,75)
𝑄3 = 𝑏 −
𝐹𝑏 − 𝐹𝑎
3𝑛
(𝑏 − 𝑎 ) × ( − 𝑁𝑎 )
4
𝑄3 = 𝑎 +
𝑁𝑏 − 𝑁𝑎
3𝑛
(𝑏 − 𝑎) × (𝑁𝑏 − )
4
𝑄3 = 𝑏 −
𝑁𝑏 − 𝑁𝑎
APPLICATION
Détermination de 𝑄1
On a donc :
𝑛
𝑛 = 200 → = 50
4
𝐹𝑎 = 0,05 (= 5%)
𝐹𝑏 = 0,3 (= 30%)
𝑁𝑎 = 10
𝑁𝑏 = 60
Page 21 sur 28
Cours de Biostatistiques - Licence en sciences de la santé (SI & AM)
31 octobre 2017
Donc le quart (25%) des individus ont une taille inférieure à 168 cm.
Détermination de 𝑄3
On a donc :
3𝑛
𝑛 = 200 → = 150
4
𝐹𝑎 = 0,725 (= 72,5%)
𝐹𝑏 = 0,975 (= 97,5%)
𝑁𝑎 = 145
𝑁𝑏 = 195
Donc les trois quarts (75%) des individus ont une taille inférieure à 181 cm, c'est-à-dire, un
quart (25%) des individus ont une taille supérieure ou égale à 181 cm.
Page 22 sur 28
Cours de Biostatistiques - Licence en sciences de la santé (SI & AM)
31 octobre 2017
Les paramètres de dispersion absolue les plus courants sont : l'étendue, l'intervalle (écart)
interquartile, l'écart absolu moyen et surtout la variance et l'écart type.
Ainsi, pour remplacer l’étendue d’une distribution par une caractéristique moins sensible
aux extrêmes, l’écart interquartile.
Remarquons que, dans cet intervalle, est contenue la moitié des observations.
- Données groupées
𝑝
∑𝑝𝑖=1 𝑛𝑖 |𝑥𝑖 − 𝑋̅|
( )
𝐸𝐴𝑀 𝑋 = = ∑ 𝑓𝑖 |𝑥𝑖 − 𝑋̅|
𝑛
𝑖=1
𝑝 𝑝
avec ∑𝑖=1 𝑛𝑖 = 𝑛 ou ∑𝑖=1 𝑓𝑖 = 1.
Page 23 sur 28
Cours de Biostatistiques - Licence en sciences de la santé (SI & AM)
31 octobre 2017
- Données groupées
𝑝 𝑝
∑𝑝𝑖=1 𝑛𝑖 (𝑥𝑖 − 𝑋̅ )2 ∑𝑝𝑖=1 𝑛𝑖 𝑥𝑖2
2
𝜎𝑥 = ̅ 2
= ∑ 𝑓𝑖 (𝑥𝑖 − 𝑋 ) = − (𝑋̅)2 = ∑ 𝑓𝑖 𝑥𝑖2 − (𝑋̅)2
𝑛 𝑛
𝑖=1 𝑖=1
𝑝 𝑝
avec ∑𝑖=1 𝑛𝑖 = 𝑛 ou ∑𝑖=1 𝑓𝑖 = 1.
NB : sur des échantillons de faible taille (n<30), on utilise l'écart-type modifié, soit en
divisant par n-1 au lieu de n (les calculatrices le font automatiquement).
Moyenne arithmétiq ue x
Page 24 sur 28
Cours de Biostatistiques - Licence en sciences de la santé (SI & AM)
31 octobre 2017
taille et âge ;
diabète et poids ;
taux de cholestérol et régime alimentaire ;
niche écologique et population ;
ensoleillement et croissance végétale ;
toxine et réaction métabolique ;
survie et pollution ;
effets et doses;
organe 1 et 2 ;
organe et fonction biologique ; …
Les caractères étudiés peuvent être aussi bien qualitatifs que quantitatifs. Les résultats sont
généralement représentés sous forme d’un tableau à double entrée, appelé tableau à deux
dimensions, ou tableau croisé ou tableau de contingence, ou parfois tableau de
corrélation.
Homme 43 36 3 82
Femme 49 12 12 73
Total 92 48 15 155
Page 25 sur 28
Cours de Biostatistiques - Licence en sciences de la santé (SI & AM)
31 octobre 2017
Y
𝑦1 𝑦2 ... 𝑦𝑗 ... 𝑦𝑧 Total
X
𝑥1 𝑛11 𝑛12 ... 𝑛1𝑗 𝑛1𝑧 𝑛1.
EFFECTIFS MARGINAUX DE Y
𝑥2 𝑛21 𝑛22 ... 𝑛2𝑗 𝑛2𝑧 𝑛2.
.
.
.
𝑥𝑖 𝑛𝑖1 𝑛𝑖2 ... 𝑛𝑖𝑗 𝑛𝑖𝑧 𝑛𝑖.
.
.
.
𝑥𝑘 𝑛𝑘1 𝑛𝑘2 ... 𝑛𝑘𝑗 𝑛𝑘𝑧 𝑛𝑘.
Total 𝑛.1 𝑛.2 ... 𝑛.𝑗 𝑛.𝑧 𝑛
EFFECTIFS MARGINAUX DE X
n i n j
f i et f j .
n n
Page 26 sur 28
Cours de Biostatistiques - Licence en sciences de la santé (SI & AM)
31 octobre 2017
Taille (variable Y) en cm
65 5 7 8 20
71 4 3 6 13
88 8 6 3 17
95 13 10 5 28
Total 30 26 22 78
n i xi
i 1
Moyenne marginale de X : X
n
n j y j
j 1
Moyenne marginale de Y : Y
n
Page 27 sur 28
Cours de Biostatistiques - Licence en sciences de la santé (SI & AM)
31 octobre 2017
n i x i
2
2
i 1
X
2
Variance marginale de X : x
n
n j y j
2
j 1 2
Variance marginale de Y : Y
2
y
n
Covariance
Une première approche entre dans la relation éventuelle des valeurs d’une variable X avec
des valeurs d’une variable Y est donnée par le calcul de la covariance. La covariance du
couple(X, Y), notée Cov(X,Y) correspond à la moyenne de ( X X )( Y Y ) . La formule est
∑𝑘 𝑧 ̅ ̅
𝑖=1 ∑𝑗=1 𝑛𝑖𝑗 ×(𝑥𝑖 −𝑋 )×(𝑦𝑗 −𝑌 )
donc la suivante : 𝐶𝑜𝑣(𝑋, 𝑌) = 𝑛
Page 28 sur 28