0% ont trouvé ce document utile (0 vote)
4 vues103 pages

Support Stat

Le document présente les concepts de base de la statistique descriptive, y compris les définitions de population, échantillon, caractère statistique, modalité et effectif. Il explique également les types de caractères (qualitatif et quantitatif) et leur classification, ainsi que l'importance de la présentation des données statistiques à travers des tableaux et des graphiques. Enfin, il aborde les méthodes de présentation graphique adaptées aux caractères qualitatifs et quantitatifs.

Transféré par

malakbnmaran
Copyright
© All Rights Reserved
Nous prenons très au sérieux les droits relatifs au contenu. Si vous pensez qu’il s’agit de votre contenu, signalez une atteinte au droit d’auteur ici.
Formats disponibles
Téléchargez aux formats PDF, TXT ou lisez en ligne sur Scribd
0% ont trouvé ce document utile (0 vote)
4 vues103 pages

Support Stat

Le document présente les concepts de base de la statistique descriptive, y compris les définitions de population, échantillon, caractère statistique, modalité et effectif. Il explique également les types de caractères (qualitatif et quantitatif) et leur classification, ainsi que l'importance de la présentation des données statistiques à travers des tableaux et des graphiques. Enfin, il aborde les méthodes de présentation graphique adaptées aux caractères qualitatifs et quantitatifs.

Transféré par

malakbnmaran
Copyright
© All Rights Reserved
Nous prenons très au sérieux les droits relatifs au contenu. Si vous pensez qu’il s’agit de votre contenu, signalez une atteinte au droit d’auteur ici.
Formats disponibles
Téléchargez aux formats PDF, TXT ou lisez en ligne sur Scribd

CHAPITRE 1

Introduction et Concepts de Base


• Définitions et Objectifs de la statistique descriptive
• Eléments de vocabulaire
 Population  Modalité
 Individus ou unités statistiques  Effectif
 Echantillon  Caractère qualitatif
 Taille de la population ou Effectif total  Caractère quantitatif
 Caractère ou Variable statistique  Classe
 fréquence
1
Chapitre 1: Introduction et Concepts de Base

Eléments de vocabulaire (1)


Population

• On appelle population, population statistique ou univers, un ensemble


d’éléments, de personnes, d’objets ou d’événements, disposant de
certaines caractéristiques plus ou moins communes et constituant
l’objet de l’étude statistique.
• La population constitue l’univers de référence de l’étude.
• Exemple:
o Etudiants inscrits à l’ENCG de Marrakech,
o Touristes visitant le Maroc en 2024,
o Notes obtenues en session de rattrapage,
o Salariés d’une entreprise.

2
Chapitre 1: Introduction et Concepts de Base

Eléments de vocabulaire (2)


Individus ou unités statistiques

• Les éléments de la population sont appelés individus statistiques ou


unités statistiques.
• L’individu est l’élément sur lequel porte l’étude.
• Exemple:
o Un étudiant
o Un touriste
o Une note
o Un salarié

3
Chapitre 1: Introduction et Concepts de Base

Eléments de vocabulaire (3)


Echantillon

• c’est un sous-ensemble de la population, ayant les mêmes


caractéristiques de la population-mère, utilisé en vue d'inférer quelque
chose à propos de cette population.
• Exemple:
o un échantillon de 100 étudiants à partir d'une
population de 400 étudiants.

4
Chapitre 1: Introduction et Concepts de Base

Eléments de vocabulaire (4)


Taille de la population ou Effectif total

• C’est le nombre d’individus ou d’unités statistiques appartenant à la


population. On le note N.
• Exemple:
o 200 étudiants.
o 1000 femmes.
o 350 entreprises.

5
Chapitre 1: Introduction et Concepts de Base

Eléments de vocabulaire (5)


Caractère ou Variable statistique
• c’est une particularité ou propriété caractéristique des éléments de la
population à laquelle on s’intéresse.
• Une variable est une information dont on recueille la valeur sur chaque
individu. On parle de variable parce que la valeur de l’information
n’est pas la même d’un individu à l’autre.
• Exemple:
o La population des étudiants peut se caractériser par le caractère "filière",
o La population des femmes peut se caractériser par le caractère "nombre des enfants",
o La population des villes peut se caractériser par le caractère "nombre des habitants".

6
Chapitre 1: Introduction et Concepts de Base

Eléments de vocabulaire (6)


Modalité
• La modalité correspond aux valeurs possibles que peut prendre une variable
statistique. C’est à partir des valeurs observées que le statisticien construit
ses classements d’individus.
• Chaque caractère possède deux ou plusieurs modalités, ce sont les
différentes situations où les individus peuvent se trouver à l’égard du
caractère.
• On appelle série statistique les différentes valeurs du caractère étudié (noté
𝒙𝒊). S’il y a k modalités du caractère, les modalités sont donc notés :
𝑥1, 𝑥2 ………………., 𝑥𝑘
• Exemple:
o Le caractère filière peut avoir comme modalités : commerce, gestion …,
o Le caractère nombre des enfants peut avoir comme modalités 0, 1, 2, 3, …,
7
Chapitre 1: Introduction et Concepts de Base

Eléments de vocabulaire (7)


Effectif
• C’est le nombre d’individus qui présentent une modalité de la variable
statistique.
• L’effectif d’une modalité « i » est noté 𝑛 𝑖. S’il y a k modalités de la
variable statistique, les effectifs sont donc notés :
𝑛1, 𝑛2 ………………., 𝑛𝑘
• L’effectif total N est la somme des effectifs des modalités 𝑛 𝑖;
N=  𝑛𝑖
• Exemple:
o Les étudiants inscrits à la filière gestion ont un effectif de 250,
o Les femmes ayant 3 enfants ont un effectif de 30.
8
Chapitre 1: Introduction et Concepts de Base

Eléments de vocabulaire (8)


Caractère qualitatif
• C’est un caractère non mesurable dont les modalités ne sont pas des
nombres; elles s'expriment de façon littérale, ou bien elles sont des
nombres sur lequel les opérations arithmétiques n'ont pas de sens.
• On distingue deux types :
Caractère qualitatif nominal: s’il n’est pas possible de classer ses modalités
suivant un ordre qui a du sens. Exemple: Couleur, Situation familiale, …
Caractère qualitatif ordinal: s’il est possible de classer ses modalités suivant
un ordre qui a du sens. Exemple: Niveau scolaire, Mention, Evaluation des
clients, …

9
Chapitre 1: Introduction et Concepts de Base

Eléments de vocabulaire (9)


Caractère quantitatif
• C’est un caractère mesurable dont les modalités sont des nombres sur
lesquels les opérations arithmétiques ont un sens.
• On distingue deux types :

 Caractère quantitatif discret: si la valeur de ses modalités relève d’un comptage (si
l’ensemble de ses modalités est dénombrable). Exemple: nb d'enfants dans une
famille, nb d'amis, nb de maisons,…
 Caractère quantitatif continu: si la valeur de ses modalités relève d’une mesure (ne
relève pas d’un comptage) et si ses modalités sont prises dans tout un intervalle de ℝ.
Exemple: la taille, l'âge, le poids, le revenu, le chiffre d’affaires (CA) des entreprises,

• Exemple:
o Sur une population de 100 voitures, on étudie la couleur de la carrosserie : c'est un caractère
qualitatif nominal; si on étudie leur puissance fiscale, c'est un caractère quantitatif discret; si on
étudie la taille de leur conducteur, c'est un caractère quantitatif continu 10
Chapitre 1: Introduction et Concepts de Base
Eléments de vocabulaire (10)
Classe
• Pour un caractère quantitative continue, toutes les valeurs des modalités
peuvent appartenir à un intervalle réel.
• Ces valeurs sont regroupées dans des intervalles de valeurs numériques
appelés classes.
• Les classes sont notées : [ 𝑒𝑖 ; 𝑒𝑖+1[
avec 𝑒𝑖 est la borne inférieure et 𝑒𝑖+1 est la borne supérieure.

• Amplitude de la classe : 𝑎𝑖 = 𝑒𝑖+1 − 𝑒𝑖

𝑒 𝑖 + 𝑒 𝑖 +1
• Centre de la classe : 𝑥𝑖 =
2
• Exemple:
o Le caractère âge peut avoir comme modalités [0; 19[, [19; 38[, …,

11
Chapitre 1: Introduction et Concepts de Base
Eléments de vocabulaire (11)
Fréquence
• La fréquence associée à une modalité (𝑓𝑖 ), ou à un ensemble de
modalités regroupées en classes indique la proportion d’individus
présentant cette modalité (ou cet ensemble de modalités) par rapport à
l’ensemble des individus.
• C’est le nombre ou l’effectif d’individus possédant ce caractère divisé
par l’effectif total de la population. On le note 𝑓𝑖.
𝑛𝑖 𝑛𝑖
𝑓𝑖 = =
𝑁 𝑛𝑖

• La somme des fréquences :  𝑓𝑖 = 1


• La fréquence en pourcentage = fréquence relative ×100.
12
CHAPITRE 2
Présentation des données statistiques
• Tableau statistique
 Effectif et Fréquence cumulés
• Présentation graphique
 Cas d’un caractère qualitatif
 Cas d’un caractère quantitatif discret
 Cas d’un caractère quantitatif continu

13
Chapitre 2: Présentation des données statistiques

Tableau statistique

• Soit une population comprenant n individus, pour chacun desquels on


a fait une observation concernant le caractère X ayant les k modalités
suivantes: 𝑥1, 𝑥2,... 𝑥𝑖 ,... 𝑥𝑘
• L'opération préliminaire de mise en ordre des observations va
consister à classer chacun des n individus dans les k sous-ensembles
définis par les diverses modalités du caractère X.
• Pour chaque modalité 𝑥𝑖, on inscrira dans le tableau statistique le
nombre d'éléments du sous-ensemble correspondant. Ce nombre est
l'effectif 𝑛𝑖 des individus présentant la modalité 𝑥𝑖.
• Du point de vue du caractère X, tous les individus présentant la
modalité 𝑥𝑖 sont considérés comme équivalents : on ne retient que leur
nombre.
14
Chapitre 2: Présentation des données statistiques
Tableau statistique
• La première ligne (ou colonne) comporte la liste des valeurs possibles du caractère
• La deuxième ligne (ou colonne) dans laquelle sont repris les effectifs.
Caractère étudié Effectif de chaque modalité
𝑥1 𝑛1
𝑥2 𝑛2
… …
𝑥𝑖 𝑛𝑖
… …
𝑥𝑘 𝑛𝑘
Total N

Caractère étudié 𝑥1 𝑥2 … 𝑥𝑖 … 𝑥𝑘 Total

Effectif de chaque 𝑛1 𝑛2 … 𝑛𝑖 … 𝑛𝑘 N
modalité 15
Chapitre 2: Présentation des données statistiques
Tableau statistique
• En plus des effectifs on rajoute la fréquence relative à chaque modalité ainsi que la
fréquence en pourcentage.
Caractère étudié Effectif de Fréquences Fréquences
chaque relatives en
modalité pourcentage
𝑥1 𝑛1 𝑓1 𝑓1× 100
𝑥2 𝑛2 𝑓2 𝑓2 × 100
… … … …
𝑛𝑖
𝑥𝑖 𝑛𝑖 𝑓𝑖 = 𝑓𝑖 × 100
N
… … … …
𝑥𝑘 𝑛𝑘 𝑓𝑘 𝑓𝑘 × 100
Total N 1,0 100%

16
Chapitre 2: Présentation des données statistiques
Tableau statistique
Effectif et Fréquence cumulés

• Effectifs cumulés croissants (noté ECC ou 𝑁𝑖 )

• Effectifs cumulés décroissants (noté ECD ou 𝑁𝑖 ↓ )

• Les fréquences cumulées croissantes (noté FCC ou 𝐹𝑖 ) et


décroissantes (noté FCD ou 𝐹𝑖 ↓) sont les proportions de chacun de
ces effectifs (croissants et décroissants) par rapport à l'effectif total.

17
Chapitre 2: Présentation des données statistiques
Tableau statistique
Effectif et Fréquence cumulés
Caractère Effectif Fréquences Fréquences Effectif Effectif Fréquence Fréquence
étudié de chaque relatives en cumulé cumulé cumulée cumulée
modalité pourcentage croissant décroissant croissante décroissante
ECC ECD FCC FCD
𝑥1 𝑛1 𝑓1 𝑓1× 100 𝑛1 N 𝑓1 1
𝑥2 𝑛2 𝑓2 𝑓2 × 100 𝑛1+𝑛2 N−𝑛1 𝑓1+𝑓2 1−𝑓1
… … … … … … … …
𝑥𝑘 𝑛𝑘 𝑓𝑘 𝑓𝑘 × 100 𝑛1+𝑛2+…+ 𝑁 − 𝑛1 − 𝑓1+𝑓2+…+ 1−𝑓1 −
𝑛𝑖+…+𝑛𝑘 = 𝑛2 −… 𝑓𝑖+…+𝑓𝑘 = 𝑓2 −…
𝑁 −𝑛𝑖−1 −… 1 −𝑓𝑖−1 −…
−𝑛𝑘−1=𝑛𝑘 −𝑓𝑘−1=𝑓𝑘
Total N 1,0 100%

18
Chapitre 2: Présentation des données statistiques

Présentation graphique

• Lorsqu'on observe un caractère sur des individus, on aboutit à un


tableau de chiffres peu parlant.
• Il est nécessaire de dresser une présentation graphique afin de faire
ressortir une partie de l’information.
• La présentation graphique du tableau permet d'un seul coup d'œil
d'avoir une idée de la manière dont se répartissent les individus.
• Elle permet de mieux mettre en évidence certaines informations
données dans le tableau.
• Les présentations graphiques varient en fonction du type de la
variable.

19
Chapitre 2: Présentation des données statistiques
Présentation graphique

20
Chapitre 2: Présentation des données statistiques

Présentation graphique
Cas d’un caractère qualitatif

• Pour présenter un caractère qualitatif, généralement on utilise


deux types de représentations graphiques ou diagrammes:

 Un diagramme à barres (à bandes/à tuyaux d’orgue),


 Un diagramme à secteurs circulaire (diagramme circulaire/ demi
circulaire).

21
Chapitre 2: Présentation des données statistiques

Présentation graphique
Cas d’un caractère qualitatif: Diagramme à tuyaux d’orgue
• La seule représentation qui nous intéresse est celle des effectifs 𝑛𝑖 (ou des
fréquences 𝑓𝑖).
• A chaque modalité 𝑥𝑖 est associé un effectif 𝑛𝑖 (ou une fréquence 𝑓𝑖) .
• Pour construire un diagramme en tuyaux d'orgues, on doit porter sur l'axe des
abscisses (la droite horizontale) les modalités 𝑥𝑖 et sur l'axe des ordonnées (l’axe
vertical) les effectifs 𝑛𝑖 (ou les fréquences 𝑓𝑖), puis on représente les modalités par
des rectangles juxtaposées dont la hauteur est proportionnelle à l'effectif (ou à la
fréquence) correspondant et dont la base est une constante.
• (attention: ne pas orienter l’axe des abscisses car les modalités ne sont pas
mesurables et il n'y a donc pas de relation d'ordre entre elles).
• On doit avoir une bande (ou rectangle) verticale à chaque modalité
• la distance entre chaque bande doit être constante et la largeur de chacune des
bandes est la même.
22
Chapitre 2: Présentation des données statistiques

Présentation graphique
Cas d’un caractère qualitatif: Diagramme à tuyaux d’orgue
Effectifs (ou
fréquences6)

0
x1 x2 x3 x4 modalités

NB. Dans les manuels de la statistique, le titre d’un graphique se situe en général en bas 23
Chapitre 2: Présentation des données statistiques

Présentation graphique
Cas d’un caractère qualitatif: Diagramme circulaire
• On les appelle également les diagrammes à secteurs (ou camemberts)
• On appelle un diagramme à secteur, un graphique qui divise un disque
(qui représente l’effectif total) en secteurs angulaires dont les aires
sont proportionnels au effectifs (ou fréquences) de chaque modalité.
• L'élaboration de ce diagramme consiste à répartir un angle de 360°
entre les différentes modalités selon le poids de chacune dans
l'ensemble de la population.
• Pour une modalité 𝑥𝑖 d'effectif 𝑛 𝑖, l'angle 𝑎𝑖 correspondante est:
𝑛𝑖
𝑎𝑖 = × 360 = 𝑓𝑖 × 360
𝑁

24
Chapitre 2: Présentation des données statistiques

Présentation graphique
Cas d’un caractère quantitatif discret

• Deux types de graphiques sont intéressants à présenter:

les diagrammes différentiels (Diagramme en bâtons et diagramme


de polygone)
les diagrammes cumulatifs.

25
Chapitre 2: Présentation des données statistiques

Présentation graphique
Cas d’un caractère quantitatif discret: Diagramme en bâtons

• Ce diagramme est appelé aussi un diagramme différentiel, puisqu’il


représente les différentes modalités de la variable discrète. C’est aussi un
diagramme à barres, sauf que les barres sont plus fines.
• Les valeurs discrètes ou les modalités 𝑥𝑖 sont placées sur l'axe des abscisses,
et les effectifs 𝑛𝑖(ou les fréquences 𝑓𝑖) sur l'axe des ordonnées.
• Le bâton est un segment de droite parallèle à l'axe des ordonnées, de
longueur proportionnelle à l'effectif ou à la fréquence correspondante. Il est
constitué par le segment qui relie le point (𝑥𝑖,0) au point (𝑥𝑖, 𝑛𝑖).

26
Chapitre 2: Présentation des données statistiques
Présentation graphique
Cas d’un caractère quantitatif discret: Diagramme en bâtons

Exemple: La distribution des étudiants en fonction du nombre de personnes dans la famille

400

350

300

250

200

150

100

50

0
0 1 2 3 4 5 6 7

27
Chapitre 2: Présentation des données statistiques

Présentation graphique
Cas d’un caractère quantitatif discret: Polygone des fréquences/effectifs
• Le polygone des effectifs (ou des fréquences) est obtenu en reliant les
extrémités des bâtons du diagramme précédent. On obtient ainsi pour
l'exemple précédent : 400
350

300

250

200

150

100

50

0
0 3 4 5 6 7

28
Chapitre 2: Présentation des données statistiques
Présentation graphique
Cas d’un caractère quantitatif discret: Diagramme cumulatif
• Il permet de visualiser l'évolution des effectifs (fréquences) cumulés croissants ou
décroissants.
• Pour obtenir la courbe croissante, on note 𝑔𝑘la fréquence cumulée du caractère 𝑥𝑘,
c'est-à-dire 𝑔𝑘= 𝑓1+...+ 𝑓𝑘. Alors la courbe des fréquences cumulées est celle
obtenue en joignant les points (𝑥𝑖, 𝑔𝑖).
• Pour l'exemple précédent, on a le tableau :
𝑥𝑖 𝑛𝑖 𝑓𝑖 𝑓𝑖% ECC ECD FCC FCD
1 150 0,142 14,2% 150 1060 0,142 1
2 240 0,226 22,5% 390 910 0,368 0,858
3 340 0,321 32,1% 730 670 0,689 0,632
4 140 0,132 13,2% 870 330 0,821 0,311
5 100 0,094 9,4% 970 190 0,915 0,179
6 90 0,085 8,5% 1060 90 1 0,085
Total 1060 1,0 100%
29
Chapitre 2: Présentation des données statistiques
Présentation graphique
Cas d’un caractère quantitatif discret: Diagramme cumulatif
• Voici le diagramme de fréquences cumulatives croissantes équivalent
• On utilise l'effectif (fréquence) cumulé croissant pour répondre aux questions du style :
Quel est le nombre (fréquence) d'individus dont la valeur du caractère est inférieure ou
égale à x ?
1,2

0,8

0,6

0,4

0,2

0
0 1 2 3 4 5 6 7
30
Chapitre 2: Présentation des données statistiques
Présentation graphique
Cas d’un caractère quantitatif discret: Diagramme cumulatif
• Voici le diagramme de fréquences cumulatives décroissantes équivalent
•On utilise l'effectif (fréquence) cumulé décroissant pour répondre aux questions du style :
Quel est le nombre (%) d'individus dont la valeur du caractère est strictement supérieure à x ?
1,2

0,8

0,6

0,4

0,2

0
0 1 2 3 4 5 6 7
31
Chapitre 2: Présentation des données statistiques
Présentation graphique
Cas d’un caractère quantitatif discret: Diagramme cumulatif
• Les deux courbes des diagrammes cumulatifs croissant et décroissant sont
symétriques par rapport à un axe horizontal d'ordonnée ½ pour les fréquences, n/2
pour les effectifs.
1,2

0,8

0,6

0,4

0,2

0
0 1 2 3 4 5 6 7
32
Chapitre 2: Présentation des données statistiques

Présentation graphique
Cas d’un caractère quantitatif continu

• Deux types de graphiques sont intéressants à présenter:


les diagrammes différentiels qui mettent en évidence les
différences d'effectifs (ou de fréquences) entre les différentes
classes de modalités. (Histogramme)
les diagrammes cumulatifs

33
Chapitre 2: Présentation des données statistiques

Présentation graphique
Cas d’un caractère quantitatif continu: Histogramme
• La Présentation graphique des fréquences (effectifs) d’un caractère continu peut
s'effectuer sous la forme d'un histogramme, en portant sur l'axe des abscisses les
valeurs des classes du caractère, et en leur donnant les fréquences (effectifs)
correspondantes.
• Un histogramme est un ensemble de rectangles contigus, chaque rectangle associé
à chaque classe ayant une surface proportionnelle à l'effectif (fréquence) de cette
classe.
• la base de chaque rectangle correspond à l’amplitude d’une classe. Généralement
toutes les classes d’une série statistique ont la même amplitude.
• Le cas des classes d'amplitudes égales ne pose aucune difficulté car il suffit de
reporter en ordonnée l'effectif (la fréquence).

34
Chapitre 2: Présentation des données statistiques
Présentation graphique
Cas d’un caractère quantitatif continu: Histogramme
Exemple 1: Amplitudes égales

• La répartition par tranches d’âge de la population des femmes marocaines en


2018 7,0
6,5
Age Nombre de 𝑓𝑖 6,0
femmes (𝑛𝑖) 5,5
en millions 5,0
4,5 [0;20[
[0;20[ 6,2 0,3444 4,0
[20;40[
3,5
[20;40[ 5,7 0,3167 3,0 [40;60[

2,5 [60;80[
[40;60[ 4,1 0,2278
2,0 80 et plus
[60;80[ 1,8 0,1 1,5
80 et plus 0,2 0,0111 1,0
0,5
Total 18,0 1 0,0
[0;20[ [20;40[ [40;60[ [60;80[ 80 et plus

35
Chapitre 2: Présentation des données statistiques
Présentation graphique la classe [20;35[ est
Cas d’un caractère quantitatif continu: Histogramme la classe qui
consomme le plus le
Exemple 2: Amplitudes inégales produit Y

• Répartition des consommateurs d’un produit Y selon l’âge


erreurs
Age effectifs (𝑛𝑖) 𝑎𝑚𝑝𝑙𝑖𝑡𝑢𝑑𝑒 Frequence d’interprétation
(𝑓𝑖)
[15;20[ 130 5 0,195
[20;35[ 343 15 0,514
[35;40[ 107 5 0,160
[40;50[ 33 10 0,05
[50,55[ 54 5 0,081
Total 667 1

36
Chapitre 2: Présentation des données statistiques

Présentation graphique
Cas d’un caractère quantitatif continu: Histogramme
• Si l'amplitude 𝑎𝑖 des classes n'est pas constante, on doit corriger cette amplitude
• Pour corriger les fréquences (effectifs), il faut choisir une unité d'amplitude 𝑎0
(généralement on prendra comme unité d'amplitude, l'amplitude la plus fréquente
mais également l'amplitude la plus petite)

Une fois que cette amplitude est choisie, on va obtenir les fréquences (effectifs)
corrigées en multipliant les fréquences (effectif) par le ratio (a0 / ai)

• Ainsi : ni corrigé = ni * (a0 / ai)

37
Chapitre 2: Présentation des données statistiques
Présentation graphique
Cas d’un caractère quantitatif continu: Histogramme
Exemple 2: Amplitudes inégales

• Répartition des consommateurs d’un produit Y selon l’âge


L’unité d’amplitude 𝒂𝟎 = 𝟓
Age effectifs (𝑛𝑖) 𝑎𝑚𝑝𝑙𝑖𝑡𝑢𝑑𝑒 Effectif Frequence Frequence
corrigé (𝑓𝑖) corrigée (
(𝑛𝑖′)= 𝑓𝑖′) =
ni*(a0 / ai) Fi * (a0 / ai)
[15;20[ 130 5 130 0,195 0,195
[20;35[ 343 15 114,333 0,514 0,171
[35;40[ 107 5 107 0,160 0,160
[40;50[ 33 10 16,5 0,05 0,025
[50,55[ 54 5 54 0,081 0,081
Total 667

38
Chapitre 2: Présentation des données statistiques
Présentation graphique
Cas d’un caractère quantitatif continu: Histogramme
Exemple 2: Amplitudes inégales

• Répartition des consommateurs d’un produit Y selon l’âge


Age effectifs (𝑛𝑖) 𝑎𝑚𝑝𝑙𝑖𝑡𝑢𝑑𝑒 Effectif Frequence Frequence
corrigé (𝑓𝑖 ) corrigée (
(𝑛𝑖′) 𝑓𝑖 ′)

16
[15;20[ 130 5 130 0,195 0,195 ,5
54
[20;35[ 343 15 114,333 0,514 0,171
[35;40[ 107 5 107 0,160 0,160
[40;50[ 33 10 66 0,05 0,025
[50,55[ 54 5 54 0,081 0,081
Total 667

39
CHAPITRE 3
Indicateurs Statistiques
• Indicateurs de tendance centrale et de
position
• Indicateurs de dispersion
• Indicateurs de concentration

40
Chapitre 3: Indicateurs Statistiques

• Les tableaux présentent l’information recueillie d’une variable et les


graphiques fournissent un portrait pour appréhender plus facilement la
globalité de l’information.

• Pour caractériser la représentation visuelle par des éléments


synthétiques, on peut utiliser des indicateurs.

• Nous appelons « Indicateurs », les nombres qui résument une base de


données selon des règles et des pratiques. On les appelle aussi des «
paramètres » ou des « caractéristiques ».
• Décrire les caractéristiques d’une série statistique consiste à calculer
des caractéristiques de tendance centrale (de position ou de
concentration), des caractéristiques de dispersion et à étudier sa
concentration.
41
Chapitre 3: Indicateurs Statistiques

Indicateurs de tendance centrale et de position

• Les indicateurs de tendance centrale et de position sont utilisés pour


donner une indication du niveau du caractère,
• Ces indicateurs indiquent où se positionne une série de données.
• Les indicateurs de la tendance centrale mesurent par exemple le centre
de la distribution d’une série de données,
• Nous introduirons le mode, la médiane, la moyenne et les quantiles
comme indicateurs de tendance centrale et de position.

42
Chapitre 3: Indicateurs Statistiques
Indicateurs de tendance centrale et de position
Le Mode
• Le mode représente la valeur ou la modalité du caractère la plus
fréquemment observée. Notation 𝑀0
• On parle également de la valeur dominante pour laquelle l’effectif est
le plus élevé (ou la fréquence est la plus élevée). Autrement dit, Le
mode représente ainsi le 𝑥𝑖 correspondant au 𝑛𝑖 (ou 𝑓𝑖) maximum.
• Le mode est l'indice le plus simple à déterminer puisqu'il suffit de lire
un graphique ou de regarder le tableau des effectifs/fréquences.
• Si les données ont exactement deux modes, on note que les données
sont bimodales. Si les données ont plus de deux modes, on souligne
que les données sont multimodales ou plurimodales.
• On doit faire la distinction entre les caractères qualitatifs ou
quantitatifs discret et des caractères quantitatifs continus.
43
Chapitre 3: Indicateurs Statistiques

Indicateurs de tendance centrale et de position


Le Mode: Cas d’un caractère quantitatif continu

• Puisque les données sont groupées en classes, on doit définir en


premier lieu la classe modale. Cette dernière est la classe ayant la plus
forte densité de fréquence.

• NB. Il faut prendre en compte l’amplitude de chaque classe.

44
Chapitre 3: Indicateurs Statistiques

Indicateurs de tendance centrale et de position


Le Mode: Cas d’un caractère quantitatif continu
Cas d’amplitudes égales
• Le mode est donné par la formule suivante:
𝒏𝒊 − 𝒏𝒊−𝟏
𝑴𝟎 = 𝑩𝑴𝟎 + × 𝒂 𝑴𝟎
(𝒏𝒊−𝒏𝒊−𝟏) + (𝒏𝒊 − 𝒏𝒊+𝟏)
Avec:
𝑩𝑴𝟎 : la borne inférieure de la classe modale.
𝒂𝑴𝟎 : l’amplitude de la classe modale.
𝒏𝒊 : l’effectif de la classe modale.
𝒏𝒊+𝟏 : l’effectif de la classe suivante à la classe modale.
𝒏𝒊−𝟏 : l’effectif de la classe précédente à la classe modale.
45
Chapitre 3: Indicateurs Statistiques

Indicateurs de tendance centrale et de position


Le Mode: Cas d’un caractère quantitatif continu
Cas d’amplitudes inégales

• Si l'amplitude des classes n'est pas constante, on doit corriger cette


amplitude
• Le mode est calculé en appliquant la même formule qu’auparavant
(avec des ni corrigés) :

𝒏𝒊 − 𝒏𝒊−𝟏
𝑴𝟎 = 𝑩𝑴𝟎 + × 𝒂 𝑴𝟎
(𝒏𝒊−𝒏𝒊−𝟏) + (𝒏𝒊 − 𝒏𝒊+𝟏)

46
Chapitre 3: Indicateurs Statistiques
Indicateurs de tendance centrale et de position
La Médiane
• La médiane est la valeur du caractère qui sépare en deux groupes de même
effectif les observations classées par ordre croissant. Notation 𝑀𝑒
• 50% des individus statistiques présentent une modalité inférieure à 𝑀𝑒 (se
trouvent en dessous de la médiane), et 50% présentent une modalité supérieure
ou égale à 𝑀𝑒 (se trouvent au-dessus de la médiane )
• La médiane ne se calcule uniquement que dans le cadre des variables
quantitatives.
• Il faut faire une distinction entre les variables quantitatives discrètes et
variables quantitatives continues.
• On peut ainsi déterminer graphiquement la médiane, dans la courbe de
fréquence cumulée (ou même dans la courbe d’effectif cumulé)

47
Chapitre 3: Indicateurs Statistiques

Indicateurs de tendance centrale et de position


La Médiane: Cas d’un caractère quantitatif discret

• La médiane d'une série statistique rangée dans l'ordre


croissant (𝑥1, 𝑥2, 𝑥3, 𝑥4, ....., 𝑥𝑛) noté 𝑀𝑒 est défini de la
façon suivante :
 Si l’effectif N = 2p est pair, 𝑀𝑒 est le centre de l'intervalle [𝑥𝑝 ; 𝑥𝑝+1]
𝑥 𝑝 +𝑥 𝑝+1
(𝑀𝑒 = );
2
avec 𝑥𝑝 est la modalité au rang p = 𝑁 et 𝑥 𝑝 +1 est la modalité au rang 𝑁
+1
2 2

Si l’effectif N est impair, 𝑀𝑒 est la modalité 𝑥𝑝 qui se trouve au rang


p = 𝑁+1
2
48
Chapitre 3: Indicateurs Statistiques

Indicateurs de tendance centrale et de position


La Médiane: Cas d’un caractère quantitatif continu

• Dans le cas d’une variable continue où les données sont


groupées en classes, on doit définir en premier lieu la classe
médiane, qui contient la médiane.
• La valeur de la médiane est déduite par la suite par
interpolation linéaire.

49
Chapitre 3: Indicateurs Statistiques

Indicateurs de tendance centrale et de position


La Médiane: Cas d’un caractère quantitatif continu

• Interpolation linéaire b
𝑴𝒆
𝑀𝑒 − 𝑎 𝑏−𝑎
=
𝐸𝐶𝐶𝑀 − 𝐸𝐶𝐶𝑎 𝐸𝐶𝐶𝑏 − 𝐸𝐶𝐶𝑎 a

𝐸𝐶𝐶𝑎 𝑬𝑪𝑪𝑴 𝐸𝐶𝐶𝑏


Alors:
𝐸𝐶𝐶𝑀 − 𝐸𝐶𝐶𝑎
𝑀𝑒 = 𝑎 + × (𝑏 − 𝑎)
𝐸𝐶𝐶𝑏 − 𝐸𝐶𝐶𝑎
𝑁 𝑁+1
𝐸𝐶𝐶𝑀 = 𝑠𝑖 𝑁 𝑒𝑠𝑡 𝑝𝑎𝑖𝑟 𝑜𝑢 𝑠𝑖𝑛𝑜𝑛
2 2
50
Chapitre 3: Indicateurs Statistiques
Indicateurs de tendance centrale et de position
Les moyennes
La moyenne arithmétique

• C’est un indicateur de tendance centrale qui concerne uniquement les


variables quantitatives.
• La moyenne arithmétique ou moyenne empirique d'une série statistique
est la moyenne ordinaire, elle est définie par la somme des valeurs de 𝑥𝑖
divisée par l’effectif total.
Exemple : la note moyenne d’une classe d’étudiants.
• Sa formule est donnée suivant la nature du caractère étudié.

51
Chapitre 3: Indicateurs Statistiques
Indicateurs de tendance centrale et de position
Les moyennes
La moyenne arithmétique
Cas d’un caractère quantitatif discret: série simple
• La moyenne arithmétique est donnée par la formule:
𝑛
 𝑖 =1 𝑥𝑖
Moy (𝑥) =
𝑁
Avec N est l’effectif total
• Exemple:
Soit les notes obtenues par 5 étudiants lors d’un examen : 18 9 14 6 13
18 + 9 + 14 + 6 + 13 = 12
Moy (x) =
5
52
Chapitre 3: Indicateurs Statistiques
Indicateurs de tendance centrale et de position
Les moyennes
La moyenne arithmétique
Cas d’un caractère quantitatif discret: série pondérée
• Dans le cas de données groupées, la moyenne arithmétique pondérée
du caractère X est égale à la somme pondérée des observations
rapportées à l’effectif total : 𝑛
 𝑖 =1 𝑛𝑖 × 𝑥𝑖
Moy (x)= 𝑥𝑖 𝑛𝑖
𝑁 8 6
• Exemple: 9 10
Soit la série des notes des étudiants avec leurs effectifs: 12 7
15 16
8 × 6 + 9 × 10 + 12 × 7 + 15 × 16 + 18 × 7 18 7
Moy ( x) = = 12,78 Total 46
46
53
Chapitre 3: Indicateurs Statistiques
Indicateurs de tendance centrale et de position
Les moyennes
La moyenne arithmétique
Cas d’un caractère quantitatif discret: série pondérée
• La moyenne arithmétique pondérée peut être donnée par la formule de
fréquences équivalente suivante:
𝑛
Moy (x) =  𝑖 =1 𝑓𝑖 × 𝑥𝑖

Justification
𝑛
 𝑖 =1𝑛 𝑖 ×𝑥 𝑖 𝑛 𝑛𝑖 𝑛
Moy (x)= =  𝑖 =1 × 𝑥𝑖 =  𝑖 =1 𝑓𝑖 × 𝑥𝑖
𝑁 𝑁

54
Chapitre 3: Indicateurs Statistiques
Indicateurs de tendance centrale et de position
Les moyennes
La moyenne arithmétique
Cas d’un caractère quantitatif continu
• dans le cas d’un caractère continu, nous remplaçons 𝑥𝑖 par 𝑐𝑖 qui
représente le centre des classes dans
𝑛
la formule
 𝑖 =1𝑛𝑖 × 𝑐𝑖
Moy (x)=
𝑁
𝑏𝑜𝑟𝑛𝑒 𝑖𝑛𝑓𝑒𝑟𝑖𝑒𝑢𝑟+𝑏𝑜𝑟𝑛𝑒 𝑠𝑢𝑝𝑒𝑟𝑖𝑒𝑢𝑟 salaires 𝑛𝑖 𝑐𝑖 𝑛𝑖 × 𝑐𝑖
Avec 𝑐 𝑖 =
2 [4500;5000[ 40 4750 190000
Exemple: [5000;6000[ 160 5500 880000
[6000;7000[ 100 6500 650000
Soit la répartition des salaires dans une entreprise
[7000;8000[ 60 7500 450000
2530000
Moy (x)= = 6325 [8000;10000[ 40 9000 360000
400 Total 400 2530000
55
Chapitre 3: Indicateurs Statistiques
Indicateurs de tendance centrale et de position
Les moyennes

• La moyenne géométrique
• La moyenne harmonique
• La moyenne quadratique

5656
Chapitre 3: Indicateurs Statistiques
Indicateurs de tendance centrale et de position
Les quantiles
• les quantiles (ou les percentiles) sont les valeurs qui divisent une série de données
en intervalles contenant le même nombre de données.
• le quantile d'ordre α (0 ≤ α ≤ 1) noté qα est la valeur de la variable telle que α%
des individus ont une modalité inférieure ou égale à qα. En d’autres termes (100 -
α)% des individus ont une valeur supérieure ou égale à qα.
• Nous allons introduire alors les quantiles les plus utilisés, à savoir, les quartiles,
les déciles et les centiles, avant de spécifier leur méthode de calcul.

57
Chapitre 3: Indicateurs Statistiques
Indicateurs de tendance centrale et de position
Les quantiles
1. Les quartiles
• un quartile est chacune des 3 valeurs qui divisent les données triées en 4 parts
égales, de sorte que chaque partie représente 1/4 de l'échantillon de population.
Le quartile inférieur est la valeur du milieu du premier ensemble, dans lequel
25% des valeurs sont inférieures à 𝑄1 et 75 % lui sont supérieures. Le premier
quartile prend la notation 𝑄1 .
Le quartile supérieur est la valeur du milieu du deuxième ensemble, dans lequel
75 % des valeurs sont inférieures à 𝑄3 et 25 % lui sont supérieures. Le troisième
quartile prend donc la notation 𝑄3.
La médiane divise les données en deux ensembles égaux. Il convient de noter que
la médiane prend la notation 𝑄2, c'est-à-dire le deuxième quartile.

58
Chapitre 3: Indicateurs Statistiques
Indicateurs de tendance centrale et de position
Les quantiles
1. Les quartiles

59
Chapitre 3: Indicateurs Statistiques
Indicateurs de tendance centrale et de position
Les quantiles
1. Les quartiles: cas d’un caractère discret
• Comment trouver 𝑄1?
 𝑛𝑖
On cherche la 1ère valeur de ECC plus grande que
4
• Comment trouver 𝑄2?
 𝑛𝑖
On cherche la 1ère valeur de ECC plus grande que
2
• Comment trouver 𝑄3?
 𝑛 ×3
𝑖
On cherche la 1ère valeur de ECC plus grande que 4

60
Chapitre 3: Indicateurs Statistiques
Indicateurs de tendance centrale et de position
Les quantiles
1. Les quartiles: cas d’un caractère discret
• Exemple1:
𝑥𝑖 𝑛𝑖 ECC
• On calcule 𝑄1:
200 1 40 40
On a = 50 ; On cherche dans ECC la 1ère valeur plus grande que 50 2 80 120
4
C’est 120; donc 𝑄1 = 2 3 60 180
• On calcule 𝑄2: 4 20 200
200
On a = 100 ; On cherche dans ECC la 1ère valeur plus grande que 100 Total 200
2
C’est 120; donc 𝑄2 = 2 (PS: on cherche la médiane)
• On calcule 𝑄3:
3×200
On a = 150 ; On cherche dans ECC la 1ère valeur plus grande que 150
4
C’est 180; donc 𝑄3 = 3

61
Chapitre 3: Indicateurs Statistiques
Indicateurs de tendance centrale et de position
Les quantiles
1. Les quartiles: cas d’un caractère continu
• Comment trouver 𝑄1, 𝑄2 et 𝑄3?
𝑛
𝑖
− 𝐸𝐶𝐶𝑖 −1
𝑄1 = 𝐵0 + 𝑎𝑖 × 4
𝑛𝑖  𝑛𝑖
− 𝐸𝐶𝐶𝑖 −1
𝑄2 = 𝐵0 + 𝑎𝑖 × 2
𝑛𝑖
 𝑛𝑖 ×3
− 𝐸𝐶𝐶𝑖 −1
𝑄3 = 𝐵0 + 𝑎𝑖 × 4
𝑛𝑖
Avec; 𝐵0: borne inferieur de la classe de 𝑄1, 𝑄2 ou 𝑄3
𝑎𝑖: amplitude de la classe de 𝑄1 , 𝑄2 ou 𝑄3
𝐸𝐶𝐶𝑖−1:ECC de la classe avant la classe de 𝑄1 , 𝑄2 ou 𝑄3
𝑛𝑖: effectif de la classe de 𝑄1 , 𝑄2 ou 𝑄3
62
113
Chapitre 3: Indicateurs Statistiques
Indicateurs de tendance centrale et de position
Les quantiles
1. Les quartiles: cas d’un caractère continu
• Exemple1:
• On calcule 𝑄1: Tranches
80 20−10 d’investissement
On a = 20 alors 𝑄1 = 300 + 100 × =355,56 en 1000dh
𝑛𝑖 ECC
4 18
𝑥𝑖
25% ont un investissement inferieur à 355560 dh
[200;300[ 10 10
75% ont un investissement supérieur à 355560 dh
[300;400[ 18 28
• On calcule 𝑄2: [400;500[ 30 58
80 40−28
On a = 40 alors 𝑄2 = 400 + 100 × =450 [500;600[ 12 70
2 30
[600;700[ 6 76
𝑄2=450000 dh est la médiane
[700;800[ 4 80
• On calcule 𝑄3:
Total 80
3×80 60−58
On a = 60 alors 𝑄3 = 500 + 100 × =516,67
4 12
75% ont un investissement inferieur à 516670 dh et 25% ont un investissement supérieur à
516670 dh 63
114
Chapitre 3: Indicateurs Statistiques
Indicateurs de tendance centrale et de position
Les quantiles
2. Les déciles
• Les déciles sont des indicateurs de position qui partagent les observations en 10
groupes d’effectifs égaux.
• Les déciles sont les 9 valeurs notés : D1, D2….D9
• Ceci dit, 10%, 20%,...90% des individus ont une valeur de la variable inférieure à
D1, D2….D9 respectivement.

64
Chapitre 3: Indicateurs Statistiques
Indicateurs de tendance centrale et de position
Les quantiles
2. Les déciles

D1 D2 D3 D9

10% 10% 10% … 10%

Décile 1 ou D1 10% 90%

65
Chapitre 3: Indicateurs Statistiques
Indicateurs de tendance centrale et de position
Les quantiles
2. Les déciles: cas d’un caractère discret
• Comment trouver 𝐷1?
 𝑛
𝑖
On cherche la 1ère valeur de ECC plus grande que 10
• Comment trouver 𝐷9?
𝑛 𝑖 ×9
On cherche la 1ère valeur de ECC plus grande que
10

66
Chapitre 3: Indicateurs Statistiques
Indicateurs de tendance centrale et de position
Les quantiles
2. Les déciles: cas d’un caractère discret
• Exemple1:
𝑥𝑖 𝑛𝑖 ECC
• On calcule 𝐷1:
200 1 40 40
On a = 20 ; On cherche dans ECC la 1ère valeur plus 2 80 120
10
3 60 180
grande que 20. C’est 40; donc 𝐷1 = 1
4 20 200
• On calcule 𝐷9: Total 200
9×200
On a = 180 ; On cherche dans ECC la 1ère valeur plus grande que 180
10
C’est 180; donc 𝐷9 = 3

67
Chapitre 3: Indicateurs Statistiques
Indicateurs de tendance centrale et de position
Les quantiles
2. Les déciles: cas d’un caractère continu
• Comment trouver 𝐷1et 𝐷9?
𝑛 𝑖
− 𝐸𝐶𝐶𝑖 −1
𝐷1 = 𝐵0 + 𝑎𝑖 × 10
𝑛𝑖
 𝑛𝑖
×9
𝐷9 = 𝐵0 + 𝑎𝑖 × 10 − 𝐸𝐶𝐶𝑖 −1
𝑛𝑖
Avec; 𝐵0: borne inferieur de la classe de 𝐷1ou 𝐷9
𝑎𝑖: amplitude de la classe de 𝐷1ou 𝐷9
𝐸𝐶𝐶𝑖−1:ECC de la classe avant la classe de 𝐷1ou 𝐷9
𝑛𝑖: effectif de la classe de 𝐷1ou 𝐷9

68
Chapitre 3: Indicateurs Statistiques
Indicateurs de tendance centrale et de position
Les quantiles
2. Les déciles: cas d’un caractère continu
• Exemple1:
• On calcule 𝐷1: Tranches
80 8−0 d’investissement
On a = 8 alors 𝐷1 = 200 + 100 × =280 en 1000dh
𝑛𝑖 ECC
10 10
𝑥𝑖
10% ont un investissement inferieur à 280000 dh
[200;300[ 10 10
90% ont un investissement supérieur à 280000 dh
[300;400[ 18 28
• On calcule 𝐷9: [400;500[ 30 58
9×80 72−70
On a = 72 alors 𝐷9 = 600 + 100 × =633,33 [500;600[ 12 70
10 6
[600;700[ 6 76
90% ont un investissement inferieur à 633330 dh et
[700;800[ 4 80
10% ont un investissement supérieur à 633330 dh
Total 80

69
Chapitre 3: Indicateurs Statistiques
Indicateurs de tendance centrale et de position
Les quantiles
3. Les centiles
• Les centiles sont des indicateurs de position qui partagent les observations en 100
groupes d’effectifs égaux.
• Les centiles sont les 99 valeurs notés : C1, C2….C99. Ceci dit, 1%, 2%, 3%
….99%, des individus ont une valeur de la variable inférieure à notés : C1,
C2….C99 respectivement.
• On procède de la même manière qu’auparavant pour trouver les centiles.

70
Chapitre 3: Indicateurs Statistiques
Indicateurs de tendance centrale et de position
Caractéristiques et formes d’une série statistique

• La moyenne, le mode et la médiane comme indicateurs


de tendance centrale nous renseignent sur l’ordre de
grandeur d’une série statistique et sur la forme qu’elle
prend.
• Statistiquement, une distribution peut être symétrique
ou asymétrique (oblique).

71
Chapitre 3: Indicateurs Statistiques
Indicateurs de tendance centrale et de position
Caractéristiques et formes d’une série statistique
1. Distribution symétrique
• Dans le cas d’une distribution symétrique, la moyenne,
le mode et la médiane ont les mêmes valeurs, et les
observations sont également dispersées par rapport à
ces valeurs centrales.
• Sa forme est représentée comme suit:

M0 = moy(x) = Mé 72
Chapitre 3: Indicateurs Statistiques
Indicateurs de tendance centrale et de position
Caractéristiques et formes d’une série statistique
2. Distribution asymétrique
• Si la distribution n’est pas symétrique, elle est asymétrique ou oblique.
•L’obliquité ou l’inclinaison se repère du côté de
la décroissance la plus forte.
•La distribution peut être oblique à gauche
(étalée vers la droite) comme dans le graphique:
• Dans ce cas, le mode est inférieur strictement à
la médiane qui est de même par rapport à la
moyenne arithmétique.
124
73
Chapitre 3: Indicateurs Statistiques
Indicateurs de tendance centrale et de position
Caractéristiques et formes d’une série statistique
2. Distribution asymétrique
• La distribution peut être aussi oblique à droite (étalée vers la
gauche) comme dans le graphique ci-dessous.
•Le mode est supérieur strictement à la médiane
qui est de même par rapport à la moyenne
arithmétique.

74
125
Chapitre 3: Indicateurs Statistiques
Indicateurs de tendance centrale et de position
Caractéristiques et formes d’une série statistique
3. Coefficient d’asymétrie
• Au lieu de dessiner la courbe qui représente les fréquences relatives
afin d'en déduire si la distribution est symétrique, oblique à droite
ou oblique à gauche, nous pouvons calculer le coefficient de Yule
et Kendall.
• Ce coefficient est égal à:
𝑄3+𝑄1−2𝑄2
Q1, Q2, Q3 représentent les quartiles
𝑄3−𝑄1
Le coefficient de Yule et Kendall est compris entre -1 et 1, son
interprétation est la suivante :
 0 : la distribution est symétrique.
 > 0 : la distribution est étalée vers la droite. (𝑀0 < 𝑀𝑒 < moy(𝑥))
 < 0 : la distribution est étalée vers la gauche. (𝑀0 > 𝑀𝑒 > moy(𝑥))
75
Chapitre 3: Indicateurs Statistiques
Indicateurs de tendance centrale et de position
Boite à moustaches
• Il est possible de résumer, sous la forme d'un graphique,
certains paramètres d'une série statistique qui sont les trois
quartiles et les intervalles qui les séparent.
• Ce graphique porte le nom de boîte à moustaches , ou encore
de boîte à pattes ou diagramme en boîte (boxplot en anglais).
• Sur un axe, on place le minimum et le maximum de la série,
le premier quartile, le troisième quartile et la médiane, puis
on construit parallèlement à l'axe un rectangle (une boîte) de
longueur l'interquartile (compris entre 𝑄1et 𝑄3) et de largeur
arbitraire.
76
Chapitre 3: Indicateurs Statistiques
Indicateurs de tendance centrale et de position
Boite à moustaches

• Dans les parties gauche et droite du graphique figurent les


«moustaches». On trace les moustaches à droite et à gauche sur la
base des valeurs minimales et maximales de la distribution
• On définit également les frontières de la boite (les limites inferieure
et supérieure de la boite) qui sont calculées comme suit:
Limite inférieure = Q1 - 1,5 * (Q3-Q1)
Limite supérieure = Q3 + 1,5 * (Q3-Q1)
77
Chapitre 3: Indicateurs Statistiques
Indicateurs de tendance centrale et de position
Boite à moustaches

• Les valeurs maximales et minimales ne doivent pas dépasser


les limites (frontières). Sinon, elles seront considérées comme
des valeurs aberrantes. Dans ce cas, on retiendra les valeurs :
minimale et maximale qui entrent dans les frontières.
• Ce diagramme est utilisé principalement pour comparer un
même caractère dans deux populations de tailles différentes.
78
Chapitre 3: Indicateurs Statistiques
Indicateurs de tendance centrale et de position
Boite à moustaches
• Exemple:
• Soit une variable statistique X dont le maximum est 55, le
minimum 20, la médiane 38, le premier quartile 32 et le
troisième quartile 45, on construit alors le diagramme en
boîte suivant :

79
Chapitre 3: Indicateurs Statistiques
Indicateurs de dispersion
• Les indicateurs de tendance centrale comme la moyenne
donnent une indication du milieu de la série mais ne disent
rien sur la dispersion des valeurs autour de la tendance
centrale.
• Les indicateurs de dispersion caractérisent numériquement la
manière dont les observations s’écartent les unes des autres,
comment les observations s’écartent d’un indicateur de
tendance centrale.
• Leur utilité se concrétise surtout lorsqu’on a deux
distributions qui peuvent être différentes tout en ayant des
caractéristiques de tendance centrale proches.
80
Chapitre 3: Indicateurs Statistiques

Indicateurs de dispersion

• Exemple: deux étudiants A et B ayant 3 notes; A(2, 10, 18) et


B(9, 10, 11)
𝑥𝐴 = 10 ; 𝑥𝐵 = 10 ; 𝑀𝑒𝐴 = 10 ; 𝑀𝑒𝐵 = 10
En regardant les notes, on peut dire que le comportement de
l’étudiant A est diffèrent du comportement de l’étudiant B
(régulier) même s’ils ont la même moyenne. Il faut alors faire
attention à comment les notes sont dispersées autour de la
moyenne.

81
Chapitre 3: Indicateurs Statistiques
Indicateurs de dispersion
Etendue
• L’étendue (noté e) est la différence entre la plus grande valeur
et la plus petite valeur des observations.
• Sa formule est la suivante :
e = Xmax − Xmin
• L’étendue est simple à calculer mais elle ne fournit qu’une
information limitée sur le calcul de la variante.
• L'étendue permet de voir si la série statistique est concentrée
(étendue faible), ou au contraire étendue (étendue grande).

82
Chapitre 3: Indicateurs Statistiques
Indicateurs de dispersion
Etendue
• Exemple: cas d’un caractère discret
• Exemple de nombre de frères et sœurs d’un groupe de
personnes
• L’Etendue est: 𝑥𝑖 𝑛𝑖
1 40
e = Xmax − Xmin = 4 – 1= 3
2 80
4 est la plus grande valeur du caractère 𝑥i 3 60
1 est la plus petite valeur du caractère 𝑥i 4 20
Total 200

83
Chapitre 3: Indicateurs Statistiques
Indicateurs de dispersion
Etendue
• Exemple: cas d’un caractère continu Tranches
d’investissem
• L’Etendue est: ent en 𝑛𝑖
e = Xmax − Xmin = 800 – 200= 600 1000dh
xi
800 est la plus grande valeur du caractère 𝑥i [200;300[ 10
200 est la plus petite valeur du caractère 𝑥i [300;400[ 18
[400;500[ 30
[500;600[ 12
[600;700[ 6
[700;800[ 4
Total 80
84
Chapitre 3: Indicateurs Statistiques
Indicateurs de dispersion
intervalle interquartile

• L’intervalle interquartile est l’intervalle [Q1 , Q3 ] et il


contient 50% des observations.

85
Chapitre 3: Indicateurs Statistiques
Indicateurs de dispersion
Ecart interquartile
• L’écart interquartile (noté EI) est un indicateur de dispersion,
qui peut être utilisé pour illustrer la boîte à moustache, et qui
n’est pas dépendant des valeurs extrêmes.
• Sa formule est la suivante :
EI = Q3 − Q1
• Notons qu’on utilise parfois l'écart semi-interquartile qui peut
être calculé selon la formule suivante : (Q3 − Q1)/2.
• Plus l'écart interquartile est petit, plus les valeurs centrales de
la série se concentrent autour de la médiane.
86
Chapitre 3: Indicateurs Statistiques
Indicateurs de dispersion
Ecart absolu
1. Ecart absolu moyen

87
Chapitre 3: Indicateurs Statistiques
Indicateurs de dispersion
Ecart absolu
1. Ecart absolu moyen

88
Chapitre 3: Indicateurs Statistiques
Indicateurs de dispersion
Ecart absolu
2. Ecart absolu médian
• L’écart absolu médian est la moyenne arithmétique des
valeurs absolues des écarts de toutes les observations à la
médiane.
• Sa formule est la suivante :
σ 𝒏𝒊=𝟏 |𝒙𝑖 − 𝑴𝒆|
• Cas d’une série non pondérée : 𝐸𝐴𝑀𝑒 =
n
𝒊=𝟏 𝒏𝒊×|𝒙𝑖 − 𝑴𝒆|
σ𝒏
• Cas d’une série pondérée : 𝐸𝐴𝑀𝑒 = 𝒏
σ 𝒊=𝟏 𝒏𝒊
• Dans le cas d’un caractère continu, on utilise 𝑐𝑖 (centre de
l’intervalle) à la place de 𝑥𝑖.
89
Chapitre 3: Indicateurs Statistiques
Indicateurs de dispersion
Variance
• La variance est une mesure de l'étalement équivalant au carré
moyen de l'écart de chaque nombre par rapport à la moyenne
arithmétique d'un ensemble de données.( notée Vx, ou 𝑠2 ou 𝜎 2 )
• Elle est utile comme une mesure pour comparer le degré de
dispersion de plusieurs populations selon la même variable
exprimée dans la même unité.
• Il faut noter que les unités associées à la variance sont élevées
au carré, ce qui rend difficile son interprétation.
• L’interprétation que nous pouvons lui donner est que la
population qui a la plus grande variance a la plus grande
dispersion.
90
Chapitre 3: Indicateurs Statistiques
Indicateurs de dispersion
Variance

91
Chapitre 3: Indicateurs Statistiques
Indicateurs de dispersion
Ecart type

• Pour obtenir un indicateur de dispersion absolue, l’écart-type est


calculé en utilisant la variance.
• L'écart-type mesure donc la dispersion autour de la moyenne.
• L'écart-type (noté σ ou s) correspond à la racine carrée de la
variance, comme dans la formule :
𝜎 = 𝑉𝑥

92
Chapitre 3: Indicateurs Statistiques
Indicateurs de dispersion
Ecart type
• L'écart-type est aussi utile quand on compare la dispersion de
deux ensembles de données séparés qui ont approximativement
la même moyenne.
• L'écart-type est zéro si toutes les valeurs d'un ensemble de
données sont les mêmes (parce que chaque valeur est égale à la
moyenne).
• L’écart type est ainsi plus facilement comparable et interprétable
que la variance, puisqu’il est mesuré dans les mêmes unités que
les données.

93
Chapitre 3: Indicateurs Statistiques
Indicateurs de concentration
• En complément des indicateurs de tendance centrale et de
position et des indicateurs de dispersion, il est parfois
intéressant de calculer les indicateurs de concentration.
• En fait, les indicateurs de concentration sont des indicateurs
qui mesurent le degré d’inégalité dans la répartition de la
somme des observations.
• La mesure de la concentration concerne les caractères
statistiques quantitatives représentant une valeur positive
cumulable (salaire, revenu, l’impôt, chiffres d’affaires,
superficie …).

94
Chapitre 3: Indicateurs Statistiques
Indicateurs de concentration
• On considère une série d'individus dont on étudie un
caractère quantitatif prenant les valeurs 𝑥1, 𝑥2, … , 𝑥𝑝
• On s'intéresse au problème suivant : existe-t-il un groupe
d'individus possédant une part de la masse nettement
supérieure à son poids démographique?
• Par exemple un groupe ayant 60% de la masse totale (la
masse salariale d'une entreprise par exemple) alors que son
effectif n'est que de 30% de l'effectif total.
• Dans ce cas peu d'individus (30%) ont beaucoup (60% de la
masse salariale) ou beaucoup d'individus (70%) ont peu (40%
de la masse salariale) : on parle alors de concentration.
95
Chapitre 3: Indicateurs Statistiques
Indicateurs de concentration
• Un autre exemple concerne une observation d’une
distribution des ménages avec leurs revenus, on serait tenté
de comparer les deux distributions pour voir si elles évoluent
de la même manière.
• Si 30% des ménages détiennent 30% du total des revenues
alors les revenus sont équitablement réparties.
• Par contre, si 30% des ménages détiennent 80% des revenus
alors les revenus sont très inéquitablement réparties
(inégalités).
• La concentration peut se caractériser soit par un procédé
graphique (courbe de Lorenz), soit par le calcul d’un indice
(Indice de Gini).
96
Chapitre 3: Indicateurs Statistiques
Indicateurs de concentration
Courbe de Lorenz

• Pour obtenir une Présentation graphique mettant en évidence


la concentration, l’idée est de travailler avec les fréquences
cumulées et les agrégats cumulés (selon la variable étudiée).
• Sur les abscisses (axe OX), on porte les fréquences cumulées
croissantes en % des individus de chaque classe 𝐹𝐶𝐶%
• Sur les ordonnés (axe OY), on porte les fréquences cumulées
croissantes en % des masses FCC𝑛𝑖𝑥𝑖 %
𝑛i 𝑛i𝑥i
• Remarque : f i = et f 𝑛 𝑖 𝑥 𝑖 =
𝑁  𝑛i𝑥i

97
Chapitre 3: Indicateurs Statistiques
Indicateurs de concentration
Courbe de Lorenz
f𝑛𝑖𝑥𝑖
D
C
On obtient donc le
carré ABCD qui
porte le nom de
« carré de Gini »
NB: La courbe de
Lorenz est
toujours en
dessous de la fi

bissectrice. A B
98
Chapitre 3: Indicateurs Statistiques
Indicateurs de concentration
Courbe de Lorenz

99
Chapitre 3: Indicateurs Statistiques
Indicateurs de concentration
Courbe de Lorenz
• La bissectrice représente la répartition égalitaire : par exemple 20% de la
population détient 20% des revenus, 60% en détient 60% des revenus, etc.
• Si la courbe est confondue avec la première bissectrice, la répartition est
donc parfaitement égalitaire
• Si cette courbe s’en éloigne, l’inégalité s’accroît. En d’autres termes, plus la
courbe est proche de la diagonale, plus la répartition de la variable étudiée
tend à être égalitaire.
• Ceci suggère d’utiliser l’aire de concentration, comprise entre la courbe et
la bissectrice comme indicateur d’inégalité.
• On peut comparer la concentration de deux populations ou plus, selon la
même variable en représentant sur le même graphique leur courbe de
Lorenz.
• On peut aussi comparer la concentration de deux variables, par rapport à la
même population.
Chapitre 3: Indicateurs Statistiques
Indicateurs de concentration
Courbe de Lorenz

• Comment quantifier l'éloignement de la courbe de Lorenz de la


droite d'Egalité?

⇒ Indice de Gini G

101
Chapitre 3: Indicateurs Statistiques
Indicateurs de concentration
Indice de Gini
• L’indice de Gini (noté G) constitue un indicateur, ou une mesure
synthétique de la concentration des données.
• C’est le rapport de l'aire de la surface de concentration (délimité
par la courbe de Lorenz et la bissectrice) à l'aire de la surface du
triangle rectangle (délimité par la bissectrice et l'axe des
abscisses)
𝐴𝑖𝑟𝑒 𝑑𝑒 𝐶𝑜𝑛𝑐𝑒𝑛𝑡𝑟𝑎𝑡𝑖𝑜𝑛
G=
𝐴𝑖𝑟𝑒 𝑑𝑢 𝑡𝑟𝑖𝑎𝑛𝑔𝑙𝑒
1 100%×100%
• Or, l’aire du Triangle est égale à (aire = )
2 2
• D’où : G = 2 × 𝐴𝑖𝑟𝑒 𝑑𝑒 𝐶𝑜𝑛𝑐𝑒𝑛𝑡𝑟𝑎𝑡𝑖𝑜𝑛
102
Chapitre 3: Indicateurs Statistiques
Indicateurs de concentration
Indice de Gini
• L’indice G varie entre 0 et 1.
• Si G est proche de 0, la courbe de Lorenz est proche de la
bissectrice, donc la concentration est faible.
• La concentration nulle (G=0) correspond à une distribution
égalitaire.
• Si G est proche de 1, la concentration est forte.

103

Vous aimerez peut-être aussi