0% ont trouvé ce document utile (0 vote)
4 vues16 pages

Cours Stat

Le document présente une introduction à la statistique, divisée en statistique descriptive et statistique mathématique, et définit des concepts clés tels que population, individu, échantillon, et variable statistique. Il aborde également la statistique unidimensionnelle, en se concentrant sur les variables quantitatives discrètes, et décrit la construction de tableaux statistiques ainsi que les représentations graphiques des données. Enfin, il explique les notions d'effectif, de fréquence, et de fonction de répartition.

Transféré par

kariganouradinehassan
Copyright
© All Rights Reserved
Nous prenons très au sérieux les droits relatifs au contenu. Si vous pensez qu’il s’agit de votre contenu, signalez une atteinte au droit d’auteur ici.
Formats disponibles
Téléchargez aux formats PDF, TXT ou lisez en ligne sur Scribd
0% ont trouvé ce document utile (0 vote)
4 vues16 pages

Cours Stat

Le document présente une introduction à la statistique, divisée en statistique descriptive et statistique mathématique, et définit des concepts clés tels que population, individu, échantillon, et variable statistique. Il aborde également la statistique unidimensionnelle, en se concentrant sur les variables quantitatives discrètes, et décrit la construction de tableaux statistiques ainsi que les représentations graphiques des données. Enfin, il explique les notions d'effectif, de fréquence, et de fonction de répartition.

Transféré par

kariganouradinehassan
Copyright
© All Rights Reserved
Nous prenons très au sérieux les droits relatifs au contenu. Si vous pensez qu’il s’agit de votre contenu, signalez une atteinte au droit d’auteur ici.
Formats disponibles
Téléchargez aux formats PDF, TXT ou lisez en ligne sur Scribd

Université: S.B.

Constantine 3
Faculté de Médecine
Département de Pharmacie
Module: Biomaths, 1 ere année

Part I
STATISTIQUE
La statistique s’applique à la plupart des disciplines: médecine, agronomie,
biologie, démographie, économie, sociologie, linguistique, psychologie, industrie
etc . . .
L’étude de la statistique a été divisée en deux parties:
La statistique descriptive, qui est un ensemble de méthodes permettant de
décrire les unités statistiques qui composent une population.
La statistique mathématique dont l’objet est de formuler des lois à partir de
l’observation d’échantillons,. La statistique mathématique intervient dans les
enquêtes et les sondages. Elle s’appuie sur la statistique descriptive, ainsi que
sur les probabilités pour formuler des lois à partir de l’observation d’échantillons.

1 STATISTIQUE DESCRIPTIVE
1.1 Dé…nitions de base
De…nition 1 La Statistique est une méthode qui consiste à réunir des données
chi¤ rées sur des ensembles nombreux, puis à les analyser, à les interpréter, à
les commenter, à les critiquer et à tirer des conclusions pour prendre la décision
qu’il faut.

On donne aussi un certain nombre de termes statistiques qui seront utilisés


par la suite.
Population: est l’ensemble concerné par une étude statistique.
Individu (ou unité statistique): désigne tout élément de la population
considérée.
Echantillon: dans une étude statistique, il est fréquent que l’on n’observe
pas toute la population.
L’échantillon est le sous-ensemble de la population sur lequel sont e¤ ective-
ment réalisées les observations.
Taille de l’échantillon: c’est le nombre d’individus qu’il contient. (En
général, on note la note par n)
Enquête (statistique): c’est l’ opération consistant a observer l’ensemble
des individus d’un échantillon.
Recensement: (enquête exhaustive) enquête dans laquelle l’échantillon
observé est en fait toute la population.

1
Sondage (enquête non exhaustive): enquête dans laquelle l’échantillon
observé est un sous-ensemble strict de la population.
Variable statistique: c’est une caractéristique, dé…nie sur la population
et observée sur l’échantillon.
Mathématiquement: Une variable statistique est une application dé…nie sur
l’échantillon.
Modalités: sont les di¤ érentes valeurs que peut prendre par la variable
statistique.
On distinguera deux types de variables statistiques:
1 Variables qualitatives: sont celles prenant des valeurs non numériques
(les modalités sont des catégories).
2 Variables quantitatives: sont celles prenant des valeurs numériques.
Données: c’ est l’ensemble des variables considérées et ces observations
sur les individus.
Les données sont en général présentées sous forme de tableaux (individus en
lignes et variables en colonnes) .

1.2 Langage probabiliste et langage statistique

Probabilités Statistique
Espace fondamental Population
Epreuve Tirage (d’un individu), expérimentation
Evènement élémentaire Individu, observation
Variable aléatoire Variable, caractère
Epreuves répétées Echantillonnage
Nombre de répétitions d’une épreuve Taille de l’échantillon, e¤ectif total
Probabilité Fréquence observée
Loi de probabilité Distribution observée ou loi empirique
Espérance mathématique Moyenne observée
Variance mathématique Variance observée
Example 2 On considère l’ensemble des étudiants de la faculté de médecine
dans une université. On s’intéresse aux nombre d’enfants dans la famille de
chaque étudiant. Dans ce cas
La population est = ensemble des étudiants de la faculté.
Individu: tout étudiant inscrit à la faculté.
La variable statistique X désigne le nombre d’enfants, donc elle quantitative
et prend ces valeurs dans
X ( ) = f0; 1; 2; 3; 4; :::g
Echantillon: on prend par exemples les étudiants de première année du
département de pharmacie.
Taille de l’échantillon est l’e¤ ectif des étudiants de première année du dé-
partement de pharmacie.
Si on fait l’étude sur tous les étudiants de faculté, on parle de recensement.

2
1.3 Statistique unidimensionnelle
On considère ici une seule variable statistique, notée X.
Dans cette section, nous présenterons successivement les cas d’une variable
quantitative discrète, quantitative continue, et en …n qualitative.

1.3.1 Variable quantitative discrète


On introduit tout d’abord la notion de tableau statistique: commençons par
arranger les données par ordre croissant. Ce tableau fait intervenir les notions
d’e¤ectif, de fréquence, d’e¤ectif cumulé et de fréquence cumulée.
Les représentations graphiques usuelles de ces variables sont le diagramme
en bâtons et le diagramme cumulatif. En …n, les caractéristiques numériques
permettant de résumer une variable discrète sont soit de tendance centrale, soit
de dispersion.

De…nition 3 on appelle variable quantitative discrète toute variable quantita-


tive ne prenant que des valeurs entières

1.3.2 Présentation des données:


Tableau statistique Pour construire le tableau statistique, il faut dé…nir:
l’e¤ectif partiel, l’e¤ectif cumulé, la fréquence et la fréquence cumulé.
Soit X une variable quantitative discrète. avec X ( ) = fx1 ; x2 ; :::; xn g.
Supposons que ces observations sont arrangées de l’ordre croissant.

De…nition 4 (e¤ ectif ). On associe pour tout xi de , le nombre d’observations


de xi (noté ni ). ni est dit e¤ ectif partiel de xi : ou tout simplement e¤ ectif de
xi : i:e
ni = Card f! 2 ; X (!) = xi g
C’est le nombre d’individus qui ont la même valeur xi .
Le nombre n dé…nie par
Pi
n= ni
j=1

est dit e¤ ectif total (c’est la somme de tous les e¤ ectifs partiels).

De…nition 5 (e¤ ectif cumulé") On appelle e¤ ectif cumulé croissant de xi ; le


nombre Ni " dé…nie par
Pi
Ni "= ni
j=1

C’est la somme de toutes les observations des valeurs qui sont inférieurs ou
égal à la valeur considérées.

3
De…nition 6 (e¤ ectif cumulé#) On appelle e¤ ectif cumulé décroissant de xi ; le
nombre noté Ni # dé…nie par
P
n
Ni #= nj
j=i

C’est la somme de toutes les observations des valeurs qui sont supérieurs ou
égal à xi .

Remark 7 si nous avons k modalités, alors on a

N1 "= n1 ; Nk "= n et Nk #= nk; N1 #= n

De…nition 8 (fréquence) On appelle fréquence relative (ou tout simplement


fréquence) de xi , la quantité fi dé…nie par
ni
fi =
n
i:e La fréquence d’une valeur est le rapport de l’e¤ ectif de cette valeur par
l’e¤ ectif total.

Remark 9 si nous avons k modalités, alors pour tout i = 1; 2; :::; n; on a

P
k
0 fi 1 et fi = 1:
i=1

Car
P
k ni
0 ni nj = n () 0 1 () 0 fi 1:
j=1 n
Et
P
k Pk n
i 1 Pk n
fi = = ni = = 1
i=1 i=1 n n i=1 n

De…nition 10 (fréquence cumulé#) On appelle fréquence cumulée croissante


(resp. décroissante) de xi , la quantité Fi " (resp. Fi #) dé…nie par

Ni " Pi
Fi "= = fj
n j=1

C’est la somme de toutes les fréquences relatives des valeurs qui sont in-
férieurs ou égal à la valeur considérées.
(resp. par)
Ni # Pn
Fi #= = fj
n j=i

C’est la somme de toutes les fréquences relatives des valeurs qui sont supérieurs
ou égal à la valeur considérées.

4
Remark 11 Si nous avons k catégories d’observations, alors on a

F1 "= f1 ; Fk "= 1 et Fk #= fk; F1 #= 1

Remark 12 Si on dit e¤ ectif cumulé (resp. fréquence cumulée) sans préciser


l’accroissement, on parle à l’e¤ ectif cumulé croissant (resp. fréquence cumulée
croissante).

De…nition 13 (fonction de répartition) Les fréquences cumulées sont représen-


tées au moyen de la fonction de répartition F , dé…nie de R dans [0; 1] pour
i = 1; 2; :::; k; par
8
>
> 0; si x < x1
>
> F1 ; si x1 x < x2
>
>
>
> ..
>
>
< .
F (x) = Fi ; si xi x < xi+1
>
> ..
>
>
>
> .
>
>
> Fk 1 ;
> si xk 1 x < xk
:
1; si x xk

De…nition 14 (tableau statistique) On appelle donc tableau statistique un tableau


dont la première colonne comporte l’ensemble des k observations distinctes et
ordonnées par ordre croissant de la variable X. Dans une seconde colonne, on
dispose, en face de chaque valeur xi , son e¤ ectif ni . Les e¤ ectifs sont souvent
remplacés par les fréquences.

Tableau de de distribution des e¤ectifs et fréquences cumulés

caractère xi e¤ ni fréq fi e¤ cum Ni " fréq cum Fi " e¤ cum Ni # fréq cum Fi #
x1 n1 f1 n1 f1 n 1
x2 n2 f2 n1 + n2 f1 + f2
.. .. .. .. .. .. ..
. . . . . . .
.. .. .. .. .. .. ..
. . . . . . .
ni Pi Pi P k P k
xi ni fi = N nj fj nj fj
j=1 j=1 j=i j=i
.. .. .. .. .. .. ..
. . . . . . .
.. .. .. .. ..
. . . . . nk 1 + nk fk 1 + fk
xk nk fk n 1 nk fk
T otal n 1

Example 15 On a noté l’âge des 50 employés d’une entreprise pharmaceutique.


Les données sont listées ci-dessous (il s’agit de données …ctives).
24; 26; 30; 24; 34; 40; 40; 24; 50; 59;

5
26; 33; 26; 50; 44; 34; 34; 34; 26; 44;
40; 40; 34; 26; 40; 26; 30; 30; 40; 30;
33; 33; 40; 50; 50; 33; 34; 40; 33; 44;
59; 40; 44; 50; 50; 50; 44; 59; 59; 40:
On résume ces données dans un tableau statistique avec valeurs observées, ef-
fectifs, e¤ ectifs cumulés croissant et décroissants, fréquences relatives, fréquences
cumulés croissants et décroissants.
xi ni Ni " Ni # fi Fi " Fi #
24 3 3 50 0; 06 0; 06 1; 00
26 6 9 47 0; 12 0; 18 0; 94
30 4 13 41 0; 08 0; 24 0; 82
33 5 18 37 0; 10 0; 34 0; 74
34 6 24 32 0; 12 0; 46 0; 64
40 10 34 26 0; 20 0; 66 0; 52
44 6 40 16 0; 12 0; 88 0; 32
50 6 46 10 0; 12 0; 92 0; 20
59 4 50 4 0; 08 1; 00 0; 08
T otal 50 1; 00

Représentations graphiques

Diagramme en bâtons Ce diagramme comporte donc un axe d’abscisses,


sur lequel …gurent les observations de la variable considérée, et un axe d’ordonnée,
sur lequel …gurent les e¤ectifs (ou les fréquences). En face de chaque observation
…gure un segment vertical sur l’axe des abscisses (un bâton), dont la hauteur
est proportionnelle à l’e¤ectif (ou à lafréquence) correspondant.

Example 16 F ig9 représente le diagramme en battons de la variable statistique


Précédente: "ages des employés".

F ig9 Diagramme en battons

6
Diagramme cumulatif. Le diagramme cumulatif est la représentation
graphique de la fonction de répartition (cumulative) de la variable statistique.
C’est une fonction en escalier

bornes d1 d2 d3 di dk dk+1
<a P1 = 0 p2 = f1 p3 = F2 pi = Fi 1 p k = Fk 1 pk = 1
a q1 = 1 q2 = 1 f1 q 3 = 1 F2 q i = 1 Fi 1 qk = 1 Fk 1 qk+1 = 0

Polygone Le polygone en e¤ectifs , e¤ectifs cumulés cumulées croissante


(resp. décroissante) est obtenu en traçant les points Mi (xi ; fi ) ; Ai (di ; Ni ") (resp.
Bi (di ; Ni #) et en interpolant linéairement entre ces points (F ig10; F ig11; F ig12).
Même chose pour les polygones des fréquences.

F ig10Polygone des e¤ectifs

; ;
F ig11 Polyg e¤,cum, croiss F ig12Polyg e¤,cum, décroiss

Example 17 Pour la série distribuée par ce tableau,

7
nous avons les polygones cumulés croissant et décroissant (F ig13).

F ig13:Polygones cumulés croissant et décroissant

1.3.3 Paramètres de position


Mode
De…nition 18 On appelle mode (dénoté M o) de la série statistique discrète, la
valeur de la variable statistique la plus fréquente. i:e: C’est la valeur qui a le
plus grand e¤ ectif (ou la plus grande fréquence).

Remark 19 Le mode d’une série statistique n’est pas forcément unique.

Remark 20 Le mode peut être trouvé pour tous les types de variable, quanti-
tative et qualitative.

Example 21 Dans l’exemple précédent, nous avons l’âge qui a le plus grand
e¤ ectif est 40; donc le mode de cette distribution est M o = 40:

Médiane La médiane, désignée par Me, est la valeur de la variable telle qu’il
y ait autant d’observations, en dessous d’elle qu’au-dessus ou, ce qui revient au
même, la valeur correspondant à 50% des observations.

De…nition 22 On appelle médiane (dénoté M e) d’une série statistique discrète


et ordonnée une valeur centrale qui divise la série en deux parties de même
e¤ ectif telle que la première partie contenant 50% des valeurs qui sont inférieur à
la médiane et la deuxième contenant 50% des valeurs supérieurs à cette médiane.

Remark 23 1) La médiane est la valeur de la série correspond à l’e¤ ectif cu-


mulé n2 ou la fréquence cumulé 21 :
2) la médiane est insensible aux valeurs extrêmes.

8
Détermination de la médiane: La médiane est une valeur centrale de
la série statistique obtenue de la manière suivante:
On trie la série statistique par ordre croissant des n valeurs observées.
Si n est impair:
M e = x n+1
2
n+1
C’est la 2 eme observation.
Si n est pair: n = 2k:
xk + xk+1
Me =
2
C’est la moyenne arithmétique des deux observations centrales.
Example 24 1) Avec la série observée suivante:

4; 1; 2; 2; 0; 4; 5; 3; 1; 2; 5
on obtient:

0; 1; 1; 2; 2; 2 ; 5; 3; 4; 4; 5
La médiane M e est la valeur qui se trouve au milieu de la série ordonnée
ci-dessus.
n = 11 est impair, alors M e = 2:
2) Pour la série suivante:

0; 1; 1; 2; 2; 2, 5 ; 3; 4; 4; 5; 6

n est pair, deux valeurs se trouvent au milieu de la série. Alors la médiane


est la moyenne de ces deux valeurs:
2+5
Me = = 3; 5
2
1
Remark 25 On peut dé…nir la médiane comme l’image de 2 par la réciproque
de la fonction de répartition:
1
Me = F (0:5):

Quantiles On a vu que la fréquence cumulée Fi (0 Fi 1) donne la pro-


portion d’observations inférieures ou egales a xi . Une approche complémentaire
consiste à se donner, une valeur , (0 1), et à rechercher une valeur x ,
véri…ant F (x ) ' .
La notion de quantile d’ordre généralise la médiane. Un quantile x est
donné par l’image de par la réciproque de la fonction de répartition:
1
x =F ( )
De…nition 26 On appele quantile d’ordre , la valeur noté x , tel que la pro-
portion des observations qui lui sont inférieures ou égales vaut , et la proportion
des observations qui lui sont supérieures vaut 1 .

9
Détermination de quantiles: Soit la série ordonnée par ordre croissant
suivante:
x1 ; x2 :::; xi ; :::; xn
Le quantile x est calculé comme suit:
1) Pour n entier,
1
x = (xn + xn +1 )
2
2) Pour n n’est pas entier,
x = x[n ] ;
où [n ] représente le plus petit nombre entier supérieur ou égal à n .
Remark 27 La médiane est le quantile d’ordre = 21 .
On utilise souvent
le premier quartile, Q1 = x1=4
le troisième quartile, Q3 = x3=4
le premier décile, D1 = x1=10 ,
le premier quintile, q1 = x1=5
le quatrième quintile, q4 = x4=5
le neuvième décile, D9 = x9=10
Example 28 Soit la série statistique 1; 3; 5; 6; 8; 9; 12; 14; 15; 17; 18; 24;
contenant 12 observations (n = 12):
Le premier quartile: Comme n = 0:25 12 = 3 2 N, on a
1 1
Q1 = x1=4 = (x3 + x4 ) = (5 + 6) = 5; 5:
2 2
La médiane : Comme n = 0:5 12 = 6 2 N, on a
1 1
Q2 = x1=2 = (x6 + x7 ) = (12 + 14) = 13:
2 2
Le troisième quartile : Comme N = 0:75 12 = 9 2 N, on a
1 1
Q3 = x3=4 = (x9 + x10 ) = (15 + 17) = 16
2 2
Example 29 Soit la série statistique 1; 3; 5; 6; 8; 9; 12; 14; 15; 17; 18; 24; 26 con-
tenant 13 observations (n = 13):
Le premier quartile : Comme n = 0:25 13 = 3; 25 2 = N, on a
Q1 = x1=4 = x[3;25 ] = x4 = 6:
La médiane: Comme n = 0:5 13 = 6; 5 2
= N, on a
Q2 = M e = x1=2 = x[6;5 ] = x7 = 12:
Le troisième quartile : Comme n = 0:75 13 = 9:; 75 2
= N, on a
Q3 = x 41 = x[9;75 ] = x10 = 17:

10
Moyenne La moyenne ne peut être dé…nie que sur une variable quantitative.
Soit n est l’e¤ectif total des observations.

Moyenne arithmétique simple


De…nition 30 La moyenne arithmétique est la somme des valeurs observées
divisée par leur nombre, elle on la note X:
1 Pn
X= xi
n i=1

Moyenne pondérée
De…nition 31 Soit fn1 ; n2 ; :::; nk g un ensemble de poids; (ni 0), tel que
P
k
ni = n. La moyenne pondérée est donnée par
i=1

1 Pn Pk
X= ni xi = fi xi
n i=1 i=1

Remark 32 1) La moyenne arithmétique est sensible aux valeurs extrêmes dans


le cadre de petits échantillons (n < 30).
2) La moyenne n’est pas nécessairement une valeur possible.

Example 33 Les notes de 15 étudiants en examen de bio mathématique sont


10; 10; 10; 11; 11; 12; 12; 12; 12; 12, 14; 14; 15; 15; 16. Alors la moyenne
arithmétique simple vaut:
10 + 10 + 10 + 11 + 11 + 12 + 12 + 12 + 12 + 12 + 14 + 14 + 15 + 15 + 16
X= = 12; 4
15
La moyenne pondérée vaut:
3 10 + 2 11 + 5 12 + 2 14 + 2 15 + 16
X= = 12; 4
3+2+5+2+2+1

Moyenne géométrique La moyenne géométrique s’utilise, par exemple,


pour calculer la moyenne de taux d’intérêt.

De…nition 34 Soiti xi 0, on appelle moyenne géométrique la quantité G


donnée par
p q
mg = n
x1 x2 ::: xn = n
xn1 1 xn2 2 ::: xnk k = xf11 xf22 ::: xfkk

Remark 35 On peut écrire la moyenne géométrique en fonction de la moyenne


arithmétique des logarithmes des valeurs observées
1 Pn
mg = exp (ln mg ) = exp ln xi
n i=1

11
Example 36 Un client versé dans la banque une somme de 1000000 DA, avec
intérêt de 5% pour la première année et de 7% pour l’année suivante et de 10%
pour la troisième et de r3 % pour les 5% durant la première année 13% pour la
quatrième. On veut calculer La somme en DA de cet client après 4 ans.
Après une année on a

1000000 + 1000000 0; 05 = 1000000 1; 05 = 1050000 DA

Après deux années on a

1000000 1; 05 1; 07 = 1123500 DA

Après trois années on a

1000000 1; 05 1; 07 1; 1 = 1235900 DA

Après quatre années on a

1000000 1; 05 1; 07 1; 1 1; 13 = 1396600 DA:

Ou bien, on calcule la moyenne géométrique des taux on obtient


p
mg = 4 1; 05 1; 07 1; 1 1; 13 = 1; 0871

Le taux moyen est G, donc on applique ce taux 4 fois, on obtient

1000000 G4 = 1000000 1; 08714 = 1396600 DA:

Moyenne harmonique La moyenne harmonique s’utilise, par exemple,


pour calculer la moyenne des vitesses

De…nition 37 Soit xi > 0, on appelle moyenne harmonique la quantité mh


donnée par
n 1
mh = Pn = k
1 P fi
xi xi
i=1 i=1

Example 38 Une voiture traverse un circuit fermé 6 foix, le premier tours


avec une vitesse v1 = 50km=h, le deuxième avec une vitesse v2 = 60km=h ,
le troisième avec une vitesse v3 = 70km=h et les autres tours avec une vitesse
v4 = 80km=h; On veut calculer la vitesse moyenne de cette voiture.

On dénote la distance du circuit d; ti le temps correspond à vi (i = 1; 2; 3; 4).


On sait que: 6d = vm t; d’où
6d d d d 3d
t= ; t1 = ; t2 = ; t3 = ; t4 = :
vm v1 v2 v3 v4

12
Et comme
t = t 1 + t2 + t 3 + t3 + t 4 :
Alors on a
6d d 2d d 3d 6d
= + + + = d d
vm v1 v2 v3 v4 v1 + v2 + vd3 + 3d
v4

Donc
6 6
vm = 1 1 1 3 =
v1 + v2 + v3 + v4
P
4
ni
vi
i=1

6
vm = 1 1 1 3 = 67; 833 km=h
50 + 60 + 70 + 80

Moyenne quadratique
De…nition 39 la moyenne quadratique d’une variable statistique X est la quan-
tité mq dé…nie par s
s
1 Pn Pk
mq = x2i = fi x2i
n i=1 i=1

Example 40 Dans l’exemple 1 la moyenne quadratique de l’âge est


s r
1 P k
2 75813
mq = ni xi = = 27; 534
100 i=1 100

Proposition 41 Pour toute variable statistique admet des moyennes arithmé-


tiques X, géométrique G et harmonique H on a

min xi H G X max xi
1 i n 1 i n

1.3.4 Paramètres de dispersion


Etendue
De…nition 42 On appelle étendu de la variable statistique X (dénoté E) la
di¤ érence entre la plus grande et la plus petite valeur observée.

eX = max xi min xi = xn x1
1 i n 1 i n

Example 43 L’étendue de l’exemple 1 est

eX = x50 x1 = 59 24 = 35

13
Ecart interquartile
De…nition 44 On appelle écart interquartile de la variable statistique X (dénoté
IQ), la di¤ érence entre le troisième et le premier quartile:

IQ = Q3 Q2

Variance
De…nition 45 On appelle variance de la variable statistique X (noté s2X ) la
moyenne arithmétique des carrés des écarts à la moyenne
1 Pn 2 P
n 2
s2X = xi X = fi xi X
n i=1 i=1

Proposition 46 (formule de Koenig) La variance est donnée aussi par

1 Pn 2 2
s2X = x2 X = m2q X :
n i=1 i

Proof.
1 Pn 2 1 P n
s2X = xi X = x2 2xi X + X 2
n i=1 n i=1 i
1 Pn 1 Pn 1 2
= x2i 2X xi + n X
n i=1 n i=1 n
1 Pn 2 2 1 Pn 2
= x2i 2X + X = x2i X
n i=1 n i=1

Si les valeurs de la variable sont données sous forme de distribution, La


variance peut être dé…nie par

1 Pk 2
s2X = ni x2i X
n i=1

Variance corrigée SI on veut estimer une variance d’une variable statis-


tique X d’un échantillon de taille n, on utilise la variance corrigée.
2
De…nition 47 La variance corrigée de la variable statistique X (noté SX ) est
dé…nie par
2 1 P k 2
SX = x2 X
n 1 i=1 i

Remark 48 On peut calculer la variance corrigée à partie de la variance

2 1 n Pk 2 n
SX = x2 X = s2X
n 1 n i=1 i n 1

14
Ecart-type
De…nition 49 On appelle écart-type de la variable statistique X (noté sX ) la
racine carrée de la variance q
sX = s2X

Remark 50 Si on veut estimer l’écart-type d’une variable statistique X d’un


échantillon de taille n, on dé…nit l’écart-type à partir de la variance corrigée
q r
2 = n
SX = SX sX :
n 1

Coe¢ cient de variation:


De…nition 51 Le coe¢ cient de variation de la variable quantitative X est la
quantité CV dé…nie par:
sX
CV =
X
Le CV permet d’apprécier la représentativité de la moyenne par rapport à
l’ensemble des observations. Il mesure le degré d’homogénéité de la série. Il faut
qu’il soit le plus faible possible (en pratique < 15%).

Remark 52 Si CV < 0; 25 On dit que les valeurs de la variable sont concentrées


Si CV 0; 25 On dit que les valeurs de la variable sont dispersées.

Example 53 si on veut calculer Les paramètres de positions et de dispersion


de la distribution de l’âge de 50 employés suivante:
xi 24 26 30 33 34 40 44 50 59 Total
ni 3 6 4 5 6 10 6 6 4 50
Le mode: le plus grand e¤ ectif est n6 = 10 donc M o = 40 ans
La médiane: N = 50 paire, d’où
x25 + x26 40 + 40
Me = = = 40 ans
2 2
Pour calculer X; s2X ; SX
2
, on utilise ce tableau
P
xi ni ni xi ni x2i Fi " Fi #
24 3 72 1728 0; 06 0; 06 1; 00
26 6 156 4056 0; 12 0; 18 0; 94
30 4 120 3600 0; 08 0; 24 0; 82
33 5 161 5313 0; 10 0; 34 0; 74
34 6 204 6936 0; 12 0; 46 0; 64
40 10 400 16000 0; 20 0; 66 0; 52
44 6 264 11616 0; 12 0; 88 0; 32
50 6 300 15000 0; 12 0; 92 0; 20
59 4 196 11564 0; 08 1; 00 0; 08
Total 50 1873 75813 1; 00

15
La moyenne:

1 P9 1873
X= ni xi = = 37; 46 ans
50 i=1 50
La variance:
2
1 P 9 2 75813 1873
s2X = ni x2i X = = 113; 01
50 i=1 50 50

L’écart-type q p
sX = s2X = 113; 01 = 10; 631
La variance corrigée

2 50 2 50
SX = sX = 113; 01 = 115; 31
50 1 49
L’écart-type corrigé
q r
2 2 50
SX = SX = sX = 10; 739
49
Proposition 54 Soient X une variable statistique, a et b; deux constante réelles
telles que Y = aX + b: Alors les propriétés on a
i) Y = aX + b
ii) s2Y = a2 s2X

Proof. i)

1 Pn 1 Pn 1 Pn 1
Y = yi = (axi + b) = a xi + nb
n i=1 n i=1 n i=1 n
= aX + b

ii)

1 P n 2 1 Pn 2
s2Y = yi Y = axi + b aX b
n i=1 n i=1
1 Pn 2
= a2 xi X = a2 s2X
n i=1

16

Vous aimerez peut-être aussi