0% ont trouvé ce document utile (0 vote)
11 vues13 pages

Outils de Statistiques pour Analyses Scientifiques

Transféré par

Lord Ahmed
Copyright
© All Rights Reserved
Nous prenons très au sérieux les droits relatifs au contenu. Si vous pensez qu’il s’agit de votre contenu, signalez une atteinte au droit d’auteur ici.
Formats disponibles
Téléchargez aux formats PDF, TXT ou lisez en ligne sur Scribd
0% ont trouvé ce document utile (0 vote)
11 vues13 pages

Outils de Statistiques pour Analyses Scientifiques

Transféré par

Lord Ahmed
Copyright
© All Rights Reserved
Nous prenons très au sérieux les droits relatifs au contenu. Si vous pensez qu’il s’agit de votre contenu, signalez une atteinte au droit d’auteur ici.
Formats disponibles
Téléchargez aux formats PDF, TXT ou lisez en ligne sur Scribd

17/01/2018

Université Ibn Tofail INTRODUCTION


Faculté des Sciences Kénitra
ELEMENTS DE NOTRE PARTIE
Pourquoi l’étude de la statistique?
Outils pour les sciences; statistiques A quoi sert l’étude de la statistique?
Partie 1
appliquées aux analyses physico- Problèmes (ou phénomène) de variabilité des données
• Statistiques descriptives univarié / bivarié
chimiques analytiques récoltées dans différents domaines:
• Probabilité et analyse combinatoire pharmaceutiques, agroalimentaire, biologique,
• Les variables aléatoires chimique, physique…

Pr. M. BOUZIANI IDRISSI • Méthodes d’échantillonnage et estimation • Facilite la lecture de la distribution des données

• Testes statistiques • Interprétation des résultats


• Facilite La prise de décision
• Définir la loi régit par la distribution
1 2 3

INTRODUCTION STATISTIQUES DESCRIPTIVES


Définitions et vocabulaire
• C’est quoi la statistique?
Statistique Individu:
Ensembles des méthodes qui ont pour but la collecte, l’analyse et 1. la collecte des données (souvent numériques) Unité statistique de base sur laquelle on effectue
l’interprétation des données (souvent numériques)
2. l’analyse statistique de ces données en vue de leur interprétation
une certain nombre de mesures ou d’observation.
Echantillon:
Statistique descriptive
Partie ou un sous ensemble de la population
C'est l'art de recueillir, présenter, analyser et interpréter des
sur laquelle porte l’expérience/analyse choisie
observations (des données) afin d'aider à la prise
par échantillonnage ou prélèvement aléatoire.
de décisions et à la résolution de problèmes.
Population:
Désigne l’ensemble des individus/unités étudiés
4 5 6

1
17/01/2018

STATISTIQUES DESCRIPTIVES STATISTIQUES DESCRIPTIVES STATISTIQUES DESCRIPTIVES


Définitions et vocabulaire Définitions et vocabulaire
Taille d’une population:
Le nombre d'individus constituant la population et noter N
Type des variables
Taille d’un échantillon:
Le nombre d'individus constituant l’échantillon et noter n
Définitions et vocabulaire  Variable
Un caractère mesuré ou observé sur chacune des individus
(unités statistique) de l’échantillon. Variable quantitative Variable qualitative

La variable, dite aléatoire, est donc une application qui associe à chaque
caractère mesuré ou observé des valeurs aléatoires de nombre réel.
• La notation du caractère ou de la variable est en majuscule X ,Y, Z,…
• Une réalisation (détermination) du caractère est noté x1,x2,… (minuscule)
8 9

STATISTIQUES DESCRIPTIVES STATISTIQUES DESCRIPTIVES STATISTIQUES DESCRIPTIVES


Définitions et vocabulaire Définitions et vocabulaire Définitions et vocabulaire
A partir d’un lot de 20 litre du peroxyde d’hydrogène, on a prélevé 1000ml de produit
pour déterminer, par une méthode analytique, le titre du peroxyde d‘hydrogène.
Variable quantitative : La méthode analytique exige une quantité de 50ml de produit pour faire le dosage.
Une variable statistique est quantitative si ses valeurs sont des nombres
exprimant une quantité, sur lesquels les opérations arithmétiques (somme, • Relever la population, l’échantillon et l’individu ?
• Quelle est la taille de la population et de l’échantillon?
etc...) ont un sens.
• Quelle est la variable et quelle est sa nature ?
• Exemple : Variable quantitative= numérique
A partir d’un lot de 20 litre du peroxyde d’hydrogène, on a prélevé 1000ml de produit  La population: lot de 20 litre du peroxyde d’hydrogène
pour déterminer, par une méthode analytique, le titre du peroxyde d‘hydrogène.
La méthode analytique exige une quantité de 50ml de produit pour faire le dosage.  L’échantillon: 1000ml du peroxyde d’hydrogène
• Relever la population, l’échantillon et l’individu ?  L’individu: 50ml du peroxyde d’hydrogène
• Quelle est la taille de la population et de l’échantillon?
• Quelle est la variable et quelle est sa nature ?  Taille de la population: 400 individus (unités)
Variable quantitative discrète: Variable quantitative continue:
Caractère qui prend des valeurs finis Caractère qui prend des valeurs finis  Taille de l’échantillon: 20 mesures (individus)
(discontinu), généralement entières.
Caractère qui prend des valeurs infinis.  La variable: le titre de H2O2
10 11  Nature e la variable: Quantitative continue 12

2
17/01/2018

STATISTIQUES DESCRIPTIVES STATISTIQUES DESCRIPTIVES STATISTIQUES DESCRIPTIVES


Définitions et vocabulaire Définitions et vocabulaire Définitions et vocabulaire

Variable qualitative : • Exemple : Variable qualitative


On veut mesurer la viscosité d’un liquide par l’appareil de viscosité Brookfield,
Une variable statistique est qualitative si ses valeurs, ou modalités, On veut mesurer la viscosité d’un liquide par l’appareil de viscosité Cette mesure a été effectuée par cinq opérateurs à différents températures.
s'expriment de façon littérale ou par un codage sur lequel les opérations Brookfield, Cette mesure a été effectuée par cinq opérateurs à différents
arithmétiques telles que moyenne, somme, ... , n'ont pas de sens. températures. • Quels sont les facteurs qui peuvent influencer la mesure de la
viscosité?
• Quelle est la nature de cesfacteurs?
• Quels sont les facteurs qui peuvent influencer la mesure de la • Quelles est la réponse de la mesure ?
viscosité?
Variable qualitative nominale : Variable qualitative ordinale :
• Quelle est la nature de cesfacteurs?
X1: Variable qualitative nominale: opérateur, nous avons 5 opérateurs (5
• Quelles est la réponse de la mesure ?
C'est une variable qualitative dont les C'est une variable qualitative dont les modalités).
modalités ne sont pas ordonnées. modalités sont naturellement ordonnées.
X2: Variable quantitative continue: température de l’échantillon.
Le saveur de la sauce tomates: le caractère salé de la soupe au poulet :
fruité, sucré, épicé ou piquant. Moins salée, peu salée, salée et plus salée Y: Réponse: la viscosité, variable quantitative continue.

13 14 15

STATISTIQUES DESCRIPTIVES STATISTIQUES DESCRIPTIVES STATISTIQUES DESCRIPTIVES


Distribution univariée & à une seule Distribution univariée & à une seule
dimension dimension
Un laboratoire pharmaceutique a reçu une nouvelle machine de Considérons un lot pharmaceutique composé de 1000 comprimés.
compression. En vue de tester la performance de fonctionnement de la Chaque comprimé doit contenir 20 mg d'une substance active. Un
nouvelle machine de compression, on a effectué, pendant un mois, un
échantillon de 20 comprimés est prélevé à partir de ce lot.
contrôle de tous les lots des comprimés issus de cette machine.
Exemple 1 Exemple 2
Ce contrôle consiste à dénombrer le nombre des comprimés non-conformes Distribution univariée & à une seule Supposons qu'il existe une méthode analytique qui permet de
par lot. Sachant qu’un lot contient 1000 comprimés et le % des non- connaître la contenance exacte en principe actif d'un comprimé et
conforme ne doit pas dépassé 5%. Les résultats observés sont regroupés dimension que les 20 comprimés sont tous analysés.
dans les tableau suivants: Peut-on conclure que la machine est
performante?
N° CONC(mg) N° CONC (mg)
Lot cps Lot cps Lot cps Lot cps Lot cps Lot cps 1 19.93 11 18.98
non- non- non- non- non- non- 2 19.93 12 19.33
conf conf conf conf conf conf 3 19.74 13 19.14
1 19 6 30 11 30 16 52 21 29 26 32 4 19.72 14 20.22
2 30 7 31 12 29 17 31 22 32 27 31 5 20.12 15 20.02
6 20.12 16 20.52
3 30 8 12 13 19 18 23 23 23 28 37 7 20.08 17 19.38
4 9 9 37 14 34 19 31 24 56 29 30 8 19.86 18 18.96
5 34 10 23 15 14 20 45 25 30 30 2916 17 9 19.85 19 20.15 18
10 20.07 20 19.57

3
17/01/2018

STATISTIQUES DESCRIPTIVES STATISTIQUES DESCRIPTIVES STATISTIQUES DESCRIPTIVES


Effectif (ni) fréquence (fi)
Effectif cumulé (Ni)
x1 x2 x3 x4 x5 x6 x7 x8 x9 x10 x11 x12
x1 x2 x3 x4 x5 x6 x7 x8 x9 x10 x11 x12
Nombre de 12 14 19 23 29 30 31 32 34 37 45 52 Total x1 x2 x3 x4 x5 x6 x7 x8 x9 x10 x11 x12
N-C (xi) Nbe de N-C(xi) 12 14 19 23 29 30 31 32 34 37 45 52 Total
Effectif (ni) 1 1 2 3 4 6 4 3 2 2 1 1 30 Nbe de N-C(xi) 12 14 19 23 29 30 31 32 34 37 45 52 Total
Effectif (ni) 1 1 2 3 4 6 4 3 2 2 1 1 30
Effectif (ni) 1 1 2 3 4 6 4 3 2 2 1 1 30
Effectifcumulée 1 2 4 7 11 17 21 24 26 28 29 30
(Ni)
Effectif cumulée 1 2 4 7 11 17 21 24 26 28 29 30
(Ni)
Fréquence (fi) % 3,3 3,3 6,7 10,0 13,3 20,0 13,3 10,0 6,7 6,7 3,3 3,3 100

L’effectif cumulé: la somme de l’effectif de la valeur (xi) et tous les effectifs précédents

Fréquence de chaque La somme des fréquences de toutes les valeurs xi égales à


valeur xi de la variable L’effectif cumulé de la dernière valeur (ici : x12) = le total des effectifs 100
19 20 21

STATISTIQUES DESCRIPTIVES STATISTIQUES DESCRIPTIVES STATISTIQUES DESCRIPTIVES


Fréquence cumulée (Fi) x1 x2 x3 x4 x5 x6 x7 x8 x9 x10 x11 x12
Courbe de l’effectif
x1 x2 x3 x4 x5 x6 x7 x8 x9 x10 x11 x12 Nbe de N-C(xi) 12 14 19 23 29 30 31 32 34 37 45 52 Total
7

Nbe de N-C(xi) Total Effectif (ni) 1 1 2 3 4 6 4 3 2 2 1 1 30 6


12 14 19 23 29 30 31 32 34 37 45 52 6 Diagramme en bâton
Effectif (ni) 1 1 2 3 4 6 4 3 2 2 1 1 30 Effectifcumulée 1 2 4 7 11 17 21 24 26 28 29 30 5
(Ni)
4 4

Effectif
Effectif cumulée 1 2 4 7 11 17 21 24 26 28 29 30 Fréquence (fi) % 3,3 3,3 6,7 10,0 13,3 20,0 13,3 10,0 6,7 6,7 3,3 3,3 100 4
(Ni) 3 3
Fréquence 3
Fréquence (fi) % 3,3 3,3 6,7 10,0 13,3 20,0 13,3 10,0 6,7 6,7 3,3 3,3 100 3,3 6,6 13,3 23,3 36,6 56,6 70,0 80,0 86,6 93,3 96,6 100,0
cumulée (Fi) % 2 2 2
2
Fréquence 3,3 6,6 13,3 23,3 36,6 56,6 70,0 80,0 86,6 93,3 96,6 100,0 nixi 12 12 28 57 92 174 120 93 64 68 37 45 802
1 1 1 1
cumulée (Fi) % 1
fixi 40 40 93 190 307 580 400 310 213 227 123 150 2673
0
12 14 19 23 29 30 31 32 34 37 45 52
Nombre de Non-C
Fréquence cumulée de la valeur x7=70 n p
 nixi
Fréquence cumulée de la dernière valeur égale à 100%
22
x =
 x
i =1
i
x = i=1 x =  f ixi 23 24

n n i =1

4
17/01/2018

STATISTIQUES DESCRIPTIVES STATISTIQUES DESCRIPTIVES


Fonction de répartition STATISTIQUES DESCRIPTIVES
100

Distribution univariée & à une seule

Fréquence cumulée
Courbe de densité 90

30
80 dimension
70
25
Considérons un lot pharmaceutique composé de 1000 comprimés.
60 Chaque comprimé doit contenir 20 mg d'une substance active. Un
20
échantillon de 30 comprimés est prélevé à partir de ce lot.
fréquence %

20 50

40 N° Conc. (mg) N° Conc. (mg)


1 13 13
1 21,04 16 18,59
5
10 10 30
Exemple 2
2 18,59 17 20,33
1
0 7 7 7 20
3 20,12 18 19,86
4 21,16 19 19,46
5 3 3 3 3 10 5 19,14 20 19,74
6 19,84 21 19,66
0 0
12 14 16 18 20 22 24 26 28 30 32 34 36 38 40 42 44 46 48 50 52 54 7 19,90 22 19,99
1 1 1 2 2 30 31 3 3 3 4 5
2 4 9 3 9 Nombre des N-C 8 19,94 23 18,99
Nombre des N-C 2
4 7 5 2
9 20,08 24 19,89
Courbe de répartition: donne la proportion des fréquences pour que 10 23,43 25 20,25
Courbe de densité: donne la fréquence ( ou la densité ) de chaque valeur de la valeur de la variable X ≤ xi 11 21,04 26 18,59
la variable X. 12 18,59 27 20,33
5% de 1000 comprimés donne 50 cps N-C: Pour la valeur xi=50 quelle est la 13 20,12 28 19,86
f(X=31)=13% 25
proportion des fréquence pour que X soit inférieur à 50 F(X ≤ 50)=99%
26
14 21,16 29 19,46
27

15 19,14 30 19,74

STATISTIQUES DESCRIPTIVES STATISTIQUES DESCRIPTIVES STATISTIQUES DESCRIPTIVES


Distribution univariée & à une seule Distribution univariée & à une seule Distribution univariée & à une seule
dimension dimension dimension
Définitions de base: Définitions de base: Définitions de base:

• Classe, catégorie, modalité : se rapporte au intervalles des valeurs que peut prendre la variable. • L’effectif de classe (ni ) est le nombre d’individus par classe:
• Calcul de k:
• La plus petite valeur admise dans la classe s’appelle la borne inférieure de classe et la plus grande
• La fréquence d’une classe (fi ), aussi appelée fréquence relative : Le calcul de du nombre de classe kest donné par la formule ci-dessous. Généralement la valeur
de k est arrondi au nombre entier et de préférence un nombre impair
fi = ni/n
est la borne supérieure de classe

• L’étendue d‘une classe: L’étendue des valeurs admissibles constitue l’intervalle de classe symbolisé
• L’effectif cumulé de classe(Ni) : la somme des effectifs d’une classe et de toute celles qui la
• Calcul de h:
par h
précèdent : = + + + Ni n1 n2 n3 ...ni L’intervalle de classe se calcule en divisant l’amplitude de variation (écart entre la plus grande
• La fréquence cumulée (Fi), aussi appelée fréquence relative d’une classe, est le rapport de l’effectif
valeur et la plus petite valeur observée de la variable) par le nombre de classe :
• cumulé à l’effectif total de l’échantillon:
Le nombre de classe est symbolisé par k Fi=Ni n= f 1+ f 2+...+ fi

28 29 30

5
17/01/2018

STATISTIQUES DESCRIPTIVES STATISTIQUES DESCRIPTIVES STATISTIQUES DESCRIPTIVES


Distribution univariée & à une seule Distribution univariée & à une seule Distribution univariée & à une seule
dimension dimension dimension
16
N° Conc. (mg) N° Conc. (mg)
1 21,04 16 18,59 Classe Borne inf Borne sup Indice de Effectif Effectif fréquence fréquence 14
2 18,59 17 20,33 n° classe cumulé % cumulée %
3 20,12 18 19,86 1 18,00 19,00 18,5 5 5 16,7 16,7 12
4 21,16 19 19,46

Effectif
5 19,14 20 19,74 10
2 19,00 20,00 19,5 14 19 46,7 63,4
6 19,84 21 19,66
Exemple 2 7 19,90 22 19,99 8

8 19,94 23 18,99 3 20,00 21,00 20,5 6 25 20,0 83,4


6
9 20,08 24 19,89
10 23,43 25 20,25 4 21,00 22,00 21,5 4 29 13,3 96,7 4
11 21,04 26 18,59
12 18,59 27 20,33
5 22,00 23,43 22,5 1 30 3,3 100,0 2
13 20,12 28 19,86
14 21,16 29 19,46 0
15 19,14 30 19,74 Total 30 100 18,5 19,5 20,5 21,5 22,7
Indice de clace
Nombre de classe: racine carré de 30 k 5
• Histogramme: est un diagramme à barres (rectangles) continues
Etendue: valeur max-valeur min E 4,84 dont les aires sont proportionnelles aux fréquences.
31 32 33
Etendue de classe: E/k h 0,97 ≈ 1

STATISTIQUES DESCRIPTIVES STATISTIQUES DESCRIPTIVES STATISTIQUES DESCRIPTIVES


Distribution univariée & à une seule Distribution univariée & à une seule Distribution univariée & à une seule
dimension dimension dimension
VARIABLE QUALITATIVE VARIABLE QUANTITATIVE
16

La fonction définie par: fi= ni/n


14 Nominale Ordinale Discrète Continue
est appelée fonction de densité noté f(x)
12
Effectifs ou Fréquences Effectifs ou Fréquences
Effectif

10 Diagramme en Diagramme en Diagramme en Histogramme


barres barres bâtons
8

4
Modalités dans l’ordre
Diagramme Si les normes d’acceptation sont 20±2 mg
2 circulaire

0 18,5 19,5 20,5 21,5 22,7


Une proportion de 99% des fréquences cumulées
Indice de clace
34 35
correspond aux résultats conformes 36

6
17/01/2018

STATISTIQUES DESCRIPTIVES STATISTIQUES DESCRIPTIVES STATISTIQUES DESCRIPTIVES


Dans le cadre d’une évaluation sensorielle, un test Modalités Effectifs Fréquences Fréquences %
Exemple 3 d’identification de la saveur de la sauce du tomate
Exemple 4
préparée dans un restaurant est effectué : Sucré 7 0,35 35,0
Dans le cadre d’une évaluation sensorielle d’un nouveau produit de chocolat, un
Epreuve n° Saveur de la sauce Modalités Effectifs Fréquences % Fruité 8 0,40 40,0
test de préférence est menée en interrogeant 130 personnes.
1 Fruité modalité 1 n1 f1= n1/n f1×100 Epicé 2 0,10 10,0
2 Sucrée Modalités Effectifs = Nombre de personnes
3 Fruité … … … … Piquant 3 0,15 15,0 Les
Pas du tout (A) 10
4 Sucrée modalité i ni fi= ni/n fi×100 modalités
Total : 20 1 100,0 Un peu (B) 25
5 Fruité sont
6 Piquante … … … … Beaucoup (C) 40
présentées
7 Epice modalité k nk fk= nk/n fk×100 Diagramme circulaire ou camembert Diagramme en barres Passionnément (D) 32
8 Fruité 9
8
dans l’ordre A la folie (E) 23
9 Epice Total :  ni = n  fi =1 100 8
7
10 Sucrée 15% 7 45
Modalités Effectifs Fréquences Fréquences % 6 40
11 Sucrée 35% 40

Diagramme

effectif
12 Fruité 10% 5
35
Sucré 7 0,35 35,0 32
13 Sucrée 4
3 en barre 30
14 Sucrée 3 25
Fruité 8 0,40 40,0 2 qui résume 25 23
15 Piquante 2

16 Piquante Epicé 2 0,10 10,0


40% 1
cette étude 20

15
17 Fruité 0 sensorielle 10
18 Fruité Piquant 3 0,15 15,0 Sucré Fruité Epicé Piquant 10

37 modalités 38 5 39
19 Sucrée
Total : 20 1 100,0 0
20 Sucrée
A B C D E

STATISTIQUES DESCRIPTIVES STATISTIQUES DESCRIPTIVES STATISTIQUES DESCRIPTIVES


Paramètres de position et de Paramètres de position et de
dispersion La moyenne arithmétique: dispersion
Les représentations graphiques ont permis une première synthèse visuelle de la  La moyenne (arithmétique) renseigne le centre de gravité de la
distribution des observations. distribution. En d'autres termes, le poids des résultats à gauche de la
moyenne est égal au poids des résultats se trouvant à droite. Si x1, …
Paramètres de position et de La statistique descriptive a pour objectif de résumer l'information contenue xn représentent les n résultats, la moyenne arithmétique est estimée de
la façon suivante: n
dispersion dans une population. Autrement dit, cette approche permet de décrire la
x =
façon dont les résultats des observations se distribuent sur leur axe en
La moyenne pondérée:
x i
utilisant différents paramètres numériques. i=1

Paramètres de position Paramètres de dispersion  La moyenne pondérée est obtenue en tenant compte de poids. Elle est
Moyenne Ecart type calculée de la façon suivante:
Médiane Variance
Mode Etendue

40 Les paramètres statistiques ne concernent que les variables quantitatives 41 42

7
17/01/2018

STATISTIQUES DESCRIPTIVES STATISTIQUES DESCRIPTIVES STATISTIQUES DESCRIPTIVES


Paramètres de position et de Paramètres de position et de Paramètres de position et de
dispersion La médiane dispersion dispersion
La moyenne vs la médiane
 Dans la représentation suivante, la taille des points représente leur La médiane est le percentile 50 qui se situe au centre de la série
poids (wi). statistique classée en ordre croissant, c'est-à-dire la valeur à laquelle  La moyenne arithmétique est très sensible aux valeurs extrêmes alors que la
w1 w2 50% des résultats se situent à sa gauche et le reste à sa droite. médiane ne l'est pas.

S’il y a un nombre impair d’observations, la médiane est la ((n+1)/2)-ième valeur Prenons deux ensembles de valeurs:
de la série. {1.441, 2.424, 2.714, 2.274, 1.762}
x1 x2 {1.441, 2.424, 4.714, 2.274, 1.762}
moyenne Exemple: pour la série [1, 32, 128, 129, 1000235], Me = 128.
 La moyenne du premier est de 2.123 et celle du second est 2.523
S’il y a un nombre pair d’observations, la médiane est la moyenne (arithmétique)  alors que les médianes sont identiques et égales à 2.274.
 Si tous les poids sont égaux à 1, alors la moyenne pondérée devient de la (n/2)-ième valeur et de la (1+n/2)-ième valeur. de la série. Par convention,
la moyenne arithmétique. on utilise la La médiane est par conséquent un paramètre de position qui est plus robuste que la
moyenne de ces deux valeurs. moyenne et doit être préféré à la moyenne dans certains cas (distribution non
symétrique par exemple).
Exemple: pour la série [1, 32, 128, 129, 532, 1000235], Me = 128,5
43 44 45
moyenne

STATISTIQUES DESCRIPTIVES STATISTIQUES DESCRIPTIVES STATISTIQUES DESCRIPTIVES


Paramètres de position et de Paramètres de position et de Paramètres de position et de
Le mode
dispersion dispersion dispersion
La variance:
L’écart type:
 la valeur de la variable dont la fréquence est maximale (valeur  La variance est le paramètre de dispersion le plus courant. Elle représente
l'écart des résultats par rapport à leur moyenne (arithmétique). Dans une
dominante) population, elle s'estime comme suit:  La variance est exprimée dans les unités des résultats au carré. Par
s 2 = 1  (xi −x )2
 Il peut y avoir plusieurs modes dans une distribution: n exemple, si les résultats sont en mg alors la variance de ceux-ci sera en
mg².
n−1 i=1
Exemple: 9, 11, 11, 19, 19,13, 15,
 Si la variance est petite, cela signifie que les résultats sont proches de la  Ainsi l'écart-type qui est la racine carrée de la variance représente un
17, 11,18, 16, 19,11, 19, 19,11, 19 moyenne ou encore que ces résultats sont peu dispersés. Une variance égale paramètre de dispersion exprimé dans les mêmes unités que les résultats.
Cette série présente deux modes: à 0 signifie que tous les résultats sont identiques. Inversement, si la variance
est grande, cela signifie que les résultats sont fortement dispersés. Cette caractéristique rend l'écart-type bien plus utilisé que la variance.
- Mode 1: la valeur 11
- Mode 2: la valeur 19
s
46 47 48

8
17/01/2018

STATISTIQUES DESCRIPTIVES STATISTIQUES DESCRIPTIVES STATISTIQUES DESCRIPTIVES


Paramètres de position et de Paramètres de position et de Paramètres de position et de
dispersion Coefficient de variation:
dispersion dispersion

Ecart interquartiles: L’étendue:


 La difficulté en travaillant avec ce type de paramètres est de déterminer
quand une variance peut être considérée comme importante. Tout cela  L‘étendue ou l’amplitude est la différence entre la valeur la plus grande
 L'écart interquartiles est la différence entre le percentile 75 (75% des dépend bien évidemment de la moyenne des résultats. Par exemple, un (le maximum) et la valeur la plus petite (le minimum). Elle représente
valeurs sont inférieures à cette valeur) et le percentile 25. Entre P75 et P25 écart-type de 10 traduira une plus grande variabilité lorsque la moyenne est donc la longueur de l'intervalle dans lequel se trouve l'entièreté des
se trouve 50% de la distribution. de 100 que lorsque la moyenne est de 1000. résultats.

 Par conséquent, le coefficient de variation qui est défini par le rapport


 Plus cet écart est élevé, plus la dispersion est importante. Inversement, plus entre l'écart-type et la moyenne n'a plus d'unité et facilite  Plus l'amplitude est élevée, plus la dispersion est importante.
il est faible, moins la dispersion est importante. considérablement l'interprétation des résultats. Le coefficient de variation Inversement, plus l'amplitude est faible, moins la dispersion est
est souvent exprimé en pourcent. importante.

100 L'amplitude n'est que très rarement utilisée


49
̅ 50 51

STATISTIQUES DESCRIPTIVES STATISTIQUES DESCRIPTIVES STATISTIQUES DESCRIPTIVES


Distribution bivariée ou à deux Distribution bivariée ou à deux
dimension dimension
Objectif : Représentations des données: (cas variable quantitative)
La représentation d’une série statistique à deux dimensions se fait par différents
Mettre en évidence les relations qui existent entre deux séries
méthodes la plus simple est le diagramme à dispersion.
d'observations
Distribution bivariée ou à deux Le diagramme à dispersion présente en abscisse la variable X et en ordonnée la
variable Y. En plaçant chaque couple (xi , yi) dans le système de coordonnée pour
dimension obtenir un nuage de point.
90

85
Y
80

75

70

65

60

55

50
150 155 160 165 170 175 180 185 190
52 53 54

9
17/01/2018

STATISTIQUES DESCRIPTIVES STATISTIQUES DESCRIPTIVES STATISTIQUES DESCRIPTIVES


Distribution bivariée ou à deux Distribution bivariée ou à deux Distribution bivariée ou à deux
dimension dimension dimension
Représentations des données: (cas variable qualitative) Exemples : Exemples : Viscosité
90
La série statistique à deux variables qualitatives se présente en utilisant le tableau Un groupe de 6 dégustateurs ont classé 4 échantillons de sauce de tomate selon 85
de contingence leur intensité d’arome: Essai N° Viscosité xi Température yi
(cps) (°C) 80
Moins intense:1 – Peu intense: 2 – Intense:3 - Assez intense: 4 - Plus intense:5
1 175 23 75
Le tableau de contingence est un tableau à double entrée: Produit 1 Produit 2 Produit 3 Produit 4 Total
Sujet 1 12 2 168 26 70
4 5 2 1
 Les colonnes correspondent aux différents modalités de la variable X Sujet 2 5 4 3 1 13 ….. ….. ….. 65

Sujet 3 5 4 2 1 12 60
 Les lignes correspondent aux modalités de la variable Y. n 185 27
Sujet 4 4 4 2 2 12
55
Sujet 5 5 3 3 1 12
Dans chaque case du tableau résultant un croisement des valeurs des deux 50
Sujet 6 5 4 2 1 12 150 155 160 165 170 175 180 185 190

modalités. Sujet 7 4 4 2 1 11 Température


55 Total 32 28 16 8 84 56 57
Existe-t-il une relation de dépendance entre x et y?

STATISTIQUES DESCRIPTIVES STATISTIQUES DESCRIPTIVES STATISTIQUES DESCRIPTIVES


Distribution bivariée ou à deux Distribution bivariée ou à deux Distribution bivariée ou à deux
dimension dimension dimension
x et y sont indépendantes Il existe une relation fonctionnelle Définitions : Définitions :
entre x et y 1- Moments : (cas deux variables)
1- Moments : (cas une seule variable)
Le moment d’ordre k et l respectivement pour la variable X et la variable Y par
Le moment d’ordre k par rapport au point c est définit comme suit:
rapport aux deux points c et d est définit comme suit:
 (xi− c)
n
1 k
m k
=
n 1=1
Si c=0 et k=1 le moment à l’ordre 1 par rapport à l’origine se confond
avec la moyenne : n Si on pose c = x et d = y , on obtient le moment par rapport aux moyennes
1
La connaissance de x permet de m 1
= x i ou encore dit moment centré.
La connaissance de x n’apporte n 1=1
connaître exactement la valeur de y
aucune certaine information sur y Si c=x et k=2, le moment par rapport à la moyenne à l’ordre 2 se
confond avec la variance. : n

 ( xi− x )
1 2
Comment mesurer cette liaison ? m 2
= Si k=l=1, ce moment est appelé aussi la covariance entre
58 n 1= 1 59 60
les deux variables X et Y.

10
17/01/2018

STATISTIQUES DESCRIPTIVES STATISTIQUES DESCRIPTIVES STATISTIQUES DESCRIPTIVES


Distribution bivariée ou à deux Distribution bivariée ou à deux Distribution bivariée ou à deux
dimension dimension dimension
En générale et selon la définition du moment d’ordre 2 par rapport à la
moyenne, la formule de la variance est:
X et Y sont deux variables quantitatives aléatoires, on suppose qu’on a prélevé X et Y sont deux variables quantitatives aléatoires, on suppose qu’on a prélevé
n individus et qu’on a mesurés chacun des deux variables X et Y. n individus et qu’on a mesurés chacun des deux variables X et Y.
On dispose n couples { x,y} On dispose n couples { x,y}
• Paramètres de positions: Individu Variable X Variable Y • Paramètres de positions: Individu Variable X Variable Y Si x=y la variance estimée est:
x Moyenne des mesures de la variable X 1 x1 y1 x Moyenne des mesures de la variable X 1 x1 y1
y Moyenne des mesures de la variable Y 2 x2 y2 y Moyenne des mesures de la variable Y 2 x2 y2
3 x3 y3 3 x3 y3 ou
( x , y ) centre de gravité, centroïde i xi yi ( x , y ) centre de gravité, centroïde i xi yi En conséquence on obtient la matrice de dispersion:
• Paramètres de dispersion … … ... • Paramètres de dispersion … … ...
x y
Les variances estimées: n xn yn Les variances estimées: n xn yn x S²xx Sxy
y syx S²yy

Si x=y : s²xx et s²yy est appelé la variance


61 62 63
Si x ≠ y: sxy et syx est appelé la covariance

STATISTIQUES DESCRIPTIVES STATISTIQUES DESCRIPTIVES STATISTIQUES DESCRIPTIVES


Distribution bivariée ou à deux Distribution bivariée ou à deux Distribution bivariée ou à deux
dimension dimension Propriétés :
dimension
En générale et selon la définition du moment d’ordre 2 par rapport à la Cov(x,y) > 0 ⇔ x et y varient dans le même sens
moyenne, la formule de la variance est: I II
la covariance est Cov (x,y ) < 0 ⇔ x et y varient en sens contraire
positive.
Si x=y la variance estimée est:
Cov(x,y) =Cov(y,x)
ou
Cov(x,x) = V(x)
La covariance est
négative
En conséquence on obtient la matrice de dispersion: IV III Var(x+y)=Var(x)+Var(y)+2Cov(x,y)
x y Cov(a x + b y , z) = a Cov(x,z) + b Cov(y,z)
x S²xx Sxy
y syx S²yy D’autre part, on peut démontrer que la covariance est toujours, en valeur
Si les points du nuage de dispersion se répartissent également dans absolue, inférieure ou égale au produit des deux écart-type des variables X et Y.
Si x=y : s²xx et s²yy est appelé la variance
C ov ( x,y ) ≤ s x s y
les quatre quadrants du graphique, la covariance sera proche de
64 zéro. 65 66
Si x ≠ y: sxy et syx est appelé la covariance

11
17/01/2018

STATISTIQUES DESCRIPTIVES STATISTIQUES DESCRIPTIVES STATISTIQUES DESCRIPTIVES


Distribution bivariée ou à deux Distribution bivariée ou à deux Distribution bivariée ou à deux
Propriétés :
dimension dimension dimension
Coefficient de corrélation:
Cov(x,y) > 0 ⇔ x et y varient dans le même sens

Cov (x,y ) < 0 ⇔


C o v (x ,y) r est un nombre sans dimension − 1 ≤ r ≤ 1
x et y varient en sens contraire r =
s(x) s(y)
Cov(x,y) =Cov(y,x)
Propriétés :
Cov(x,x) = V(x)

Var(x+y)=Var(x)+Var(y)+2Cov(x,y) Si r =+1 : on a une corrélation positive et parfaite entre x et y


Cov(a x + b y , z) = a Cov(x,z) + b Cov(y,z) Si r = -1 : on a une corrélation négative et parfaite entre x et y

D’autre part, on peut démontrer que la covariance est toujours, en valeur Si r = 0 : les variables x et y sont indépendantes
absolue, inférieure ou égale au produit des deux écart-type des variables X et Y.

C ov ( x,y ) ≤ s x s y 67 68 69

STATISTIQUES DESCRIPTIVES STATISTIQUES DESCRIPTIVES STATISTIQUES DESCRIPTIVES


Distribution bivariée ou à deux Distribution bivariée ou à deux Distribution bivariée ou à deux
dimension dimension dimension
Exemple de corrélation Exemple de corrélation

N° de comprimé Prise d’essai (mg) Teneur en PA (mg)


Covariance : 0,886945
Coefficient corrélation : 0,878935
1 100,3 19,93
2 101,2 20,63
3 99,7 19,74
4 99,2 17,46
5 100,05 20,72
6 99,6 18,08
7 99,4 18,99
8 100,1 19,85
9 100,8 21,07
10 101,7 22,04

70 71 72

12
17/01/2018

73

13

Vous aimerez peut-être aussi