Statistique inférentielle, tests
d’hypothèses Comparaison de deux
pourcentages Comparaison de deux
moyennes
Objectifs du cours
• Comprendre le principe des tests statistiques
• Connaitre les étapes de réalisation d’un test
• Savoir formuler les hypothèses à tester
• Savoir choisir un test statistique
• Savoir interpréter le résultat du test
• Savoir faire une comparaison de
pourcentages
• Savoir faire une comparaison de moyennes
Introduction
⚫ La biostatistique est l’application des
concepts et principes statistiques à des
données médicales, biologiques et de santé
publique.
⚫ Echantillon : Sous-ensemble représentatif
de la population, qui va être étudié pour en
tirer des conclusions sur la population dans
son ensemble (inférence).
ECHANTILLON REPRESENTATIF
⚫ Il faut que l’échantillon ait été tiré selon des
règles destinées à en assurer la
représentativité.
⚫ Le mode de tirage le plus simple et le plus
important est l’échantillonnage aléatoire
simple correspondant à des tirages
équiprobables et indépendants les uns des
autres.
Objectifs de la biostatistique
inférentielle
⚫ Tirer des conclusions sur des populations à partir
de calculs conduits sur des échantillons
(inférence).
- Généraliser un résultat observé sur un échantillon à
toute la population (estimer un paramètre inconnu)
- Réfuter une hypothèse grâce à l’utilisation de critères
fiables et contrôlables
- Comparer des échantillons et identifier des liens et
associations entre variables en leur appliquant des
tests statistiques
Tests statistiques
⚫ Pour comparer des séries de données, on a recours
aux tests statistiques.
⚫ Les séries de données sont résumées en moyenne,
en pourcentage…
⚫ Une des applications les plus fréquentes de la
statistique est de tester la liaison ou la relation entre
deux variables
⚫ La différence ou la liaison observée est-elle réelle ou
bien due au hasard
Quel que soit le test utilisé, la méthode du test d’hypothèse
comporte les étapes suivantes :
1) Formuler l’hypothèse nulle, notée H0, à vérifier (contrôler) ;
2) choix du test statistique
3) Choix du seuil de signification, il est implicitement égale à 5% si
rien n’est spécifié
4) Conditions d’application du test statistique
5) Exécution du test statistique
6) Décision concernant l’hypothèse posée au seuil choisi et sens
de la liaison
⚫ Exemple1 :
A partir d’un groupe de 100 malades, on a
constitué :
Groupe de 54 malades traités par traitement A
Groupe de 46 malades traités par traitement B
les résultats sont consignés au tableau 1.
⚫ Tableau 1 : données hypothétiques relatives à la
comparaison de deux traitements A et B chez 100
malades.
Malades succès
traités effectif %
TRT A 54 43 79,6
TRT B 46 31 67,4
⚫ Si l’on se tient aux seules données du
tableau, on pourrait conclure que le
traitement A est plus efficace que le
traitement B puisque la fréquence relative de
succès avec A (79,6%).
⚫ Mais cette différence pourrait être expliquée
par le seul hasard.
⚫ Il s’agit donc de savoir si les sujets soumis
au traitement A sont caractérisés par la
même fréquence relative de succès (ou
d’échec) que les sujets soumis au traitement
B.
⚫ ou encore, en d’autres termes,
il existe une relation entre les deux variables :
Le traitement : modalités : A et B
Le résultat : modalités : succès et échec
⚫ La méthode du test d’hypothèse va permettre de
quantifier le rôle du hasard dans l’observation de
cette différence.
⚫ La formulation de l’hypothèse nulle est la première
étape du test d’hypothèse.
• L’hypothèse nulle notée Hₒest une hypothèse
d’absence de différence ; elle est susceptible d’être
vérifiée statistiquement.
De manière générale c’est une hypothèse
d’indépendance ou d’absence de relation entre
deux variables dont on cherche à tester la liaison.
⚫ Méthode du test d’hypothèse Étapes:
1.-Formulation de l’hypothèse nulle, notée Ho qui est
une hypothèse d’absence de différence.
Dans notre exemple, Hₒ pourrait s’énoncer :
• Le traitement et le résultat produit sont indépendants
;
• Il n’existe pas de relation entre le traitement et le
résultat produit ;
• L’utilité du traitement A n’est pas différente de celle du
traitement B ;
• Il n’existe pas de différence entre les deux
traitements.
⚫ Sous forme abrégée, si pA et PB désignent
les fréquences relatives de succès
observées pour les deux traitements,
on peut écrire Hₒ sous la forme :
Hₒ : pA = pB
Un test statistique permet soit de retenir ou de
rejeter Hₒ
⚫ 2è étape: choix du test statistique
Selon la nature de la variable
Variables qualitatives ► test du X2
test de l’écart-réduit
Variable qualitative/quantitative► test de l’écart-réduit
Nature des variable
⚫ Une des statistiques descriptives utilisées pour
décrire une variable qualitative est le pourcentage
(fréquence relative) de ces modalités.
Variable qualitative dichotomique (binaire) :
2 modalités
• sexe : masculin / féminin
• tabac : oui / non
• décès : oui/non
Variable qualitative polytomique : > 2 modalités
• couleur des yeux: bleu, vert, brun…
• groupe sanguin: A,B, AB, O
⚫ Comparer 2 pourcentages revient à tester la
liaison entre :
1 variable qualitative binaire et une variable
qualitative binaire.
Exemple : traitement (oui/non)
décès J30 (oui/non)
Pdécès J30 (traité) = Pdécès J30 (non-traité) ?
⚫ Comparer plusieurs pourcentages revient à tester la
liaison entre :
Une variable qualitative binaire
Une variable qualitative polytomique
Exemple :
• Fumeur (oui/non)
•CSP(ouvrier/agriculteur/artisan/cadre/employé…)
Pfumeur (ouvrier) = Pfumeur (agriculteur) = Pfumeur
(artisan) = … ?
Comparaison de 2
pourcentages observés sur 2
échantillons indépendants
⚫ Soit Pa un % observé sur un échantillon Na
et Pb un % observé sur un échantillon Nb.
⚫ On veut savoir s’il y a une différence entre
les deux pourcentages.
⚫ Deux méthodes :
- test de Khi-deux
- test de l’écart réduit
Test du Khi Deux (X²)
Test du Khi Deux (X²)
• Principe :
Le X² teste la liaison entre deux variables qualitatives.
Il est ainsi adapté au problème de la comparaison de
deux traitements exposé dans l’exemple 1.
De façon générale le test X² s’applique à tous les
tableaux de contingence quel que soit le nombre de
modalités des deux variables qualitatives.
Le principe du test X² consiste à calculer pour chacune
des cases du tableau de contingence l’écart
quadratique : (O-C)²/C et à en faire la somme :
X²= ∑ (O-C)²/C
• O est l’effectif observé de la case,
• C est l’effectif calculé (appelé aussi effectif théorique)
correspondant à la case et qui devrait être observé
si H0 était vraie.
⚫ A coté du calcul du X², il faut déterminer le
nombre de degrés de liberté (dl).
⚫ Celui-ci dans un tableau de contingence à L
ligne ( l modalité pour une variable)
et c colonnes (c modalités pour l’autre
variable), est tout simplement :
⚫ Calcul du degré de liberté (dl)
dl = (l –1) (c -1)
l: nombre de lignes.
c: nombre de colonnes
⚫ Dans un tableau 2x2, c'est-à-dire à 4 cases
(chacune des deux variables n’a que deux
modalités), le nombre de degrés de liberté
(ddl) est toujours égale à 1 :
dl = (2-1) (2-1)=1
⚫ Conditions d’application :
Pour exécuter le test du X², les effectifs
calculés dans chaque case doivent être au
moins égaux ou supérieurs à 5.
Comment calculer les effectifs théoriques?
⚫ On multiplie le total ligne par le total colonne
correspondant à la case, le résultat est divisé
par le total général.
C= (Total ligne x Total colonne) /Total général
Tableau de contingence
E+ E- Total
M+ a b m1
M- c d m2
Total n1 n2 N
⚫ Les deux pourcentages observés sont: Pa = a/n1 et Pb = b/n2
⚫ a, b, c et d: effectifs observés
⚫ On va calculer les effectifs calculés (théoriques )
⚫ L’effectif théorique de la 1èrecase (a: effectif observé): n1*m1/N
L’effectif théorique de la 2èmecase (b : effectif observé): n2*m1/N
L’effectif théorique de la 3èmecase (c : effectif observé): n1*m2/N
L’effectif théorique de la 4èmecase (d : effectif observé): n2*m2/N
⚫ Le calcul
X²= ∑ (O-C)²/C
⚫ Règle générale
• Si : X2 calculé ≥X2 de la table, pour un ddl
donné et un risque d’erreur égal à 5%, la
différence est significative →Ho est rejetée. •
•Si : X2 calculé < X2 de la table, pour un ddl
donné et un risque d’erreur égal à 5%, la
différence n’est pas significative → H0 est
acceptée
⚫ Exemple :
• Reprenons les données du tableau 1 relatives à la
comparaison de deux traitements A et B.
• Disposons les données comme dans le tableau 1 où
les effectifs observés dans chacune des 4 cases
sont facilement déduits par différence.
• L’effectif calculé correspondant à chaque effectif
observé est entre parenthèses.
⚫ Tableau 1 : données hypothétiques relatives à la
comparaison de deux traitements A et B chez 100
malades.
Malades traités Succès
Effectif %
Traitement A 54 43 79,6
Traitement B 46 31 67,4
⚫ Relation ou non
1. H0 : Il n’existe pas de relation entre le traitement et
le résultat produit.
2. Choix du test :
Deux variables qualitatives :
•Le traitement : modalités : A et B
•Le résultat : modalités : succès et échec
→Test X²
[Link] du seuil de signification: 5%
⚫ tableau de contingence:
A partir des données de l’énoncé,
↓
reconstituer le tableau de contingence à 2
lignes et 2 colonnes
⚫ 4. Conditions d’application du test
Tableau de contingence:
Résultat Total
succès Echec
Traitement A 43 11 54
Traitement B 31 15 46
total 74 26 100
calcul des effectifs théoriques
Résultat Total
succès Echec
Traitement A 43 (40) 11 (14) 54
Traitement B 31 (34) 15 (12) 46
total 74 26 100
⚫ On remarque que tous les effectifs théoriques sont
supérieurs à 5.
⚫ Illustrons la façon dont l’effectif correspondant à l’effectif observé 43 a
été calculé. Il s’agit donc de l’effectif des sujets qui ont reçu le
traitement A et qui sont des succès.
⚫ Selon H0, les groupes A et B ont la même distribution en matière de
résultats obtenu. Le nombre de succès grâce au traitement A devrait
être : (74/100) x54=40,0
⚫ En pratique, pour éviter cette règle de trois et effectuer machinalement
les calculs, on multiplie le total ligne par le total correspondant à la
case, le résultat est divisé par le total général.
⚫ On remarque que tous les effectifs théoriques sont supérieurs à 5.
5. Exécution du test :
X²= ∑ (O-C)²/C
• O est l’effectif observé de la case,
• C est l’effectif calculé
Résultat Total
succès Echec
Traitement A 43 (40) 11 (14) 54
Traitement B 31 (34) 15 (12) 46
total 74 26 100
X²= X²= ∑ (O-C)²/C = (43-40)²/40 + (31- 34)²/34+ (11- 14)²/14+ (15
12)²/12= 1,93
• Le ddl étant égal à 1, la table de khi-deux montre que le X2 de la
table = 3,84
6. Décision au seuil choisi et sens de la liaison
X²c =1,93 < X² table (3,84) ,
la différence entre les pourcentages de succès
des deux traitements n’est pas donc
significative contrairement à ce que laissait
supposer un examen superficiel des résultats
et Ho est acceptée.
Test de l’écart réduit : z
⚫ Test de l’écart réduit : z
- La comparaison de deux pourcentages P1 et
P2 observés sur N1 et N2 cas
respectivement, est basée sur l’écart réduit :
⚫ Où P0 et (1-P0) désignent les proportions
évaluées sur l’ensemble des deux
échantillons.
⚫ Conditions d'application:
n₁. Po≥ 5 et n₁.(1- po) ≥ 5
n2. Po ≥ 5 et n2.(1- po) ≥ 5
Étapes:
1.-Formulation de l’hypothèse nulle, notée Ho qui est
une hypothèse d’absence de différence.
• Dans notre exemple, H0 pourrait s’énoncer :
• Le traitement et le résultat produit sont indépendants;
• Il n’existe pas de relation entre le traitement et le
résultat produit ;
Il n’existe pas de différence entre les deux traitements.
Comparaison de deux
moyennes
Comparaison de 2 moyennes observées sur 2
échantillons indépendants
Si les effectifs des deux échantillons sont grands
(supérieurs à 30) :
⚫ Les étapes de réalisation du test de l’hypothèse
⚫ 1. Formulation des hypothèses: H0 : µ = µH0 H1 : µ µH0
⚫ [Link] le risque α = 0.05 (5%)
⚫ 3. Vérifier les conditions d’application du test
(n1 ≥ 30 et n2 ≥ 30 )
⚫ 4. Choix du test : Test Z de l’écart réduit(variable qualitative/v.
quantitative)
⚫ 5. Application du test:
⚫ 6. Déterminer la valeur p de signification de la différence et
conclure– On utilise la table Z
Principe du test de l’écart-réduit Z
Consiste à comparer des paramètres en testant leurs différences
Test Z de l’écart réduit-principe
Hypothèse nulle :
– H0: m1= m
[Link] le risque α = 0.05 (5%)
3. Vérifier les conditions d’application du test:
N1 ≥ 30 et N2 ≥ 30
4. Choix du test : Test de l’écart réduit
⚫ Détermination de la valeur de Z α
correspondant à un risque α = 0.05 (5%)
Test Z (Ɛ ) ou de l’écart réduit
⚫ Interprétation du test Z
– On utilise la table Z Au risque α = 5% :
• Si la valeur z < 1,96→ on ne rejette pas H0 → On ne
peut pas affirmer que les échantillons proviennent de
populations différentes → la différence entre les
paramètres n’est pas significative.
• Si la valeur z ≥ 1,96→ on rejette H0 → les
échantillons proviennent de populations différentes
→ On affirme que la différence entre les paramètres
est significative
Exemple-
On veut comparer le périmètre crânien moyen d’un
échantillon de 82 nouveau-nés prématurés ( mais de
développement normal) m1 = 30,06 variance
(S1)2=2,04 ; à celui d’un échantillon de 87 nouveau-
nés dysmatures (de développement intra-utérin
retardé par rapport au terme), m2 = 30,72 variance
(S2)2= 1,96
1. Formulation de l’hypothèse nulle
H0 : Les périmètres crâniens moyens des populations
dont sont tirés les deux échantillons de nouveau-nés
sont identiques : m1= m2
2. Donner le risque α = 0.05 (5%)
⚫ choix du test : N1 > 30 et n2 ˃30 => test de
l’écart réduit
3. Vérifier les conditions d’application du test:
N1 ≥ 30 et N2 ≥ 30
4. choix du test : Test de l’écart réduit
⚫ Références bibliographiques:
1) Ancelle T. Evaluation des méthodes d’analyse appliquées aux sciences de la vie et de la santé – statistique éd
Maloine 2010
2) Hanba Mustapha «Statistique inférentielle, tests d’hypothèses Comparaison de deux pourcentages
Comparaison de deux moyennes» cours 2025
3) ZANOUN .N 2023-2024 «Statistique inférentielle, tests d’hypothèses Comparaison de deux
pourcentages Comparaison de deux moyennes» cours 2023-2024