Université des Sciences et de la Technologie Houari Boumediene
Faculté de Mathématiques
Département de Probabilités et Statistiques
Analyse de la Variance à Deux Facteurs
Réalisé par : LAIB Fella et CHIKH Hadil
Encadré par : M. Rih
Avril 2025
1 Objectif
L’ANOVA à deux facteurs permet d’étudier l’effet de deux facteurs qualitatifs (A et B) ainsi que leur
interaction sur une variable quantitative de réponse.
2 Présentation du modèle
Le modèle général de l’ANOVA à deux facteurs est :
Yijk = µ + αi + βj + (αβ)ij + εijk
où :
• µ : moyenne générale,
• αi : effet du niveau i du facteur A,
• βj : effet du niveau j du facteur B,
• (αβ)ij : effet d’interaction entre A et B,
• εijk : erreur aléatoire.
Code R pour le modèle
# Modèle général en R
aov(Y ~ A * B, data = data)
3 Hypothèses nécessaires
Pour que l’ANOVA soit applicable de manière valide, les hypothèses suivantes doivent être respectées :
• Indépendance des observations.
• Normalité des erreurs : εijk ∼ N (0, σ 2 ).
• Homogénéité des variances entre les différents groupes (homoscédasticité).
4 Sources de variabilité
La variabilité totale de la variable réponse est décomposée en :
• Variabilité due au facteur A.
• Variabilité due au facteur B.
• Variabilité due à l’interaction entre A et B.
1
• Variabilité résiduelle (erreur).
Mathématiquement, la somme totale des carrés (SCT) se décompose comme :
SCT = SCA + SCB + SCAxB + SCE
où :
• SCA : Somme des carrés due au facteur A,
• SCB : Somme des carrés due au facteur B,
• SCAxB : Somme des carrés due à l’interaction,
• SCE : Somme des carrés de l’erreur.
5 Formules des sommes des carrés et des statistiques F
Sommes des carrés
• Somme des carrés totale :
a X
X b X
n
SCT = (yijk − ȳ...)2
i=1 j=1 k=1
• Somme des carrés due au facteur A :
a
X
SCA = bn (ȳi.. − ȳ...)2
i=1
• Somme des carrés due au facteur B :
b
X
SCB = an (ȳ.j. − ȳ...)2
j=1
• Somme des carrés d’interaction :
a X
X b
SCAB = n (ȳij. − ȳi.. − ȳ.j. + ȳ...)2
i=1 j=1
• Somme des carrés résiduelle :
a X
X b X
n
SCR = (yijk − ȳij. )2
i=1 j=1 k=1
Statistiques F
Les statistiques F permettent de tester les effets des facteurs. Elles sont calculées comme suit :
M CA M CB M CAxB
FA = , FB = , FAxB =
M CE M CE M CE
où :
SCA SCB SCAxB SCE
M CA = , M CB = , M CAxB = , M CE =
a−1 b−1 (a − 1)(b − 1) ab(n − 1)
6 Tableau de l’ANOVA
USTHBblue!20 Source ddl Carré moyen Statistique F
Facteur A a−1 CMA = SCA /(a − 1) FA = CMA /CMR
Facteur B b−1 CMB = SCB /(b − 1) FB = CMB /CMR
Interaction A×B (a − 1)(b − 1) CMAB = SCAB /((a − 1)(b − 1)) FAB = CMAB /CMR
Résidus ab(n − 1) CMR = SCR/(ab(n − 1))
2
Code R pour le tableau
# Résultat de l’ANOVA
summary(aov2)
7 Conditions de validité de l’ANOVA à deux facteurs
Pour garantir la validité des tests F :
• Résidus indépendants,
• Résidus normalement distribués (loi N (0, σ 2 )),
• Homogénéité des variances (homoscédasticité).
Vérifications possibles :
• Normalité : test de Shapiro-Wilk,
• Homogénéité : test de Bartlett ou de Levene,
• Indépendance : test de Durbin-Watson.
...
# Test de n o r m a l i t : Shapiro - Wilk
shapiro . test ( residuals ( model ) )
# Test d ’ h o m o g n i t des variances : Bartlett
bartlett . test ( Y ~ interaction (A , B ) , data = data )
# Ou test de Levene
library ( car )
leveneTest ( Y ~ interaction (A , B ) , data = data )
# Test d ’ i n d p e n d a n c e : Durbin - Watson
library ( lmtest )
dwtest ( model )
8 Interprétation des résultats
Après avoir calculé les statistiques F :
• Si la statistique F associée à un facteur est significative (p-value < 0.05), alors ce facteur a un effet
significatif sur la variable réponse.
• Si l’interaction est significative, l’effet d’un facteur dépend du niveau de l’autre facteur, et il est
nécessaire d’interpréter l’interaction avant d’interpréter les effets principaux.
• Si l’interaction n’est pas significative, on peut analyser séparément les effets principaux.
9 Exemple Pratique sous R
> anova_model <- aov(mpg ~ am * cyl, data = mtcars)
> residus = residuals(anova_model)
> [Link](residus)
Shapiro-Wilk normality test
data: residus
W = 0.96277, p-value = 0.3263
3
Ici, on accepte H0 car la p-value > 0,05, donc les résidus sont considérés comme normalement
distribués.
> [Link](residus ~ am, data = mtcars)
Bartlett test of homogeneity of variances
data: residus by am
Bartlett’s K-squared = 2.2254, df = 1, p-value = 0.1358
Ici, on accepte H0 car la p-value > 0,05, donc les variances des am sont homogènes.
> [Link](residus ~ cyl, data = mtcars)
Bartlett test of homogeneity of variances
data: residus by cyl
Bartlett’s K-squared = 7.1493, df = 2, p-value = 0.02802
On rejette H0 car la p-value < 0,05, donc les variances des cyl ne sont pas homogènes.
> anova_model <- aov(mpg ~ am * cyl, data = mtcars)
> summary(anova_model)
Df Sum Sq Mean Sq F value Pr(>F)
am 1 405.2 405.2 44.064 4.85e-07 ***
cyl 2 456.4 228.2 24.819 9.35e-07 ***
am:cyl 2 25.4 12.7 1.383 0.269
Residuals 26 239.1 9.2
---
Signif. codes: 0 ‘***’ 0.001 ‘**’ 0.01 ‘*’ 0.05 ‘.’ 0.1 ‘ ’ 1
Interprétation de l’ANOVA
• Effet principal de am (transmission automatique vs manuelle) :
– F (1, 26) = 44.064, p < 0.001
– Effet très fortement significatif (∗ ∗ ∗).
– Le type de transmission a un effet important sur la consommation (mpg). Les voitures au-
tomatiques et manuelles ont des consommations significativement différentes.
• Effet principal de cyl (nombre de cylindres) :
– F (2, 26) = 24.819, p < 0.001
– Effet très fortement significatif (∗ ∗ ∗).
– Le nombre de cylindres influence significativement la consommation (mpg) : la consommation
varie selon que la voiture a 4, 6 ou 8 cylindres.
• Effet d’interaction am:cyl :
– F (2, 26) = 1.383, p = 0.269
– Effet non significatif.
– Il n’y a pas d’interaction significative entre le type de transmission et le nombre de cylindres
: l’effet de la transmission est relativement stable quel que soit le nombre de cylindres, et
inversement.
Conclusion générale : La transmission (am) et le nombre de cylindres (cyl) influencent tous deux
séparément la consommation (mpg), sans interaction notable entre eux.
4
Conclusion
L’ANOVA à deux facteurs est une méthode essentielle pour analyser l’impact simultané de plusieurs
facteurs sur une variable quantitative. La compréhension des hypothèses, des sources de variabilité et
l’interprétation correcte des résultats sont cruciales pour des conclusions fiables.