Modélisation par Plans d'Expériences
Modélisation par Plans d'Expériences
Toute reproduction sans autorisation du Centre français d’exploitation du droit de copie est strictement interdite.
© Techniques de l’Ingénieur, traité Mesures et Contrôle R 275 − 1
MODÉLISATION PAR LES PLANS D’EXPÉRIENCES _____________________________________________________________________________________________
Toute reproduction sans autorisation du Centre français d’exploitation du droit de copie est strictement interdite.
R 275 − 2 © Techniques de l’Ingénieur, traité Mesures et Contrôle
____________________________________________________________________________________________ MODÉLISATION PAR LES PLANS D’EXPÉRIENCES
1.2 Notion de modélisation ■ Lorsque l’on attribue la valeur – 1 au niveau bas d’un facteur et la
valeur + 1 au niveau haut, on effectue deux modifications impor-
mathématique tantes :
1. On change l’unité de mesure. Par exemple, si le niveau bas
En l’absence de toute information sur la fonction qui lie la réponse d’un facteur est 10 oC et le niveau haut 30 oC, il y a 20 oC entre ces
aux facteurs, on se donne, a priori, une loi d’évolution dont la for- deux valeurs, soit 20 fois l’unité de température. Entre – 1 et + 1 il y
mulation la plus générale est la suivante : a deux unités nouvelles. La nouvelle unité vaut 10 oC, on lui donne
le nom de Pas ;
y = f (x1 , x2 , x3 ..., xn ) (1) 2. On déplace l’origine des mesures. Dans l’exemple choisi, le
milieu de l’intervalle [– 1 + 1] correspond à une température de
■ Cette fonction est trop générale et il est d’usage d’en prendre un 20 oC. La nouvelle origine, notée zéro, diffère donc de l’origine
développement limité de Taylor. Si les dérivées du développement exprimée en unité courante.
de Taylor peuvent être considérées comme des constantes le déve-
loppement précédent prend la forme d’un polynôme de degré plus ■ Ces deux modifications entraînent l’introduction de nouvelles
ou moins élevé : variables que l’on appelle variables centrées réduites (v.c.r.) : cen-
trées pour indiquer le changement d’origine et réduites pour
signaler la nouvelle unité.
y = a 0 + ∑ a i x i + ∑ a ij x i x j + ∑ a ii x i + ...
2
(2)
Le passage des variables d’origine A aux variables centrées
● y est la grandeur à laquelle s’intéresse l’expérimentateur. C’est réduites x, et inversement, est donné par la formule suivante
la réponse ou la grandeur d’intérêt. Elle est mesurée au cours de (A0 étant la valeur centrale en unités courantes) :
l’expérimentation et elle est obtenue avec une précision donnée. A–A
● xi représente le niveau attribué au facteur i . C’est la valeur de la x = ----------------0- (4)
pas
coordonnée du facteur i retenue par l’expérimentateur pour réaliser
un essai. Cette valeur est parfaitement connue. On supposera L’intérêt des v.c.r. est de pouvoir présenter les plans d’expériences
même, par la suite, que ce niveau est déterminé sans erreur (hypo- de la même manière quels que soient les domaines d’étude retenus
thèse classique de la régression). et quels que soient les facteurs. La théorie des plans d’expériences
présente ainsi une grande généralité.
● a0 , ai , aij , aii sont les coefficients du modèle mathématique
adopté a priori. Ils ne sont pas connus et doivent être calculés à par-
tir des résultats des expériences.
Toute reproduction sans autorisation du Centre français d’exploitation du droit de copie est strictement interdite.
© Techniques de l’Ingénieur, traité Mesures et Contrôle R 275 − 3
MODÉLISATION PAR LES PLANS D’EXPÉRIENCES _____________________________________________________________________________________________
nues (s’il y a p coefficients dans le modèle choisi a priori ). Ce ●Critère de presque orthogonalité
système s’écrit d’une manière simple en notation matricielle : Si la sous-matrice obtenue en retirant la première ligne et la pre-
y = Xa + e (5) mière colonne de la matrice (t X X)–1 est diagonale, le critère de
presque orthogonalité est respecté.
avec y vecteur des réponses, ● Critère de D-optimalité
X matrice de calcul, qui dépend des points expérimentaux Si l’on veut la plus petite variance possible sur l’ensemble des
choisis pour exécuter le plan et du modèle postulé, coefficients, il faut que les termes diagonaux de la matrice de dis-
a vecteur des coefficients, persion soient eux-mêmes les plus petits possibles. On obtient ce
e vecteur des résidus. résultat en maximisant le déterminant de la matrice t X X. Le critère
correspondant s’appelle le critère de D-optimalité.
Ce système ne peut pas, en général, être résolu simplement car le
nombre d’équations est inférieur au nombre d’inconnues. En effet, il ●Critère de A-optimalité
y a n équations et p + n inconnues. Cette résolution ne peut être La somme des variances des coefficients peut être minimisée.
menée à bien que si l’on utilise une méthode de régression qui Dans ce cas, on parle de critère de A-optimalité. Un plan est A-opti-
introduit p équations supplémentaires. La plupart du temps cette mal si la position des points expérimentaux minimise la trace de la
méthode est basée sur le critère d’optimisation des moindres car- matrice (t X X)–1.
rés. On obtient ainsi les estimations les plus probables des coeffi- ● Critère de G-optimalité
cients que l’on note :
Parmi les variances des coefficients il y en a une qui est plus
â grande que toutes les autres. On peut vouloir que cette forte
Le résultat de ce calcul est : variance soit la plus faible possible. Le critère correspondant
s’appelle le critère de G-optimalité.
â = (t X X)–1t X y (6) ●Critère d’isovariance par rotation
formule dans laquelle la matrice tX est la matrice transposée de X. On désire que les réponses calculées avec le modèle issu du plan
Il existe de nombreux logiciels qui exécutent ce calcul et qui don- d’expériences aient une erreur de prévision identique pour des
nent directement les valeurs des coefficients. points situés à la même distance du centre du domaine d’étude.
Dans ce cas on parle de plan isovariant par rotation (rotatable ) [2].
Deux matrices interviennent constamment dans la théorie des
plans d’expériences : ■ On remarquera que ces critères conduisent à des qualités de
modélisation différentes. Certains privilégient une bonne précision
— la matrice d’information t X X ;
sur les coefficients du modèle, d’autres assurent une répartition
— la matrice de dispersion (t X X)–1.
homogène de l’erreur de prévision.
Nous allons maintenant appliquer les notions et les propriétés
que nous venons de décrire aux plans d’expériences les plus clas-
1.6 Dispersion des coefficients siques. Nous verrons successivement les plans suivants :
— plans factoriels complets à deux niveaux ;
Les statisticiens ont établi la formule qui donne l’erreur sur les — plans factoriels fractionnaires à deux niveaux ;
coefficients du modèle lorsque l’on a une estimation du résidu. — autres plans à deux niveaux ;
Cette formule, sous sa forme la plus simple, est la suivante : — plans à plusieurs niveaux ;
–1
— plans pour surfaces de réponse ;
2 t
Diag V ( â ) = Diag σ r ( X X ) (7) — plans de mélanges ;
— plans booléens.
C’est-à-dire que les variances des coefficients sont égales à la
2
variance du résidu, σ r , multipliée par l’élément diagonal de la
matrice de dispersion. 2. Plans factoriels complets
Les variances des coefficients sont les termes diagonaux de la
matrice V (â). On obtient ces variances par identification. à deux niveaux
Pour ces plans, le nombre des niveaux de chaque facteur est res-
treint à deux. Toutes les combinaisons de niveaux sont effectuées au
1.7 Critères d’optimalité cours de l’expérimentation. Ces plans peuvent être utilisés indistinc-
tement pour les variables continues et pour les variables discrètes.
Suivant les objectifs de l’étude, les meilleurs emplacements des
points expérimentaux dans le domaine d’étude ne sont pas les
mêmes. En effet, la disposition optimale des points expérimentaux 2.1 Plan à deux facteurs
dépend de plusieurs choix effectués par l’expérimentateur, choix
qui dépendent eux-mêmes des caractéristiques de l’étude et des Pour deux facteurs, le domaine d’étude est un carré. Par exemple,
objectifs à atteindre. Ces choix dépendent d’abord du domaine la figure 6 représente un plan factoriel complet à deux facteurs. Le
d’étude et du modèle a priori retenus par l’expérimentateur. Ils modèle mathématique postulé est un modèle du premier degré par
dépendent ensuite d’un critère d’optimalité. rapport à chaque facteur. Le modèle est :
■ Les principaux critères d’optimalité sont les suivants. y = a0 + a1x1 + a2x2 + a12x1x2 + e (8)
Toute reproduction sans autorisation du Centre français d’exploitation du droit de copie est strictement interdite.
R 275 − 4 © Techniques de l’Ingénieur, traité Mesures et Contrôle
____________________________________________________________________________________________ MODÉLISATION PAR LES PLANS D’EXPÉRIENCES
Exemple : l’essai no 1 est celui pour lequel les deux facteurs étu-
diés sont aux niveaux bas, 40 % (ou – 1 en v.c.r.) et 10 oC (ou – 1 en
Température v.c.r.). Cet essai no 1 correspond au point A de la figure 6.
D
L’essai no 2 est celui pour lequel le premier facteur est fixé au niveau
C
30 °C +1 haut, 80 % (ou + 1 en v.c.r.) et le second facteur est fixé au niveau bas :
10 oC (ou – 1 en v.c.r.). Cet essai no 2 correspond au point B.
Ce tableau peut être écrit en utilisant les unités physiques habi-
tuelles (tableau 1) ou en utilisant les unités centrées réduites
(tableau 2). Dans ce dernier cas, il est prudent de rappeler la signifi-
10 °C --1 cation de ces unités en indiquant la valeur des niveaux haut et bas
A B de chacun des facteurs.
--1 +1 La représentation qui utilise les unités centrées réduites est plus
Concentration générale que celle qui emploie les unités physiques habituelles.
40 % 80 %
C’est celle qui est le plus souvent adoptée et c’est celle que nous uti-
La théorie des plans d'expériences montre que les meilleurs emplacements liserons par la suite.
sont les sommets A, B, C, D du domaine d'étude.
Figure 6 – Meilleurs emplacements des points expérimentaux La représentation géométrique et la représentation par
dans le cadre du modèle du premier degré tableaux sont équivalentes. Les tableaux (ou matrice d’expé-
riences) présentent l’avantage de pouvoir être utilisés quel que
soit le nombre de facteurs, c’est-à-dire quel que soit le nombre
de dimensions de l’espace expérimental. Il est utile de savoir
On démontre que les meilleurs emplacements des points d’expé-
passer d’une représentation à l’autre pour bien interpréter les
riences sont situés aux sommets du domaine d’étude.
résultats des plans d’expériences.
1 (A) –1 –1 1 –1 –1 y1 y1 = 1180
2 (B) +1 –1 2 +1 –1 y2 y2 = 1 450
3 (C) –1 +1 3 –1 +1 y3 y3 = 1 240
4 (D) +1 +1 4 +1 +1 y4 y4 = 1 530
Toute reproduction sans autorisation du Centre français d’exploitation du droit de copie est strictement interdite.
© Techniques de l’Ingénieur, traité Mesures et Contrôle R 275 − 5
MODÉLISATION PAR LES PLANS D’EXPÉRIENCES _____________________________________________________________________________________________
â 0 + + + + y1
â 1 1 – + – + y2 --1 0 +1
= --- (11) Facteur 1
n – – + + y3
â 2
L'effet du facteur 1 est la variation de la réponse entre le centre du domaine
â 12 + – – + y4
d'étude et le niveau haut du facteur 1; y+ (y--) est la valeur moyenne de la
réponse au niveau haut (bas) du facteur 1.
Cette relation matricielle peut s’écrire sous forme de quatre rela-
tions algébriques :
Figure 7 – Effet du facteur 1 dans le plan moyen du facteur 2
1
â 0 = --- 3 + y 1 + y 2 + y 3 + y 4 4 (12)
4
1 L’interaction apparaît comme la demi-différence entre l’effet du
â 1 = --- 3 – y 1 + y 2 – y 3 + y 4 4 (13) facteur 1 au niveau haut du facteur 2 (effet noté ef + ) et l’effet du fac-
4
teur 1 au niveau bas du facteur 2 (effet noté ef – ). Elle traduit une
1 variation de l’effet d’un facteur en fonction du niveau d’un autre
â 2 = --- 3 – y 1 – y 2 + y 3 + y 4 4 (14)
4 facteur.
1 L’interaction â12 entre les deux facteurs 1 et 2 est une interaction
â 12 = --- 3 + y 1 – y 2 – y 3 + y 4 4 (15) d’ordre 2.
4
Connaissant les coefficients, on peut écrire le modèle de régres-
sion qui servira à faire des prévisions :
ŷ = â 0 + â 1 x 1 + â 2 x 2 + â 12 x 1 x 2
2.8 Exemple. Mesure des concentrations
(16)
par ultrasons
■ Description de l’étude
2.5 Signification de â0
La vitesse de propagation des ultrasons dans un fluide dépend
essentiellement de la température et de la nature du fluide. Si le
Si nous donnons à x1 et x2 la valeur zéro, nous définissons le cen- fluide est constitué d’un mélange de plusieurs produits, on peut
tre du domaine d’étude. La relation (16) devient alors : trouver, à une température donnée, la relation qui existe entre la
concentration d’un des constituants du mélange et la vitesse de pro-
ŷ0 = + aˆ 0 (17) pagation. Appliquons ce principe à un mélange d’eau et d’alcool.
Définissons les facteurs et le domaine d’étude :
Le coefficient â0 est la valeur calculée de la réponse au centre du — facteur 1 : concentration en éthanol entre 40 % et 80 % ;
domaine d’étude. — facteur 2 : température entre 10 oC et 30 oC.
La réponse est la vitesse des ultrasons utilisés.
L’expérimentateur décide d’exécuter un plan factoriel complet 22.
2.6 Signification de â1 Ce plan est illustré par la figure 6 et le résultat consigné dans le
tableau 3 (§ 2.3). On obtient :
Toute reproduction sans autorisation du Centre français d’exploitation du droit de copie est strictement interdite.
R 275 − 6 © Techniques de l’Ingénieur, traité Mesures et Contrôle
____________________________________________________________________________________________ MODÉLISATION PAR LES PLANS D’EXPÉRIENCES
30 1
Température (facteur 2)
Vitesse (m/s) Vitesse (m/s)
1 490 1 500
+140
1 385
1 350 1 350 --35 0,5
1 315
1 210
--1 0 +1 --1 0 +1
20 0
40 % 80 % 10 °C 30 °C
1 250 1 300 1 350 1 400 1 450
Concentration en éthanol (facteur 1) Température (facteur 2)
-0,5
Figure 8 – Effet de la concentration en éthanol et de la température
sur la vitesse des ultrasons
1 200
10 --1
L’effet de la concentration est de 140 m/s pour une variation de --1 -0,5 0 0,5 1
20 %, soit 7 m/s pour 1 %. On peut donc espérer avoir une bonne
40 50 60 70 80
précision sur la mesure de la concentration.
Concentration en éthanol (facteur 1)
L’effet de la température est de 35 m/s pour 10 oC,
soit 3,5 m/s
pour 1 oC. Il en résulte que le contrôle de la température est absolu-
ment indispensable pour faire une bonne estimation de la concen- Figure 9 – Courbes d’isoréponses montrant l’influence
tration. de la concentration en éthanol et de la température
sur la vitesse des ultrasons
Il y a une légère interaction qui devra être prise en compte pour
les mesures de grande précision, car la courbe de la vitesse des
ultrasons en fonction de la concentration n’est pas tout à fait une
droite. Pour avoir une vue d’ensemble des résultats, on trace les
courbes isocinétiques dans le domaine d’étude (figure 9). 3. Plans factoriels
fractionnaires
2.9 Plans factoriels à k facteurs
à deux niveaux 2k –q
à deux niveaux
Les plans factoriels fractionnaires sont des plans factoriels qui
permettent d’étudier tous les facteurs, mais dont le nombre d’essais
La théorie des plans d’expériences vient d’être appliquée aux est réduit par rapport aux plans factoriels complets. Un plan facto-
plans factoriels complets à deux niveaux et un exemple a été pré- riel fractionnaire a 2 fois moins ou 4 fois moins ou 2q fois moins
senté. Les principes restent les mêmes si on augmente le nombre de d’essais que le factoriel complet correspondant.
facteurs. L’espace expérimental possède autant de dimensions
À la fin d’un plan factoriel fractionnaire, on a un système de n
qu’il y a de facteurs et le modèle mathématique correspond aux
équations à p inconnues avec p plus grand que n. On ne sait pas
relations (2) et (5). Les coefficients du modèle sont la réponse au
résoudre un tel système. Comme on ne peut pas augmenter le nom-
centre du domaine expérimental, les effets principaux, les interac-
bre d’équations, il faut diminuer le nombre d’inconnues. On y arrive
tions d’ordre 2, les interactions d’ordre 3, etc., l’interaction d’ordre k.
en utilisant un artifice : on regroupe les inconnues et on résout le
Un plan comportant k facteurs à deux niveaux est noté 2k : système pour ces groupes d’inconnues. On appelle ces groupes
— le k en exposant signifie qu’il y a k facteurs étudiés ; d’inconnues des contrastes et on dit que les inconnues sont aliasées
— le 2 indique le nombre de niveaux par facteur. dans les contrastes.
On remarquera que cette notation indique également le nombre
d’essais à faire. Ce nombre devient rapidement très important. Pour
seulement 7 facteurs, il faudrait exécuter 128 essais. Pour diminuer 3.1 Notation des plans factoriels
le nombre des essais, en conservant la possibilité d’étudier tous les
facteurs, on a introduit les plans factoriels fractionnaires à deux fractionnaires
niveaux (§ 3).
Pour k facteurs prenant 2 niveaux le plan complet est noté 2k
(§ 2.9).
2.10 Matrices d’Hadamard 1
Le plan fractionnaire, moitié du plan complet, a --- 2 k ou 2k–1
essais. 2
Les matrices d’Hadamard sont des matrices particulières présen- On peut donner une signification à chaque caractère de cette
tant les propriétés suivantes : notation :
— les éléments sont + 1 ou – 1 ; — le k signifie qu’il y a k facteurs étudiés ;
— ces matrices sont carrées et possèdent un nombre de lignes — le 2 signifie que chaque facteur prend 2 niveaux ;
(ou de colonnes) égal à 2 ou à un multiple de 4 ; — le 1 signifie que le nombre d’essais du plan a été divisé par 21.
— ces matrices sont orthogonales, c’est-à-dire que le produit sca- Un plan 25 – 2 permet d’étudier cinq facteurs prenant chacun
laire de deux lignes (ou de deux colonnes) est égal à zéro. 2 niveaux en 8 essais. Le plan complet a été divisé par 22 = 4.
La matrice de calcul, X, d’un plan factoriel est une matrice d’Hada- Un plan 2k – q permet d’étudier k facteurs prenant chacun
mard. 2 niveaux. Le plan complet a été divisé par 2q.
Toute reproduction sans autorisation du Centre français d’exploitation du droit de copie est strictement interdite.
© Techniques de l’Ingénieur, traité Mesures et Contrôle R 275 − 7
MODÉLISATION PAR LES PLANS D’EXPÉRIENCES _____________________________________________________________________________________________
On ne sait pas résoudre le système (20) où p est plus grand que n. Un plan est un ensemble de points d'expériences. L'ensemble des points
"noirs" forme un plan optimal (matrice d'Hadamard); de même l'ensemble
On adopte un autre modèle, le modèle de substitution ou le des points "cyan".
modèle 2, ne contenant que n inconnues. Cela revient à regrouper
les coefficients du modèle 1 dans de nouvelles inconnues, les Figure 10 – Division d’un plan factoriel complet 23 en deux plans
contrastes [5]. Les contrastes sont notés , . On s’arrange pour que factoriels fractionnaires 23–1, un plan noir et un plan cyan
le système possède n équations et n inconnues, il s’écrit :
y = Xs , (21)
Si on effectue 4 essais, on obtient un système de 4 équations à
( n ,1 ) (n,n) ( n ,1 )
8 inconnues [cf. relation (20)] :
La matrice Xs dépend de l’emplacement des points expérimen-
taux du plan fractionnaire et du modèle 2. y = X a
(29)
(4, 1) (4, 8) (8, 1)
Pour interpréter les résultats, Il faut trouver la relation qui existe
entre les contrastes du modèle 2 et les coefficients du modèle 1. où :
Cette relation dépend de la matrice Xs (n,n ) et de la matrice X (n, p ).
On décompose la matrice X de la formule (20) en 2 sous-matrices,
Xs (n,n ) et Xβ (n , p – n ) : +1 –1 –1 +1 +1 –1 –1 +1
+1 +1 –1 –1 –1 –1 +1 +1
X =
X = Xs Xβ (22) +1 –1 +1 –1 –1 +1 –1 +1
La relation (22) peut alors être développée de la manière suivante, +1 +1 +1 +1 +1 +1 +1 +1
en décomposant la matrice a en deux sous-matrices aα (n,1) et
aβ (p – n,1) :
et
a0
y = Xa =
aα
(23)
Xs Xβ (30)
aβ a1
a2
soit :
y = Xs aα + X β aβ (24) a3
a =
En égalant les expressions (21) et (24) du vecteur réponse y, on a 12
obtient : a 13
y = Xs , = Xs aα + Xβ aβ (25)
a 23
d’où :
a 123
, = aα + (t Xs Xs)–1 t Xs Xβ aβ (26)
On ne sait pas résoudre le système (29). Comme il n’y a que
Il est donc possible de calculer les contrastes du modèle 2 en 4 essais, on ne peut calculer que 4 inconnues.
fonction des coefficients du modèle 1.
On adopte le modèle 2 :
La matrice :
(t Xs Xs)–1 t Xs Xβ (27) y = ,0 + ,1 x1 + ,2 x2 + ,3 x3 (31)
est la matrice des aliases. C’est une matrice (n,p – n). Les 4 essais conduisent au système [cf. relation (21)] :
y = Xs ,
(32)
(4, 1) (4, 4) (4, 1)
3.3 Applications avec :
+1 –1 –1 +1
3.3.1 Plan factoriel fractionnaire 23 – 1 Xs = +1 +1 –1 –1
+1 –1 +1 –1
On veut étudier 3 facteurs en ne faisant que 4 essais. On prend la +1 +1 +1 +1
précaution de choisir les 4 essais pour que la matrice Xs soit une
matrice orthogonale d’Hadamard (§ 2.10). Les 4 points choisis sont et :
disposés comme l’indique la figure 10. ,0
Le modèle mathématique de la réponse d’un plan factoriel à 3 fac-
,1
teurs comporte 8 coefficients (modèle 1) : , =
,2
y = a0 + a1x1 + a2x2 + a3x3 + a12x1x2
+ a13x1x3 + a23x2x3 + a123x1x2x3 (28) ,3
Toute reproduction sans autorisation du Centre français d’exploitation du droit de copie est strictement interdite.
R 275 − 8 © Techniques de l’Ingénieur, traité Mesures et Contrôle
____________________________________________________________________________________________ MODÉLISATION PAR LES PLANS D’EXPÉRIENCES
Toute reproduction sans autorisation du Centre français d’exploitation du droit de copie est strictement interdite.
© Techniques de l’Ingénieur, traité Mesures et Contrôle R 275 − 9