0% encontró este documento útil (0 votos)
135 vistas19 páginas

Diseño Factorial 2k en Estadística

Este documento describe los diseños factoriales 2k, que son experimentos con k factores cada uno con 2 niveles. Explica cómo se realizan réplicas de cada combinación de tratamientos y cómo se codifican y analizan los datos usando un modelo de regresión. Proporciona un ejemplo numérico para ilustrar el proceso.
Derechos de autor
© All Rights Reserved
Nos tomamos en serio los derechos de los contenidos. Si sospechas que se trata de tu contenido, reclámalo aquí.
Formatos disponibles
Descarga como DOCX, PDF, TXT o lee en línea desde Scribd
0% encontró este documento útil (0 votos)
135 vistas19 páginas

Diseño Factorial 2k en Estadística

Este documento describe los diseños factoriales 2k, que son experimentos con k factores cada uno con 2 niveles. Explica cómo se realizan réplicas de cada combinación de tratamientos y cómo se codifican y analizan los datos usando un modelo de regresión. Proporciona un ejemplo numérico para ilustrar el proceso.
Derechos de autor
© All Rights Reserved
Nos tomamos en serio los derechos de los contenidos. Si sospechas que se trata de tu contenido, reclámalo aquí.
Formatos disponibles
Descarga como DOCX, PDF, TXT o lee en línea desde Scribd

ITSA

Diseñ o
Factorial 2k
ESTADISTICA INFERENCIAL

JENNY ARLEN GARCIA HERNANDEZ


Diseño Factorial 2k
El más importante de los casos especiales de los diseños factoriales es el
que tiene k factores cada uno a dos niveles. Estos niveles pueden ser
cuantitativos, valores de temperatura o presión, o pueden ser cualitativos, tales
como 2 máquinas o dos operadores, o tal vez pueda ser la presencia o
ausencia de un factor. Una réplica completa de tal diseño requiere 2 × 2 × 2 × · ·
· × 2 = 2k observaciones y se conoce como un diseño factorial 2k.

Como cada factor en el experimento tiene 2 niveles los llamaremos nivel


bajo (-) y nivel alto (+). El diseño mas pequeño en este tipo de experimento es el
que tiene k = 2 factores. Es importante realizar réplicas de cada tratamiento o
combinación en el experimento ya que esto me permite comparar entre valores
(datos obtenidos en los diferentes niveles de un factor fijando los demás
factores) y dentro de valores (datos obtenidos de una misma combinación), para
entender mejor lo antes establecido vea el ejemplo en l siguiente figura:

Réplica:
I II
2 dentro
Presión

(32.5) (25.98) entre


1 (32) (29)

1 A 2
Temperatura

El número de corridas a realizarse en el experimento es 2k × # réplicas.


Además, también es importante que el orden en que se realizan las corridas sea
aleatorio, es por esto que el experimento es un experimento completamente
aleatorio. Muchas veces
resulta conveniente escribir la data en orden descendente de las combinaciones de
los tratamientos. Esta forma de tabular se le conoce como el orden estándar y es como
sigue:

Combinación Nomenclatura
A B de de
Tratamiento Tratamientos
s
- - A low, B low a0b0 = (1)
+ - A high, B low a1b0 = a
- + A low, B high a0b1 = b
+ + A high, B high a1b1 = ab

Cuando el factor esta en su nivel bajo su exponente es 0 y cuando el


factor esta en su nivel alto su exponente es 1. Gráficamente esta nomenclatura
es representada de la siguiente manera:

b ab (+,+)
(-,+)

(-,-) A (+,-)
(1) a

En un diseño factorial 2k es fácil expresar los resultados del


experimento en términos de un modelo de regresión. Aunque para este tipo
de experimentos se pueden usar modelos de efectos como de promedios, el
modelo de regresión es mucho más natural e intuitivo. La ecuación para un
modelo de regresión sería:
y  0  1x1  2 x 2  
Ejemplo:
Se quiere medir el rendimiento de un químico midiendo la temperatura
y la presión a la que esta expuesto. Supongamos que de la data obtenida los
valores de la temperatura fluctúan entre 100oF y 200oF y los valores de la
presión varían entre 3 y 5 Bars.
Supongamos la siguiente ecuación
resultante del modelo de regresión:
Presi ó n 5
No tiene una explicación, por lo tanto, no
se puede decir que significa este
B intercepto.

3 yˆ  50  0.1X A  1X B
100 A 200

Temperatura Para determinar cual de los dos factores tiene mas peso en
el experimento no puedo fijarme en sus coeficientes, también debo
ver su tabulación ya que el rango de valores de ambos factores es
diferente.

De esta forma resulta muy difícil poder llegar a conclusiones asertivas, es


por esto que para este tipo de experimento es necesario codificar las variables.
La ecuación para codificar las variables (factores) es como sigue:

  X i : var iable _ codificada


Xi  i i
, donde i : var iable _ natural
rangoi
i : promedio _ var iable _ natural
2

Codificando las variables del ejemplo anterior tenemos:


Variable Temperatura:
100  150 200  150
X100   1 X 200  100  1
100
2 2
Variable Presión:
34 54
X3 
2  1 X 5  2  1
2 2

Supongamos que ahora con las variables codificadas la ecuación


resultante del modelo de regresión es la siguiente:
yˆ  30  0.2X A 
1.3X B
El valor de la constante, 30, es el valor de mi respuesta cuando X i está en cero
(cero es el centro de mi región experimental). Ahora tiene una explicación física
porque los ceros están contenidos.
Ahora, ¿Cuál factor, XA o XB, tiene mayor peso en el experimento?
o XB, porque como ahora los valores están codificados pues puedo utilizar
el coeficiente para determinar cual factor tiene mayor peso.

Ahora veremos un ejemplo de ANOVA por regresión:


Data:
A
1 2
8 4
1
9 3
B
10 1
2 12 4
1

8 b0 b1 b2 b3 
  1  1
11 
9  
 1   1  1
 4 1 
  1 1 1 
3  1
y   
10 X1
  1   1
1
  1  1   1
1
12 1   1  1
14 
1

  1 1   1
1
11 1 
  1  1  1

X→ debe tener una columna por cada coeficiente a estimar y una fila por cada
dato en el experimento.

y  b0  b1XA  b 2 X B  b3 X A X B  

bˆ  X X  X Y
1

Resolviendo por partes:


1 1
1  1   1
1 
 1
 1
1 1 1 1   1
1 1 1 1
1 1
8 0 0 0
    
 1 1 1  1  1 1  1  1 1  0 8 0 0
XX   1
 
1 1

 1  1  1   1  1  1  1  1   0 0 8 0 
1 11 1
    
 1  1   1  1  1   1 1  1   1 0 0 0 8 
 
1 1 1
1   1  1
1 
  1  1
1 
1

El codificar me permite entender el modelo y me da una propiedad muy


útiles el las matrices.

1 0 0 0
 8 
0 1
XX  0
1
 0
8 
0 0 1 0
 8
0 0 1 
0 8 

8
 
9
 1 1 1 1 1 1 1 1  4   76 
1 1 1 1  1 1 1 3 37  39  2
1
XY       
 1  1  1  1   1  1  110 52  24  28
1    
1 1 1  1  1  1 !  47  29  18
 112  
14
 

1 0 11
8 0 0  76  76 8 
 

 18 0 0   
bˆ  X X  X Y   0
1
  2   2 
0 0 1 0  28    8 
 28
 8   
    8
1  18
0 0 0 8  18 8
  

Si estimamos cuando A = -1 y B = -1 tenemos:


76 2
y  X
18
28  XX

X
A
8 8 8
B
8
A B
76 2 28 18
   1   1   1 1
8 8 8 8
76 2 28 18 68
 8  8  8  8  8  8.5

Ahora, si A = 1 y B = 1, tenemos:
76 2 28 18 120
y  1  1  11   15
8 8 8 8 8

De igual manera podemos visualizar la interacción de los factores. La


siguiente figura ilustra la interacción cuando dos de los factores están en su nivel
alto y uno esta en su nivel bajo.
Si todos los factores en el experimento están en su nivel alto, su
representación grafica es como se muestra a continuación:

= corridas +

= corridas
_

ABC

Si tenemos un experimento con 5 factores el número de posibles combinaciones


es 32. Los efectos principales son los 5 factores, cuando uno de ellos esta en su
nivel alto y el resto en su nivel bajo, dándonos un total de 5 combinaciones (A, B,
C, D, y E). Cuando realizamos las interacciones tenemos la combinación de 2
factores en su nivel alto y 3 factores en su nivel bajo, 3 factores en su nivel alto y
2 factores en su nivel bajo, 4 factores en su nivel alto y 1 factor en su nivel alto y,
por ultimo, todos los factores en su nivel alto. Estas posibles interacciones se
muestran a continuación:

AB BC CD DE
ABC ACD BCD CDE
Interaccion _ 2  BD CE
AC Interaccion _ 3  ACE BCE
BE ABD ADE BDE
A
D ABE
AE

ABCD BCDE
ABCE
Interaccion _ 4 Interaccion _ 5  ABCDE
 ABDE
ACDE

Todas estas interacciones gráficamente representadas se verían como sigue:


bce abce
bcde abcde
+ ce ace
cde
acde
be abe
bde abde
e ae
E de ade
bc abc
abcd
c bcd
C ac
cd acd
b ab
bd abd
B
(1) a d ad
A
D
+

A medida que aumenta el número de factores en el experimento, realizar


las calculaciones de cada una de las combinaciones resultantes se vuelve
complicado y tedioso, además que se dificulta visualizar la interacción de los
factores de forma grafica. Si aumentamos el número de factores, el numero de
combinaciones o tratamientos a realizar aumente y esto es sin tomar en
cuanta el numero de corridas que debemos realizar para tener réplicas.
Cuando un experimento de 2k envuelve muchos factores es económicamente
difícil poder realizar replicas, por esto, si uno o mas de los factores es
irrelevantes se puede imponer cuadros o caras sobre cuadros o caras
(trasladándolos) permitiendo así las réplicas.

Algo muy importante que hay que tener en cuenta es que cuando no hay
replicas no tenemos estimado de error. Para esta situación, Daniela sugiere
trazar los estimados de los efectos en una grafica de probabilidad normal. De
esta forma los efectos no significativos estarán normalmente distribuidos, con
promedio cero (0) y varianza σ2 y además van a estar alineados formando una
línea recta en la gráfica. Los factores que sean significativos van a tener una
distribución con promedio distinto de cero y se
alejaran de la línea formada por los no significativos. Esta línea se le conoce
como el Trazo Normal de los efectos (Trazo de Daniela). Este método nos ayuda
a distinguir aquellos efectos que sobresalen para explicar la respuesta. Este
método parte de la premisa de que cuando k es lo suficientemente grande, todas
las fuentes de variación no serán relevantes; algunas de ellas deben pertenecer
al error o ruido.

Ejemplo usando MINITAB:

Se realizo un experimento en una planta donde fabrican semiconductores


en un esfuerzo por mejor el rendimiento. Cinco factores, cada uno a dos niveles,
se estudiaron. Se hizo una corrida del diseño sin réplicas y se muestra a
continuación:
(1) = 7 d=8 e=8 de = 6
a=9 ad = 10 ae =12 ade = 10
b = 34 bd = 32 be = 35 bde = 30
ab = 55 abd = 50 abe =52 abde = 53
c = 16 cd = 18 ce = 15 cde =15
ac = 20 acd = 21 ace = 22 acde = 20
bc = 40 bcd = 44 bce = 45 bcde = 41
abc = 60 abcd =61 abce = 65 abcde = 63

**Para realizar los pasos en MINITAB refiérase al manual de MINITAB provisto.

(a) Construya la grafica de probabilidad normal de los efectos estimados


(Trazo de Daniela). ¿Cuáles efectos aparecen muy alejados?
Normal Probability Plot of the Effects
(response is Results, Alpha = .05)
Effect Type
99
Not
B Significant
95 Significant
A
90 C Fact Name
or
AB A A
80 B B
Percent

70 C C
60 D D
50 E E
40
30
20

10
5

0 5 10 15 20 25 30 35
Effect
Lenth's PSE = 0.65625

En esta gráfica podemos notar que los factores significativos


para este experimento son A, B, C y la interacción AB.

(b) Realice un análisis de varianza para confirmar sus descubrimientos en la parte


(a).

Analysis of Variance for Results (coded units)

Source D Seq SS Adj SS Adj MS F P


F
Main Effects 5 11087. 11087.9 2217.58 *
9 *
2-Way 1 536.3 536.3 53.63 * *
Interactions 0
3-Way 1 24.3 24.3 2.43 * *
Interactions 0
4-Way 5 15.2 15.2 3.03 * *
Interactions
5-Way 1 0.3 0.3 0.28 * *
Interactions
Residual Error 0 * * *
Total 3 11664.
1 0

Como podemos apreciar los residuales del error aparecen con un


asterisco, esto se debe a que en un experimento sin réplicas no se puede
estimar el error. Tambien podemos notar que los valores de la distribución F y el
P-value de los efectos y las interacciones, todas tiene asterisco y es debido a
que no se pueden estimar cuando el error es igual a cero (0) o no se ha podido
estimar.
(c) Escriba el modelo de regresión relacionando el rendimiento con las
variables significativas del proceso.

Ŷ = 30.5313 + 5.9063XA + 16.9687XB + 4.8438XC + 3.9688XAB

(d) Grafique los residuales en una grafica de probabilidad normal. ¿Es


satisfactoria la grafica resultante?

Residual Plots for Results


Normal Probability Plot of the Residuals Residuals Versus the Fitted Values
99
3.0

90 1.5
Residual
Percent

50 0.0

10 -1.5

1-3.0
-4-2 0 2 4 0 15 30 45 60
Residual Fitted Value

Histogram of the Residuals Residuals Versus the Order of the Data


3.0
6.0

4.5 1.5
Frequency

Residual

3.0 0.0

1.5 -1.5

0.0 -3.0
-2.4 -[Link] 2.4 2 4 6 8 10 12 14 16 18 20 22 24 26 28 30 32
Residual Observation Order

Como podemos ver los residuales están distribuidos a través de la


línea de normalidad y el histograma tiene una forma de campana mostrando
que los promedios son iguales a cero (0)
(e) Grafique los residuales versus el rendimiento predecido y versus cada
uno de los factores. Comente sobre las graficas resultantes.

Residuals Versus A
(response is Results)
3

1
Residual

-1

-2

-3
-1.0 -0.5 0.0 0.5 1.0
A

Residuals Versus B
(response is Results)
3

1
Residual

-1

-2

-3
-1.0 -0.5 0.0 0.5 1.0
B
Residuals Versus C
(response is Results)

Residual
0

-1

-2

-3
-1.0 -0.5 0.0 0.5 1.0
C

Residuals Versus D
(response is Results)
3

1
Residual

-1

-2

-3
-1.0 -0.5 0.0 0.5 1.0
D

Residuals Versus E
(response is Results)
3

1
Residual

-1

-2

-3
-1.0 -0.5 0.0 0.5 1.0
E

Como podemos ver en cada una de las graficas resultantes los


residuales estan entre los valores de -1 y +1 indicándonos que nuestro
modelo es razonable.
(f) Interprete cualquier interacción significante.

Según la gráfica de probabilidad normal la única interacción significante en este


experimento es la AB.

Interaction Plot (data means) for Results


-1 1 -1 1 -1 1 -1 1
60
A
-1
40 1
A
20
60
B
40 -1
B
1
20
60
C
40 -1
C 1
20
60
D
40 -1
D
1
20

(g) ¿Cuales son sus recomendaciones con respecto a las condiciones en


que opera el proceso?

Eliminar los factores D y E y realizar más replicas con los factores que
resultaron significativos para poder tener un análisis comparativo. Entiendo que
si no son significativos pueden ser eliminados del experimento. Esto se puede
probar con la gráfica del “main effect”.
Main Effects Plot (data means) for Results
A B C
50

40

30

Mean of Results 20

-1 1 -1 1 -1 1
10
D E
50

40

30

20

-1 1 -1 1
10
(h) Proyecte el diseño 25 en un problema 2k tomando en cuenta los
factores importantes o significativos.

Factorial Fit: Results versus A, B, C

Estimated Effects and Coefficients for Results (coded units)

Term Effec Coef SE Coef T P


t
Consta 30.531 101.0 0.00
nt 7 0
0.3021
A 11.81 5.906 0.3021 19.55 0.00
3 0
B 33.93 16.969 56.17 0.00
7
S = 1.70884R-Sq = 99.32%R-Sq(adj) = 99.22%0
0.3021
C 9.688 4.844 0.3021 16.03 0.00
0
A*B 7.938 3.969 0.3021 13.14 0.00
0

Cube Plot (data means) for Results

42.50 62.25

32.75 52.50
1

B 16.00 20.75
1

C
7.25 10.25
-1 -1
-11
A

También podría gustarte