PRUEBA DE RACHAS
ESTADÍSTICA II
UES – FMO
Ciclo II - 2019
PRUEBA DE RACHAS
Se utiliza para contrastar la aleatoriedad de
los datos (o la falta de ésta).
La prueba de rachas de una muestra está
diseñada para ver si una cadena de sucesos
de dos tipos posibles está generada por un
proceso aleatorio.
Puede probarse la aleatoriedad de una serie
de caras o cruces, resultado de tiradas de
una moneda, por ejemplo, como podría
probarse una secuencia de éxitos y fracasos
de algo.
PRUEBA DE RACHAS
Si hay sólo dos resultados posibles para
cada experimento y el objetivo es
determinar si la secuencia se genera en
forma aleatoria, se puede usar la prueba
de rachas.
También se llama Prueba de corridas.
Procedimiento de la prueba de
rachas
Consiste en examinar la secuencia de
sucesos observados y contar el número
de rachas.
Una racha es una serie ininterrumpida de
uno de los resultados. Si se lanza una
moneda seis veces, por ejemplo, en H
representa cara y T representa cruz,
resultan las siguientes secuencias en el
número de rachas indicadas
1) HHTTHH : tres rachas
2) HHHTTT : dos rachas
3) HTHTHT : seis rachas
Una vez que se conoce el número de
rachas en la secuencia, se determina el
número total de resultados de un tipo
(𝑛1 ) y el número de resultados de otro
tipo (𝑛2 ).
La prueba consiste en encontrar si el
número de rachas observado se puede
considerar proveniente de una curva
normal con media y desviación estándar
siguientes:
2𝑛1 𝑛2 2𝑛1 𝑛2 2𝑛1 𝑛2 −𝑛1 −𝑛2
𝜇𝑟 = + 1 y 𝜎𝑟 =
𝑛1 +𝑛2 𝑛1 +𝑛2 2 𝑛1 +𝑛2 −1
donde:
𝜇𝑟 = media
𝜎𝑟 = desviación estándar
𝑛1 = número de ocurrencias de un tipo
𝑛2 = número de ocurrencias del otro tipo
Hipótesis
𝐻0 : la sucesión es aleatoria
𝐻1 : la sucesión es no aleatoria
Regla de decisión: Si es poco probable
que el número de rachas observado
puede venir de una distribución normal, la
hipótesis nula de un proceso aleatorio se
rechaza. Si el número de rachas
observado parece probable, la hipótesis
nula se un proceso aleatorio no se
rechaza.
El estadístico de prueba es el valor z que
se calcula mediante:
𝑟−𝜇𝑟
𝑧= donde: 𝜇𝑟 = media
𝜎𝑟
𝜎𝑟 = desviación estándar
𝑟 = número de rachas
Ejemplo
Joe Short voló a Las Vegas y perdió $150 jugando a la
ruleta. Pensó que tenía un sistema a prueba de todo
para jugar el rojo contra el negra, un sistema que
había desarrollado en casa usando una pequeña rueda
de ruleta. Después de perder su dinero, sospechó
que la rueda no era imparcial y decidió registrar las
ocurrencias de rojo o negro durante varios minutos
antes de regresar a casa haciendo autostop. Se ofrece
seguidamente la cadena de rojos y negros que Joe
registró, donde R representa rojo y N negro. Las
rachas están subrayadas
NNN RR N R N RRR NN R N R N RR NNNN RRR
NNN R NNN RRRRRR N R N RRR NNNN RRR
Probar la aleatoriedad de la sucesión a un nivel de
significancia de 0.05
Solución
Hipótesis
𝐻0 : La sucesión es aleatoria
𝐻1 : La sucesión es no aleatoria
Como se ve, el número de rachas que
observó Joe fue 24. El número de rojos fue
27 (𝑛1 = 27), y el número de negros fue 25
(𝑛2 = 25). Se usa la distribución normal para
probar la hipótesis nula de que el proceso
que generó esta secuencia es aleatorio.
La media y la desviación estándar de la
distribución normal para esta prueba están
dadas por las ecuaciones siguientes:
2𝑛1 𝑛2 2(27)(25)
𝜇𝑟 = +1= + 1 = 26.96
𝑛1 + 𝑛2 27 + 25
2𝑛1 𝑛2 2𝑛1 𝑛2 −𝑛1 −𝑛2 2 27 25 [2 27 25 −27−25]
𝜎𝑟 = = = 3.56
𝑛1 +𝑛2 2 𝑛1 +𝑛2 −1 27+25 2 (27+25−1)
Joe puede ahora completar la prueba de aleatoriedad
viendo si se puede considerar poco probable que el
número de rachas observado (24) haya venido de una
distribución normal con la media y la desviación estándar
que se muestran.
Decide probar la aleatoriedad a un nivel de significancia
de 0.05.
Regla de decisión: Se rechaza la 𝐻0 si el valor z calculado
es menor que -1.96 o mayor que 1.96.
𝑟−𝜇𝑟 24−26.96
El estadístico de prueba es: 𝑧 = = = −0.83
𝜎𝑟 3.56
Tomar una decisión: Como el z calculado
(-0.83) no es menor que la z crítica (-1.96),
la hipótesis nula no se rechaza, Joe
concluye que la rueda de la ruleta genera
rojos y negros de manera aleatoria, y que
la causa de que perdiera su dinero fue su
sistema de juego.
𝐻0 es cierta
0.025 0.025
-0.83 𝝁𝒓 = 𝟐𝟔. 𝟗𝟔
-1.96 1.96
PRUEBA U DE MANN-WHITNEY
ESTADÍSTICA II
UES – FMO
Ciclo II 2019
Prueba U de Mann-Whitney
La prueba U de Mann-Whitney está diseñada
para determinar si dos muestras se han
obtenido de la misma población.
Se usa para comparar datos de dos
poblaciones continuas con la misma forma y
dispersión.
Se puede usar cuando no se cumple la
hipótesis de normalidad.
Esta prueba se usa como una alternativa
para la prueba t para la diferencia entre dos
medias independientes con muestras
pequeñas.
Prueba U de Mann-Whitney
La prueba U de Mann-Whitney se usa
para encontrar si dos muestras
independientes proceden de poblaciones
simétricas que tienen la misma media o
mediana.
La prueba se usa cuando no se puede
verificar la suposición de dos poblaciones
normales con varianzas iguales.
Se le conoce como Prueba de Wilcoxon de
la suma de los rangos.
Prueba U de Mann-Whitney
La prueba de la suma de los rangos
involucra la asignación de rangos a los
datos después de que las dos muestras
han sido combinadas, se juntan los datos
de las dos muestras y se ordenan de
menor a mayor.
En el caso de repeticiones, a los datos
repetidos se les asigna el promedio de los
rangos que les hubiera correspondido de
no haberse dado repeticiones.
Prueba U de Mann-Whitney
Por ejemplo, si las observaciones cuarta,
quinta y sexta son iguales, se les asigna un
rango de cinco a cada una.
Después de asignar rangos a los datos,
escogemos la muestra menor y
encontramos la suma de los rangos,
denotada por W para esa muestra,
Si ambas muestras son del mismo tamaño,
cada una se puede usar para determinar
la suma W de los rangos.
Prueba U de Mann-Whitney
Si las poblaciones de las que proceden las
muestras tienen medias distintas,
esperaríamos que la mayoría de los
rangos inferiores pertenezcan a la
muestra cuya media poblacional sea
menor, y que la mayor parte de los rangos
superiores sean de la muestra de
población con media mayor.
Prueba U de Mann-Whitney
La prueba de la suma de los rangos se
basa en el estadístico U definido por:
𝑛1 𝑛1 +1
𝑈 =W− donde 𝑛1 es el tamaño
2
de la muestra menor.
𝑛1 𝑛1 +1
El número de es mínimo valor
2
que puede tomar W, y el estadístico U
mide la distancia entre W y su valor
mínimo.
Prueba U de Mann-Whitney
El estadístico U se relaciona
estrechamente con W.
Los valores de U varían directamente con
los de W. Si el estadístico de prueba U es
grande, W es grande y la muestra usada
para generar W corresponderá a la
población con la media mayor.
Prueba U de Mann-Whitney
Si escogemos una notación tal que 𝜇1 sea la
media de la población con tamaño de
muestra 𝑛1 , entonces el significado de un
valor grande de U es que 𝐻0 : 𝜇1 ≤ 𝜇2 se
rechaza en favor de 𝐻1 : 𝜇1 > 𝜇2 ; y si el valor
de U es pequeño, 𝐻0 : 𝜇1 ≥ 𝜇2 se rechaza en
favor de 𝐻1 : 𝜇1 < 𝜇2 .
Si las muestras provienen de poblaciones
continuas idénticas y no hay repeticiones en
los rangos, entonces la distribución muestral
de U tiene una media y una desviación
estándar dadas por:
Media y desviación estándar para el estadístico U
𝑛1 𝑛2
𝜇𝑈 =
2
𝑛1 𝑛2 𝑛1 +𝑛2 +1
𝜎𝑈 =
12
donde 𝑛1 es el tamaño de la muestra pequeña y
𝑛2 es el tamaño de la muestra grande; además, si
𝑛1 es mayor que ocho, la distribución muestral de
U es aproximadamente normal.
El valor z para U está determinado por:
𝑈−𝜇𝑈
𝑧=
𝜎𝑈
Si 𝑛1 ≤ 8, es necesario usar tablas especiales para
determinar los valores críticos del estadístico U.
APLICACIÓN
A dos grupos de estudiantes se les enseñó
estadística con dos métodos distintos, A y
B. Al término del curso ambos grupos
presentaron un mismo examen. Los
resultados aparecen en la tabla siguiente:
Método A 73 67 72 46 83 75 62 90 95
Método B 71 47 68 87 77 92 65 86 79 57
Use la prueba de la suma de los rangos con 𝛼 =
0.05 para determinar si hay diferencia entre los
promedios de las calificaciones finales para los
estudiantes que aprendieron por los métodos A y
B.
Solución Datos Rango Muestra
46 1 A
Hipótesis 𝐻0 : 𝜇𝐴 − 𝜇𝐵 = 0 47 2 B
𝐻1 : 𝜇𝐴 − 𝜇𝐵 ≠ 0 57 3 B
62 4 A
Como la muestra A es la menor, 65 5 B
𝑛1 = 9 𝑦 𝑛2 = 10 , la suma de los 67 6 A
rangos para la muestra A (señalada 68 7 B
con color azul) resulta ser: 71 8 B
𝑊 = 1 + 4 + 6 + 9 + 10 + 11 + 14 + 72 9 A
17 + 19 = 91 73 10 A
75 11 A
El valor del estadístico de prueba U
77 12 B
se encuentra mediante: 79 13 B
𝑛1 𝑛1 + 1
𝑈=𝑊− 83 14 A
2 86 15 B
9 10
= 91 − 87 16 B
2 90 17 A
= 91 − 45 = 46 92 18 B
95 19 A
La media y la desviación estándar son:
𝑛1 𝑛2 (9)(10)
𝜇𝑈 = = = 45
2 2
𝑛1 𝑛2 𝑛1 +𝑛2 +1 (9)(10)(9+10+1)
𝜎𝑈 = = = 12.25
12 12
Como 𝑛1 > 8, la distribución muestral de U es
aproximadamente normal y el estadístico z para U
𝑈−𝜇𝑈 46−45
es 𝑧 = = = 0.08
𝜎𝑈 12.25
𝐥𝐨𝐬 𝐯𝐚𝐥𝐨𝐫𝐞𝐬 𝐜𝐫𝐢𝐭𝐢𝐜𝐨𝐬
𝐳𝟎.𝟎𝟓 = ±𝟏. 𝟗𝟔
𝐳𝟎.𝟎𝟓 = −𝟏. 𝟗𝟔 𝐳𝟎.𝟎𝟓 = 𝟏. 𝟗𝟔
Regla de decisión: Rechazar la hipótesis
nula si z calculado (0.08) es mayor que
1.96 o menor que -1.96.
Tomar una decisión: Como el valor de z
calculado es −1.96 < 0.08 < 1.96 , no
podemos rechazar la hipótesis nula. Por
tanto, no hay diferencia significativa entre
los promedios de las calificaciones finales
de los estudiantes sujetos a métodos
diferentes.
APLICACIÓN
Los pacientes que sufren cierta enfermedad
son tratados con dos tipos distintos de
medicamentos y se les evalúa en dos
muestras aleatorias de nueve pacientes.
Cada una fue tratada con el medicamento A
y B, respectivamente. En la tabla está
registrado el tiempo en días que cada
paciente tardó en recuperarse por
completo:
Medicamento A 13 10 12 14 14 15 16 16 17
Medicamento B 8 17 9 11 15 11 14 12 18
Use la prueba de la suma de los rangos con
el nivel de significancia de 0.05 para
determinar si la media del tiempo de
recuperación para los pacientes tratados con
el medicamento B es menor que la de los
pacientes tratados con el fármaco A.