Introducción a la Estadística Inferencial
Introducción a la Estadística Inferencial
“Estadística Inferencial I”
Cuadernillo de trabajo
Docente:
Alumno:
Contenido
La estadística inferencial es una parte de la estadística que comprende los métodos y procedimientos que por
medio de la inducción determina propiedades de una población estadística, a partir de una parte de esta. Su objetivo
es obtener conclusiones útiles para hacer deducciones sobre una totalidad, basándose en la información numérica
de la muestra. Se dedica a la generación de los modelos, inferencias y predicciones asociadas a los fenómenos en
cuestión teniendo en cuenta la aleatoriedad de las observaciones. Se usa para modelar patrones en los datos y
extraer inferencias acerca de la población bajo estudio. Estas inferencias pueden tomar la forma de respuestas a
preguntas sí/no (prueba de hipótesis), estimaciones de unas características numéricas (estimación), pronósticos de
futuras observaciones, descripciones de asociación (correlación) o modelamiento de relaciones entre variables de
Sam (análisis de regresión). Otras técnicas de modelamiento incluyen análisis de varianza, series de tiempo y
minería de datos.
Toma de muestras o muestreo, que se refiere a la forma adecuada de considerar una muestra que permita
obtener conclusiones estadísticamente válidas y significativas.
Estimación de parámetros o variables estadísticas, que permite estimar valores poblacionales a partir de
muestras de mucho menor tamaño.
Contraste de hipótesis, que permite decidir si dos muestras son estadísticamente diferentes, si un determinado
procedimiento tiene un efecto estadístico significativo, etc.
Diseño experimental.
Inferencia bayesiana.
Métodos no paramétricos.
Planteamiento del problema: un problema de inferencia estadística suele iniciarse con una fijación de
objetivos o algunas preguntas del tipo:
¿Cuál será la media de esta población respecto a tal característica?
¿Se parecen estas dos poblaciones?
¿Hay alguna relación entre...?
En el planteamiento se definen con precisión la población, la característica a estudiar, las variables, etc.
Elaboración de un modelo: en caso de establecer un modelo teórico, se replantea el procedimiento y se llega
a una conclusión lógica. Los posibles modelos son distribuciones de probabilidad.
Extracción de la muestra: se usa alguna técnica de muestreo o un diseño experimental para
obtener información de una pequeña parte de la población.
Tratamiento de los datos: en esta fase se eliminan posibles errores, se depura la muestra, se tabulan los datos
y se calculan los valores que serán necesarios en pasos posteriores, como la media muestral, la varianza
muestral.
Los métodos de esta etapa están definidos por la estadística descriptiva.
Estimación de los parámetros: con determinadas técnicas se realiza una predicción sobre cuáles podrían ser
los parámetros de la población.
Contraste de hipótesis: los contrastes de hipótesis son técnicas que permiten simplificar el modelo
matemático bajo análisis. Frecuentemente el contraste de hipótesis recurre al uso de estadísticos muestrales.
Conclusiones: se critica el modelo y se hace un balance. Las conclusiones obtenidas en este punto pueden
servir para tomar decisiones o hacer predicciones.
El estudio puede comenzar de nuevo a partir de este momento, en un proceso cíclico que permite conocer cada
vez mejor la población y características de estudio.
Muestrear es una forma de evaluar la calidad de un producto, la opinión de los consumidores, la eficacia de un
medicamento o de un tratamiento. Muestra es una parte de la población. Población es el total de resultados de un
experimento. Hacer una conclusión sobre el grupo entero (población) basados en información estadística obtenida
de un pequeño grupo (muestra) es hacer una inferencia estadística.
A menudo no es factible estudiar la población entera. Algunas de las razones por lo que es necesario muestrear
son:
Muestreo aleatorio simple: también llamado muestreo aleatorio con reemplazamiento, es el muestreo más
común y es aquel en el que cada elemento tiene igual probabilidad de ser seleccionado en cada extracción,
supuestas que las extracciones son independientes entre sí, de tal manera que cada elemento es devuelto a
la población para que la probabilidad de selección no varíe.
Muestreo aleatorio sin reemplazo: cada elemento tiene igual probabilidad de ser seleccionado, solo que
una vez elegido, este es excluido en siguientes extracciones.
Muestreo estratificado: se consideran dos o más sub-poblaciones (estratos) lo más homogéneas posibles
sobre las que se seleccionan, mediante un muestreo aleatorio simple un número de elementos fijado de
antemano en cada estrato. Este número fijado de antemano, se decide en base a consideraciones sobre el
estrato.
Estadísticos muestrales
El propósito principal al seleccionar muestras aleatorias es obtener información acerca de los parámetros
desconocidos de la población. Por ejemplo: se desea llegar a una conclusión respecto a la proporción de personas
bebedoras de café en Estados Unidos que prefieran cierta marca de café. Sería imposible preguntar a cada bebedor
de café estadounidense a fin de calcular el valor del parámetro 𝜌 que representa la proporción de la población. En
su lugar, se selecciona una muestra aleatoria grande y se calcula la proporción 𝜌̂ de personas en esta muestra que
prefieren la marca de café en cuestión. El valor de 𝜌̂ se utiliza para hacer inferencia con respecto a la proporción
𝜌 verdadera.
El valor de 𝜌̂ es una función de los valores observados en la muestra aleatoria; como son posibles muchas muestras
aleatorias a partir de la misma población, se esperaría que 𝜌̂ varíe algo de una muestra a otra. Es decir, 𝜌̂ es un
valor de una variable aleatoria que representamos con 𝛲̂. Tal variable aleatoria se llama estadística. Es decir,
cualquier función de las variables aleatorias que forman una muestra aleatoria se llama estadística.
La más importante de éstas, y que se define de la siguiente manera es la media; si 𝑋1 , 𝑋2 , … , 𝑋𝑛 representan una
muestra aleatoria de tamaño 𝑛, entonces la media de la muestra se define mediante la estadística
∑𝑛𝑖=1 𝑋𝑖
𝑋̅ =
𝑛
𝑛
∑ 𝑥
La estadística 𝑋̅ toma el valor de 𝑥̅ = 𝑖=1 𝑖 cuando 𝑋1 toma el valor de 𝑥1 , y así sucesivamente. En la práctica
𝑛
al valor de de una estadística se le da el nombre de la estadística. El término media de la muestra se aplica tanto a
la estadística 𝑋̅ como a su valor calculado 𝑥̅ .
Ejemplo 1: Se tomó una muestra aleatoria de las edades de estudiantes de una primaria, obteniendo la siguiente
distribución de edades 9, 11, 13, 4, 6, 6, 8. Calcule la media de la muestra.
Solución:
(9 + 11 + 13 + 4 + 6 + 6 + 8)
𝑥̅ = = 8.14 años
7
Ejemplo 2: Se tiene el siguiente conjunto de datos: 43, 37, 30, 39, 42, 37, 36, 45, 47, 37, 52, 54, 45, 37 y 50.
Calcule la media de la muestra.
Solución:
La segunda estadística más útil para medir el centro de un conjunto de datos es la mediana. Se designa a la mediana
con el símbolo 𝑋̃: si 𝑋1 , 𝑋2 , … , 𝑋𝑛 representan una muestra aleatoria de tamaño 𝑛, acomodada en orden creciente
de magnitud, entonces la mediana de la muestra se define mediante la estadística
𝑋(𝑛+1)⁄ si 𝑛 es impar
2
𝑋̃ = {𝑋𝑛⁄ + 𝑋(𝑛⁄
2 2)+1
si 𝑛 es par
2
(𝑛+1)
Es decir, si el número de términos de la distribución es “impar”, la mediana es el valor 𝑥 en la posición 2 , es
decir, que ocupa el lugar central cuando los datos están ordenados de menor a mayor. Y si el número de términos
𝑛 𝑛
de la distribución es “par”, la mediana se define como la media de las observaciones 𝑥 en las posiciones y + 1,
2 2
es decir, el promedio de los datos centrales.
Ejemplo 3: Se tomó una muestra aleatoria de las edades de estudiantes de una primaria, obteniendo la siguiente
distribución de edades 9, 11, 13, 4, 6, 6, 8, Calcule la mediana de la muestra.
Solución;
Ordenar las observaciones en orden creciente de magnitud, se obtiene
4 6 6 8 9 11 13
(𝑛+1) (7+1)
El valor en la posición = = 4 es la mediana 𝑥̃ = 9.
2 2
Ejemplo 4: Se tomó una muestra aleatoria de las edades de estudiantes de una primaria, obteniendo la siguiente
distribución de edades 11, 13. 4, 6, 7, 6, 8, 9. Calcule la mediana de la muestra.
Solución:
Ordenar las observaciones en orden creciente de magnitud, se obtiene
4 6 6 7 8 9 11 13
Ejemplo 5: Se tiene el siguiente conjunto de datos: 43, 37, 30, 39, 42, 37, 36, 45, 47, 37, 52, 54, 45, 37 y 50.
Calcule la mediana de la muestra.
Solución:
La tercera y última estadística para medir el centro de una muestra aleatoria es la moda, que se designa con la
estadística 𝑀: si 𝑋1 , 𝑋2 , … , 𝑋𝑛 , no necesariamente diferentes, representan una muestra aleatoria de tamaño 𝑛,
entonces la moda 𝑀 es aquel valor de la muestra que ocurre más a menudo o con la mayor frecuencia. La moda
puede no existir, y cuando existe no necesariamente es única. La moda no siempre existe. Esto es realmente cierto
cuando todas las observaciones ocurren con la misma frecuencia. Para algunos conjuntos de datos habrá varios
valores que ocurren con la mayor frecuencia, en cuyo caso tenemos más de una moda.
Ejemplo 6: Se tomó una muestra aleatoria de las edades de estudiantes de una primaria, obteniendo la siguiente
distribución de edades 11, 13. 4, 6, 7, 6, 8, 9. Calcule la moda de la muestra.
Solución:
El valor que ocurre con mayor frecuencia es el 6, por lo tanto, la moda es 𝑀 = 6.
Ejemplo 7: Se tomó una muestra aleatoria de las edades de estudiantes de una primaria, obteniendo la siguiente
distribución de edades 9, 11, 13. 4, 6, 7, 6, 8, 9. Calcule la moda de la muestra.
Solución:
En este caso, se tienen dos valores con la misma frecuencia el 6 y el 9, por lo tanto, existen dos modas 𝑀 = 6 y
𝑀 = 9, se dice que la distribución es bimodal.
Ejemplo 8: Se tiene el siguiente conjunto de datos: 43, 37, 30, 39, 42, 37, 36, 45, 47, 37, 52, 54, 45, 37 y 50.
Calcule la moda de la muestra.
Solución:
En resumen, se consideran los méritos relativos de la media, mediana y moda. La media es la medida de
localización central más utilizada en estadística. Emplea toda la información disponible. Las distribuciones de
medias que se obtienen en muestreos repetidos de una población son bien conocidos, y en consecuencia los
métodos que se utilizan en la inferencia estadística para estimar μ se basna en la media de la muestra. La única
desventaja real de la media es que se puede resultar afectada de la manera adversa por valores extremos.
La mediana tiene la ventaja de ser fácil de calcular si el número de observaciones es relativamente pequeño. No
resulta influida por valores extremos. Al tratar con muestras que se seleccionan de poblaciones, las medias de las
muestras por lo general no variarán tanto de una muestra a otra como las medianas. Por tanto, si se estima el centro
de una población con base en un valor de la muestra, la media es más estable que la mediana. Por tanto, una media
de la muestra probablemente esté más cercana que la mediana de la muestra a la media de la población.
La moda es la medición que se utiliza menos de las tres. Para conjuntos pequeños de datos su valor casi no tiene
utilidad si es que, de hecho, existe. Sólo en el caso de una gran cantidad de datos tiene un sentido significativo.
Sus dos ventajas principales son que no requiere cálculo y se puede usar para datos cualitativos, así como para
cuantitativos. Entonces, si correr es la forma de ejercicio que la mayoría de las personas expresa como preferida,
se dice que correr es la selección modal.
Variabilidad en la muestra
Las tres medidas de localización central no ofrecen por sí mismas una descripción adecuada de nuestros datos. Es
necesario conocer cómo se dispersan las observaciones del promedio. Es muy posible tener dos conjuntos de
observaciones con la misma media o mediana que difieran de manera considerable en la variabilidad de sus
mediciones alrededor del promedio. Las estadísticas más importantes para medir la variabilidad de una muestra
aleatoria son el rango y la varianza.
La más simple de calcular es el rango: el rango de una muestra aleatoria 𝑋1 , 𝑋2 , … , 𝑋𝑛 se define con la siguiente
estadística 𝑟 = 𝑋𝑚á𝑥 − 𝑋𝑚í𝑛 , donde 𝑋𝑚á𝑥 y 𝑋𝑚í𝑛 son, respectivamente, las observaciones más grande y pequeña
en la muestra.
Ejemplo 9: Los CI de una muestra aleatoria de cinco miembros de una asociación estudiantil femenina son 108,
112, 127, 118 y 113. Encuentre el rango.
Solución:
Se localizan el valor más grande 127 y el más pequeño 108, por lo tanto, el rango es 𝑟 = 127 − 108 = 19
El rango puede ser una medida pobre de la variabilidad, en particular si el tamaño de la muestra o población es
grande. Considera los valores extremos y no dice nada acerca de la distribución de los valores intermedios.
Ejemplo 10: Considere, los dos conjuntos de los siguientes datos, ambos con un rango 𝑟 = 12:
Datos observados
Conjunto A 3 4 5 6 8 9 10 12 15
Conjunto B 3 7 7 7 8 8 8 9 15
En el primer conjunto la media y la mediana son 8, pero los números varían a lo largo de todo el intervalo de 3 a
15. En el segundo conjunto la media y la mediana también son 8, pero la mayor parte de los valores están más
cerca del centro de los datos. Aunque el rango falla al medir esta variabilidad entre la observación superior y la
inferior, tiene algunas aplicaciones útiles. En la industria el rango se puede predeterminar al especificar por
adelantado que una medición particular de los artículos que salen de una línea de producción deba caer dentro de
cierto intervalo.
Ejemplo 11: Se tiene el siguiente conjunto de datos: 43, 37, 30, 39, 42, 37, 36, 45, 47, 37, 52, 54, 45, 37 y 50.
Calcule el rango de la muestra.
Solución:
Para compensar la desventaja del rango, se considera una medida de variabilidad, la varianza de la muestra, que
considera la posición de cada observación en relación con la media de la muestra: si 𝑋1 , 𝑋2 , … , 𝑋𝑛 , representan una
muestra aleatoria de tamaño 𝑛, entonces la varianza de la muestra se define con la estadística
∑𝑛𝑖=1(𝑋𝑖 − 𝑋̅)2
𝑆2 =
𝑛−1
El valor calculado de 𝑆 2 para una muestra se denota con 𝑠 2 . Se observa que 𝑆 2 se define esencialmente como el
promedio de los cuadrados de las desviaciones de las observaciones de su media.
Ejemplo 12: Una comparación de precios de café en cuatro tiendas de abarrotes seleccionadas al azar, muestran
aumentos en comparación con el mes anterior de 12, 15, 17 y 20 centavos para una bolsa de libra. Encuentre la
varianza de esta muestra aleatoria de aumentos de precios.
Solución:
Al calcular la media de la muestra, se obtiene
12 + 15 + 17 + 20
𝑥̅ = = 16 centavos
4
Por lo tanto, la varianza de la muestra
∑𝑛𝑖=1(𝑥𝑖 − 16)2 (12 − 16)2 + (15 − 16)2 + (17 − 16)2 + (20 − 16)2 34
𝑠2 = = =
4−1 3 3
Si 𝑥̅ es un número decimal que se redondea, se acumula un error grande cuando se utiliza la fórmula anterior de la
varianza, para evitar esto se deriva la siguiente fórmula de la varianza.
2
𝑛 ∑𝑛𝑖=1 𝑋𝑖2 − (∑𝑛𝑖=1 𝑋𝑖 )2
𝑆 =
𝑛(𝑛 − 1)
La desviación estándar de la muestra, que se denota con 𝑆, es la raíz cuadrada de la varianza de la muestra.
Ejemplo 13: Encuentre la varianza de los siguientes datos 3, 4, 5, 6, 6 y 7, que representan el número de truchas
atrapadas por una muestra aleatoria de seis pescadores el 19 de junio de 1996, en el lago Muskoka.
Solución:
6(32 + 42 + 52 + 62 + 62 + 72 ) − (3 + 4 + 5 + 6 + 6 + 7)2 6(171) − (31)2 13
𝑠2 = = =
6(6 − 1) 30 6
Ejemplo 14: Se tiene el siguiente conjunto de datos: 43, 37, 30, 39, 42, 37, 36, 45, 47, 37, 52, 54, 45, 37 y 50.
Calcule varianza y la desviación estándar de la muestra.
Solución:
A menudo se necesita estudiar las propiedades de una determinada población, pero se tiene el inconveniente de
que ésta es demasiado numerosa como para analizar a todos los individuos que la componen. Por tal motivo, se
recurre a extraer una muestra de la misma y a utilizar la información obtenida para hacer inferencias sobre toda la
población. Estas estimaciones serán válidas sólo si la muestra tomada es “representativa” de la población.
Como una estadística es una variable aleatoria que depende sólo de la muestra observada, debe tener una
distribución de probabilidad. La distribución de probabilidad de una estadística se llama distribución muestral.
La distribución muestral de una estadística depende del tamaño de la población, el tamaño de las muestras y el
método de la elección de las muestras.
La primera distribución muestral a considerar es la de la media 𝑋̅, se tiene una muestra aleatoria de 𝑛 observaciones
se toma de una población normal con media 𝜇 y varianza 𝜎 2 . Cada observación 𝑋𝑖 , 𝑖 = 1,2, … , 𝑛 de la muestra
aleatoria tendrá entonces la misma distribución normal que la población que se muestrea.
Si tomamos muestras de una población con distribución desconocida, finita o infinita, la distribución muestral de
𝜎2
𝑋̅ aún será aproximadamente normal con media 𝜇 y varianza siempre que el tamaño de muestra sea grande. Este
𝑛
resultado es consecuencia del siguiente teorema, que se llama;
𝑋̅ − 𝜇
𝑍=𝜎
⁄ 𝑛
√
La aproximación normal para 𝑋̅ por lo general será buena si 𝑛 ≥ 30 sin importar la forma de la distribución. Si
𝑛 < 30, la aproximación es buena si la población no es muy diferente de una distribución normal.
Ejemplo 15: Una empresa eléctrica fabrica focos que tienen una duración que se distribuye aproximadamente en
forma normal, con media de 800 horas y desviación estándar de 40 horas. Encuentre la probabilidad de que una
muestra aleatoria de 16 focos tenga una vida promedio de menos de 775 horas.
Solución:
Los datos son:
𝑥̅ = 775
𝜇 = 800
𝜎 = 40
𝑛 = 16
Por lo tanto, se localiza el valor de -2.5 es las tablas de distribución normal estándar inversa,
𝑃(𝑋̅ < 775) = 𝑃(𝑍 < −2.5) = 0.0062
Gráfica de distribución
Normal, Media=0, [Link].=1
0.4
0.3
Densidad
0.2
0.1
0.00621
0.0
-2.5 0
X
Conclusión: Por lo tanto, la probabilidad de que una muestra aleatoria de 16 focos tenga una vida promedio de
menos de 775 horas es de 0.0062.
Ejemplo 16: La compañía de baterías Timeless afirma que sus baterías tienen una vida media de 60 meses y una
desviación estándar de 9 meses. Un grupo de consumidores que está poniendo a prueba esta afirmación compra
36 baterías y determina la vida media.
Solución:
a) Suponiendo que lo que afirma Timeless es cierto, ¿cuál es la probabilidad de que la vida media de la muestra
sea menor que 58 meses?
En el punto anterior sólo se hacen inferencias sobre una sola población, pero en ocasiones, resulta necesario hacer
inferencias sobre dos poblaciones. Si se extraen al azar muestras independientes de tamaño 𝑛1 y 𝑛2 de dos
poblaciones, discretas o continuas, con medias 𝜇1 y 𝜇2 y varianzas 𝜎12 y 𝜎22 , respectivamente, entonces la
distribución muestral de las diferencias de medias 𝑋̅1 − 𝑋̅2 , está distribuida aproximadamente de forma normal
con media y varianzas dadas por
𝜎12 𝜎22
𝜇𝑋̅1 −𝑋̅2 = 𝜇1 − 𝜇2 𝜎𝑋2̅1 −𝑋̅2 = +
𝑛1 𝑛2
De aquí:
(𝑋̅1 − 𝑋̅2 ) − (𝜇1 − 𝜇2 )
𝑍=
2 2
√(𝜎1 ⁄𝑛 ) + (𝜎2 ⁄𝑛 )
1 2
Ejemplo 17: Los cinescopios para televisión del fabricante A tienen una duración media de 6.5 años y una
desviación estándar de 0.9 años, mientras que los del fabricante B tienen una duración media de 6 años y una
desviación estándar de 0.8 años. ¿Cuál es la probabilidad de que una muestra aleatoria de 36 cinescopios del
fabricante A tengan una duración media que sea al menos de un año más que la duración media de una muestra de
49 cinescopios del fabricante B?
Solución:
Población 1 𝜇1 = 6.5, 𝜎1 = 0.9 y 𝑛1 = 36,
Población 2 𝜇2 = 6, 𝜎2 = 0.8 y 𝑛2 = 49,
La distribución muestral de 𝑋̅1 − 𝑋̅2 será aproximadamente normal con una media y una desviación estándar de
0.9 0.8
𝜇𝑋̅1 −𝑋̅2 = 6.5 − 6 = 0.5 y 𝜎𝑋̅1 −𝑋̅2 = √ 36 − 49
= 0.189
1−0.5
El valor 𝑥̅1 − 𝑥̅2 = 1 y 𝑧 = = 2.65
0.189
La probabilidad de que la media de 36 cinescopios del fabricante A sea al menos un año mayor que los 49
cinescopios del fabricante B, está dada por
𝑃(𝑋̅1 − 𝑋̅2 ≥ 1) = 𝑃(𝑍 ≥ 2.65) = 1 − 𝑃(𝑍 < 2.65) = 1 − 0.996 = 0.0040
Gráfica de distribución
Normal, Media=0, [Link].=1
0.4
0.3
Densidad
0.2
0.1
0.00402
0.0
0 2.65
X
Conclusión: la probabilidad de que la media de 36 cinescopios del fabricante A sea al menos un año mayor que
los 49 cinescopios del fabricante B, es de 0.004.
Ejemplo 18: La calificación media de estudiantes de primer año en un examen de aptitud en cierta universidad es
540 puntos, con una desviación estándar de 50. ¿Cuál es la probabilidad de que dos grupos de que consisten en 32
y 50 estudiantes, respectivamente, difieran en sus calificaciones medias por menos de 50 puntos?
Solución:
La utilidad del teorema del límite central, sus aplicaciones giran alrededor de las inferencias sobre una media de
la población o la diferencia entre medias de poblaciones. El uso del teorema del límite central y la distribución
normal es bueno, en este contexto. Sin embargo, se supuso que la desviación estándar 𝜎 de la población se conoce.
Si 𝑛 es grande, esto no representa ningún problema aún cuando 𝜎 sea desconocida, ya que en este caso es razonable
sustituirla por la desviación estándar de la muestra 𝑠.
Si 𝑥̅ es la muestra de una variable aleatoria de tamaño 𝑛 tomada de una población normal con la con media 𝜇 y
∑𝑛
𝑖=1(𝑥𝑖 −𝑥̅ )
2
varianza 𝜎 2 y 𝑆 2 = 𝑛−1
, entonces
𝑥̅ − 𝜇
𝑡=
𝑆⁄
√𝑛
Entonces se trata de una variable aleatoria con distribución 𝑡 con 𝑣 = 𝑛 − 1 grados de libertad.
Se acostumbra representar con 𝑡𝛼 el valor 𝑡 por arriba del cual se encuentra un área igual a 𝛼. Como la distribución
𝑡 es simétrica alrededor de una media de cero, tenemos 𝑡1−𝛼 = −𝑡𝛼 ; es decir, el valor t que deja un área de 1 − 𝛼
a la derecha y por tanto un área de α a la izquierda, es igual al valor 𝑡 negativo que deja un área de 𝛼 en la cola
derecha de la distribución. Esto es, 𝑡0.95 = −𝑡0.05 , 𝑡0.99 = −𝑡0.01, etc.
Ejemplo 19: Un ingeniero químico afirma que el rendimiento medio de la población de cierto proceso en lotes es
500 gramos por milímetro de materia prima. Para verificar esta afirmación toma una muestra de 25 lotes cada mes.
La muestra tiene una desviación estándar de 40 gramos. Determine la probabilidad de que el rendimiento medio
del proceso esté por encima de los 518 gramos. Suponga que la distribución de rendimientos es aproximadamente
normal.
Solución:
Se procede a calcular el valor de t:
𝑥̅ − 𝜇 518 − 500
𝑡= = = 2.25
𝑆⁄ 40⁄
√𝑛 √25
Gráfica de distribución
T, df=24
0.4
0.3
Densidad
0.2
0.1
0.0169
0.0
0 2.25
X
Conclusión: De aquí que la probabilidad de que la media este por encima de 518 es de 0.0169.
Ejemplo 20: La vida media de una máquina para hacer pasta es de siete años, pero se desconoce la desviación
estándar poblacional. Encuentre la probabilidad de que la vida media de una muestra aleatoria de 10 máquinas sea
menor a 7.3 años con una desviación estándar muestral de un año.
Solución:
Existen ocasiones en las cuales no estamos interesados en la media de la muestra, sino que queremos investigar la
proporción de artículos defectuosos o la proporción de alumnos reprobados en la muestra. La distribución muestral
de proporciones es la adecuada para dar respuesta a estas situaciones. Esta distribución se genera de igual manera
que la distribución muestral de medias, a excepción de que al extraer las muestras de la población se calcula el
𝑥
estadístico proporción (𝑝̂ = 𝑛 en donde “𝑥” es el número de éxitos u observaciones de interés y “𝑛” el tamaño de
la muestra) en lugar del estadístico media.
Una población binomial está estrechamente relacionada con la distribución muestral de proporciones; una
población binomial es una colección de éxitos y fracasos, mientras que una distribución muestral de proporciones
contiene las posibilidades o proporciones de todos los números posibles de éxitos en un experimento binomial, y
como consecuencia de esta relación, las afirmaciones probabilísticas referentes a la proporción muestral pueden
evaluarse usando la aproximación normal a la binomial, siempre que 𝑛𝑝̂ ≥ 5 y 𝑛(1 − 𝑝̂ ) ≥ 5. Cualquier evento
se puede convertir en una proporción si se divide el número obtenido entre el número de intentos.
𝑥̅ −𝜇
El teorema del límite central 𝑧 = queda de la siguiente manera:
𝜎
𝑝̂ − 𝑃
𝑧=
√𝑃(1 − 𝑃)
𝑛
𝑝̂ − 𝑃
𝑧=
√𝑃(1 − 𝑃) √𝑁 − 𝑛
𝑛 𝑁−1
Ejemplo 21: Si tiramos una moneda no trucada 100 veces, ¿cuál es la probabilidad de que obtengamos más de 55
caras?
Solución:
Los datos son:
𝑃 = 0.5, 𝑥 = 55, 𝑛 = 100
𝑥 55
Se calculan el valor de 𝑝̂ = = = 0.55 ahora se sustituye:
𝑛 100
𝑝̂ − 𝑃 0.55 − 0.5
𝑧= = = 1.005
√𝑃(1 − 𝑃) √0.55(1 − 0.55)
𝑛 100
Gráfica de distribución
Normal, Media=0, [Link].=1
0.4
0.3
Densidad
0.2
0.1
0.157
0.0
0 1.005
X
Conclusión: la probabilidad de que una muestra aleatoria de 100 la probabilidad de que salgan más de 55 caras es
de 0.157.
Ejemplo 22: Se ha determinado que 85.1% de los estudiantes de una universidad fuman cigarrillos. Se toma una
muestra aleatoria de 200 estudiantes. Calcular la probabilidad de que no más de 80% de alumnos de la muestra
fume.
Solución:
Muchas aplicaciones involucran poblaciones de datos cualitativos que deben compararse utilizando proporciones
o porcentajes. A continuación, se citan algunos ejemplos:
Educación: ¿Es mayor la proporción de los estudiantes que aprueban matemáticas que las de los que
aprueban inglés?
Medicina: ¿Es menor el porcentaje de los usuarios del medicamento A que presentan una reacción adversa
que el de los usuarios del fármaco B que también presentan una reacción de ese tipo?
Administración: ¿Hay diferencia entre los porcentajes de hombres y mujeres en posiciones gerenciales?
Ingeniería: ¿Existe diferencia entre la proporción de artículos defectuosos que genera la máquina A, a los
que genera la máquina B?
Cuando el muestreo procede de dos poblaciones binomiales y se trabaja con dos proporciones muestrales, la
distribución muestral de diferencia de proporciones es aproximadamente normal para tamaños de muestra grande
(𝑛1 𝑝̂1 ≥ 5, 𝑛1 𝑞1 ≥ 5, 𝑛2 𝑝̂ 2 ≥ 5, 𝑛2 𝑞2 ≥ 5). Entonces 𝑝1 y 𝑝2 tienen distribuciones muestrales aproximadamente
normales, así que su diferencia 𝑝̂1 − 𝑝̂ 2 también tiene una distribución muestral aproximadamente normal. La
fórmula que se utilizará para el cálculo de probabilidad del estadístico de diferencia de proporciones es:
Ejemplo 23: Los hombres y mujeres adultos radicados en una ciudad grande del norte difieren en sus opiniones
sobre la promulgación de la pena de muerte para personas culpables de asesinato. Se cree que el 12% de los
hombres adultos están a favor de la pena de muerte, mientras que sólo 10% de las mujeres adultas lo están. Si se
pregunta a dos muestras aleatorias de 100 hombres y 100 mujeres su opinión sobre la promulgación de la pena de
muerte, determine la probabilidad de que el porcentaje de hombres a favor sea al menos 3% mayor que el de las
mujeres.
Solución:
Los datos son:
𝑃1 = 0.12, 𝑛1 = 100, 𝑞1 = 0.88
𝑃2 = 0.10, 𝑛2 = 100, 𝑞2 = 0.90
𝑝̂1 − 𝑝̂2 ≥ 0.03
Se incluye el factor de corrección de 0.5 por ser una distribución binomial y se usa la 𝑁(0,1).
0.5
𝑝̂1 − 𝑝̂ 2 = 0.03 − = 0.025
100
Gráfica de distribución
Normal, Media=0, [Link].=1
0.4
0.3
Densidad
0.2
0.4550
0.1
0.0
0.11305
0
X
Conclusión: la probabilidad de que el porcentaje de hombres a favor de la pena de muerte, al menos 3% mayor
que el de mujeres es de 0.455.
Ejemplo 24: Se sabe que 3 de cada 6 productos fabricados por la máquina 1 son defectuosos y que 2 de cada 5
objetos fabricados por la máquina 2 son defectuosos; se toman muestras de 120 objetos de cada máquina:
Solución:
a) ¿Cuál es la probabilidad de que la proporción de artículos defectuosos de la máquina 2 rebase a la máquina 1
en por lo menos 0.10?
Otro punto importante es analizar la distribución muestral teórica de la varianza muestral de muestras aleatorias
de poblaciones normales. Puesto que 𝑆 2 no puede ser negativa, se puede esperar que esta distribución de muestreo
𝑛−1
no es una curva normal; en efecto, se relaciona con la distribución gamma, con 𝛼 = y 𝛽 = 2, llamada
2
distribución ji-cuadrada. Se tiene el siguiente teorema:
Si S2 es la varianza de una muestra aleatoria de tamaño n tomada de una población normal con varianza σ2, entonces
Ejemplo 25: Una empresa óptica compra cristales para engastarlos en lentes, y se sabe por experiencia que la
varianza del índice de refracción de este tipo de cristales es de 1.26X10-4. Como es importante que las diversas
piezas de cristal tengan casi el mismo índice de refracción, la empresa rechaza un embarque si la varianza de la
muestra de 20 piezas seleccionadas al azar excede de 2X10-4. Suponiendo que los valores de la muestra pueden
ser considerados como una muestra aleatoria de una población normal, ¿cuál es la probabilidad un embarque sea
rechazado, aunque σ2=1.26X10-4?
Solución:
2
Al sustituir en la fórmula del estadístico , se obtiene
Usando la tabla estadística de la distribución ji-cuadrada para v = 20 -1 = 19 grados de libertad y una probabilidad
de 0.05, se tiene un valor de 30.144, el cual es menor que 30.2,
Gráfica de distribución
Chicuadrado, df=19
0.07
0.06
0.05
Densidad
0.04
0.03
0.02
0.01
0.0493
0.00
0 30.2
X
Conclusión: la probabilidad de que un embarque aceptable sea rechazado erróneamente es de menos de 0.05.
Ejemplo 26: Suponga que los tiempos requeridos por un cierto autobús para alcanzar un de sus destinos en una
ciudad grande forman una distribución normal con una desviación estándar 𝜎 = 1 minuto. Si se elige al azar una
muestra de 17 tiempos, encuentre la probabilidad de que la varianza muestral sea menor que 1.2.
Solución:
Para determinar si la razón de varianzas muestrales es muy reducida o muy grande, usamos la teoría;
Si 𝑆12 y 𝑆22 son las varianzas de muestras aleatorias independientes de tamaño 𝑛1 y 𝑛2 , respectivamente, tomadas
de dos poblaciones normales con la misma varianza, entonces
𝑆12
𝐹=
𝑆22
La distribución se relaciona con la distribución beta y sus dos parámetros, 𝑣1 y 𝑣2 , se llaman grados de libertad
del numerador y denominador.
1
𝑓1−𝛼 (𝑣1 , 𝑣2 ) =
𝑓𝛼 (𝑣2 , 𝑣1 )
Ejemplo 27: Si dos muestras aleatorias independientes de tamaño n1= 7 y n2 = 13 se toman de una población
normal, ¿cuál es la probabilidad de que la varianza de la primera muestra sea al menos tres veces mayor que la de
la segunda muestra?
Solución:
𝑆2
Se tiene que 𝐹 = 𝑆12 = 3, y los grados de libertad de 6 y 12, localizamos el valor de 3 o un aproximado en las
2
tablas estadísticas.
Gráfica de distribución
F, df1=6, df2=12
0.8
0.7
0.6
0.5
Densidad
0.4
0.3
0.2
0.1
0.0498
0.0
0 3
X
𝑆12
𝑃( > 3) = 𝑃(𝐹 > 3) = 0.0498
𝑆22
Conclusión: la probabilidad es aproximadamente de 0.05 de que la varianza de la muestra 1 sea tres veces mayor
que la segunda.
Ejemplo 28: Si 𝑠12 y 𝑠22 son las varianzas muestrales de muestras aleatorias independientes de tamaños 𝑛1 = 10 y
𝑛2 = 20, tomadas de poblaciones normales que tienen las mismas varianzas, encuentre que el cociente entre las
varianza sea menor que 2.42.
Solución:
Prácticas Unidad 1
Ejercicio 1: El peso de 200 estudiantes varones de cierta universidad es 151 libras, y la desviación típica es 15
libras. Si los pesos están distribuidos normalmente, calcular la probabilidad de que los estudiantes pesen entre 120
y 155 libras.
Solución:
Ejercicio 2: Si S12 y S22 , representan las varianzas de muestras aleatorias independientes de tamaño 𝑛1 = 8 y 𝑛2 =
S2
12, tomadas de poblaciones normales con varianzas poblacionales iguales, encuentre 𝑃 (S12 < 1.48)
2
Solución:
Ejercicio 3: Un medicamento para malestar estomacal tiene la advertencia de que algunos usuarios pueden
presentar una reacción adversa a él, más aún, se piensa que alrededor del 3% de los usuarios tienen tal reacción.
Si una muestra aleatoria de 150 personas con malestar estomacal usa el medicamento, encuentre la probabilidad
de que la proporción de la muestra de los usuarios que realmente presentan una reacción adversa, exceda el 4%.
Solución:
Ejercicio 4: La compañía de baterías Timeless afirma que sus baterías tienen una vida media de 60 meses
y una desviación estándar de 9 meses. Un grupo de consumidores que está poniendo a prueba esta
afirmación compra 36 baterías y determina la vida media. Suponiendo que lo que afirma Timeless es
cierto, ¿cuál es la probabilidad de que la vida media de la muestra sea menor que 58 meses? Determine la
probabilidad de que la vida media de la muestra esté entre 57 y 63 meses.
Solución:
Ejercicio 5: Se prueba el rendimiento en km/L de 2 tipos de gasolina, encontrándose una desviación estándar de
1.23𝑘𝑚/𝐿 para la primera gasolina y una desviación estándar de 1.37𝑘𝑚/𝐿 para la segunda gasolina; se prueba
la primera gasolina en 35 autos y la segunda en 42 autos. ¿Cuál es la probabilidad de que la primera gasolina de
un rendimiento promedio mayor de 0.45𝑘𝑚/𝐿 que la segunda gasolina?
Solución:
Ejercicio 6: Un especialista en genética ha detectado que el 26% de los hombres y el 24% de las mujeres de cierta
región del país tiene un leve desorden sanguíneo; si se toman muestras de 150 hombres y 150 mujeres, determine
la probabilidad de que la diferencia muestral de proporciones que tienen ese leve desorden sanguíneo sea: a) menos
de 0.035 a favor de los hombres y b) entre 0.01 y 0.04 a favor de los hombres.
Solución:
Ejercicio 7: Encuentre la probabilidad de que una muestra aleatoria de 25 observaciones, de una población
normal con varianza de 6, tenga una varianza muestral: a) mayor que 9.1 y b) entre 3.462 y 10.745.
Solución:
Unidad 2 Estimación
2.1 Introducción
Estimador y estimaciones
Un estimador es una estadística de muestra utilizada para estimar un parámetro de población. La media de la
muestra puede ser un estimador de la media de la población, y la porción de la muestra se puede utilizar como
estimador de la porción de la población. También podemos utilizar el alcance de la muestra como un estimador
del alcance de la población. Cuando hemos observado un valor numérico específico de nuestro estimador, nos
referimos a ese valor como una estimación. Una estimación es un valor específico observado de una estadística.
Hacemos una estimación si tomamos una muestra y calculamos el valor que toma nuestro estimador en esa
muestra.
1. Sesgo: Se denomina sesgo de un estimador a la diferencia entre la esperanza (o valor esperado) del estimador
y el verdadero valor del parámetro a estimar. Es deseable que un estimador sea insesgado o centrado, es decir,
que su sesgo sea nulo por ser su esperanza igual al parámetro que se desea estimar. Por ejemplo, si se desea
estimar la media de una población, la media aritmética de la muestra es un estimador insesgado de la misma,
ya que su esperanza (valor esperado) es igual a la media de la población.
2. Eficiencia: Diremos que un estimador es más eficiente o más preciso que otro estimador, si la varianza del
primero es menor que la del segundo. Un estimador es más eficiente (más preciso), por tanto, cuanto menor
es su varianza. La eficiencia de los estimadores está limitada por las características de la distribución de
probabilidad de la muestra de la que proceden.
3. Consistencia: Si no es posible emplear estimadores de mínima varianza, el requisito mínimo deseable para
un estimador es que a medida que el tamaño de la muestra crece, el valor del estimador tiende a ser el valor
del parámetro, propiedad que se denomina consistencia.
4. Robustez: Un estimador de un parámetro será robusto si la vulneración de los supuestos de partida en los que
se basa la estimación (normalmente, atribuir a la población un determinado tipo de función de distribución
que, en realidad, no es la correcta), no altera de manera significativa los resultados que éste proporciona.
5. Suficiencia: Se dice que un estimador es suficiente cuando resume toda la información relevante contenida
en la muestra, de forma que ningún otro estimador pueda proporcionar información adicional sobre el
parámetro desconocido de la población.
6. Invarianza: Se dice que un estimador es invariante cuando el estimador de la función del parámetro coincide
con la función del estimador del parámetro. Ejemplo: si para estimar la varianza muestral utilizamos la
varianza poblacional, entonces para estimar la desviación típica muestral será razonable utilizar la desviación
típica poblacional.
Tipos de estimación
Podemos hacer dos tipos de estimaciones concernientes a una población:
Una estimación puntual: es sólo un número que se utiliza para estimar un parámetro de población
desconocido. Una estimación puntual a menudo resulta insuficiente, debido a que sólo tiene dos
opciones: es correcta o está equivocada. Una estimación puntual es mucho más útil si viene
acompañada por una estimación del error que podría estar implicado.
Una estimación de intervalo: es un intervalo de valores que se utiliza para estimar un parámetro de
población. Esta estimación indica el error de dos maneras: por la extensión del intervalo y por la
probabilidad de obtener el verdadero parámetro de la población que se encuentra dentro del intervalo.
Se llama intervalo de confianza en estadística a un par de números entre los cuales se estima que estará cierto valor
desconocido con una determinada probabilidad de acierto. Formalmente, estos números determinan un intervalo,
que se calcula a partir de datos de una muestra, y el valor desconocido es un parámetro poblacional. La probabilidad
de éxito en la estimación se representa por 1 − 𝛼 y se denomina nivel de confianza. En estas circunstancias, α es
el llamado error aleatorio o nivel de significación, esto es, una medida de las posibilidades de fallar en la estimación
mediante tal intervalo. El nivel de confianza y la amplitud del intervalo varían conjuntamente, de forma que un
intervalo más amplio tendrá más posibilidades de acierto (mayor nivel de confianza), mientras que, para un
intervalo más pequeño, que ofrece una estimación más precisa, aumentan sus posibilidades de error. Para la
construcción de un determinado intervalo de confianza es necesario conocer la distribución teórica que sigue el
parámetro a estimar. Es habitual que el parámetro se distribuya normalmente.
De este manera, cuando se ha obtenido una muestra y se calcula el valor de 𝑥̅ , se dice que con (1 − 𝛼)% de
𝜎 𝜎
confianza que el intervalo de 𝑥̅ − 𝑧𝛼⁄2 ( 𝑛) < 𝜇 < 𝑥̅ + 𝑧𝛼⁄2 ( 𝑛) contiene a 𝜇. A un intervalo de este clase se le
√ √
llama “intervalo de confianza” para 𝜇 con el “grado de confianza” (1 − 𝛼)%, donde 𝛼 es el grado de error, y a sus
puntos extremos “límites de confianza”.
Ejemplo 1: Se sabe que la velocidad de los coches que circulan por una carretera es una variable aleatoria que con
desviación estándar 12 km/hora. Si se toma una muestra aleatoria de 400 coches que da una velocidad media de
87 km/hora. Obtenga un intervalo con un 95% de confianza, para la velocidad media del total de coches que
circulan por esa carretera.
Solución:
Se tienen los siguientes datos,
𝑥̅ = 87 𝛼 𝛼 0.05
Se calcula el valor 𝛼 y de 2 , 𝛼 = 1 − 0.95 = 0.05 y 2 = 2 = 0.025,
𝜎 = 12
entonces calculamos la probabilidad inversa de 𝑧0.025, observando la
𝑛 = 400 gráfica.
(1 − 𝛼) = 0.95
Gráfica de distribución
Normal, Media=0, [Link].=1
0.4
0.3
Densidad
0.2
0.1
0.025
0.0
0 1.96
X
Se tiene que el valor 𝑥 = 1.96, es el valor de 𝑧0.025 = 1.96, sustituyendo en la fórmula del intervalo de confianza,
se observa
𝜎 𝜎
𝑥̅ − 𝑧𝛼⁄2 ( ) < 𝜇 < 𝑥̅ + 𝑧𝛼⁄2 ( )
√𝑛 √𝑛
12 12
87 − (1.96) ( ) < 𝜇 < 87 + (1.96) ( )
√400 √400
Conclusión: el intervalo de confianza para la velocidad media del total de coches que circulan esa carretera es de
85.824 km/h a 88.176 km/h, con un grado de confianza del 95%.
Ejemplo 2: Se conoce que la desviación estándar de calorías contenidas en las barras de chocolate es de 15
calorías, si se toma una muestra de 45 chocolates que tienen una media de 230 calorías. Encuentre un intervalo de
confianza para determinar el promedio real del contenido energético de los chocolates con un nivel de confianza
del 99%.
Solución:
𝑠 𝑠
𝑥̅ − 𝑡𝛼⁄ ( ) < 𝜇 < 𝑥̅ + 𝑡𝛼⁄ ,𝑣 ( )
2,𝑣 2
√𝑛 √𝑛
Donde 𝑡𝛼⁄ es el valor de 𝑡 con 𝑣 = 𝑛 − 1 grados de libertad, que deja un área de 𝛼⁄2 a la derecha.
2
Ejemplo 3: Suponga que se ha tomado una muestra de tamaño 20, de la altura de las chicas de 18 años de la
Universidad de Aragón, la cual tiene una desviación estándar de 10 cm y una media muestral de 170 cm. Encuentre
un intervalo de confianza de 99% para la altura promedio de las chicas de 18 años.
Solución:
Se tienen los siguientes datos,
𝑥̅ = 170
𝑠 = 10
𝑛 = 20
(1 − 𝛼) = 0.99
𝛼 𝛼 0.01
Se calcula el valor 𝛼 y de 2 , 𝛼 = 1 − 0.99 = 0.01 y 2 = 2 = 0.005, y los grados de libertad de 𝑣 = 𝑛 − 1 =
20 − 1 = 19 entonces se calcula el valor de 𝑡0.005,19 , observando la gráfica.
Gráfica de distribución
T, df=19
0.4
0.3
Densidad
0.2
0.1
0.005
0.0
0 2.86
X
Se tiene que el valor 𝑥 = 2.86, es el valor de 𝑡0.005,19 = 2.86, sustituyendo en la fórmula del intervalo de
confianza, se observa
𝑠 𝑠
𝑥̅ − 𝑡𝛼⁄2,𝑣 ( ) < 𝜇 < 𝑥̅ + 𝑡𝛼⁄2,𝑣 ( )
√𝑛 √𝑛
10 10
170 − 2.86 ( ) < 𝜇 < 170 − 2.86 ( )
√20 √20
Conclusión: que el intervalo de confianza para la altura media para las chicas de 18 de la Universidad de Aragón
es de 163.604cms a 16.395cms, con un grado de confianza del 99%.
Ejemplo 4: Se conoce que la desviación estándar de calorías contenidas en las barras de chocolate es de 15
calorías, si se toma una muestra de 15 chocolates que tienen una media de 230 calorías. Encuentre un intervalo de
confianza para determinar el promedio real del contenido energético de los chocolates con un nivel de confianza
del 95%.
Solución:
𝜎2 𝜎2 𝜎2 𝜎2
(𝑥̅1 − 𝑥̅2 ) − 𝑧𝛼⁄ (√ 1 + 2 ) < 𝜇1 − 𝜇2 < (𝑥̅1 − 𝑥̅2 ) + 𝑧𝛼⁄ (√ 1 + 2 )
2 𝑛1 𝑛2 2 𝑛1 𝑛2
Ejemplo 5: Los cinescopios para televisión del fabricante A tienen una desviación estándar de 0.9 años, mientras
que los del fabricante B una desviación estándar de 0.8 años. Se toma una muestra aleatoria de 36 cinescopios del
fabricante A que tienen una duración media de 6.5 años y una muestra de 49 cinescopios del fabricante B tienen
una duración media de 6 años, encuentre un intervalo de confianza del 98%, para la diferencia promedio de la
duración de los cinescopios 𝜇𝐴 − 𝜇𝐵 .
Solución:
Se tienen los datos,
𝑥̅𝐴 = 6.5 𝑥̅𝐵 = 6
𝜎𝐴 = 0.9 𝜎𝐵 = 0.8
𝑛𝐴 = 36 𝑛𝐵 = 49
(1 − 𝛼) = 0.98
𝛼 𝛼 0.02
Se calcula el valor 𝛼 y de , 𝛼 = 1 − 0.98 = 0.02 y = = 0.01, entonces se calcula el valor de 𝑍0.01 =
2 2 2
2.33, observando la gráfica
Gráfica de distribución
Normal, Media=0, [Link].=1
0.4
0.3
Densidad
0.2
0.1
0.01
0.0
0 2.33
X
Se tiene que el valor 𝑥 = 2.33, es el valor de 𝑍0.01 = 2.33, sustituyendo en la fórmula del intervalo de confianza,
se observa
Conclusión: el intervalo de confianza para la diferencia media de la duración de los cinescopios de la compañía
A y B, es de 0.06061 años a 0.93938 años, con un grado de confianza del 99%.
Solución:
Dada una variable aleatoria con distribución Binomial 𝐵(𝑛, 𝑝), el objetivo es la construcción de un intervalo de
confianza para el parámetro p, basada en una observación de la variable que ha dado como valor x.
El mismo caso se aplica si estudiamos una Binomial 𝐵(1, 𝑝) y consideramos el número de veces que ocurre el
suceso que define la variable al repetir el experimento n veces en condiciones de independencia.
𝑝̂ (1 − 𝑝̂ ) 𝑝̂ (1 − 𝑝̂ )
𝑝̂ − 𝑧𝛼⁄ √ ≤ 𝑃̂ ≤ 𝑝̂ + 𝑧𝛼⁄ √
2 𝑛 2 𝑛
Ejemplo 7: Un fabricante de reproductores de discos compactos utiliza un conjunto de pruebas amplias para
evaluar la función eléctrica de su producto. Todos los reproductores de discos compactos deben pasar todas las
pruebas antes de venderse. Una muestra aleatoria de 500 reproductores tiene como resultado 15 que fallan en una
o más pruebas. Encuentre un intervalo de confianza de 90% para la proporción de los reproductores de discos
compactos de la población que no pasan todas las pruebas.
Solución:
Se tienen los datos;
𝛼 = 0.10
𝑛 = 500
𝑥 = 15
15
𝑝̂ = = 0.03
500
𝛼 𝛼 0.10
Teniendo el valor 𝛼 y de , 𝛼 = 1 − 0.90 = 0.10 y = = 0.05, entonces se calcula el valor de 𝑍0.05 = 1. 645,
2 2 2
observando la gráfica
Gráfica de distribución
Normal, Media=0, [Link].=1
0.4
0.3
Densidad
0.2
0.1
0.05
0.0
0 1.645
X
𝑝̂ (1 − 𝑝̂ ) 𝑝̂ (1 − 𝑝̂ )
𝑝̂ − 𝑧𝛼⁄2 √ ≤ 𝑃̂ ≤ 𝑝̂ + 𝑧𝛼⁄2 √
𝑛 𝑛
0.01745 ≤ 𝑃̂ ≤ 0.04255
Conclusión: el intervalo de confianza para la proporción de reproductores que fallas es de 0.01745 a 0.04255, con
un grado de confianza del 90%.
Ejemplo 8: En un estudio de 300 accidentes de automóvil en una ciudad específica, 60 tuvieron consecuencias
fatales. Con base en esta muestra, construya un intervalo del 95% de confianza para aproximar la proporción de
todos los accidentes automovilísticos que en esa ciudad tienen consecuencias fatales.
Solución:
𝑝̂ (1 − 𝑝̂ ) 𝑁 − 𝑛 𝑝̂ (1 − 𝑝̂ ) 𝑁 − 𝑛
𝑝̂ − 𝑧𝛼⁄2 √ √ ≤ 𝑃̂ ≤ 𝑝̂ + 𝑧𝛼⁄2 √ √
𝑛 𝑁−1 𝑛 𝑁−1
Ejemplo 9: En un almacén se está haciendo una auditoria para las facturas defectuosas. De 500 facturas de venta
se escoge una muestra de 30, de las cuales 5 contienen errores. Construir un intervalo de confianza del 95%.
Solución:
Se tienen los datos;
𝛼 = 0.05
𝑁 = 500
𝑛 = 30
𝑥=5
5
𝑝̂ = = 0.16667
30
𝛼 𝛼 0.05
Teniendo el valor 𝛼 y de 2 , 𝛼 = 1 − 0.95 = 0.05 y 2
= 2
= 0.025, entonces el valor de 𝑍0.025 = 1.96 ,
observando la gráfica
Gráfica de distribución
Normal, Media=0, [Link].=1
0.4
0.3
Densidad
0.2
0.1
0.025
0.0
0 1.960
X
𝑝̂ (1 − 𝑝̂ ) 𝑁 − 𝑛 𝑝̂ (1 − 𝑝̂ ) 𝑁 − 𝑛
𝑝̂ − 𝑧𝛼⁄ √ √ ≤ 𝑃̂ ≤ 𝑝̂ + 𝑧𝛼⁄ √ √
2 𝑛 𝑁−1 2 𝑛 𝑁−1
0.03724 ≤ 𝑃̂ ≤ 0.2961
Conclusión: el intervalo de confianza para la proporción de facturas con errores en una población de 500 facturas
es de 0.03724 a 0.2961, con un grado de confianza del 95%.
Ejemplo 10: Un fabricante de reproductores de discos compactos utiliza un conjunto de pruebas amplias para
evaluar la función eléctrica de su producto. Todos los reproductores de discos compactos deben pasar todas las
pruebas antes de venderse. Se tiene un lote 1500 reproductores, de los cuales se toma una muestra de 350 tiene
como resultado 10 que fallan en una o más pruebas. Encuentre un intervalo de confianza de 90% para la proporción
de los reproductores de discos compactos del lote que no pasan todas las pruebas.
Solución:
Los límites para el intervalo de confianza del (1 − 𝛼)% de una diferencia de proporciones correspondientes a
dos muestras independientes son:
𝑃1 (1 − 𝑃1 ) 𝑃2 (1 − 𝑃2 ) 𝑃1 (1 − 𝑃1 ) 𝑃2 (1 − 𝑃2 )
(𝑃1 − 𝑃2 ) − 𝑧𝛼⁄ √ + ≤ 𝑝̂1 − 𝑝̂2 ≤ (𝑃1 − 𝑃2 ) + 𝑧𝛼⁄2 √ +
2 𝑛1 𝑛2 𝑛1 𝑛2
Este intervalo puede utilizarse de manera alternativa al contraste de hipótesis para decidir (con nivel de
significación α %) si hay igualdad de los dos grupos. Se decidirá por la igualdad de los grupos si el valor 0 queda
incluido en cualquier posición en el intervalo.
Aunque se haga el contraste de dos proporciones, en primer lugar, es aconsejable obtener el intervalo de
confianza de la diferencia de medias, si éste ha resultado significativo, puesto que ayudará a interpretar si existe
significación aplicada además de la estadística.
Ejemplo 11: Se considera cierto cambio en un proceso de fabricación de partes componentes. Se toman muestras
del procedimiento existente y del nuevo para determinar si éste tiene como resultado una mejoría. Si se encuentra
que 75 de 1500 artículos del procedimiento actual son defectuosos y 80 de 2000 artículos del procedimiento nuevo
también lo son, encuentre un intervalo de confianza de 90% para la diferencia real en la fracción de defectuosos
entre el proceso actual y el nuevo.
Solución:
Se tienen los datos;
𝛼 = 0.10
75
𝑃1 = = 0.05
1500
80
𝑃2 = = 0.04
2000
𝑛1 = 1500
𝑛2 = 2000
𝛼 𝛼 0.10
Teniendo el valor 𝛼 y de , 𝛼 = 1 − 0.90 = 0.10 y = = 0.05, entonces se calcula el valor de 𝑍0.05 = 1.645,
2 2 2
observando la gráfica
Gráfica de distribución
Normal, Media=0, [Link].=1
0.4
0.3
Densidad
0.2
0.1
0.05
0.0
0 1.645
X
𝑃1 (1 − 𝑃1 ) 𝑃2 (1 − 𝑃2 ) 𝑃1 (1 − 𝑃1 ) 𝑃2 (1 − 𝑃2 )
(𝑃1 − 𝑃2 ) − 𝑧𝛼⁄ √ + ≤ 𝑝̂ 1 − 𝑝̂ 2 ≤ (𝑃1 − 𝑃2 ) + 𝑧𝛼⁄ √ +
2 𝑛1 𝑛2 2 𝑛1 𝑛2
−0.00173 ≤ 𝑃̂ ≤ 0.02173
Conclusión: el intervalo de confianza para la diferencia en la proporción de artículos defectuosos de los procesos
es de -0.00173 a 0.02173, con un grado de confianza del 90%. A su vez podríamos decir, que los dos procesos son
iguales, no ofrecen mucha diferencia en la proporción de defectos.
Ejemplo 12: Se cree que la osteoporosis está relacionada con el sexo. Para ello se elige una muestra de 100
hombres de más de 50 años y una muestra de 200 mujeres en las mismas condiciones. Se obtiene que 10 hombres
y 40 mujeres con algún grado de osteoporosis. ¿Qué podemos concluir con una confianza del 95 %?
Solución:
(𝑛 − 1)𝑠 2 (𝑛 − 1)𝑠 2
< 𝜎2 <
𝜒𝛼2⁄ 2
𝜒1− 𝛼⁄
2,𝑣 2,𝑣
Un intervalo de confianza del (1 − 𝛼)100% para 𝜎 se obtiene al tomar la raíz cuadrada de cada extremo del
intervalo de 𝜎 2 .
Ejemplo 13: Una empresa eléctrica fabrica focos que tienen una duración aproximadamente distribuida de forma
normal con una desviación estándar de 40 horas. Se toma una muestra aleatoria de 30 focos. Determine un intervalo
de confianza de 95%, para la varianza poblacional.
Solución:
Se tienen los siguientes datos,
𝑠 = 40
𝑛 = 30
(1 − 𝛼) = 0.95
𝛼 𝛼 0.05
Se calcula el valor 𝛼 y de , 𝛼 = 1 − 0.95 = 0.05 y = = 0.025, y el valor de 1 − 𝛼⁄2 = 1 − 0.025 =
2 2 2
2 2
0.975, y los grados de libertad 𝑣 = 30 − 1 = 29 entonces se calcula el valor de 𝜒0.025,29 = 45.7 y 𝜒0975,29 =
16, observando la gráfica.
0.05 0.05
0.04 0.04
Densidad
Densidad
0.02 0.02
0.01 0.01
0.025
0.00 0.00
45.7 16.0
X X
(𝑛 − 1)𝑠 2 (𝑛 − 1)𝑠 2
< 𝜎2 <
𝜒𝛼2⁄ 2
𝜒1− 𝛼⁄
2,𝑣 2,𝑣
(29)(40)2 (29)(40)2
< 𝜎2 <
45.7 16
Conclusión: el
Ejemplo 14: La desviación típica de resistencia a la rotura de 100 cables producidos por una compañía fue de 180
libras. Determinar los límites de confianza del 99% para la desviación típica de todos los cables producidos por la
compañía.
Solución:
𝝈𝟐
Intervalo de confianza para la razón de 𝝈𝟏𝟐
𝟐
Si 𝑠12 y 𝑠22 son las varianzas de muestras independientes de tamaño 𝑛1 y 𝑛2 , respectivamente, de poblaciones
𝜎12
normales, entonces un intervalo de confianza de (1 − 𝛼)100% para es
𝜎22
Donde 𝑓𝛼⁄ es un valor 𝑓 con 𝑣1 = 𝑛1 − 1 y 𝑣2 = 𝑛2 − 1 grados de libertad que deja un área de 𝛼⁄2 a la
2,(𝑣1 ,𝑣2 )
derecha, 𝑓𝛼⁄2,(𝑣2 ,𝑣1 ) es un valor 𝑓 similar con 𝑣2 = 𝑛2 − 1 y 𝑣1 = 𝑛1 − 1 grados de libertad.
Ejemplo 15: Las desviaciones estándar de los diámetros de tornillos producidos por dos máquinas son 0.042 cm
y 0.035 cm respectivamente, basados en muestras de tamaño 10 y 12 cada una. Hallar el intervalo de confianza
del 95% para la relación de varianzas.
Solución:
Se tienen los datos, 𝑠2 = 0.035
𝑠1 = 0.042 𝑛2 = 12
𝑛1 = 10 (1 − 𝛼) = 0.95
𝛼 𝛼 0.05
Se calcula el valor 𝛼 y de , 𝛼 = 1 − 0.95 = 0.05 y = = 0.025, y los grados de libertad 𝑣1 = 10 − 1 = 9
2 2 2
y 𝑣2 = 12 − 1 = 11, entonces se calcula el valor de 𝑓0.025,(9,11) = 3.59 y 𝑓0.025,(11,9) = 3.91, observando la
gráfica.
0.7 0.7
0.6 0.6
0.5 0.5
Densidad
Densidad
0.4 0.4
0.3 0.3
0.2 0.2
0.1 0.1
0.025 0.025
0.0 0.0
0 3.59 0 3.91
X X
𝜎12
0.40111 < < 5.6304
𝜎22
Conclusión: el intervalo de confianza para la relación de varianzas de los diámetros de los tornillos de las dos
máquinas, es de 0.40111 a 5.6304, con un grado de confianza del 95%, es decir, la varianza de una de las máquinas
puede ser hasta 5.6 veces mayor.
Ejemplo 16: En un estudio que se lleva a cabo en la Universidad de Virginia sobre las capacidades de rendimiento
de dos tipos de trigo, el rendimiento se mide en kilogramos por parcela.
Tipo 1: 38, 23, 35, 41, 44, 29, 37, 31, 38.
Tipo 2: 45, 25, 31, 38, 50, 33, 36, 40, 43, 45, 40.
Encuentre un intervalo de confianza del 95% para la diferencia de las desviaciones estándar del rendimiento del
trigo.
Solución:
Los objetivos que se tienen al determinar un número adecuado de muestra, son los siguientes:
1. Estimar un parámetro determinado con el nivel de confianza deseado.
2. Detectar una determinada diferencia, si realmente existe, entre los grupos de estudio con un mínimo de
garantía.
3. Reducir costes o aumentar la rapidez del estudio.
Cosas que debes tener en cuenta a la hora de calcular el tamaño de una muestra:
Si deseas un margen de error más pequeño, debes tener un tamaño de muestra más grande para la
misma población.
Cuanto más alto desees que sea el nivel de confianza, más grande tendrá que ser el tamaño de la
muestra.
Si la población es finita, como previamente se señaló, es decir conocemos el total de la población y desearíamos
saber cuántos del total tendríamos que estudiar, la respuesta sería:
Donde:
𝑁 (𝑍𝛼2⁄ ) (𝑆 2 ) 𝑍𝑎2⁄ = nivel de confianza o seguridad
2 2
𝑛= 𝑆 2 = varianza
𝑑2 (𝑁 − 1) + 𝑁(𝑆 2 )
𝑑 = precisión o error máximo permitido
𝑁 = tamaño de la población
Ejemplo 17: Se desea conocer la media de la glucemia basal de una población, con una seguridad de 95% y una
precisión de ± 3 𝑚𝑔/𝑑𝑙 y tenemos información por un estudio piloto o revisión bibliográfica que la varianza es
de 250 𝑚𝑔/𝑑𝑙.
Solución:
Datos: Se localiza en la tabla de distribución normal estándar
𝛼 = 0.05 el valor de 𝑍0.05⁄ = 𝑍0.025 = 1.96 , se observa la
2
𝑑=3 gráfica.
𝑆 2 = 250
Gráfica de distribución
Sustituyendo en la fórmula; Normal, Media=0, [Link].=1
0.4
(1.96)2 (250)
𝑛= = 106.7111 ≈ 107 0.3
32
Densidad
0.2
Conclusión: se requiere una muestra de 107 pacientes.
0.1
0.025
0.0
0 1.960
X
Ejemplo 18: Un biólogo quiere estimar el peso promedio de los ciervos cazados en el estado de Maryland. Un
estudio anterior de diez ciervos cazados mostró que la desviación estándar de sus pesos es de 12.2 libras. ¿Qué tan
grande debe ser una muestra para que el biólogo tenga el 95% de confianza de que el error de estimación es a lo
más de 4 libras?
Solución:
Donde:
𝑍𝛼 = valor de Z correspondiente al riesgo de cometer un error 𝛼
𝑍𝛽 = valor de Z correspondiente al riesgo de cometer un error 𝛽
𝑆 2 = varianza de la variable cuantitativa del grupo de referencia
𝑑 = precisión o error máximo permitido
Donde:
𝑍𝛼⁄2 = valor de Z correspondiente al riesgo de cometer un error 𝛼
𝜎12 = varianza de la variable cuantitativa del grupo 1
𝜎22 = varianza de la variable cuantitativa del grupo 2
𝑑 = precisión o error máximo permitido
Ejemplo 19: Se desea utilizar un nuevo fármaco antidiabético y se considera que sería clínicamente eficaz si
lograse un descenso de 15 𝑚𝑔/𝑑𝑙 respecto al tratamiento habitual con el antidiabético estándar. Por estudios
previos se sabe que la desviación típica de la glucemia en pacientes que reciben el tratamiento habitual es de
16 𝑚𝑔/𝑑𝑙. Se acepta un riesgo de 0.05 y un poder estadístico de 90% para detectar diferencias si es que existen.
Solución:
Datos: Se localiza en la tabla de distribución normal estándar
𝛼 = 0.05 𝑍0.05 = 1.645 , y 𝑍0.10 = 1.282 se observa la gráfica.
𝛽 = 0.1 Gráfica de distribución
Normal, Media=0, [Link].=1
𝑑 = 15 0.4
𝑆 = 16
0.3
Sustituyendo en la fórmula;
Densidad
0.2
𝑛= = 19.49548 ≈ 20
152 0.0
0.05
0 1.645
X
0.4
0.3
Densidad
0.2
0.1
0.1
0.0
0 1.282
X
Ejemplo 20: Un director de personal quiere comparar la efectividad de dos métodos de entrenamiento para
trabajadores industriales a fin de efectuar cierta operación de montaje. Se divide un número de operarios en dos
grupos iguales: el primero recibe el método de entrenamiento 1, y el segundo, el método 2. Cada uno realizará la
operación de montaje y se registrará el tiempo de trabajo. Se espera que las mediciones para ambos grupos tengan
una desviación estándar aproximadamente de 2 minutos. Si se desea que la estimación de la diferencia en tiempo
medio de montaje sea correcta hasta por un minuto, con una probabilidad igual a 0.95, ¿cuántos trabajadores se
tienen que incluir en cada grupo de entrenamiento?
Solución:
𝑍𝛼2⁄ (𝑝)(𝑞)
2
𝑛=
𝑑2
Donde:
𝑍𝛼2⁄ = nivel de confianza o seguridad
2
𝑝 = proporción esperada
𝑞 =1−𝑝
𝑑 = precisión o error máximo permitido
Si la población es finita, es decir conocemos el total de la población y deseásemos saber cuántos del total tendremos
que estudiar la respuesta seria:
𝑁 (𝑍𝛼2⁄ ) (𝑝)(𝑞)
2
𝑛=
𝑑2 (𝑁 − 1) + (𝑍𝛼2⁄ ) (𝑝)(𝑞)
2
Donde:
𝑍𝛼2⁄ = nivel de confianza o seguridad
2
𝑝 = proporción esperada
𝑞 =1−𝑝
𝑑 = precisión o error máximo permitido
𝑁 = tamaño de la población
Ejemplo 21: ¿A cuántas personas se tendrían que estudiar para conocer la prevalencia de diabetes? Se sabe que la
Seguridad = 95%; Precisión = 3%: Proporción esperada = asumamos que puede ser próxima al 5%; si no
tuviésemos ninguna idea de dicha proporción utilizaría el valor 𝑝 = 0.5(50%) que maximiza el tamaño muestral.
Solución:
Datos: Se localiza en la tabla de distribución normal estándar
𝛼 = 0.05 𝑍0.05⁄ = 𝑍0.025 = 1.96 , se observa la gráfica.
2
𝑝 = 0.05 Gráfica de distribución
𝑞 = 0.95 Normal, Media=0, [Link].=1
0.4
𝑑 = 0.03
0.3
Sustituyendo en la fórmula;
Densidad
𝑛= = 202.75111 ≈ 203
(0.03)2 0.1
0.025
0.0
Conclusión: se requiere una muestra de 203 pacientes. 0
X
1.960
Ejemplo 22: ¿A cuántas personas tendría que estudiar de una población de 15.000 habitantes para conocer la
prevalencia de diabetes? Seguridad = 95%; Precisión = 3%; proporción esperada = asumamos que puede ser
próxima al 5%; si no tuviese ninguna idea de dicha proporción utilizaríamos el valor 𝑝 = 0.5 (50%) que
maximiza el tamaño muestral.
Solución:
Datos: Se localiza en la tabla de distribución normal estándar
𝛼 = 0.05 el valor de 𝑍0.05⁄ = 𝑍0.025 = 1.96 , se observa la
2
𝑝 = 0.05 gráfica.
𝑞 = 0.95
𝑑 = 0.03 Gráfica de distribución
𝑁 = 15,000 Normal, Media=0, [Link].=1
0.4
Sustituyendo en la fórmula;
0.3
2 (0.05)(0.95)
15,000(1.96)
Densidad
𝑛= 0.2
Ejemplo 23: En una muestra aleatoria de 500 familias que tienen televisores en la ciudad de Hamilton, Canadá,
se encuentra que 340 están suscritas a HBO. ¿Qué tan grande se requiere que sea una muestra si se quiere tener
95% de confianza de que la estimación de 𝑝 esté dentro de 0.02?
Solución:
Donde:
𝑍𝛼 = valor de Z correspondiente al riesgo de cometer un error 𝛼
𝑍𝛽 = valor de Z correspondiente al riesgo de cometer un error 𝛽
𝑝1 = proporción del grupo de referencia
𝑝2 = proporción del grupo del nuevo tratamiento
𝑝 = media de las dos proporciones
Donde:
𝑍𝛼⁄2 = valor de Z correspondiente al riesgo de cometer un error 𝛼
𝑝1 = proporción del grupo de referencia
𝑝2 = proporción del grupo del nuevo tratamiento
𝑝 = media de las dos proporciones
𝑑 = precisión o error máximo permitido
Ejemplo 24: Se desea evaluar si el Tratamiento 𝑇2 es mejor que el tratamiento 𝑇1 para el alivio del dolor para lo
que se diseña un ensayo clínico. Se sabe por datos previos que la eficacia del fármaco habitual está alrededor del
70% y se considera clínicamente relevante si el nuevo fármaco alivia el dolor en un 90%. El nivel de riesgo lo
fijamos en 0.05 y deseamos un poder estadístico de un 80%.
Solución:
Datos:
𝛼 = 0.05
𝛽 = 0.2
𝑝1 = 0.70
𝑝2 = 0.90
𝑝 = 0.8
Se localiza en la tabla de distribución normal estándar el valor de 𝑍0.05 = 1.645 , y 𝑍0.20 = 0.8416 de se observa
la gráfica.
Gráfica de distribución Gráfica de distribución
Normal, Media=0, [Link].=1 Normal, Media=0, [Link].=1
0.4 0.4
0.3 0.3
Densidad
Densidad
0.2 0.2
0.1 0.1
0.2
0.05
0.0 0.0
0 1.645 0 0.8416
X X
Sustituyendo en la fórmula;
2
1.645√2(0.8)(1 − 0.8) + 0.8416√(0.70)(1 − 0.70) + (0.90)(1 − 0.90)
𝑛=[ ] = 48.40791 ≈ 49
(0.70 − 0.90)
Ejemplo 25: Una compañía de productos alimenticios contrató a una empresa de investigación de mercadotecnia,
para muestrear dos mercados, I y II, a fin de comparar las proporciones de consumidores que prefieren la comida
congelada de la compañía con los productos de sus competidores. No hay información previa acerca de la magnitud
de las proporciones P1 y P2. Si la empresa de productos alimenticios quiere estimar la diferencia dentro de 0.04,
con una probabilidad de 0.95, ¿cuántos consumidores habrá que muestrear en cada mercado?
Solución:
Prácticas Unidad 2
Ejercicio 2: La desviación típica de resistencia a la rotura de 100 cables producidos por una compañía fue de 180
libras. Determinar los límites de confianza del 99% para la desviación típica de todos los cables producidos por la
compañía.
Solución:
Ejercicio 3: Los siguientes datos registrados en días, representan el tiempo de recuperación para pacientes que se
tratan al azar con uno de dos medicamentos para curar infecciones de la piel:
Muestra Media
Medicamento 1 14 17
Medicamento 2 16 19
Se sabe que las desviaciones poblacionales de cada medicamento son de 1.5 y 1.8, respectivamente, encuentre un
intervalo del 95% para la diferencia 𝜇2 − 𝜇1 en el tiempo promedio de recuperación de los dos medicamentos.
Solución:
Ejercicio 4: Los siguientes datos representan los tiempos de duración de las películas que producen dos compañías
cinematográficas.
Compañía Tiempo (minutos)
I 98 103 94 110 87
II 118 97 82 123 92 175 88
Se conoce que las compañías tienen una desviación estándar población de 15.79 minutos, encuentre un intervalo
de confianza de 90% para la diferencia del promedio de duración de las películas que producen las dos compañías.
Solución:
Ejercicio 5: Una muestra aleatoria de 12 graduadas de una escuela secretarial escriben a máquina en promedio
79.3 palabras por minuto con una desviación de 7.8 palabras por minuto. Encuentre un intervalo de confianza del
98% para el número promedio de palabras escritas por las alumnas graduadas de esta escuela.
Solución:
Ejercicio 6: Tomada, al azar, una muestra de 120 estudiantes de una Universidad, se encontró que 54 de ellos
hablaban inglés. Halle, con un nivel de confianza del 90%, un intervalo de confianza para estimar la proporción
de estudiantes que hablan el idioma inglés entre los estudiantes de esa Universidad.
Solución:
Ejercicio 7: En una encuesta realizada a 500 mujeres adultas de una población se encontró que 300 de ellas están
casadas actualmente. Construya con estos datos un intervalo de confianza, con un nivel del 90%, para la proporción
de mujeres adultas actualmente casadas en esa población.
Solución:
Ejercicio 8: Un artículo relacionado con la salud, reporta los siguientes datos sobre la incidencia de disfunciones
importantes entre recién nacidos con madres fumadoras de marihuana y de madres que no la fumaban:
Usuaria No Usuaria
Ejercicio 9: Una empresa eléctrica fabrica focos que tienen una duración aproximadamente normal con una
desviación estándar de 40 horas. ¿De qué tamaño se necesita una muestra si se desea tener 96% de confianza que
la media real esté dentro de 10 horas de la media real?
Solución:
Ejercicio 10: Una legisladora estatal desea encuestar a los residentes de su distrito para conocer qué proporción
del electorado conoce la opinión de ella, respecto al uso de fondos estatales para pagar abortos. ¿Qué tamaño de
muestra se necesita si se requiere una confianza del 95% y un error máximo de estimación de 0.10?
Solución:
Ejercicio 11: Se quiere estudiar la tasa de combustión de dos propelentes sólidos utilizados en los sistemas de
escape de emergencia de aeroplanos. Se sabe que la tasa de combustión de los dos propelentes tiene
aproximadamente la misma desviación estándar; esto es 𝜎1 = 𝜎2 = 3𝑐𝑚/𝑠 . Qué tamaño de muestra debe
utilizarse en cada población si se desea que el error en la estimación de la diferencia entre las medias de las tasas
de combustión sea menor que 4 𝑐𝑚/𝑠 con una confianza del 99%?
Solución:
Ejercicio 12: Se tienen que seleccionar muestras aleatorias independientes de 𝑛1 = 𝑛2 = 𝑛 observaciones de cada
una de dos poblaciones binomiales, 1 y 2. Si se desea estimar la diferencia entre los dos parámetros binomiales,
exacta dentro de 0.05, con una probabilidad de 0.98. ¿qué tan grande tendría que ser 𝑛? No se tiene información
anterior acerca de los valores 𝑃1 y 𝑃2 , pero se quiere estar seguro de tener un número adecuado de observaciones
en la muestra.
Solución:
Un contraste de hipótesis (también denominado test de hipótesis o prueba de significación) es una metodología
de inferencia estadística para juzgar si una propiedad que se supone cumple una población estadística es compatible
con lo observado en una muestra de dicha población. Fue iniciada por Ronald Fisher y fundamentada
posteriormente por Jerzy Neyman y Karl Pearson. Mediante esta teoría, se aborda el problema estadístico
considerando una hipótesis determinada 𝐻𝑂 y una hipótesis alternativa 𝐻𝑎 , y se intenta dirimir cuál de las dos es
la hipótesis verdadera, tras aplicar el problema estadístico a un cierto número de experimentos.
Un ejemplo del primer grupo es la hipótesis de que la media de una variable es 10, y del segundo que la distribución
de probabilidad es la distribución normal.
Se denomina hipótesis nula 𝐻𝑂 a la hipótesis que se desea contrastar. El nombre de “nula” indica que 𝐻𝑂 representa
la hipótesis que mantendremos a no ser que los datos indiquen su falsedad, y puede entenderse, por tanto, en el
sentido de “neutra”. La hipótesis 𝐻𝑂 nunca se considera probada, aunque puede ser rechazada por los datos.
A partir de una muestra de la población en estudio, se extrae un estadístico (esto es, un valor que es función de la
muestra) cuya distribución de probabilidad esté relacionada con la hipótesis en estudio y sea conocida. Se toma
entonces el conjunto de valores que es más improbable bajo la hipótesis como región de rechazo, esto es, el
conjunto de valores para el que consideraremos que, si el valor del estadístico obtenido entra dentro de él,
rechazaremos la hipótesis.
La probabilidad de que se obtenga un valor del estadístico que entre en la región de rechazo aun siendo cierta la
hipótesis puede calcularse. De esta manera, se puede escoger dicha región de tal forma que la probabilidad de
cometer este error sea suficientemente pequeña.
El error de tipo I también mal llamado error de tipo alfa (alfa es la probabilidad de que ocurra este error), es el
error que se comete cuando el investigador rechaza la hipótesis nula (Ho) siendo ésta verdadera en la población.
Es equivalente a encontrar un resultado falso positivo, porque el investigador llega a la conclusión de que existe
una diferencia entre las hipótesis cuando en realidad no existe.
En un estudio de investigación, el error de tipo II, también llamado error de tipo beta (aunque beta es la
probabilidad de que exista éste error), se comete cuando el investigador no rechaza la hipótesis nula siendo ésta
falsa en la población. Es equivalente a la probabilidad de un resultado falso negativo, ya que el investigador llega
a la conclusión de que ha sido incapaz de encontrar una diferencia que existe en la realidad. Se acepta en un estudio
que el valor del error beta debe estar entre el 5 y el 20%.
Estados posibles
Decisión posible
𝐻𝑜 cierta 𝐻𝑜 falsa
El poder o potencia del estudio representa la probabilidad de observar en la muestra una determinada diferencia
o efecto, si existe en la población. Es el complementario del error de tipo II (1-β).
Las pruebas de hipótesis proporcionan un enfoque ir o no ir para la toma de decisiones. En las pruebas de hipótesis
se quiere demostrar la hipótesis alterna (𝐻𝑎).
Ejemplo 1: Una muestra aleatoria de 8 cigarrillos de una marca determinada tiene un contenido promedio de
nicotina de 2.6 miligramos y una desviación estándar de 0.9 miligramos. ¿Existe suficiente evidencia estadística
para decir que el contenido promedio real de nicotina de esta marca de cigarros en particular es mayor 2.4
miligramos? 𝛼 = 0.05.
Solución:
Se plantean las hipótesis
𝐻𝑜: 𝜇 = 2.4
𝐻𝑎: 𝜇 > 2.4
𝑋̅ − 𝜇𝑜 2.6 − 2.4
𝑡= 𝑠 = = 0.628
⁄ 𝑛 0.9⁄
√ √8
Valor crítico 𝛼 = 0.05, 𝑡0.05,8 = 1.89, se compara el estadístico con el valor crítico si 𝑡 > 𝑡𝛼,𝑛−1 se rechaza 𝐻𝑜,
Conclusión: dado que el estadístico de prueba es menor que el valor crítico, podemos decir que existe suficiente
evidencia para aceptar 𝐻𝑜, y decimos que el promedio real de nicotina de esa marca de cigarrillos no es mayor a
2.4 miligramos.
Ejemplo 2: Una empresa eléctrica fabrica baterías de celular que tienen una duración que se distribuye de forma
aproximadamente normal con una media de 800 horas y una desviación estándar de 40 horas. Si una muestra
aleatoria de 30 baterías tiene una duración promedio de 788 horas, ¿muestran los datos suficiente evidencia para
decir que la duración media no es 800? Utilice un nivel de significancia del 0.05.
Solución:
Comparación de dos poblaciones bajo las mismas condiciones. Por ejemplo: el antes de una mejora y el después
de la mejora.
Ejemplo 3: Se realizó un estudio para comparar los años promedio de servicio de quienes se retiraron en 1979 con
los que se retiraron el año anterior en Delong Manufacturing. Con un nivel de significancia de .01 ¿podemos
concluir que los trabajadores que se retiraron el año pasado trabajaron más años según la siguiente muestra? Nota:
sea población #1= año anterior. Los datos de la población 2 son: 𝑋̅2 = 25.6, 𝜎2 = 2.9 el tamaño de la muestra es
de 40, y la población 1: 𝑋̅1 = 30.4, 𝜎1 = 3.6 el tamaño de la muestra es de 45, es el año anterior.
Solución:
Se plantean las hipótesis
𝐻𝑜: 𝜇1 = 𝜇2
𝐻𝑎: 𝜇1 > 𝜇2
Usamos el estadístico de prueba Z, dado que las muestras son mayores 30, y conocemos las desviaciones
poblacionales, por lo tanto, sustituimos;
Se busca el valor crítico con un 𝛼 = 0.01, 𝑧0.01 = 2.33, comparamos el estadístico de prueba con el valor crítico
si 𝑧 > 𝑍𝛼 se rechaza 𝐻𝑜,
Conclusión: dado que el estadístico de prueba es mayor que el valor crítico, podemos decir que existe suficiente
evidencia para rechazar la 𝐻𝑜, y decimos que los trabajadores que se retiraron el año pasado (Población 1)
trabajaron en promedio más años que los que se retiraron este año.
Ejemplo 4: El control de calidad una fábrica de pilas y baterías sospecha que hubo defectos en la producción de
un modelo de batería para teléfonos móviles, bajando su tiempo de duración. Hasta ahora el tiempo de duración
en conversación seguía una distribución normal con media 300 minutos y desviación típica 30 minutos, en el lote
de 75 baterías (Lote 1). Sin embargo, en la inspección del último lote producido (Lote 2), antes de enviarlo al
mercado, se obtuvo que de una muestra de 60 baterías el tiempo medio de duración en conversación fue de 290
minutos. Suponiendo que ese tiempo sigue siendo Normal con la misma desviación típica: ¿Se puede concluir que
las sospechas del control de calidad son ciertas a un nivel de significación del 2%?
Solución:
El concepto de la prueba de hipótesis también se puede utilizar para probar hipótesis en relación con datos
cualitativos. Por ejemplo, el gerente de una fábrica de llantas quiere determinar la proporción de llantas que se
revientan antes de 10,000 kilómetros.
Ejemplo 5: Una encuesta realizada por Bancomer a 35 clientes indicó que un poco más del 74 por ciento tenían
un ingreso familiar de más de $200,000 al año. Si esto es cierto, el banco desarrollará un paquete especial de
servicios para este grupo. La administración quiere determinar si el porcentaje verdadero es mayor del 60 por
ciento antes de desarrollar e introducir este nuevo paquete de servicios. Los resultados mostraron que 74.29 por
ciento de los clientes encuestados reportaron ingresos de $200,000 o más al año. 𝛼 = 0.05.
Solución:
Se plantean las hipótesis
𝐻𝑜: 𝑝 = 0.60
𝐻𝑎: 𝑝 > 0.60
𝑝 − 𝑝𝑜 0.7429 − 0.60
𝑧= =𝑧= = 1.73
√𝜌𝑜 (1 − 𝑝𝑜 ) √0.60(0.40)
𝑛 35
Se busca el valor crítico con un 𝛼 = 0.05, 𝑧0.05 = 1.645, comparamos el estadístico de prueba con el valor
crítico si 𝑧 > 𝑍𝛼 se rechaza 𝐻𝑜,
Conclusión: dado que el estadístico de prueba es mayor que el valor crítico, podemos decir que existe suficiente
evidencia para rechazar la 𝐻𝑜, el banco puede concluir con un 95% de confianza que más de un 60 por ciento de
sus clientes tienen ingresos familiares de $200,000 o más. La administración puede introducir el nuevo paquete de
servicios orientado a este grupo.
Ejemplo 6: Una marca de nueces afirma que, como máximo, el 6% de las nueces están vacías. Se eligieron 300
nueces al azar y se detectaron 21 vacías. Con un nivel de significación del 1%, ¿se puede aceptar la afirmación de
la marca?
Solución:
En lugar de preocuparse por las diferencias entre dos poblaciones en términos de una variable cuantitativa, el
interés podría ser las diferencias en alguna característica cualitativa.
Ejemplo 7: La administración de las tiendas Oxxo cree, sobre la base de una investigación, que el porcentaje de
hombres que visitan sus tiendas 9 o más veces al mes (clientes frecuentes) es mayor que el porcentaje de mujeres
que hacen lo mismo. Se toma una muestra de 45 hombre y 71 mujeres, sus proporciones son 0.58 y 0.42,
respectivamente. 𝛼 = 0.05
Solución:
Se plantean las hipótesis
𝐻𝑜: 𝜌ℎ = 𝜌𝑚
𝐻𝑎: 𝜌ℎ > 𝜌𝑚
(𝑝1 − 𝑝2 ) 0.16
𝑧= = = 1.71
𝑝 (1 − 𝑝1 ) 𝑝2 (1 − 𝑝2 )
√ 1 + √0.58(0.42) + 0.42(0.58)
𝑛1 𝑛2 45 71
Se busca el valor crítico con un 𝛼 = 0.05, 𝑧0.05 = 1.645, comparamos el estadístico de prueba con el valor
crítico si 𝑧 > 𝑍𝛼 se rechaza 𝐻𝑜,
Conclusión: dado que el estadístico de prueba es mayor que el valor crítico, podemos decir que existe suficiente
evidencia para rechazar la 𝐻𝑜, la administración puede concluir con un 95% de confianza que la proporción de
hombres que visita 9 o más veces los Oxxo es mayor que la proporción de mujeres.
Solución:
Cuando se analizan variables cuantitativas, a menudo es importante sacar conclusiones en cuanto a la variabilidad,
así como al promedio de una característica de interés. Por ejemplo, en el estudio de las llantas, el gerente de la
fábrica, probablemente se interesaría en determinar si la variabilidad en la duración de las llantas está o no dentro
de los límites aceptables antes de concluir que el proceso funciona en forma correcta. En este caso, lo que
interesaría sería llegar a conclusiones acerca de la desviación estándar o a la varianza de la población.
Ejemplo 9: Una muestra aleatoria de 16 cigarrillos de una marca determinada tiene una desviación estándar de
0.9 miligramos. ¿Existe suficiente evidencia estadística para decir que la desviación estándar es menor a 1
miligramo? 𝛼 = 0.05.
Solución:
Se plantean las hipótesis
𝐻𝑜: 𝜎12 = 1
𝐻𝑎: 𝜎12 < 1
2
Se busca el valor crítico con un 𝛼 = 0.05, 𝜒0.95 = 7.261, comparamos el estadístico de prueba con el valor
2 2
crítico si 𝜒 < 𝜒1−𝛼 , se rechaza 𝐻𝑜
Conclusión: dado que el estadístico de prueba es menor que el valor crítico, podemos decir que no existe suficiente
evidencia para rechazar la 𝐻𝑜, y decimos que la varianza de los cigarrillos no es menor a 1.
Ejemplo 10: Un fabricante de detergente liquido está interesado en la uniformidad de la maquina utilizada para
llenar botellas de manera específica es deseable que la varianza sea; 0.01 onzas² del líquido. Al tomar una muestra
aleatoria de 20 botellas se obtiene una varianza muestral (𝑠²) para el volumen de llenado 𝑠² = 0.0153.
(distribución normal). El fabricante está preocupado porque piensa que la variación del proceso es mayor que la
variación histórica. Con un α=0.05, el fabricante tiene elementos que sustenten se preocupación?
Solución:
En una forma análoga a las ya descritas para las medias y proporciones, también interesa determinar si las dos
poblaciones tienen o no la misma variabilidad. Para poder comparar la igualdad de las varianzas de dos poblaciones
independientes, se ha ideado un procedimiento estadístico basado en la razón de las dos varianzas muestrales.
Ejemplo 11: Se realizó un estudio para comparar los años promedio de servicio de quienes se retiraron en 1979
con los que se retiraron el año anterior en Delong Manufacturing. Con un nivel de significancia de 0.01 ¿Se puede
concluir que las varianzas que los años que trabajaron los trabajadores que se retiraron el año pasado son diferentes
de la de los que se retiraron este año? Nota: sea población #1= año anterior. Los datos de la población 2 son los
siguientes: 𝑠2 = 2.9 el tamaño de la muestra es de 40, y la población 1: 𝑠1 = 3.6 el tamaño de la muestra es de
45, es el año anterior.
Solución:
Se plantean las hipótesis
Se busca el valor crítico con un 𝛼 = 0.01, 𝐹0.005,44,39 = 2.28 y 𝐹0.995,44,39 = 0.446, comparamos el estadístico
de prueba con el valor crítico si tenemos que 𝑓 < 𝐹1−𝑎⁄2,𝑣1 ,𝑣2 ó 𝑓 > 𝐹𝑎⁄2,𝑣1 ,𝑣2 se rechaza 𝐻𝑜
Conclusión: dado que el estadístico de prueba está en el intervalo de los valores críticos podemos decir que no
existe suficiente evidencia para rechazar la 𝐻𝑜, y decimos que la varianza de la población 1 no es diferente de la
población 2.
Ejemplo 12: Dos fuentes de materias primas están siendo consideradas. Ambas fuentes parecen tener
características similares, pero no se está seguro de su homogeneidad. Una muestra de 10 grupos de la fuente A
produce una varianza de 250 y una muestra de 11 grupos de la fuente B produce una varianza de 195. ¿Con base
en esta información se puede concluir que la varianza de la fuente A es significativamente mayor que la de la
fuente B? Considere una confianza del 99%.
Solución:
Prácticas Unidad 3
Ejercicio 1: Un gerente de ventas de libros universitarios afirma que en promedio sus representantes de ventas
realizan 40 visitas a profesores por semana. Varios de estos representantes piensan que realizan un número de
visitas promedio superior a 40. Una muestra tomada al azar durante 8 semanas reveló un promedio de 42 visitas
semanales y una desviación estándar de 2 visitas. Utilice un nivel de confianza del 99% para aclarar esta cuestión.
Solución:
Ejercicio 2: Un sociólogo ha pronosticado que, en una determinada ciudad, el nivel de abstención en las próximas
elecciones será del 40% como mínimo. Se elige al azar una muestra aleatoria de 200 individuos, con derecho a
voto, 75 de los cuales estarían dispuestos a votar. Determinar con un nivel de significación del 1%, si se puede
admitir el pronóstico.
Solución:
Ejercicio 3: Un informe indica que el precio medio del billete de avión entre Canarias y Madrid es, como máximo,
de 120 € con una desviación típica de 40 €. Se toma una muestra de 100 viajeros y se obtiene que la media de los
precios de sus billetes es de 128 €. ¿Se puede aceptar, con un nivel de significación igual a 0.10, la afirmación de
partida?
Solución:
Ejercicio 4: Para encontrar si un nuevo suero detiene la leucemia, se seleccionan nueve ratones, todos con una
etapa avanzada de la enfermedad. Cinco ratones reciben el tratamiento y cuatro no. Los tiempos de sobrevivencia
en años, a partir del momento en que comienza el experimento son los siguientes:
Ejercicio 5: Se realizó un experimento para comparar el tiempo promedio requerido por el cuerpo humano para
absorber dos medicamentos, A y B. Suponga que el tiempo necesario para que cada medicamento alcance un nivel
específico en el torrente sanguíneo se distribuye normalmente. Se eligieron al azar a doce personas para ensayar
cada fármaco registrándose el tiempo en minutos que tardó en alcanzar un nivel específico en la sangre. Calcule
con 𝛼 = 0.05 si existe diferencia entre los tiempos promedio. Suponga varianzas iguales.
Medicamento A Medicamento B
𝑛𝐴 = 12 𝑛𝐵 = 12
𝑥̅𝐴 = 26.8 𝑥̅𝐴 = 32.6
𝑆𝐴2 = 15.57 𝑆𝐵2 = 17.54
Solución:
Ejercicio 6: Un supermercado tiene dos formas diferentes de venta: tradicional o con caja rápida. En la tradicional,
un operario registra cada artículo lo pone en bolsas y efectúa el cobro. En la caja rápida, el cliente registra cada
artículo, lo introduce en bolsas y paga en una máquina con tarjeta de crédito. La dirección del supermercado desea
saber si el tiempo medio que un cliente se encuentra en la fila del proceso con el método tradicional es mayor que
con la caja rápida, reuniendo la información adjunta:
Tradicional Caja rápida
𝑛 𝑇 = 49 𝑛𝐶𝑅 = 72
𝜇̅ 𝑇 = 6.1 𝑚𝑖𝑛 𝜇̅ 𝐶𝑅 = 5.6 𝑚𝑖𝑛
𝜎𝐴2 = 0.49 𝑚𝑖𝑛2 𝜎𝐶𝑅 2
= 0.36 𝑚𝑖𝑛2
Suponiendo que el tiempo en espera en el proceso es normal, con un nivel de confianza 99%, ¿Qué decisión debería
adoptar el supermercado para agilizar las ventas?
Solución:
Ejercicio 7: La variabilidad en la cantidad de impurezas presentes en un lote de productos químicos, utilizada para
un proceso en particular, depende del tiempo que tarda el proceso. Un fabricante que emplea dos líneas de
producción 1 y 2, hizo un pequeño ajuste al proceso 2, con la esperanza de reducir la variabilidad, así como la
cantidad media de impurezas en los productos químicos. Las muestras presentaron los siguientes resultados de
𝑛1 = 25, 𝑠12 = 1.04 y 𝑛2 = 20, 𝑠22 = 0.51, ¿Presentan los datos suficiente evidencia para indicar que las
variaciones del proceso son menores para el proceso 2?
Solución:
Ejercicio 8: Las capas de óxido en las obleas semiconductoras son depositadas en una mezcla de gases para
alcanzar el espesor apropiado. La variabilidad del espesor es una característica crítica de la oblea, y lo deseable
para los siguientes pasos de la fabricación es tener una variabilidad baja. Para ello se estudian dos mezclas
diferentes de gases con la finalidad de determinar con cuál se obtienen mejores resultados en cuanto a la reducción
en la variabilidad del espesor del óxido. Se depositan 21 obleas en cada gas. Las desviaciones estándar de cada
muestra del espesor del óxido son 𝑠1 = 1.96 𝑎𝑛𝑔𝑠𝑡𝑟𝑜𝑚𝑠 y 𝑠1 = 2.13 𝑎𝑛𝑔𝑠𝑡𝑟𝑜𝑚𝑠. ¿Existe evidencia que indique
una diferencia en las desviaciones?
Solución:
Ejercicio 9: Se ponen a prueba la enseñanza de la Estadística empleando Excel y Winstats. Para determinar si los
estudiantes difieren en términos de estar a favor de la nueva enseñanza se toma una muestra de 20 estudiantes de
dos paralelos. De paralelo A 18 están a favor, en tanto que del paralelo B están a favor 14. ¿Es posible concluir
con un nivel de significación de 0,05 que los estudiantes que están a favor de la nueva enseñanza de la Estadística
es la misma en los dos paralelos?
Solución:
Ejercicio 10: En un estudio se afirma que 3 de 10 estudiantes universitarios trabajan. Pruebe esta aseveración, a
un nivel de significación de 0,025, respecto a la alternativa de que la proporción real de los estudiantes
universitarios trabajan es mayor de lo que se afirma, si una muestra aleatoria de 600 estudiantes universitarios
revela que 200 de ellos trabajan. La muestra fue tomada de 10000 estudiantes.
Solución:
una población.
200
Y
relación entre dos variables por ejemplo: un fabricante 100
-2 0 2 4 6 8 10 12 14 16
X
La ecuación que se obtiene se puede usar de diversas formas. Una de ellas es para explicar los valores de una
variable en términos de la otra. Por ejemplo: un economista puede explicar los cambios en la demanda de
automóviles usados en términos de nivel de desempleo. Otro uso de la ecuación es para predecir los valores futuros
de una variable, por ejemplo: a menudo se llevan a cabo pruebas de selección para posibles estudiantes para
predecir la potencialidad de tener éxito en la escuela.
Para poder crear un modelo de regresión lineal, es necesario que se cumpla con los siguientes supuestos:
La relación entre las variables es lineal. Los errores tienen una media igual a cero.
Los errores son independientes. El error total es la suma de todos los errores.
Los errores tienen varianza constante.
300
Cuando se requiere hacer predicciones si el valor INTERPOLACIÓN
100
Cuando el valor de 𝑥 esta fuera del rango de valores de
𝑥 esta es una extrapolación, y no es válida aún teniendo 50
-50
-4 -2 0 2 4 6 8 10 12 14 16 18
X
El procedimiento estadístico para encontrar la recta de mejor ajuste para un conjunto de puntos es el criterio de
bondad que se conoce como el principio de los mínimos cuadrados y se establece como sigue: escoger la recta de
mejor ajuste que minimice la suma de los cuadrados de las desviaciones (errores "𝜀") de los valores observados de
"𝑦" respecto a los pronosticados.
𝑆𝑆𝑥𝑦
Para obtener los coeficientes 𝑏0 y 𝑏1 se siguen las fórmulas: 𝑏0 = 𝑦̅ − 𝑏1 𝑥̅ 𝑏1 =
𝑆𝑆𝑥
Ejemplo 1: Una empresa de fabricación de jabón se plantea cambiar la composición de uno de sus productos
utilizando una nueva materia prima. Antes de tomar una decisión, la empresa decide realizar un ensayo para
estudiar la posible relación entre la utilización dicha materia prima y el número de no conformidades. Para ello
analiza lotes con diferentes porcentajes de la nueva materia prima y toma los siguientes datos:
Muestra 1 2 3 4 5 6 7 8 9 10 11 12 13 14 15
Materia prima (%) (𝒙) 1 2 1.5 1.5 3 4 1.6 2.6 3.5 4.6 5 0.5 4.3 3.2 5.1
Producto no conforme (𝒚) 10 5 7 6 2 1 8 3 2 1 1 15 1 3 1
Solución:
a) Realizar el diagrama de dispersión y trazar la recta de predicción.
12 12
𝑛 = 12 ∑ 𝑥𝑖 = 1 + ⋯ + 5.1 = 43.4 ∑ 𝑦𝑖 = 10 + ⋯ + 1 = 66
𝑖=1 𝑖=1
12 12
15.0
12.5
Conclusión: La ecuación de regresión,
Producto no conforme
10.0
para la predicción del producto no
7.5 conforme respecto al % de materia
prima nueva es:
5.0
0 1 2 3 4 5
Materia prima (%)
Es necesario probar estadísticamente la validez de la relación entre las variables que interfieren en la regresión. La
relación entre las variables puede ser:
c) Nula para 𝑏1 = 0
En la regresión generalmente se está interesado en probar la relación entre variables, para esto se contrastan las
siguientes hipótesis.
Hipótesis Nula 𝐻𝑜: 𝑏1 = 0. No hay relación entre las variables. El modelo de regresión no es adecuado.
(Se acepta si 𝑝 > 0.05)
Hipótesis Alterna 𝐻𝑎: 𝑏1 ≠ 0. Si hay relación entre las variables. El modelo de regresión es adecuado.
(Se acepta si 𝑝 ≤ 0.05)
Fórmulas:
𝑛 𝑛
(∑𝑛𝑖=1 𝑦𝑖 )2 𝑆𝑆𝐸
𝑆𝑆𝑅 = ∑(𝑦̂𝑖 − 𝑦̅) 2
𝑆𝑆𝑦 = (∑ 𝑦𝑖2 ) − 𝑀𝑆𝐸 =
𝑛 𝑛−𝑘−1
𝑖=1 𝑖=1
𝑆𝑆𝑅 𝑀𝑆𝑅
𝑆𝑆𝐸 = 𝑆𝑆𝑦 − 𝑆𝑆𝑅 𝑀𝑆𝑅 = 𝑓=
𝑘 𝑀𝑆𝐸
Para aceptar o rechazar alguna de estas hipótesis se comprueban los siguientes enunciados:
Si 𝑓 ≥ 𝐹𝛼 Se rechaza la hipótesis nula 𝐻𝑜, es decir, SI hay relación entre las variables.
Si 𝑓 < 𝐹𝛼 Se acepta la hipótesis nula 𝐻𝑜, es decir, NO hay relación entre las variables.
Cuando se usa la recta de mínimos cuadrados para predecir algún valor futuro de y los errores aleatorios afectarán
el error de predicción, por consiguiente se usa el estimador 𝑠 2 para medir la variabilidad de tales errores. Si a este
estimador se le obtiene la raíz cuadrada 𝑠 se le conoce como la desviación estándar y es la variación porcentual de
los valores de "𝑦" y los estimados "𝑦̂".
Método de predictores:
Si |𝑇| ≥ 𝑡∝⁄2,𝑛−𝑘−1 Se rechaza la hipótesis nula 𝐻𝑜, es decir, SI hay relación entre las variables.
Si |𝑇| < 𝑡∝⁄2,𝑛−𝑘−1 Se acepta la hipótesis nula 𝐻𝑜, es decir, NO hay relación entre las variables.
Ejemplo 2: Del ejemplo 1, aplicar una prueba de hipótesis para verificar si existe o no relación entre las variables.
Con una confiabilidad del 95%.
Solución:
Muestra 𝒙 𝒚 ̂𝒊
𝒚 (𝒚 ̅)𝟐
̂𝒊 − 𝒚
1 1 10 9.05176 21.6388711
𝑆𝑆𝑅 = 191.049805
2 2 5 6.59484 4.81732263
3 1.5 7 7.8233 11.7189829
4 1.5 6 7.8233 11.7189829 (66)2
𝑆𝑆𝑦 = 530 − [ ] = 239.6
5 3 2 4.13792 0.06868593 15
6 4 1 1.681 7.392961
7 1.6 8 7.577608 10.0971926
𝐻𝑜: 𝑏1 = 0 el modelo de regresión no es
8 2.6 3 5.120688 0.51939119
adecuado, el % de materia prima nueva (𝑥) no
9 3.5 2 2.90946 2.22170949 tiene relación con el producto no conforme (𝑦).
10 4.6 1 0.206848 17.5825237 𝐻𝑎: 𝑏1 ≠ 0 el modelo de regresión si es
11 5 1 -0.77592 26.7901478 adecuado, el % de materia prima nueva (𝑥) si
12 0.5 15 10.28022 34.5769872 tiene relación con el producto no conforme (𝑦).
13 4.3 1 0.943924 11.9444613
14 3.2 3 3.646536 0.567708
15 5.1 1 -1.021612 29.3938767
Conclusión: Dado que 51.156629 > 4.667, se rechaza 𝐻𝑜; el modelo de regresión si es adecuado, es decir, si
hay relación entre el % de materia prima nueva (𝑥) y el producto no conforme (𝑦).
−2.45962
𝑡0.025,13 = 2.16 𝑇= = |−7.19374| = 7.19374
√ 3.73463
31.94633
Conclusión: Dado que 7.19374 > 2.16, se rechaza 𝐻𝑜; si hay relación entre el % de materia prima nueva (𝑥) y
el producto no conforme (𝑦).
Coeficiente de correlación
El coeficiente de correlación lineal mide el grado de intensidad de esta posible relación entre las variables. Este
coeficiente se aplica sólo cuando la relación que puede existir entre las variables es lineal.
Los valores que puede tomar el coeficiente de correlación "𝑟" son: −1 < 𝑟 < 1
a) Si 𝑟 > 0, la correlación lineal es positiva (si sube el valor de una variable sube el de la otra). La correlación
es tanto más fuerte cuanto más se aproxime a 1.
b) Si 𝑟 < 0, la correlación lineal es negativa (si sube el valor de una variable disminuye el de la otra). La
correlación negativa es tanto más fuerte cuanto más se aproxime a -1.
c) Si 𝑟 = 0, no existe correlación lineal entre las variables. Aunque podría existir otro tipo de correlación
(parabólica, exponencial, etc.)
𝑆𝑆𝑥𝑦
El coeficiente de correlación se obtiene con la siguiente fórmula; 𝑟=
√(𝑆𝑆𝑥)(𝑆𝑆𝑦)
Solución:
−77.76
𝑟= = −0.8888
√(31.94633)(239.6)
Conclusión: El coeficiente de correlación es de −0.8888, por lo tanto, es menor que 0, es decir, que si se tiene un
% mayor de materia prima nueva se obtendrán menos producto no conforme.
𝑆𝑆𝑅
𝑅2 = (100%)
𝑆𝑆𝑦
El coeficiente de determinación múltiple se utiliza para ilustrar lo adecuado de un modelo de regresión. El resultado
𝑅 2 se interpreta como una variación porcentual explicada por el modelo que se postula.
Solución:
191.049805
𝑅2 = (100%) = 79.737
239.6
El intervalo de confianza de (1−∝)100% para la estimación del valor de 𝑦, cuando 𝑥𝑝 = 𝑥, es decir, que el valor
de 𝑥𝑝 que es valor con el cual se va a hacer una predicción sea igual a un valor conocido de 𝑥, es el siguiente;
2
1 (𝑥𝑝 − 𝑥̅ )
𝑦̂ ∓ (𝑡∝⁄2,𝑛−𝑘−1 )𝑠√ +
𝑛 𝑆𝑆𝑥
Donde:
𝑦̂ resultado de la predicción para un valor de 𝑥𝑝
𝑡∝⁄2,𝑛−𝑘−1 valor de la distribución t
𝑛 tamaño de la muestra
𝑠 desviación estándar
𝑥̅ media de los valores de 𝑥
𝑆𝑆𝑥 suma de cuadrados de 𝑥
Ejemplo 5: Realice una predicción y un intervalo de confianza para saber cuánto será el producto no conforme si
se tiene un 2% de nueva materia prima, de los datos del ejemplo 1.
1 (2 − 2.893)2
6.59485 ∓ (2.16)(1.93252)√ +
15 31.94633
6.59485 ∓ 1.263555
Conclusión: Esto significa que estamos 95% seguros de que el producto no conforme será de 6.59485 dado un
2% de materia prima nueva, y además sabemos que el producto no conforme mínimo será de 5.3315 y el máximo
de 7.8584.
Ejemplo 6: Una compañía de publicidad desea encontrar un modelo que le ayude a predecir el volumen de ventas
(millones), dependiendo de la inversión en los gastos publicitarios (millones), se muestra la tabla con el volumen
de ventas y los gastos publicitarios de los 10 meses anteriores.
Mes 1 2 3 4 5 6 7 8 9 10
Gastos (x) 1.2 0.8 1 1.3 0.7 0.8 1 0.6 0.9 1.1
Ventas (y) 101 92 110 120 90 82 93 75 91 105
Solución:
a) Realizar el diagrama de dispersión y trazar la recta de predicción.
b) Aplicar una prueba de hipótesis para verificar si existe o no relación entre las variables. Con una confiabilidad
del 95%.
e) Realice una predicción y un intervalo de confianza para saber cuánto será el volumen de ventas de la compañía
si invierte 1.15 millones.
Prácticas Unidad 4
Ejercicio 1: Una empresa realiza pruebas de tensión a cierto tipo de acero para conocer cuánto es el alargamiento
que tiene, "𝑥" es la fuerza de tensión aplicada a un espécimen de acero en miles de libras y, "𝑦" es el alargamiento
resultante en milésimas de pulgada:
Fuerza de tensión
1.5 2.7 3 4 5.2 6 7 8 9 10
x
Alargamiento y 14 33 40 63 76 85 90 96 102 108
Solución:
c) Realizar el diagrama de dispersión y trazar la recta de predicción.
d) Aplicar una prueba de hipótesis para verificar si existe o no relación entre las variables. Con una confiabilidad
del 95%.
g) Realice una predicción y un intervalo de confianza para saber cuánto será el volumen de ventas de la compañía
si invierte 1.15 millones.
Ejercicio 2: Una empresa automotriz desea conocer cuántos autos inspeccionan sus empleados en una estación de
inspección, durante el mediodía y las 2 p.m. en cierto día, la tabla muestra el número de semanas trabajadas y el
número de autos inspeccionados:
Semanas empleadas 2 7 9 1 5 12 6 10 8 4
Vehículos inspeccionados 13 21 23 14 15 21 18 25 21 14
Solución:
a) Realizar el diagrama de dispersión y trazar la recta de predicción.
b) Aplicar una prueba de hipótesis para verificar si existe o no relación entre las variables. Con una confiabilidad
del 95%.
e) Realice una predicción y un intervalo de confianza para saber cuánto será el número de autos inspeccionados
en 4.5 semanas.
Ejercicio 3: Una empresa realiza pruebas para determinar cómo el porcentaje de cierta sustancia influye en el
tiempo de secado en segundos de un pegamento. La tabla adjunta refleja los valores obtenidos.
Solución:
a) Realizar el diagrama de dispersión y trazar la recta de predicción.
b) Aplicar una prueba de hipótesis para verificar si existe o no relación entre las variables. Con una confiabilidad
del 95%.
e) Realice una predicción y un intervalo de confianza para saber cuánto será el tiempo de secado con un 17% de
sustancia.
z 0 0.01 0.02 0.03 0.04 0.05 0.06 0.07 0.08 0.09 z 0 0.01 0.02 0.03 0.04 0.05 0.06 0.07 0.08 0.09
Estadística Inferencial I
-3.5 0.0002 0.0002 0.0002 0.0002 0.0002 0.0002 0.0002 0.0002 0.0002 0.0002 0.0 0.5000 0.5040 0.5080 0.5120 0.5160 0.5199 0.5239 0.5279 0.5319 0.5359
-3.4 0.0003 0.0003 0.0003 0.0003 0.0003 0.0003 0.0003 0.0003 0.0003 0.0002 0.1 0.5398 0.5438 0.5478 0.5517 0.5557 0.5596 0.5636 0.5675 0.5714 0.5753
-3.3 0.0005 0.0005 0.0005 0.0004 0.0004 0.0004 0.0004 0.0004 0.0004 0.0003 0.2 0.5793 0.5832 0.5871 0.5910 0.5948 0.5987 0.6026 0.6064 0.6103 0.6141
-3.2 0.0007 0.0007 0.0006 0.0006 0.0006 0.0006 0.0006 0.0005 0.0005 0.0005 0.3 0.6179 0.6217 0.6255 0.6293 0.6331 0.6368 0.6406 0.6443 0.6480 0.6517
-3.1 0.0010 0.0009 0.0009 0.0009 0.0008 0.0008 0.0008 0.0008 0.0007 0.0007 0.4 0.6554 0.6591 0.6628 0.6664 0.6700 0.6736 0.6772 0.6808 0.6844 0.6879
-3.0 0.0013 0.0013 0.0013 0.0012 0.0012 0.0011 0.0011 0.0011 0.0010 0.0010 0.5 0.6915 0.6950 0.6985 0.7019 0.7054 0.7088 0.7123 0.7157 0.7190 0.7224
-2.9 0.0019 0.0018 0.0018 0.0017 0.0016 0.0016 0.0015 0.0015 0.0014 0.0014 0.6 0.7257 0.7291 0.7324 0.7357 0.7389 0.7422 0.7454 0.7486 0.7517 0.7549
-2.8 0.0026 0.0025 0.0024 0.0023 0.0023 0.0022 0.0021 0.0021 0.0020 0.0019 0.7 0.7580 0.7611 0.7642 0.7673 0.7704 0.7734 0.7764 0.7794 0.7823 0.7852
-2.7 0.0035 0.0034 0.0033 0.0032 0.0031 0.0030 0.0029 0.0028 0.0027 0.0026 0.8 0.7881 0.7910 0.7939 0.7967 0.7995 0.8023 0.8051 0.8078 0.8106 0.8133
-2.6 0.0047 0.0045 0.0044 0.0043 0.0041 0.0040 0.0039 0.0038 0.0037 0.0036 0.9 0.8159 0.8186 0.8212 0.8238 0.8264 0.8289 0.8315 0.8340 0.8365 0.8389
-2.5 0.0062 0.0060 0.0059 0.0057 0.0055 0.0054 0.0052 0.0051 0.0049 0.0048 1.0 0.8413 0.8438 0.8461 0.8485 0.8508 0.8531 0.8554 0.8577 0.8599 0.8621
-2.4 0.0082 0.0080 0.0078 0.0075 0.0073 0.0071 0.0069 0.0068 0.0066 0.0064 1.1 0.8643 0.8665 0.8686 0.8708 0.8729 0.8749 0.8770 0.8790 0.8810 0.8830
-2.3 0.0107 0.0104 0.0102 0.0099 0.0096 0.0094 0.0091 0.0089 0.0087 0.0084 1.2 0.8849 0.8869 0.8888 0.8907 0.8925 0.8944 0.8962 0.8980 0.8997 0.9015
-2.2 0.0139 0.0136 0.0132 0.0129 0.0125 0.0122 0.0119 0.0116 0.0113 0.0110 1.3 0.9032 0.9049 0.9066 0.9082 0.9099 0.9115 0.9131 0.9147 0.9162 0.9177
-2.1 0.0179 0.0174 0.0170 0.0166 0.0162 0.0158 0.0154 0.0150 0.0146 0.0143 1.4 0.9192 0.9207 0.9222 0.9236 0.9251 0.9265 0.9279 0.9292 0.9306 0.9319
-2.0 0.0228 0.0222 0.0217 0.0212 0.0207 0.0202 0.0197 0.0192 0.0188 0.0183 1.5 0.9332 0.9345 0.9357 0.9370 0.9382 0.9394 0.9406 0.9418 0.9429 0.9441
-1.9 0.0287 0.0281 0.0274 0.0268 0.0262 0.0256 0.0250 0.0244 0.0239 0.0233 1.6 0.9452 0.9463 0.9474 0.9484 0.9495 0.9505 0.9515 0.9525 0.9535 0.9545
-1.8 0.0359 0.0351 0.0344 0.0336 0.0329 0.0322 0.0314 0.0307 0.0301 0.0294 1.7 0.9554 0.9564 0.9573 0.9582 0.9591 0.9599 0.9608 0.9616 0.9625 0.9633
-1.7 0.0446 0.0436 0.0427 0.0418 0.0409 0.0401 0.0392 0.0384 0.0375 0.0367 1.8 0.9641 0.9649 0.9656 0.9664 0.9671 0.9678 0.9686 0.9693 0.9699 0.9706
-1.6 0.0548 0.0537 0.0526 0.0516 0.0505 0.0495 0.0485 0.0475 0.0465 0.0455 1.9 0.9713 0.9719 0.9726 0.9732 0.9738 0.9744 0.9750 0.9756 0.9761 0.9767
-1.5 0.0668 0.0655 0.0643 0.0630 0.0618 0.0606 0.0594 0.0582 0.0571 0.0559 2.0 0.9772 0.9778 0.9783 0.9788 0.9793 0.9798 0.9803 0.9808 0.9812 0.9817
-1.4 0.0808 0.0793 0.0778 0.0764 0.0749 0.0735 0.0721 0.0708 0.0694 0.0681 2.1 0.9821 0.9826 0.9830 0.9834 0.9838 0.9842 0.9846 0.9850 0.9854 0.9857
-1.3 0.0968 0.0951 0.0934 0.0918 0.0901 0.0885 0.0869 0.0853 0.0838 0.0823 2.2 0.9861 0.9864 0.9868 0.9871 0.9875 0.9878 0.9881 0.9884 0.9887 0.9890
-1.2 0.1151 0.1131 0.1112 0.1093 0.1075 0.1056 0.1038 0.1020 0.1003 0.0985 2.3 0.9893 0.9896 0.9898 0.9901 0.9904 0.9906 0.9909 0.9911 0.9913 0.9916
-1.1 0.1357 0.1335 0.1314 0.1292 0.1271 0.1251 0.1230 0.1210 0.1190 0.1170 2.4 0.9918 0.9920 0.9922 0.9925 0.9927 0.9929 0.9931 0.9932 0.9934 0.9936
-1.0 0.1587 0.1562 0.1539 0.1515 0.1492 0.1469 0.1446 0.1423 0.1401 0.1379 2.5 0.9938 0.9940 0.9941 0.9943 0.9945 0.9946 0.9948 0.9949 0.9951 0.9952
-0.9 0.1841 0.1814 0.1788 0.1762 0.1736 0.1711 0.1685 0.1660 0.1635 0.1611 2.6 0.9953 0.9955 0.9956 0.9957 0.9959 0.9960 0.9961 0.9962 0.9963 0.9964
-0.8 0.2119 0.2090 0.2061 0.2033 0.2005 0.1977 0.1949 0.1922 0.1894 0.1867 2.7 0.9965 0.9966 0.9967 0.9968 0.9969 0.9970 0.9971 0.9972 0.9973 0.9974
-0.7 0.2420 0.2389 0.2358 0.2327 0.2296 0.2266 0.2236 0.2206 0.2177 0.2148 2.8 0.9974 0.9975 0.9976 0.9977 0.9977 0.9978 0.9979 0.9979 0.9980 0.9981
-0.6 0.2743 0.2709 0.2676 0.2643 0.2611 0.2578 0.2546 0.2514 0.2483 0.2451 2.9 0.9981 0.9982 0.9982 0.9983 0.9984 0.9984 0.9985 0.9985 0.9986 0.9986
-0.5 0.3085 0.3050 0.3015 0.2981 0.2946 0.2912 0.2877 0.2843 0.2810 0.2776 3.0 0.9987 0.9987 0.9987 0.9988 0.9988 0.9989 0.9989 0.9989 0.9990 0.9990
-0.4 0.3446 0.3409 0.3372 0.3336 0.3300 0.3264 0.3228 0.3192 0.3156 0.3121 3.1 0.9990 0.9991 0.9991 0.9991 0.9992 0.9992 0.9992 0.9992 0.9993 0.9993
-0.3 0.3821 0.3783 0.3745 0.3707 0.3669 0.3632 0.3594 0.3557 0.3520 0.3483 3.2 0.9993 0.9993 0.9994 0.9994 0.9994 0.9994 0.9994 0.9995 0.9995 0.9995
-0.2 0.4207 0.4168 0.4129 0.4090 0.4052 0.4013 0.3974 0.3936 0.3897 0.3859 3.3 0.9995 0.9995 0.9995 0.9996 0.9996 0.9996 0.9996 0.9996 0.9996 0.9997
-0.1 0.4602 0.4562 0.4522 0.4483 0.4443 0.4404 0.4364 0.4325 0.4286 0.4247 3.4 0.9997 0.9997 0.9997 0.9997 0.9997 0.9997 0.9997 0.9997 0.9997 0.9998
90
0.0 0.5000 0.4960 0.4920 0.4880 0.4840 0.4801 0.4761 0.4721 0.4681 0.4641 3.5 0.9998 0.9998 0.9998 0.9998 0.9998 0.9998 0.9998 0.9998 0.9998 0.9998
Tabla de distribución 𝒕-Student
Cola derecha
t α
v 0.9995 0.995 0.99 0.975 0.9 0.85 0.8 0.75 0.25 0.2 0.15 0.1 0.025 0.01 0.005 0.0005
Estadística Inferencial I
1 -636.619 -63.657 -31.821 -12.706 -3.078 -1.963 -1.376 -1.000 1.000 1.376 1.963 3.078 12.706 31.821 63.657 636.619
2 -31.599 -9.925 -6.965 -4.303 -1.886 -1.386 -1.061 -0.816 0.816 1.061 1.386 1.886 4.303 6.965 9.925 31.599
3 -12.924 -5.841 -4.541 -3.182 -1.638 -1.250 -0.978 -0.765 0.765 0.978 1.250 1.638 3.182 4.541 5.841 12.924
4 -8.610 -4.604 -3.747 -2.776 -1.533 -1.190 -0.941 -0.741 0.741 0.941 1.190 1.533 2.776 3.747 4.604 8.610
5 -6.869 -4.032 -3.365 -2.571 -1.476 -1.156 -0.920 -0.727 0.727 0.920 1.156 1.476 2.571 3.365 4.032 6.869
6 -5.959 -3.707 -3.143 -2.447 -1.440 -1.134 -0.906 -0.718 0.718 0.906 1.134 1.440 2.447 3.143 3.707 5.959
7 -5.408 -3.499 -2.998 -2.365 -1.415 -1.119 -0.896 -0.711 0.711 0.896 1.119 1.415 2.365 2.998 3.499 5.408
8 -5.041 -3.355 -2.896 -2.306 -1.397 -1.108 -0.889 -0.706 0.706 0.889 1.108 1.397 2.306 2.896 3.355 5.041
9 -4.781 -3.250 -2.821 -2.262 -1.383 -1.100 -0.883 -0.703 0.703 0.883 1.100 1.383 2.262 2.821 3.250 4.781
10 -4.587 -3.169 -2.764 -2.228 -1.372 -1.093 -0.879 -0.700 0.700 0.879 1.093 1.372 2.228 2.764 3.169 4.587
11 -4.437 -3.106 -2.718 -2.201 -1.363 -1.088 -0.876 -0.697 0.697 0.876 1.088 1.363 2.201 2.718 3.106 4.437
12 -4.318 -3.055 -2.681 -2.179 -1.356 -1.083 -0.873 -0.695 0.695 0.873 1.083 1.356 2.179 2.681 3.055 4.318
13 -4.221 -3.012 -2.650 -2.160 -1.350 -1.079 -0.870 -0.694 0.694 0.870 1.079 1.350 2.160 2.650 3.012 4.221
14 -4.140 -2.977 -2.624 -2.145 -1.345 -1.076 -0.868 -0.692 0.692 0.868 1.076 1.345 2.145 2.624 2.977 4.140
15 -4.073 -2.947 -2.602 -2.131 -1.341 -1.074 -0.866 -0.691 0.691 0.866 1.074 1.341 2.131 2.602 2.947 4.073
16 -4.015 -2.921 -2.583 -2.120 -1.337 -1.071 -0.865 -0.690 0.690 0.865 1.071 1.337 2.120 2.583 2.921 4.015
91
30 -3.646 -2.750 -2.457 -2.042 -1.310 -1.055 -0.854 -0.683 0.683 0.854 1.055 1.310 2.042 2.457 2.750 3.646
Tabla de distribución 𝑭𝟎.𝟎𝟓
Cola derecha
F0.05 v2
Estadística Inferencial I
v1 1 2 3 4 5 6 7 8 9 10 11 12 13 14 15 16 17 18 19 20 21 22 23 24 25 26 27 28 29 30
1 161.448 18.513 10.128 7.709 6.608 5.987 5.591 5.318 5.117 4.965 4.844 4.747 4.667 4.600 4.543 4.494 4.451 4.414 4.381 4.351 4.325 4.301 4.279 4.260 4.242 4.225 4.210 4.196 4.183 4.171
2 199.500 19.000 9.552 6.944 5.786 5.143 4.737 4.459 4.256 4.103 3.982 3.885 3.806 3.739 3.682 3.634 3.592 3.555 3.522 3.493 3.467 3.443 3.422 3.403 3.385 3.369 3.354 3.340 3.328 3.316
3 215.707 19.164 9.277 6.591 5.409 4.757 4.347 4.066 3.863 3.708 3.587 3.490 3.411 3.344 3.287 3.239 3.197 3.160 3.127 3.098 3.072 3.049 3.028 3.009 2.991 2.975 2.960 2.947 2.934 2.922
4 224.583 19.247 9.117 6.388 5.192 4.534 4.120 3.838 3.633 3.478 3.357 3.259 3.179 3.112 3.056 3.007 2.965 2.928 2.895 2.866 2.840 2.817 2.796 2.776 2.759 2.743 2.728 2.714 2.701 2.690
5 230.162 19.296 9.013 6.256 5.050 4.387 3.972 3.687 3.482 3.326 3.204 3.106 3.025 2.958 2.901 2.852 2.810 2.773 2.740 2.711 2.685 2.661 2.640 2.621 2.603 2.587 2.572 2.558 2.545 2.534
6 233.986 19.330 8.941 6.163 4.950 4.284 3.866 3.581 3.374 3.217 3.095 2.996 2.915 2.848 2.790 2.741 2.699 2.661 2.628 2.599 2.573 2.549 2.528 2.508 2.490 2.474 2.459 2.445 2.432 2.421
7 236.768 19.353 8.887 6.094 4.876 4.207 3.787 3.500 3.293 3.135 3.012 2.913 2.832 2.764 2.707 2.657 2.614 2.577 2.544 2.514 2.488 2.464 2.442 2.423 2.405 2.388 2.373 2.359 2.346 2.334
8 238.883 19.371 8.845 6.041 4.818 4.147 3.726 3.438 3.230 3.072 2.948 2.849 2.767 2.699 2.641 2.591 2.548 2.510 2.477 2.447 2.420 2.397 2.375 2.355 2.337 2.321 2.305 2.291 2.278 2.266
9 240.543 19.385 8.812 5.999 4.772 4.099 3.677 3.388 3.179 3.020 2.896 2.796 2.714 2.646 2.588 2.538 2.494 2.456 2.423 2.393 2.366 2.342 2.320 2.300 2.282 2.265 2.250 2.236 2.223 2.211
10 241.882 19.396 8.786 5.964 4.735 4.060 3.637 3.347 3.137 2.978 2.854 2.753 2.671 2.602 2.544 2.494 2.450 2.412 2.378 2.348 2.321 2.297 2.275 2.255 2.236 2.220 2.204 2.190 2.177 2.165
11 242.983 19.405 8.763 5.936 4.704 4.027 3.603 3.313 3.102 2.943 2.818 2.717 2.635 2.565 2.507 2.456 2.413 2.374 2.340 2.310 2.283 2.259 2.236 2.216 2.198 2.181 2.166 2.151 2.138 2.126
12 243.906 19.413 8.745 5.912 4.678 4.000 3.575 3.284 3.073 2.913 2.788 2.687 2.604 2.534 2.475 2.425 2.381 2.342 2.308 2.278 2.250 2.226 2.204 2.183 2.165 2.148 2.132 2.118 2.104 2.092
13 244.690 19.419 8.729 5.891 4.655 3.976 3.550 3.259 3.048 2.887 2.761 2.660 2.577 2.507 2.448 2.397 2.353 2.314 2.280 2.250 2.222 2.198 2.175 2.155 2.136 2.119 2.103 2.089 2.075 2.063
14 245.364 19.424 8.715 5.873 4.636 3.956 3.529 3.237 3.025 2.865 2.739 2.637 2.554 2.484 2.424 2.373 2.329 2.290 2.256 2.225 2.197 2.173 2.150 2.130 2.111 2.094 2.078 2.064 2.050 2.037
15 245.950 19.429 8.703 5.858 4.619 3.938 3.511 3.218 3.006 2.845 2.719 2.617 2.533 2.463 2.403 2.352 2.308 2.269 2.234 2.203 2.176 2.151 2.128 2.108 2.089 2.072 2.056 2.041 2.027 2.015
92
30 250.095 19.462 8.617 5.746 4.496 3.808 3.376 3.079 2.864 2.700 2.570 2.466 2.380 2.308 2.247 2.194 2.148 2.107 2.071 2.039 2.010 1.984 1.961 1.939 1.919 1.901 1.884 1.869 1.854 1.841
Tabla de distribución 𝑭𝟎.𝟗𝟓
Cola izquierda
F0.95 v2
Estadística Inferencial I
v1 1 2 3 4 5 6 7 8 9 10 11 12 13 14 15 16 17 18 19 20 21 22 23 24 25 26 27 28 29 30
1 0.006 0.005 0.005 0.004 0.004 0.004 0.004 0.004 0.004 0.004 0.004 0.004 0.004 0.004 0.004 0.004 0.004 0.004 0.004 0.004 0.004 0.004 0.004 0.004 0.004 0.004 0.004 0.004 0.004 0.004
2 0.054 0.053 0.052 0.052 0.052 0.052 0.052 0.052 0.052 0.052 0.052 0.052 0.051 0.051 0.051 0.051 0.051 0.051 0.051 0.051 0.051 0.051 0.051 0.051 0.051 0.051 0.051 0.051 0.051 0.051
3 0.099 0.105 0.108 0.110 0.111 0.112 0.113 0.113 0.113 0.114 0.114 0.114 0.115 0.115 0.115 0.115 0.115 0.115 0.115 0.115 0.116 0.116 0.116 0.116 0.116 0.116 0.116 0.116 0.116 0.116
4 0.130 0.144 0.152 0.157 0.160 0.162 0.164 0.166 0.167 0.168 0.168 0.169 0.170 0.170 0.171 0.171 0.171 0.172 0.172 0.172 0.173 0.173 0.173 0.173 0.173 0.174 0.174 0.174 0.174 0.174
5 0.151 0.173 0.185 0.193 0.198 0.202 0.205 0.208 0.210 0.211 0.213 0.214 0.215 0.216 0.217 0.217 0.218 0.218 0.219 0.219 0.220 0.220 0.221 0.221 0.221 0.221 0.222 0.222 0.222 0.222
6 0.167 0.194 0.210 0.221 0.228 0.233 0.238 0.241 0.244 0.246 0.248 0.250 0.251 0.253 0.254 0.255 0.256 0.257 0.257 0.258 0.259 0.259 0.260 0.260 0.261 0.261 0.262 0.262 0.262 0.263
7 0.179 0.211 0.230 0.243 0.252 0.259 0.264 0.268 0.272 0.275 0.278 0.280 0.282 0.283 0.285 0.286 0.287 0.288 0.289 0.290 0.291 0.292 0.293 0.293 0.294 0.294 0.295 0.295 0.296 0.296
8 0.188 0.224 0.246 0.261 0.271 0.279 0.286 0.291 0.295 0.299 0.302 0.305 0.307 0.309 0.311 0.312 0.314 0.315 0.316 0.317 0.318 0.319 0.320 0.321 0.322 0.322 0.323 0.324 0.324 0.325
9 0.195 0.235 0.259 0.275 0.287 0.296 0.304 0.310 0.315 0.319 0.322 0.325 0.328 0.331 0.333 0.335 0.336 0.338 0.339 0.341 0.342 0.343 0.344 0.345 0.346 0.346 0.347 0.348 0.349 0.349
10 0.201 0.244 0.270 0.288 0.301 0.311 0.319 0.326 0.331 0.336 0.340 0.343 0.346 0.349 0.351 0.354 0.356 0.357 0.359 0.360 0.362 0.363 0.364 0.365 0.366 0.367 0.368 0.369 0.370 0.370
11 0.206 0.251 0.279 0.298 0.312 0.323 0.332 0.339 0.345 0.350 0.355 0.359 0.362 0.365 0.368 0.370 0.372 0.374 0.376 0.378 0.379 0.381 0.382 0.383 0.384 0.385 0.386 0.387 0.388 0.389
12 0.211 0.257 0.287 0.307 0.322 0.334 0.343 0.351 0.358 0.363 0.368 0.372 0.376 0.379 0.382 0.385 0.387 0.389 0.391 0.393 0.395 0.396 0.398 0.399 0.400 0.402 0.403 0.404 0.405 0.405
13 0.214 0.263 0.293 0.315 0.331 0.343 0.353 0.361 0.368 0.374 0.380 0.384 0.388 0.392 0.395 0.398 0.400 0.403 0.405 0.407 0.409 0.410 0.412 0.413 0.415 0.416 0.417 0.418 0.419 0.420
14 0.217 0.267 0.299 0.321 0.338 0.351 0.362 0.371 0.378 0.384 0.390 0.395 0.399 0.403 0.406 0.409 0.412 0.414 0.417 0.419 0.421 0.423 0.424 0.426 0.427 0.429 0.430 0.431 0.432 0.433
15 0.220 0.272 0.304 0.327 0.345 0.358 0.369 0.379 0.386 0.393 0.399 0.404 0.408 0.412 0.416 0.419 0.422 0.425 0.427 0.430 0.432 0.434 0.435 0.437 0.439 0.440 0.441 0.443 0.444 0.445
93
30 0.240 0.302 0.342 0.372 0.395 0.413 0.428 0.441 0.452 0.462 0.470 0.478 0.485 0.491 0.496 0.501 0.506 0.510 0.514 0.518 0.521 0.524 0.527 0.530 0.532 0.535 0.537 0.539 0.541 0.543
Tabla de distribución 𝑭𝟎.𝟎𝟏
Cola derecha
F0.01 v2
Estadística Inferencial I
v1 1 2 3 4 5 6 7 8 9 10 11 12 13 14 15 16 17 18 19 20 21 22 23 24 25 26 27 28 29 30
1 4052.181 98.503 34.116 21.198 16.258 13.745 12.246 11.259 10.561 10.044 9.646 9.330 9.074 8.862 8.683 8.531 8.400 8.285 8.185 8.096 8.017 7.945 7.881 7.823 7.770 7.721 7.677 7.636 7.598 7.562
2 4999.500 99.000 30.817 18.000 13.274 10.925 9.547 8.649 8.022 7.559 7.206 6.927 6.701 6.515 6.359 6.226 6.112 6.013 5.926 5.849 5.780 5.719 5.664 5.614 5.568 5.526 5.488 5.453 5.420 5.390
3 5403.352 99.166 29.457 16.694 12.060 9.780 8.451 7.591 6.992 6.552 6.217 5.953 5.739 5.564 5.417 5.292 5.185 5.092 5.010 4.938 4.874 4.817 4.765 4.718 4.675 4.637 4.601 4.568 4.538 4.510
4 5624.583 99.249 28.710 15.977 11.392 9.148 7.847 7.006 6.422 5.994 5.668 5.412 5.205 5.035 4.893 4.773 4.669 4.579 4.500 4.431 4.369 4.313 4.264 4.218 4.177 4.140 4.106 4.074 4.045 4.018
5 5763.650 99.299 28.237 15.522 10.967 8.746 7.460 6.632 6.057 5.636 5.316 5.064 4.862 4.695 4.556 4.437 4.336 4.248 4.171 4.103 4.042 3.988 3.939 3.895 3.855 3.818 3.785 3.754 3.725 3.699
6 5858.986 99.333 27.911 15.207 10.672 8.466 7.191 6.371 5.802 5.386 5.069 4.821 4.620 4.456 4.318 4.202 4.102 4.015 3.939 3.871 3.812 3.758 3.710 3.667 3.627 3.591 3.558 3.528 3.499 3.473
7 5928.356 99.356 27.672 14.976 10.456 8.260 6.993 6.178 5.613 5.200 4.886 4.640 4.441 4.278 4.142 4.026 3.927 3.841 3.765 3.699 3.640 3.587 3.539 3.496 3.457 3.421 3.388 3.358 3.330 3.304
8 5981.070 99.374 27.489 14.799 10.289 8.102 6.840 6.029 5.467 5.057 4.744 4.499 4.302 4.140 4.004 3.890 3.791 3.705 3.631 3.564 3.506 3.453 3.406 3.363 3.324 3.288 3.256 3.226 3.198 3.173
9 6022.473 99.388 27.345 14.659 10.158 7.976 6.719 5.911 5.351 4.942 4.632 4.388 4.191 4.030 3.895 3.780 3.682 3.597 3.523 3.457 3.398 3.346 3.299 3.256 3.217 3.182 3.149 3.120 3.092 3.067
10 6055.847 99.399 27.229 14.546 10.051 7.874 6.620 5.814 5.257 4.849 4.539 4.296 4.100 3.939 3.805 3.691 3.593 3.508 3.434 3.368 3.310 3.258 3.211 3.168 3.129 3.094 3.062 3.032 3.005 2.979
11 6083.317 99.408 27.133 14.452 9.963 7.790 6.538 5.734 5.178 4.772 4.462 4.220 4.025 3.864 3.730 3.616 3.519 3.434 3.360 3.294 3.236 3.184 3.137 3.094 3.056 3.021 2.988 2.959 2.931 2.906
12 6106.321 99.416 27.052 14.374 9.888 7.718 6.469 5.667 5.111 4.706 4.397 4.155 3.960 3.800 3.666 3.553 3.455 3.371 3.297 3.231 3.173 3.121 3.074 3.032 2.993 2.958 2.926 2.896 2.868 2.843
13 6125.865 99.422 26.983 14.307 9.825 7.657 6.410 5.609 5.055 4.650 4.342 4.100 3.905 3.745 3.612 3.498 3.401 3.316 3.242 3.177 3.119 3.067 3.020 2.977 2.939 2.904 2.871 2.842 2.814 2.789
14 6142.674 99.428 26.924 14.249 9.770 7.605 6.359 5.559 5.005 4.601 4.293 4.052 3.857 3.698 3.564 3.451 3.353 3.269 3.195 3.130 3.072 3.019 2.973 2.930 2.892 2.857 2.824 2.795 2.767 2.742
15 6157.285 99.433 26.872 14.198 9.722 7.559 6.314 5.515 4.962 4.558 4.251 4.010 3.815 3.656 3.522 3.409 3.312 3.227 3.153 3.088 3.030 2.978 2.931 2.889 2.850 2.815 2.783 2.753 2.726 2.700
94
30 6260.649 99.466 26.505 13.838 9.379 7.229 5.992 5.198 4.649 4.247 3.941 3.701 3.507 3.348 3.214 3.101 3.003 2.919 2.844 2.778 2.720 2.667 2.620 2.577 2.538 2.503 2.470 2.440 2.412 2.386
Tabla de distribución 𝑭𝟎.𝟗𝟗
Cola izquierda
F0.99 v2
Estadística Inferencial I
v1 1 2 3 4 5 6 7 8 9 10 11 12 13 14 15 16 17 18 19 20 21 22 23 24 25 26 27 28 29 30
1 0.000 0.000 0.000 0.000 0.000 0.000 0.000 0.000 0.000 0.000 0.000 0.000 0.000 0.000 0.000 0.000 0.000 0.000 0.000 0.000 0.000 0.000 0.000 0.000 0.000 0.000 0.000 0.000 0.000 0.000
2 0.010 0.010 0.010 0.010 0.010 0.010 0.010 0.010 0.010 0.010 0.010 0.010 0.010 0.010 0.010 0.010 0.010 0.010 0.010 0.010 0.010 0.010 0.010 0.010 0.010 0.010 0.010 0.010 0.010 0.010
3 0.029 0.032 0.034 0.035 0.035 0.036 0.036 0.036 0.037 0.037 0.037 0.037 0.037 0.037 0.037 0.037 0.037 0.037 0.037 0.037 0.038 0.038 0.038 0.038 0.038 0.038 0.038 0.038 0.038 0.038
4 0.047 0.056 0.060 0.063 0.064 0.066 0.067 0.068 0.068 0.069 0.069 0.070 0.070 0.070 0.070 0.071 0.071 0.071 0.071 0.071 0.071 0.072 0.072 0.072 0.072 0.072 0.072 0.072 0.072 0.072
5 0.062 0.075 0.083 0.088 0.091 0.094 0.096 0.097 0.098 0.099 0.100 0.101 0.102 0.102 0.103 0.103 0.104 0.104 0.104 0.105 0.105 0.105 0.105 0.106 0.106 0.106 0.106 0.106 0.106 0.107
6 0.073 0.092 0.102 0.109 0.114 0.118 0.121 0.123 0.125 0.127 0.128 0.130 0.131 0.131 0.132 0.133 0.134 0.134 0.135 0.135 0.136 0.136 0.136 0.137 0.137 0.137 0.138 0.138 0.138 0.138
7 0.082 0.105 0.118 0.127 0.134 0.139 0.143 0.146 0.149 0.151 0.153 0.155 0.156 0.157 0.158 0.159 0.160 0.161 0.162 0.162 0.163 0.164 0.164 0.165 0.165 0.165 0.166 0.166 0.167 0.167
8 0.089 0.116 0.132 0.143 0.151 0.157 0.162 0.166 0.169 0.172 0.174 0.176 0.178 0.180 0.181 0.183 0.184 0.185 0.186 0.187 0.187 0.188 0.189 0.189 0.190 0.191 0.191 0.192 0.192 0.192
9 0.095 0.125 0.143 0.156 0.165 0.172 0.178 0.183 0.187 0.190 0.193 0.196 0.198 0.200 0.202 0.203 0.204 0.206 0.207 0.208 0.209 0.210 0.211 0.211 0.212 0.213 0.213 0.214 0.215 0.215
10 0.100 0.132 0.153 0.167 0.177 0.186 0.192 0.198 0.202 0.206 0.210 0.213 0.215 0.217 0.219 0.221 0.223 0.224 0.226 0.227 0.228 0.229 0.230 0.231 0.232 0.233 0.233 0.234 0.235 0.235
11 0.104 0.139 0.161 0.176 0.188 0.197 0.205 0.211 0.216 0.220 0.224 0.227 0.230 0.233 0.235 0.237 0.239 0.241 0.243 0.244 0.245 0.247 0.248 0.249 0.250 0.251 0.251 0.252 0.253 0.254
12 0.107 0.144 0.168 0.185 0.197 0.207 0.216 0.222 0.228 0.233 0.237 0.241 0.244 0.247 0.249 0.252 0.254 0.256 0.258 0.259 0.261 0.262 0.263 0.265 0.266 0.267 0.268 0.269 0.269 0.270
13 0.110 0.149 0.174 0.192 0.206 0.216 0.225 0.232 0.239 0.244 0.248 0.253 0.256 0.259 0.262 0.265 0.267 0.269 0.271 0.273 0.275 0.276 0.277 0.279 0.280 0.281 0.282 0.283 0.284 0.285
14 0.113 0.153 0.180 0.199 0.213 0.224 0.234 0.242 0.248 0.254 0.259 0.263 0.267 0.270 0.274 0.276 0.279 0.281 0.283 0.285 0.287 0.289 0.290 0.292 0.293 0.294 0.296 0.297 0.298 0.299
15 0.115 0.157 0.185 0.204 0.220 0.232 0.241 0.250 0.257 0.263 0.268 0.273 0.277 0.281 0.284 0.287 0.290 0.292 0.294 0.297 0.299 0.300 0.302 0.304 0.305 0.306 0.308 0.309 0.310 0.311
95
30 0.132 0.186 0.222 0.249 0.270 0.288 0.303 0.315 0.326 0.336 0.344 0.352 0.359 0.365 0.370 0.375 0.380 0.385 0.389 0.392 0.396 0.399 0.402 0.405 0.408 0.410 0.413 0.415 0.417 0.419
Tabla de distribución 𝝌𝟐
Cola derecha
χ2 α
v 0.9995 0.995 0.99 0.975 0.95 0.9 0.85 0.8 0.75 0.25 0.2 0.15 0.1 0.05 0.025 0.01 0.005 0.0005
1 3.9E-07 3.9E-05 0.00016 0.00098 0.00393 0.01579 0.03577 0.06418 0.102 1.323 1.642 2.072 2.706 3.841 5.024 6.635 7.879 12.116
Estadística Inferencial I
2 0.00100 0.01003 0.02010 0.05064 0.10259 0.21072 0.32504 0.44629 0.575 2.773 3.219 3.794 4.605 5.991 7.378 9.210 10.597 15.202
3 0.01528 0.07172 0.11483 0.21580 0.35185 0.58437 0.79777 1.00517 1.213 4.108 4.642 5.317 6.251 7.815 9.348 11.345 12.838 17.730
4 0.06392 0.20699 0.29711 0.48442 0.71072 1.06362 1.36648 1.64878 1.923 5.385 5.989 6.745 7.779 9.488 11.143 13.277 14.860 19.997
5 0.15814 0.41174 0.55430 0.83121 1.14548 1.61031 1.99382 2.34253 2.675 6.626 7.289 8.115 9.236 11.070 12.833 15.086 16.750 22.105
6 0.29941 0.67573 0.87209 1.23734 1.63538 2.20413 2.66127 3.07009 3.455 7.841 8.558 9.446 10.645 12.592 14.449 16.812 18.548 24.103
7 0.48487 0.98926 1.23904 1.68987 2.16735 2.83311 3.35828 3.82232 4.255 9.037 9.803 10.748 12.017 14.067 16.013 18.475 20.278 26.018
8 0.71038 1.34441 1.64650 2.17973 2.73264 3.48954 4.07820 4.59357 5.071 10.219 11.030 12.027 13.362 15.507 17.535 20.090 21.955 27.868
9 0.97170 1.73493 2.08790 2.70039 3.32511 4.16816 4.81652 5.38005 5.899 11.389 12.242 13.288 14.684 16.919 19.023 21.666 23.589 29.666
10 1.26498 2.15586 2.55821 3.24697 3.94030 4.86518 5.57006 6.17908 6.737 12.549 13.442 14.534 15.987 18.307 20.483 23.209 25.188 31.420
11 1.58685 2.60322 3.05348 3.81575 4.57481 5.57778 6.33643 6.98867 7.584 13.701 14.631 15.767 17.275 19.675 21.920 24.725 26.757 33.137
12 1.93438 3.07382 3.57057 4.40379 5.22603 6.30380 7.11384 7.80733 8.438 14.845 15.812 16.989 18.549 21.026 23.337 26.217 28.300 34.821
13 2.30506 3.56503 4.10692 5.00875 5.89186 7.04150 7.90084 8.63386 9.299 15.984 16.985 18.202 19.812 22.362 24.736 27.688 29.819 36.478
14 2.69673 4.07467 4.66043 5.62873 6.57063 7.78953 8.69630 9.46733 10.165 17.117 18.151 19.406 21.064 23.685 26.119 29.141 31.319 38.109
15 3.10752 4.60092 5.22935 6.26214 7.26094 8.54676 9.49928 10.30696 11.037 18.245 19.311 20.603 22.307 24.996 27.488 30.578 32.801 39.719
16 3.53581 5.14221 5.81221 6.90766 7.96165 9.31224 10.30902 11.15212 11.912 19.369 20.465 21.793 23.542 26.296 28.845 32.000 34.267 41.308
17 3.98018 5.69722 6.40776 7.56419 8.67176 10.08519 11.12486 12.00227 12.792 20.489 21.615 22.977 24.769 27.587 30.191 33.409 35.718 42.879
18 4.43939 6.26480 7.01491 8.23075 9.39046 10.86494 11.94625 12.85695 13.675 21.605 22.760 24.155 25.989 28.869 31.526 34.805 37.156 44.434
19 4.91234 6.84397 7.63273 8.90652 10.11701 11.65091 12.77272 13.71579 14.562 22.718 23.900 25.329 27.204 30.144 32.852 36.191 38.582 45.973
20 5.39807 7.43384 8.26040 9.59078 10.85081 12.44261 13.60386 14.57844 15.452 23.828 25.038 26.498 28.412 31.410 34.170 37.566 39.997 47.498
96
100 59.89566 67.32756 70.06489 74.22193 77.92947 82.35814 85.44061 87.94534 90.133 109.141 111.667 114.659 118.498 124.342 129.561 135.807 140.169 153.167









