Asignatura:
Estadística aplicada
MÓDULO II:
NOCIONES DE MUESTREO E
INFERENCIA ESTADÍSTICA
Docente: Mg. Walter Bernia
León
INTRODUCCION
Al realizar la investigación, casi nunca es posible estudiar a toda la población que te
interesa. Esta es la razón por la que los investigadores utilizan diversos tipos de
muestreo cuando pretenden recopilar datos y responder las preguntas de
investigación.
TEORIA DEL MUESTREO
Los problemas más corrientes que se presentan en la práctica, cuando se procede a investigar
las características de una población estadística es la imposibilidad de estudiar a cada uno de los
individuos u objetos que la conforman; por ello debemos depender de un subconjunto o parte
de la población como base para llegar a hipótesis relacionadas a varias características o
parámetros de ella.
Ventajas de la utilización de las muestras
1) El costo es menor y se puede obtener un mejor rendimiento del dinero
invertido.
2) Se obtiene una disminución notable del tiempo necesario para alcanzar la
información
Cuando una muestra posee 30 o más datos se denomina grandes muestras y
si la muestra tiene menos de 30 observaciones se denomina pequeñas
muestras. Al procedimiento utilizado para elegir una muestra se denomina
Muestreo.
Necesidad del Muestreo.
1. Población Infinita
2. Población uniforme
3. Proceso de investigación destructiva
4. Economía de costos
5. Calidad
Características
Para que una muestra sea aceptable
a) Deberá seleccionarse de manera que sea representativa de la población de la cual se obtuvo.
a) La muestra además de permitir obtener estimaciones de características de la población
(totales, promedios, porcentajes, entre otros) deberá proporcionar medidas de la precisión
de dichas estimaciones.
b) La muestra debe ser bastante reducida para evitar gastos innecesarios y lo bastante amplia
para que el error de muestreo sea admisible y además debe reunir las exigencias de
eficiencia, representatividad, seguridad y flexibilidad.
Limitaciones
1.- No permite hacer cálculos, proyecciones o tabulaciones con respecto a sectores pequeños de
una población
2.- El cálculo de los resultados está sujeto a los errores del muestreo en sí y de errores ajenos al
muestreo.
3.- Las investigaciones completas ofrecen un margen más sólido y eficiente de exactitud que los
obtenidos en base a la muestra.
Función de la estadística y los parámetros
Matemáticamente, podemos describir muestras
y poblaciones al emplear mediciones como la
media, la mediana, la moda y la desviación
estándar. Cuando estos términos describen las
características de una muestra, se denominan
estadísticas.
Cuando describen las características de una
población, se llaman parámetros. Una estadística Tipos de muestreo
es una característica de una muestra y un
parámetro es una característica de una
población. Muestreo de juicio (No
probabilístico)
En el muestreo de juicio, se emplea el
conocimiento y la opinión personal para
identificar a los elementos de la población
que deben incluirse en la muestra.
Para ser consecuentes, los especialistas en
estadística emplean literales latinas minúsculas Muestreo de Probabilidad
para representar estadísticas de muestra, y
literales griegas o latinas mayúsculas para (Probabilístico)
representar parámetros de población. En el muestreo de probabilidad, todos los
elementos de la población tienen la
oportunidad de ser escogidos para la
muestra
El riguroso análisis estadístico que puede llevarse a cabo a partir de muestras
aleatorias, no puede ser efectuado con muestras de juicio. Son más cómodas y
pueden usarse con éxito aunque no podamos medir su validez. No debe perderse de
vista que si un estudio recurre al muestreo de juicio a costa de perder un grado
importante de representatividad, la comodidad habrá costado un precio demasiado
alto.
Muestra Sesgada
Una muestra sesgada es una muestra estadística que ha sido falsamente
considerada como la típica de una población de la cual ha sido tomada. Por
ejemplo, alguien puede decir «A todo el mundo le gustó la película» sin
mencionar (o sin saber) que «todo el mundo» fue un grupo que son fans del
director de la película.
Tipo de Muestreo Probabilístico
Tipo de Muestreo No Probabilístico
Determinación de tamaño de nuestra para ser aplicado en Estadísticas Paramétricas y
no Paramétricas
Población homogénea y
heterogénea
Si es homogénea se requiere pocos
elementos en la muestra y si la
población es heterogénea se requiere
un mayor número de elementos.
Para establecer una fórmula del tamaño
de muestra se requiere saber el tipo de
parámetro que se desea estimar, es
decir, si el interés es estimar una media
aritmética se requiere una fórmula
específica y si se quiere estimar una
proporción se considera otra fórmula.
Determinación de tamaño de nuestra para ser aplicado en
Estadísticas Paramétricas y no Paramétricas
Ejemplo:
Se tiene el interés de conocer el promedio con respecto a la preferencia por determinado producto
consumido por los estudiantes de la Facultad de Contabilidad de la USMP. (Suponemos que la población es
1800 alumnos) El estudio queremos realizarlo mediante una muestra, para ello necesitamos calcular el
tamaño de muestra n, considerando: un grado de confianza del 95%, y los resultados de un estudio
preliminar:
Determinación de tamaño de nuestra para ser aplicado en
Estadísticas Paramétricas y no Paramétricas
Determinación de tamaño de nuestra para ser aplicado en
Estadísticas Paramétricas y no Paramétricas
Determinación de tamaño de nuestra para ser aplicado en
Estadísticas Paramétricas y no Paramétricas
Por lo menos se requiere para ejecutar el estudio por lo menos 462 estudiantes,
con un grado de confianza del 99% y precisión del 5%.
En caso de que se desconocer el tamaño de la población N, las fórmulas
quedaran reducidas como:
ESTADÍSTICA INFERENCIAL
La estadística inferencial es una parte de la estadística que comprende los métodos
y procedimientos que por medio de la inducción determina propiedades de
una población estadística, a partir de una parte de esta. Su objetivo es obtener
conclusiones útiles para hacer deducciones sobre una totalidad, basándose en la
información numérica de la muestra.
Se dedica a la generación de los modelos, inferencias y predicciones asociadas a
los fenómenos en cuestión teniendo en cuenta la aleatoriedad de las observaciones.
Se usa para modelar patrones en los datos y extraer inferencias acerca de la
población bajo estudio.
Estas inferencias pueden tomar la forma de:
- Respuestas a preguntas sí/no (prueba de hipótesis).
- Estimaciones de unas características numéricas (estimación).
- Pronósticos de futuras observaciones, descripciones de asociación (correlación) o
modelamiento de relaciones entre variables de Sam (análisis de regresión).
- Otras técnicas de modelamiento incluyen análisis de varianza, series de tiempo y
minería de datos.
Estudio de la estadística inferencial
1. Toma de muestras o cuantitativo muestreo, que se refiere a la forma adecuada de
considerar una muestra que permita obtener conclusiones estadísticamente válidas y
significativas.
2. Estimación de parámetros o variables estadísticas, que permite estimar valores
poblacionales a partir de muestras de mucho menor tamaño.
3. Contraste de hipótesis, que permite decidir si dos muestras son estadísticamente
diferentes, si un determinado procedimiento tiene un efecto estadístico significativo, etc
•Diseño experimental.
El diseño experimental prescribe una serie de pautas relativas qué variables
hay que manipular, de qué manera, cuántas veces hay que repetir el
experimento y en qué orden para poder establecer con un grado de
confianza predefinido la necesidad de una presunta relación de causa-efecto
•Inferencia bayesiana.
Las evidencias u observaciones se emplean para actualizar
o inferir la probabilidad de que una hipótesis pueda ser cierta.
•Métodos no paramétricos
Método
Planteamiento del problema:
Suele iniciarse con una fijación de objetivos o algunas preguntas como: ¿Cuál
será la media de esta población respecto a tal característica? ¿Se parecen
estas dos poblaciones?
Elaboración de un modelo:
Los posibles modelos son distribuciones de probabilidad.
Extracción de la muestra
se usa alguna técnica de muestreo o un diseño experimental para
obtener información de una pequeña parte de la población
Tratamiento de los datos
En esta fase se eliminan posibles errores, se depura la muestra, se tabulan los
datos y se calculan los valores que serán necesarios en pasos posteriores, como
la media muestral, la varianza muestral.
Estimación de los parámetros
con determinadas técnicas se realiza una predicción sobre cuáles podrían ser los
parámetros de la población, en base a un muestreo.
Contraste de hipótesis
Los contrastes de hipótesis son técnicas que permiten simplificar el modelo
matemático bajo análisis. Frecuentemente el contraste de hipótesis recurre al uso
de estadísticos muestrales. Se realiza una contrastación de información entre la
hipótesis estadística existente y los resultados obtenidos de la muestra, para una
corroboración
Conclusiones
se critica el modelo y se hace un balance. Las conclusiones obtenidas en este
punto pueden servir para tomar decisiones o hacer predicciones
Estimaciones, estimación puntual y por intervalos en variables
cuantitativas
Es cuando queremos realizar el estudio de una población cualquiera de la que
desconocemos sus parámetros por ejemplo su media poblacional o la
probabilidad de éxito si la población sigue una distribución binomial , debemos
tomar una muestra aleatoria de dicha población para calcular una
aproximación a dichos parámetros q conocemos y queremos estimar .
Estimación de parámetros
Introducimos métodos que nos permiten estimar con precisión razonable la
proporción de la población (la fracción de la población que posee una característica
dada) y la media de la población.
Calcular la proporción exacta o la media exacta sería una meta imposible. Pero, a
pesar de ello, seremos capaces de hacer una estimación, establecer una afirmación
respecto al error que tal vez acompañará a esta estimación, y poner en marcha
algunos controles para evitar dicho error en la medida de lo posible.
Estimaciones, estimación puntual y por intervalos en variables
cuantitativas
¿Que es una estimación puntual?
Una estimación es puntual cuando se usa un solo valor extraído de la muestra para estimar el
parámetro desconocido de la población. Al valor usado se le llama estimador.
La media de la población se puede estimar puntualmente mediante la media de la muestra:
La proporción de la población se puede estimar puntualmente mediante la proporción de la
muestra:
La desviación típica de la población se puede estimar puntualmente mediante la desviación típica
de la muestra, aunque hay mejores estimadores:
Estimaciones, estimación puntual y por intervalos en variables
cuantitativas
PROPIEDADES DEL ESTIMADOR
En el caso del error estándar de p´,
Insesgado:
Un estimador es insesgado cuando la
media de su distribución muestral
asociada coincide con la media de la
población. Observar que cuanto mayor sea el tamaño
Esto ocurre, por ejemplo, con el de la muestra n , menor será la
estimador x , ya que µ x = µ y con variabilidad del estimador x y de p´, por
estimador p´ ya que p µ p′ = P De tanto, mejor serán nuestras estimaciones.
Varianza mínima: Eficiencia:
La variabilidad de un estimador viene La eficiencia se refiere al tamaño del error
determinada por el cuadrado de su estándar del estadístico. Si comparamos dos
desviación estándar. En el caso del estadísticos de una muestra del mismo tamaño
estimador x , su desviación estándar es y tratamos de decidir cuál de ellas es un
estimador más eficiente, escogeríamos la
estadística que tuviera el menor error estándar
o la menor desviación estándar de la
distribución muestral.
Estimaciones, estimación puntual y por intervalos en variables
cuantitativas
Ejemplo:
Escogemos una muestra de un tamaño determinado y debemos decidir si utilizamos
la media de la muestra o la mediana de la muestra para estimar la media de la
población. Si calculamos el error estándar de la media de la muestra y encontramos
que es 1.05, y luego calculamos el error estándar de la mediana de la muestra y
tenemos que éste es 1.6, diríamos que la media de la muestra es un estimador más
eficiente de la media poblacional ya que su error estándar es menor.
Consistencia.
Una estadística es un estimador consistente de un parámetro de población si al
aumentar el tamaño de la muestra, se tiene casi la certeza de que el valor de la
estadística se aproxima bastante al valor del parámetro poblacional. Si un estimador
es consistente, se vuelve más confiable al tener tamaños de muestra más grandes.
Estimaciones, estimación puntual y por intervalos en variables
cuantitativas
Suficiencia.
Un estimador es suficiente si utiliza tanta información de la muestra que ningún
otro estimador puede extraer información adicional acerca del parámetro de
población que se está estimando. Por ejemplo, supongamos que la compañía
Sonytron desea estimar la edad media de los compradores de equipos de alta
fidelidad. Seleccionan una muestra de 100 compradores y calculan la media de
esta muestra, este valor será un estimador puntual de la media de la población.
a) Estimación puntual de la media:
La media de la muestra x es el mejor estimador de la media de la población. Es
insesgada, consistente, el estimador más eficiente y, siempre y cuando la muestra
sea suficientemente grande, su distribución muestral puede ser aproximada por
medio de la distribución normal.
Si conocemos la distribución muestral de x, podemos obtener conclusiones
respecto a cualquier estimación que podamos hacer a partir de la información
muestral.
Estimaciones, estimación puntual y por intervalos en variables
cuantitativas
Ejemplo:
Considere el caso de una compañía de
suministros clínicos que produce jeringas
desechables. Cada jeringa está cubierta por
una envoltura estéril que a su vez se empaca
en grandes cajas de cartón corrugado.
Podemos obtener la media de la
Debido al proceso de empaque, las cajas de muestra, x, sumando todos los
cartón contienen distintas cantidades de resultados, x, y dividiendo esta suma
jeringas. entre n, el número de cajas
muestreadas:
Como las jeringas se venden por pieza, la
compañía necesita una estimación del
número de piezas que hay por caja, para
propósitos de facturación. Tomamos una
muestra aleatoria de 35 cajas y registramos el
número de jeringas contenidas en cada caja.
Estimaciones, estimación puntual y por intervalos
en variables cuantitativas
Estimación puntual de la varianza y la
desviación estándar de la población
Uso de la desviación estándar de la
muestra para estimar la desviación
estándar de la población
Suponga que la administración de la
compañía de suministros clínicos desea
estimar la varianza y/o la desviación
estándar de la distribución del número de
jeringas empacadas por caja.
El estimador más utilizado para estimar la
desviación estándar de la población σ , es
la desviación estándar de la muestra, s.
Podemos calcular la desviación estándar
de la muestra. Resultando 6.01.
Estimaciones, estimación puntual y por intervalos en variables
cuantitativas
Intervalo de confianza para la media
Estimación por Intervalo.
Los valores de los límites, inferior (L1) y
La estimación por intervalo Consiste en
determinar, mediante un estimador, 2 superior (L2), se encuentran aplicando la
valores numéricos llamados límite fórmula general:
inferior (L1) y límite superior (L2). Con
un cierto grado de confianza, se espera
que estos límites contengan el valor del
parámetro que se quiere hallar.
Es decir, el valor del parámetro debería
encontrarse entre el límite inferior y Por consiguiente, los límites del intervalo
límite superior obtenidos de la se obtienen sumando o restando el error
estimación. Cabe mencionar que no estándar al valor de la media muestral.
todos los intervalos obtenidos de un
estimador incluirán realmente al Específicamente, para hallar el límite
parámetro. Es por ello que se aplica el inferior (L1) se resta el error estándar y
concepto de nivel de confianza. para hallar el límite superior (L2) se suma
el error estándar.
Estimaciones, estimación puntual y por intervalos en variables
cuantitativas
Por consiguiente, los límites del intervalo se
obtienen sumando o restando el error
estándar al valor de la media muestral.
Específicamente, para hallar el límite inferior
(L1) se resta el error estándar y para hallar el
límite superior (L2) se suma el error estándar.
Para explicar el uso de esta forma de
estimación se resolverán los ejemplos
planteados anteriormente y otros.
Ejemplo: Se tiene interés en estimar la
altura media de los alumnos de la
Facultad de Medicina de la USMP. Se
recurre a una muestra aleatoria de 36
alumnos y se obtienen los siguientes
resultados:
Estimaciones para la Diferencia de Medias
Estimación para la Diferencia de Medias Para calcular el intervalo de
confianza para la diferencia de dos medias se debe saber si las varianzas
poblacionales son conocidas o desconocidas, y en caso de que sean
desconocidas, se debe probar si son igual es o diferentes.
Cada uno de estos tres casos se analizará por separado Si las varianzas
poblacionales son conocidas y diferentes, los pasos a seguir para
encontrar el intervalo de confianza son los siguientes:
a) El estadístico usado como estimador puntual de la diferencia de
medias μ1 − μ 2, será T = x 1 − x 2 , que es un estimador
suficiente
b) La variable aleatoria asociada con el estimador será la variable
normal estándar dada por:
Estimaciones para la Diferencia de Medias
c) Para calcular el intervalo de
confianza se debe tener en cuenta el
nivel de confianza que se quiere
considerar.
Si x1 − x2 son las medias de dos
muestras aleatorias independientes de
tamaño n1 y n2 tomadas de
poblaciones que tienen varianzas
conocidas 1 2 y 2 2
respectivamente, entonces el intervalo
de confianza para μ1 − μ 2 es:
Estimaciones para la Diferencia de Medias
Ejemplo.
Construya un intervalo de confianza del
94% para la diferencia real entre las
duraciones de dos marcas de focos, si una
muestra de 40 focos tomada al azar de la
primera marca dio una duración media de
418 horas, y una muestra de 50 focos.
De otra marca dieron una duración media
de 402 horas.
Las desviaciones estándares de las dos
poblaciones son 26 horas y 22 horas,
respectivamente.
Estimación puntual y por intervalos en variables cualitativas.
Estimación puntual de la proporción de la población.
La proporción de unidades de una población dada que tiene una característica
particular se denota por p. Si conocemos la proporción de unidades de una muestra
que tiene la misma característica (denotada por pˆ, podemos utilizar esta pˆ como
estimador de p. Se puede demostrar que pˆ tiene todas las características deseables
analizadas; es insesgado (no sesgado), consistente, eficiente y suficiente.
Ejemplo
Del fabricante de suministros médicos, intentaremos hacer una estimación de la
proporción de la población a partir de la proporción de la muestra. Suponga que la
administración de la empresa desea estimar el número de cajas que llegarán dañadas
a su destino por mal manejo en el traslado. Podemos verificar una muestra de 50 cajas
a partir del punto de embarque hasta su arribo al punto de destino, y
luego registrar la presencia o ausencia de daños.
Estimación puntual y por intervalos en variables cualitativas.
Estimación puntual de la proporción de la población.
• En este caso, si encontramos que la proporción de cajas dañadas
en la muestra es 0.08, diríamos que: pˆ = 0.08 ← Proporción de
la muestra dañada Y, debido a que la proporción de la muestra pˆ
es un estimador conveniente de la proporción de la población p,
podemos estimar que la proporción de cajas dañadas de toda la
población será también 0.08.
Estimaciones por Intervalo para la Proporción de la población.
Intervalo de confianza para la proporción P Los valores de los límites, inferior (L1) y superior
(L2), se encuentran aplicando la fórmula general:
Por consiguiente, los límites del intervalo se obtienen sumando o restando el error
estándar al valor de la proporción muestral (p). Específicamente, para hallar el límite
inferior (L1) se resta el error estándar y para hallar el límite superior (L2) se suma el
error estándar.
[Link]
Estimaciones por Intervalo para la Proporción de la población.
Ejemplo:
Supóngase que en una muestra de 2000 personas se encontró que 250 son
alcohólicos. Es decir, el porcentaje de alcohólicos en la muestra es:
p=250/2000x100=12.5%. Calcular el intervalo de confianza al 95%.
Por lo tanto, con un nivel de confianza de 95%, se puede afirmar que el
porcentaje de alcoholismo en la población se encuentra entre 11.05% y 13.95%.
Estimaciones por intervalo para la Diferencia de Proporciones
Los límites para el intervalo de una diferencia de proporciones correspondientes a
dos muestras independientes son:
Donde el símbolo zα/2 es el mismo valor crítico utilizado anteriormente (Z >
zα/2) = α/2, y corresponde a un intervalo de confianza 1 − α %.
Este intervalo puede utilizarse de manera alternativa al contraste de hipótesis
para decidir (con nivel de significación α %) si hay igualdad de los dos grupos. Se
decidirá por la igualdad de los grupos si el valor 0 queda incluido en cualquier
posición en el intervalo.
Aunque se haga el contraste de dos proporciones, en primer lugar, es
aconsejable obtener el intervalo de confianza de la diferencia de medias, si éste
ha resultado significativo, puesto que ayudará a interpretar si existe
significación aplicada además de la estadística.
Estimaciones por intervalo para la Diferencia de Proporciones
Si se dispone de alguna información previa y sólo quiere calcularse alguno de los
dos intervalos unilaterales, bastará sustituir zα/2 por zα y descartar el límite
superior o inferior del intervalo según el caso. Por ejemplo, el intervalo unilateral
derecho corresponde a:
[Link]
PRUEBAS DE HIPÓTESIS
Tenemos que empezar por definir que es una hipótesis y que es prueba de hipótesis.
Hipótesis es una aseveración de una población elaborado con el propósito de poner
aprueba, para verificar si la afirmación es razonable se usan datos.
En el análisis estadístico se hace una aseveración, es decir, se plantea una hipótesis,
después se hacen las pruebas para verificar la aseveración o para determinar que no
es verdadera.
Por tanto, la prueba de hipótesis es un procedimiento basado en la evidencia
muestral y la teoría de probabilidad; se emplea para determinar si la hipótesis es una
afirmación razonable.
Pasos para probar una hipótesis.
Una hipótesis estadística, es un enunciado sobre la población. Su posibilidad de ser
evaluada es en base en la información obtenida de una muestra aleatoria de la
población.
PASO 1.- PLANTEAMIENTO DE HIPOTESIS
PASO 2.- NIVELES DE SIGNIFICACION.
PASO 3.- ESTADISTICO DE PRUEBA
PASO 4.- REGLA DE DECISION
PASO 5.- TOMA DE DECISION
1.- PLANTEAMIENTO DE HIPOTESIS.
- Ho: Hipótesis Nula
- H1: Hipótesis Alternativo
Hipótesis Nula.- Una afirmación o enunciado tentativo que se realiza acerca del valor de un
parámetro poblacional. Por lo común en una afirmación de que el parámetro de población tiene
valor especifico.
Hipótesis Alternativa.- Una afirmación o enunciado que se aceptara si los datos muéstrales
proporcionan amplia evidencia de que la hipótesis nula es falsa.
2.- NIVELES DE SIGNIFICACION.
El riesgo que se ahumé acerca e rechazar la hipótesis nula cuando en realidad deben asemejarse
por ser verdadera.
El nivel de significación se denota mediante la letra griega sigma. No hay un nivel de significación
que se aplique a todos los estudios que implican muestreo.
Deben tomarse una decisión de usar el nivel 0.05, el nivel 0.01, el 0.10 o cualquier otro nivel
entre 0 y 1 Tradicionalmente se relaciona el nivel 0.05 para proyectos de investigación sobre
consumo, el 0.01 para control de calidad y el 0.10 para encuesta políticas.
3.- ESTADISTICO DE PRUEBA
Un valor, determinado a partir de la información muestral, que se utiliza para aceptar
o rechazar la hipótesis nula.
Existen muchos estadísticos de prueba para nuestro caso utilizaremos los estadísticos
z y t. La elección de uno de estos depende de la cantidad de muestras que se toman,
si las muestras son de la prueba son iguales a 30 o mas se utiliza el estadístico z, en
caso contrario se utiliza el estadístico t.
Tipos de prueba
Prueba bilateral o de dos extremos: la hipótesis planteada se formula con la igualdad
Ejemplo
H0 : µ = 200
H1 : µ ≠ 200
b) Pruebas unilateral o de un extremo: la hipótesis planteada se formula con ≥ o ≤
H0 : µ ≥ 200 H0 : µ ≤ 200
H1 : µ < 200 H1 : µ > 200
En las pruebas de hipótesis para la media (μ), cuando se conoce la desviación estándar (σ)
poblacional, o cuando el valor de la muestra es grande (30 o más), el valor estadístico de prueba es z
y se determina a partir de:
El valor estadístico z, para muestra grande y desviación estándar poblacional desconocida se
determina por la ecuación:
En la prueba para una media poblacional con muestra pequeña y desviación estándar poblacional
desconocida se utiliza el valor estadístico t.
PASO 4.- REGLA DE DECISION
Es una regla simple la cual es una afirmación de las condiciones bajo las que se
acepta la hipótesis nula.
PASO 5.- TOMA DE DECISION
Es la toma de decisión si se debe aceptar o rechazar la hipótesis nula
Objetivo de la prueba de hipótesis.
El propósito de la prueba de hipótesis no es cuestionar el valor calculado del
estadístico (muestral), sino hacer un juicio con respecto a la diferencia entre
estadístico de muestra y planteado del parámetro.
Error tipo I.
En una prueba de hipótesis para la toma de decisiones se haya sujeta a los datos recolectados a
través de un experimento o de una muestra aleatoria, por lo que es posible cometer dos tipos
de errores que pueden llevar a una pérdida sustancialmente diferente, estos errores son:
• Error tipo 1: Rechazar una hipótesis verdadera.
• Error tipo 2: No rechazar una hipótesis falsa.
El tamaño de estos dos tipos de error se define como la probabilidad de que cada uno de ellos
ocurra; al término α (alfa) se le llama nivel de significancia de la prueba, generalmente se le
asignan los valores 0.10, 0.05 ó 0.01 y se determina al inicio de la investigación; a β (beta) se le
denomina potencia de la prueba.
Nótese que debido a la relación existente entre las hipótesis, los dos tipos de error se hayan
relacionados, al controlar el tipo 1 automáticamente se controla el otro, para un tamaño de
muestra dado.
En la práctica se busca trabajar con errores pequeños del tipo 1, es decir, se puede
tomar como el error más serio rechazar Ho cuando es verdadera, que no rechazarla
cuando es falsa.
DÓCIMAS DE HIPÓTESIS EN VARIABLES CUANTITATIVAS. DÓCIMAS PARA LA MEDIA
POBLACIONAL. DÓCIMAS PARA LA DIFERENCIA DE MEDIAS.
Es otra forma de hacer inferencia estadística, cuyo objetivo es probar una hipótesis
acerca de los parámetros de una población (media, varianza, proporción) Definiendo
un procedimiento o regla de decisión que nos permita concluir probabilísticamente la
aceptación o rechazo de tal hipótesis.
2.1 Docimas de hipótesis en variables cuantitativas
Una de las situaciones más comunes a las que debe enfrentarse un investigador es la
comparación de las medias de dos grupos.
Por ejemplo en la comparación de dos situaciones, en los que se mide su eficacia en
función unos resultados obtenidos y medidos numéricamente.
2.2 Docimas para la media poblacional
Paso 1.-Planteamiento de hipótesis.
Paso 2.-Niveles de significación: símbolo alfa.
Paso 3.-Estadístico de prueba.
Ejemplo 1: Una empresa eléctrica fabrica focos que tienen una duración que se
distribuye de forma aproximadamente normal con una media de 800 horas y una
desviación estándar de 40 horas. Pruebe la hipótesis de que µ≠800 horas si una muestra
aleatoria de 30 focos tiene una duración promedio de 788 horas. Utilice un nivel de
significancia de 0.04.
Con la resolución del ejercicio, se acepta la hipótesis nula y se llega a la conclusión de
que la duración media de los focos si corresponde a 800 horas por lo que la hipótesis
nula es aceptada.
Docimas para la diferencia de medias.
Paso 1.-Planteamiento de hipótesis.
Paso 2.-Niveles de significación. (teórico) ”Símbolo alfa”
Paso 3.-Estadístico de prueba. Para varianza conocida
Paso 4.- Formular la regla de decisión
Si el p-valor < α Se rechaza H0
Si el p-valor ≥ α No se rechaza H0
Paso 5.- Conclusión: En este caso se especifica la hipótesis estadística
que no ha sido rechazada indicando el nivel de significancia teórico
considerado (α)
Ejemplo:
Se lleva a cabo un experimento para comparar el desgaste por abrasivo de
dos diferentes materiales laminados. Se prueban 12 piezas del material 1
mediante la exposición de cada pieza a una máquina para medir el desgaste.
10 piezas del material 2 se prueban de manera similar.
En cada caso, se mide la profundidad del desgaste. Las muestras del material
1 dan un desgaste promedio de 85 unidades con una desviación estándar
muestral de 4, mientras que las muestras del material 2 dan un promedio de
81, desviación estándar muestral de 5.
¿Podemos concluir con un nivel de significancia del 0.05 que el desgaste
abrasivo del material 1 excede el del material 2 en 2 unidades?
Representemos con µ₁ y µ₂ las medias poblacionales del desgaste abrasivo para el material 1 y 2,
respectivamente.
DÓCIMAS DE HIPÓTESIS EN VARIABLES CUALITATIVAS. DÓCIMAS PARA LA
PROPORCIÓN POBLACIONAL. DÓCIMAS PARA LA DIFERENCIA DE PROPORCIONES.
Docimas de hipótesis en variables cualitativas
Existen muchos estadísticos de prueba para nuestro caso utilizaremos los
estadísticos z y t. La elección de uno de estos depende de la cantidad de muestras
que se toman, si las muestras son de la prueba son iguales a 30 o más se utiliza el
estadístico z, en caso contrario se utiliza el estadístico t.
Docimas para la proporción poblacional.
Paso 1.-Planteamiento de hipótesis
Paso 2.-Niveles de significación.” α”
Paso 3.-Estadístico de prueba.
Paso 4.-Formular la regla de decisión
Si el p-valor < α Se rechaza H0
Si el p-valor ≥ α No se rechaza H0
Paso 5.-Conclusión:
En este caso se especifica la hipótesis estadística que no ha sido rechazada
indicando el nivel de significancia teórico considerado (α)
Ejemplo 3
En el pasado, el 15% de las solicitudes de pedidos por correo
para cierta obra de caridad dio lugar a una contribución
financiera. Un nuevo formato de solicitud se ha diseñado y se
envía a una muestra de 200 personas y 45 respondieron con una
contribución. ¿En el nivel de significación del .05 se puede
concluir que la nueva solicitud es más eficaz? Paso 1: Establezca
la hipótesis nula y la hipótesis alternativa
Paso 1: Establezca la hipótesis nula y la hipótesis alternativa
Entonces: H0: π ≤ 0,15 H1: π >0,15
Paso 2: Seleccione el nivel de significancia. Es 0,05.
Paso 3: Encuentre un estadístico de prueba. La distribución de z es el estadístico de
prueba.
Paso 4: Indique la regla de decisión. Se rechaza la hipótesis nula si z es mayor que
1.65.
Paso 5: Tome una decisión e interprete los resultados.
Se rechaza la hipótesis nula. Más de 15% de solicitudes responde con un
compromiso. El nuevo formato es más eficaz.
Docimas para la diferencia de proporciones.
Paso 1.-Planteamiento de hipótesis.
Paso 2.-Niveles de significación. (teórico) ” α”
Paso 3.-Estadístico de prueba.
Paso 4.-Formular la regla de decisión
Si el p-valor < α Se rechaza H0
Si el p-valor ≥ α No se rechaza H0
Paso 5.-Conclusión: En este caso se especifica la hipótesis estadística que no ha sido
rechazada indicando el nivel de significancia teórico considerado (α).
Conclusiones
-El muestreo es una técnica, que nos permite conocer a ciertas poblaciones y en base
a ello se obtienen conclusiones dando como un beneficio directo bajo costo y
resultados en menor tiempo.
-La estimación es una técnica que permite dar un valor aproximado de un parámetro
de una población a partir de los datos proporcionados por una muestra
-El Nivel de confianza con el que deseamos trabajar dependerá de la precisión de la
estimación.
-Las pruebas de hipótesis pueden dar dos resultados: rechazar o aceptar H0. ... Se
rechaza H0 cuando ésta es falsa, una diferencia verdadera es declarada
estadísticamente significativa.
-Una prueba de hipótesis es una regla que especifica cuando se puede aceptar o
rechazar una afirmación sobre una población dependiendo de la evidencia
proporcionada por una muestra de datos.