0% encontró este documento útil (0 votos)
46 vistas60 páginas

Nociones de Muestreo e Inferencia Estadística

Este documento trata sobre nociones de muestreo e inferencia estadística. Explica que cuando se investiga una población, casi nunca es posible estudiar a todos los individuos, por lo que se debe depender de una muestra representativa. Describe los tipos de muestreo probabilístico y no probabilístico, y las ventajas y características de utilizar muestras. También cubre conceptos como estadísticas, parámetros, estimación de parámetros poblacionales a partir de muestras, y contraste de hipótesis
Derechos de autor
© All Rights Reserved
Nos tomamos en serio los derechos de los contenidos. Si sospechas que se trata de tu contenido, reclámalo aquí.
Formatos disponibles
Descarga como PDF, TXT o lee en línea desde Scribd
0% encontró este documento útil (0 votos)
46 vistas60 páginas

Nociones de Muestreo e Inferencia Estadística

Este documento trata sobre nociones de muestreo e inferencia estadística. Explica que cuando se investiga una población, casi nunca es posible estudiar a todos los individuos, por lo que se debe depender de una muestra representativa. Describe los tipos de muestreo probabilístico y no probabilístico, y las ventajas y características de utilizar muestras. También cubre conceptos como estadísticas, parámetros, estimación de parámetros poblacionales a partir de muestras, y contraste de hipótesis
Derechos de autor
© All Rights Reserved
Nos tomamos en serio los derechos de los contenidos. Si sospechas que se trata de tu contenido, reclámalo aquí.
Formatos disponibles
Descarga como PDF, TXT o lee en línea desde Scribd

Asignatura:

Estadística aplicada

MÓDULO II:
NOCIONES DE MUESTREO E
INFERENCIA ESTADÍSTICA

Docente: Mg. Walter Bernia


León
INTRODUCCION

Al realizar la investigación, casi nunca es posible estudiar a toda la población que te


interesa. Esta es la razón por la que los investigadores utilizan diversos tipos de
muestreo cuando pretenden recopilar datos y responder las preguntas de
investigación.
TEORIA DEL MUESTREO

Los problemas más corrientes que se presentan en la práctica, cuando se procede a investigar
las características de una población estadística es la imposibilidad de estudiar a cada uno de los
individuos u objetos que la conforman; por ello debemos depender de un subconjunto o parte
de la población como base para llegar a hipótesis relacionadas a varias características o
parámetros de ella.
Ventajas de la utilización de las muestras

1) El costo es menor y se puede obtener un mejor rendimiento del dinero


invertido.
2) Se obtiene una disminución notable del tiempo necesario para alcanzar la
información

Cuando una muestra posee 30 o más datos se denomina grandes muestras y


si la muestra tiene menos de 30 observaciones se denomina pequeñas
muestras. Al procedimiento utilizado para elegir una muestra se denomina
Muestreo.

Necesidad del Muestreo.


1. Población Infinita
2. Población uniforme
3. Proceso de investigación destructiva
4. Economía de costos
5. Calidad
Características

Para que una muestra sea aceptable

a) Deberá seleccionarse de manera que sea representativa de la población de la cual se obtuvo.

a) La muestra además de permitir obtener estimaciones de características de la población


(totales, promedios, porcentajes, entre otros) deberá proporcionar medidas de la precisión
de dichas estimaciones.

b) La muestra debe ser bastante reducida para evitar gastos innecesarios y lo bastante amplia
para que el error de muestreo sea admisible y además debe reunir las exigencias de
eficiencia, representatividad, seguridad y flexibilidad.

Limitaciones
1.- No permite hacer cálculos, proyecciones o tabulaciones con respecto a sectores pequeños de
una población

2.- El cálculo de los resultados está sujeto a los errores del muestreo en sí y de errores ajenos al
muestreo.

3.- Las investigaciones completas ofrecen un margen más sólido y eficiente de exactitud que los
obtenidos en base a la muestra.
Función de la estadística y los parámetros

Matemáticamente, podemos describir muestras


y poblaciones al emplear mediciones como la
media, la mediana, la moda y la desviación
estándar. Cuando estos términos describen las
características de una muestra, se denominan
estadísticas.

Cuando describen las características de una


población, se llaman parámetros. Una estadística Tipos de muestreo
es una característica de una muestra y un
parámetro es una característica de una
población. Muestreo de juicio (No
probabilístico)
En el muestreo de juicio, se emplea el
conocimiento y la opinión personal para
identificar a los elementos de la población
que deben incluirse en la muestra.
Para ser consecuentes, los especialistas en
estadística emplean literales latinas minúsculas Muestreo de Probabilidad
para representar estadísticas de muestra, y
literales griegas o latinas mayúsculas para (Probabilístico)
representar parámetros de población. En el muestreo de probabilidad, todos los
elementos de la población tienen la
oportunidad de ser escogidos para la
muestra
El riguroso análisis estadístico que puede llevarse a cabo a partir de muestras
aleatorias, no puede ser efectuado con muestras de juicio. Son más cómodas y
pueden usarse con éxito aunque no podamos medir su validez. No debe perderse de
vista que si un estudio recurre al muestreo de juicio a costa de perder un grado
importante de representatividad, la comodidad habrá costado un precio demasiado
alto.

Muestra Sesgada
Una muestra sesgada es una muestra estadística que ha sido falsamente
considerada como la típica de una población de la cual ha sido tomada. Por
ejemplo, alguien puede decir «A todo el mundo le gustó la película» sin
mencionar (o sin saber) que «todo el mundo» fue un grupo que son fans del
director de la película.
Tipo de Muestreo Probabilístico
Tipo de Muestreo No Probabilístico
Determinación de tamaño de nuestra para ser aplicado en Estadísticas Paramétricas y
no Paramétricas
Población homogénea y
heterogénea

Si es homogénea se requiere pocos


elementos en la muestra y si la
población es heterogénea se requiere
un mayor número de elementos.

Para establecer una fórmula del tamaño


de muestra se requiere saber el tipo de
parámetro que se desea estimar, es
decir, si el interés es estimar una media
aritmética se requiere una fórmula
específica y si se quiere estimar una
proporción se considera otra fórmula.
Determinación de tamaño de nuestra para ser aplicado en
Estadísticas Paramétricas y no Paramétricas
Ejemplo:
Se tiene el interés de conocer el promedio con respecto a la preferencia por determinado producto
consumido por los estudiantes de la Facultad de Contabilidad de la USMP. (Suponemos que la población es
1800 alumnos) El estudio queremos realizarlo mediante una muestra, para ello necesitamos calcular el
tamaño de muestra n, considerando: un grado de confianza del 95%, y los resultados de un estudio
preliminar:
Determinación de tamaño de nuestra para ser aplicado en
Estadísticas Paramétricas y no Paramétricas
Determinación de tamaño de nuestra para ser aplicado en
Estadísticas Paramétricas y no Paramétricas
Determinación de tamaño de nuestra para ser aplicado en
Estadísticas Paramétricas y no Paramétricas
Por lo menos se requiere para ejecutar el estudio por lo menos 462 estudiantes,
con un grado de confianza del 99% y precisión del 5%.

En caso de que se desconocer el tamaño de la población N, las fórmulas


quedaran reducidas como:
ESTADÍSTICA INFERENCIAL
La estadística inferencial es una parte de la estadística que comprende los métodos
y procedimientos que por medio de la inducción determina propiedades de
una población estadística, a partir de una parte de esta. Su objetivo es obtener
conclusiones útiles para hacer deducciones sobre una totalidad, basándose en la
información numérica de la muestra.

Se dedica a la generación de los modelos, inferencias y predicciones asociadas a


los fenómenos en cuestión teniendo en cuenta la aleatoriedad de las observaciones.
Se usa para modelar patrones en los datos y extraer inferencias acerca de la
población bajo estudio.
Estas inferencias pueden tomar la forma de:

- Respuestas a preguntas sí/no (prueba de hipótesis).


- Estimaciones de unas características numéricas (estimación).
- Pronósticos de futuras observaciones, descripciones de asociación (correlación) o
modelamiento de relaciones entre variables de Sam (análisis de regresión).
- Otras técnicas de modelamiento incluyen análisis de varianza, series de tiempo y
minería de datos.

Estudio de la estadística inferencial

1. Toma de muestras o cuantitativo muestreo, que se refiere a la forma adecuada de


considerar una muestra que permita obtener conclusiones estadísticamente válidas y
significativas.

2. Estimación de parámetros o variables estadísticas, que permite estimar valores


poblacionales a partir de muestras de mucho menor tamaño.

3. Contraste de hipótesis, que permite decidir si dos muestras son estadísticamente


diferentes, si un determinado procedimiento tiene un efecto estadístico significativo, etc
•Diseño experimental.
El diseño experimental prescribe una serie de pautas relativas qué variables
hay que manipular, de qué manera, cuántas veces hay que repetir el
experimento y en qué orden para poder establecer con un grado de
confianza predefinido la necesidad de una presunta relación de causa-efecto

•Inferencia bayesiana.
Las evidencias u observaciones se emplean para actualizar
o inferir la probabilidad de que una hipótesis pueda ser cierta.

•Métodos no paramétricos

Método

Planteamiento del problema:


Suele iniciarse con una fijación de objetivos o algunas preguntas como: ¿Cuál
será la media de esta población respecto a tal característica? ¿Se parecen
estas dos poblaciones?

Elaboración de un modelo:
Los posibles modelos son distribuciones de probabilidad.
Extracción de la muestra
se usa alguna técnica de muestreo o un diseño experimental para
obtener información de una pequeña parte de la población

Tratamiento de los datos


En esta fase se eliminan posibles errores, se depura la muestra, se tabulan los
datos y se calculan los valores que serán necesarios en pasos posteriores, como
la media muestral, la varianza muestral.

Estimación de los parámetros


con determinadas técnicas se realiza una predicción sobre cuáles podrían ser los
parámetros de la población, en base a un muestreo.

Contraste de hipótesis
Los contrastes de hipótesis son técnicas que permiten simplificar el modelo
matemático bajo análisis. Frecuentemente el contraste de hipótesis recurre al uso
de estadísticos muestrales. Se realiza una contrastación de información entre la
hipótesis estadística existente y los resultados obtenidos de la muestra, para una
corroboración

Conclusiones
se critica el modelo y se hace un balance. Las conclusiones obtenidas en este
punto pueden servir para tomar decisiones o hacer predicciones
Estimaciones, estimación puntual y por intervalos en variables
cuantitativas

Es cuando queremos realizar el estudio de una población cualquiera de la que


desconocemos sus parámetros por ejemplo su media poblacional o la
probabilidad de éxito si la población sigue una distribución binomial , debemos
tomar una muestra aleatoria de dicha población para calcular una
aproximación a dichos parámetros q conocemos y queremos estimar .

Estimación de parámetros
Introducimos métodos que nos permiten estimar con precisión razonable la
proporción de la población (la fracción de la población que posee una característica
dada) y la media de la población.
Calcular la proporción exacta o la media exacta sería una meta imposible. Pero, a
pesar de ello, seremos capaces de hacer una estimación, establecer una afirmación
respecto al error que tal vez acompañará a esta estimación, y poner en marcha
algunos controles para evitar dicho error en la medida de lo posible.
Estimaciones, estimación puntual y por intervalos en variables
cuantitativas
¿Que es una estimación puntual?

 Una estimación es puntual cuando se usa un solo valor extraído de la muestra para estimar el
parámetro desconocido de la población. Al valor usado se le llama estimador.
 La media de la población se puede estimar puntualmente mediante la media de la muestra:

 La proporción de la población se puede estimar puntualmente mediante la proporción de la


muestra:

 La desviación típica de la población se puede estimar puntualmente mediante la desviación típica


de la muestra, aunque hay mejores estimadores:
Estimaciones, estimación puntual y por intervalos en variables
cuantitativas
PROPIEDADES DEL ESTIMADOR
En el caso del error estándar de p´,
Insesgado:
Un estimador es insesgado cuando la
media de su distribución muestral
asociada coincide con la media de la
población. Observar que cuanto mayor sea el tamaño
Esto ocurre, por ejemplo, con el de la muestra n , menor será la
estimador x , ya que µ x = µ y con variabilidad del estimador x y de p´, por
estimador p´ ya que p µ p′ = P De tanto, mejor serán nuestras estimaciones.

Varianza mínima: Eficiencia:


La variabilidad de un estimador viene La eficiencia se refiere al tamaño del error
determinada por el cuadrado de su estándar del estadístico. Si comparamos dos
desviación estándar. En el caso del estadísticos de una muestra del mismo tamaño
estimador x , su desviación estándar es y tratamos de decidir cuál de ellas es un
estimador más eficiente, escogeríamos la
estadística que tuviera el menor error estándar
o la menor desviación estándar de la
distribución muestral.
Estimaciones, estimación puntual y por intervalos en variables
cuantitativas
Ejemplo:
Escogemos una muestra de un tamaño determinado y debemos decidir si utilizamos
la media de la muestra o la mediana de la muestra para estimar la media de la
población. Si calculamos el error estándar de la media de la muestra y encontramos
que es 1.05, y luego calculamos el error estándar de la mediana de la muestra y
tenemos que éste es 1.6, diríamos que la media de la muestra es un estimador más
eficiente de la media poblacional ya que su error estándar es menor.

Consistencia.
Una estadística es un estimador consistente de un parámetro de población si al
aumentar el tamaño de la muestra, se tiene casi la certeza de que el valor de la
estadística se aproxima bastante al valor del parámetro poblacional. Si un estimador
es consistente, se vuelve más confiable al tener tamaños de muestra más grandes.
Estimaciones, estimación puntual y por intervalos en variables
cuantitativas

Suficiencia.
Un estimador es suficiente si utiliza tanta información de la muestra que ningún
otro estimador puede extraer información adicional acerca del parámetro de
población que se está estimando. Por ejemplo, supongamos que la compañía
Sonytron desea estimar la edad media de los compradores de equipos de alta
fidelidad. Seleccionan una muestra de 100 compradores y calculan la media de
esta muestra, este valor será un estimador puntual de la media de la población.

a) Estimación puntual de la media:


La media de la muestra x es el mejor estimador de la media de la población. Es
insesgada, consistente, el estimador más eficiente y, siempre y cuando la muestra
sea suficientemente grande, su distribución muestral puede ser aproximada por
medio de la distribución normal.

Si conocemos la distribución muestral de x, podemos obtener conclusiones


respecto a cualquier estimación que podamos hacer a partir de la información
muestral.
Estimaciones, estimación puntual y por intervalos en variables
cuantitativas
Ejemplo:

Considere el caso de una compañía de


suministros clínicos que produce jeringas
desechables. Cada jeringa está cubierta por
una envoltura estéril que a su vez se empaca
en grandes cajas de cartón corrugado.
Podemos obtener la media de la
Debido al proceso de empaque, las cajas de muestra, x, sumando todos los
cartón contienen distintas cantidades de resultados, x, y dividiendo esta suma
jeringas. entre n, el número de cajas
muestreadas:
Como las jeringas se venden por pieza, la
compañía necesita una estimación del
número de piezas que hay por caja, para
propósitos de facturación. Tomamos una
muestra aleatoria de 35 cajas y registramos el
número de jeringas contenidas en cada caja.
Estimaciones, estimación puntual y por intervalos
en variables cuantitativas
Estimación puntual de la varianza y la
desviación estándar de la población
Uso de la desviación estándar de la
muestra para estimar la desviación
estándar de la población

Suponga que la administración de la


compañía de suministros clínicos desea
estimar la varianza y/o la desviación
estándar de la distribución del número de
jeringas empacadas por caja.

El estimador más utilizado para estimar la


desviación estándar de la población σ , es
la desviación estándar de la muestra, s.
Podemos calcular la desviación estándar
de la muestra. Resultando 6.01.
Estimaciones, estimación puntual y por intervalos en variables
cuantitativas
Intervalo de confianza para la media
Estimación por Intervalo.
Los valores de los límites, inferior (L1) y
La estimación por intervalo Consiste en
determinar, mediante un estimador, 2 superior (L2), se encuentran aplicando la
valores numéricos llamados límite fórmula general:
inferior (L1) y límite superior (L2). Con
un cierto grado de confianza, se espera
que estos límites contengan el valor del
parámetro que se quiere hallar.

Es decir, el valor del parámetro debería


encontrarse entre el límite inferior y Por consiguiente, los límites del intervalo
límite superior obtenidos de la se obtienen sumando o restando el error
estimación. Cabe mencionar que no estándar al valor de la media muestral.
todos los intervalos obtenidos de un
estimador incluirán realmente al Específicamente, para hallar el límite
parámetro. Es por ello que se aplica el inferior (L1) se resta el error estándar y
concepto de nivel de confianza. para hallar el límite superior (L2) se suma
el error estándar.
Estimaciones, estimación puntual y por intervalos en variables
cuantitativas
Por consiguiente, los límites del intervalo se
obtienen sumando o restando el error
estándar al valor de la media muestral.
Específicamente, para hallar el límite inferior
(L1) se resta el error estándar y para hallar el
límite superior (L2) se suma el error estándar.

Para explicar el uso de esta forma de


estimación se resolverán los ejemplos
planteados anteriormente y otros.

Ejemplo: Se tiene interés en estimar la


altura media de los alumnos de la
Facultad de Medicina de la USMP. Se
recurre a una muestra aleatoria de 36
alumnos y se obtienen los siguientes
resultados:
Estimaciones para la Diferencia de Medias

Estimación para la Diferencia de Medias Para calcular el intervalo de


confianza para la diferencia de dos medias se debe saber si las varianzas
poblacionales son conocidas o desconocidas, y en caso de que sean
desconocidas, se debe probar si son igual es o diferentes.

Cada uno de estos tres casos se analizará por separado Si las varianzas
poblacionales son conocidas y diferentes, los pasos a seguir para
encontrar el intervalo de confianza son los siguientes:

a) El estadístico usado como estimador puntual de la diferencia de


medias μ1 − μ 2, será T = x 1 − x 2 , que es un estimador
suficiente

b) La variable aleatoria asociada con el estimador será la variable


normal estándar dada por:
Estimaciones para la Diferencia de Medias

c) Para calcular el intervalo de


confianza se debe tener en cuenta el
nivel de confianza que se quiere
considerar.

Si x1 − x2 son las medias de dos


muestras aleatorias independientes de
tamaño n1 y n2 tomadas de
poblaciones que tienen varianzas
conocidas 1 2 y 2 2
respectivamente, entonces el intervalo
de confianza para μ1 − μ 2 es:
Estimaciones para la Diferencia de Medias

Ejemplo.
Construya un intervalo de confianza del
94% para la diferencia real entre las
duraciones de dos marcas de focos, si una
muestra de 40 focos tomada al azar de la
primera marca dio una duración media de
418 horas, y una muestra de 50 focos.

De otra marca dieron una duración media


de 402 horas.

Las desviaciones estándares de las dos


poblaciones son 26 horas y 22 horas,
respectivamente.
Estimación puntual y por intervalos en variables cualitativas.
Estimación puntual de la proporción de la población.

La proporción de unidades de una población dada que tiene una característica


particular se denota por p. Si conocemos la proporción de unidades de una muestra
que tiene la misma característica (denotada por pˆ, podemos utilizar esta pˆ como
estimador de p. Se puede demostrar que pˆ tiene todas las características deseables
analizadas; es insesgado (no sesgado), consistente, eficiente y suficiente.

Ejemplo
Del fabricante de suministros médicos, intentaremos hacer una estimación de la
proporción de la población a partir de la proporción de la muestra. Suponga que la
administración de la empresa desea estimar el número de cajas que llegarán dañadas
a su destino por mal manejo en el traslado. Podemos verificar una muestra de 50 cajas
a partir del punto de embarque hasta su arribo al punto de destino, y
luego registrar la presencia o ausencia de daños.
Estimación puntual y por intervalos en variables cualitativas.
Estimación puntual de la proporción de la población.

• En este caso, si encontramos que la proporción de cajas dañadas


en la muestra es 0.08, diríamos que: pˆ = 0.08 ← Proporción de
la muestra dañada Y, debido a que la proporción de la muestra pˆ
es un estimador conveniente de la proporción de la población p,
podemos estimar que la proporción de cajas dañadas de toda la
población será también 0.08.
Estimaciones por Intervalo para la Proporción de la población.

Intervalo de confianza para la proporción P Los valores de los límites, inferior (L1) y superior
(L2), se encuentran aplicando la fórmula general:

Por consiguiente, los límites del intervalo se obtienen sumando o restando el error
estándar al valor de la proporción muestral (p). Específicamente, para hallar el límite
inferior (L1) se resta el error estándar y para hallar el límite superior (L2) se suma el
error estándar.

[Link]
Estimaciones por Intervalo para la Proporción de la población.

Ejemplo:
Supóngase que en una muestra de 2000 personas se encontró que 250 son
alcohólicos. Es decir, el porcentaje de alcohólicos en la muestra es:
p=250/2000x100=12.5%. Calcular el intervalo de confianza al 95%.

Por lo tanto, con un nivel de confianza de 95%, se puede afirmar que el


porcentaje de alcoholismo en la población se encuentra entre 11.05% y 13.95%.
Estimaciones por intervalo para la Diferencia de Proporciones

Los límites para el intervalo de una diferencia de proporciones correspondientes a


dos muestras independientes son:

Donde el símbolo zα/2 es el mismo valor crítico utilizado anteriormente (Z >


zα/2) = α/2, y corresponde a un intervalo de confianza 1 − α %.

Este intervalo puede utilizarse de manera alternativa al contraste de hipótesis


para decidir (con nivel de significación α %) si hay igualdad de los dos grupos. Se
decidirá por la igualdad de los grupos si el valor 0 queda incluido en cualquier
posición en el intervalo.

Aunque se haga el contraste de dos proporciones, en primer lugar, es


aconsejable obtener el intervalo de confianza de la diferencia de medias, si éste
ha resultado significativo, puesto que ayudará a interpretar si existe
significación aplicada además de la estadística.
Estimaciones por intervalo para la Diferencia de Proporciones

Si se dispone de alguna información previa y sólo quiere calcularse alguno de los


dos intervalos unilaterales, bastará sustituir zα/2 por zα y descartar el límite
superior o inferior del intervalo según el caso. Por ejemplo, el intervalo unilateral
derecho corresponde a:

[Link]
PRUEBAS DE HIPÓTESIS

Tenemos que empezar por definir que es una hipótesis y que es prueba de hipótesis.

Hipótesis es una aseveración de una población elaborado con el propósito de poner


aprueba, para verificar si la afirmación es razonable se usan datos.

En el análisis estadístico se hace una aseveración, es decir, se plantea una hipótesis,


después se hacen las pruebas para verificar la aseveración o para determinar que no
es verdadera.

Por tanto, la prueba de hipótesis es un procedimiento basado en la evidencia


muestral y la teoría de probabilidad; se emplea para determinar si la hipótesis es una
afirmación razonable.
Pasos para probar una hipótesis.
Una hipótesis estadística, es un enunciado sobre la población. Su posibilidad de ser
evaluada es en base en la información obtenida de una muestra aleatoria de la
población.

PASO 1.- PLANTEAMIENTO DE HIPOTESIS


PASO 2.- NIVELES DE SIGNIFICACION.
PASO 3.- ESTADISTICO DE PRUEBA
PASO 4.- REGLA DE DECISION
PASO 5.- TOMA DE DECISION
1.- PLANTEAMIENTO DE HIPOTESIS.

- Ho: Hipótesis Nula


- H1: Hipótesis Alternativo

Hipótesis Nula.- Una afirmación o enunciado tentativo que se realiza acerca del valor de un
parámetro poblacional. Por lo común en una afirmación de que el parámetro de población tiene
valor especifico.

Hipótesis Alternativa.- Una afirmación o enunciado que se aceptara si los datos muéstrales
proporcionan amplia evidencia de que la hipótesis nula es falsa.

2.- NIVELES DE SIGNIFICACION.

El riesgo que se ahumé acerca e rechazar la hipótesis nula cuando en realidad deben asemejarse
por ser verdadera.

El nivel de significación se denota mediante la letra griega sigma. No hay un nivel de significación
que se aplique a todos los estudios que implican muestreo.

Deben tomarse una decisión de usar el nivel 0.05, el nivel 0.01, el 0.10 o cualquier otro nivel
entre 0 y 1 Tradicionalmente se relaciona el nivel 0.05 para proyectos de investigación sobre
consumo, el 0.01 para control de calidad y el 0.10 para encuesta políticas.
3.- ESTADISTICO DE PRUEBA

Un valor, determinado a partir de la información muestral, que se utiliza para aceptar


o rechazar la hipótesis nula.

Existen muchos estadísticos de prueba para nuestro caso utilizaremos los estadísticos
z y t. La elección de uno de estos depende de la cantidad de muestras que se toman,
si las muestras son de la prueba son iguales a 30 o mas se utiliza el estadístico z, en
caso contrario se utiliza el estadístico t.

Tipos de prueba

Prueba bilateral o de dos extremos: la hipótesis planteada se formula con la igualdad


Ejemplo

H0 : µ = 200
H1 : µ ≠ 200
b) Pruebas unilateral o de un extremo: la hipótesis planteada se formula con ≥ o ≤

H0 : µ ≥ 200 H0 : µ ≤ 200
H1 : µ < 200 H1 : µ > 200

En las pruebas de hipótesis para la media (μ), cuando se conoce la desviación estándar (σ)
poblacional, o cuando el valor de la muestra es grande (30 o más), el valor estadístico de prueba es z
y se determina a partir de:

El valor estadístico z, para muestra grande y desviación estándar poblacional desconocida se


determina por la ecuación:

En la prueba para una media poblacional con muestra pequeña y desviación estándar poblacional
desconocida se utiliza el valor estadístico t.
PASO 4.- REGLA DE DECISION

Es una regla simple la cual es una afirmación de las condiciones bajo las que se
acepta la hipótesis nula.

PASO 5.- TOMA DE DECISION

Es la toma de decisión si se debe aceptar o rechazar la hipótesis nula

Objetivo de la prueba de hipótesis.

El propósito de la prueba de hipótesis no es cuestionar el valor calculado del


estadístico (muestral), sino hacer un juicio con respecto a la diferencia entre
estadístico de muestra y planteado del parámetro.
Error tipo I.
En una prueba de hipótesis para la toma de decisiones se haya sujeta a los datos recolectados a
través de un experimento o de una muestra aleatoria, por lo que es posible cometer dos tipos
de errores que pueden llevar a una pérdida sustancialmente diferente, estos errores son:

• Error tipo 1: Rechazar una hipótesis verdadera.


• Error tipo 2: No rechazar una hipótesis falsa.

El tamaño de estos dos tipos de error se define como la probabilidad de que cada uno de ellos
ocurra; al término α (alfa) se le llama nivel de significancia de la prueba, generalmente se le
asignan los valores 0.10, 0.05 ó 0.01 y se determina al inicio de la investigación; a β (beta) se le
denomina potencia de la prueba.

Nótese que debido a la relación existente entre las hipótesis, los dos tipos de error se hayan
relacionados, al controlar el tipo 1 automáticamente se controla el otro, para un tamaño de
muestra dado.
En la práctica se busca trabajar con errores pequeños del tipo 1, es decir, se puede
tomar como el error más serio rechazar Ho cuando es verdadera, que no rechazarla
cuando es falsa.

DÓCIMAS DE HIPÓTESIS EN VARIABLES CUANTITATIVAS. DÓCIMAS PARA LA MEDIA


POBLACIONAL. DÓCIMAS PARA LA DIFERENCIA DE MEDIAS.

Es otra forma de hacer inferencia estadística, cuyo objetivo es probar una hipótesis
acerca de los parámetros de una población (media, varianza, proporción) Definiendo
un procedimiento o regla de decisión que nos permita concluir probabilísticamente la
aceptación o rechazo de tal hipótesis.

2.1 Docimas de hipótesis en variables cuantitativas


Una de las situaciones más comunes a las que debe enfrentarse un investigador es la
comparación de las medias de dos grupos.

Por ejemplo en la comparación de dos situaciones, en los que se mide su eficacia en


función unos resultados obtenidos y medidos numéricamente.
2.2 Docimas para la media poblacional

Paso 1.-Planteamiento de hipótesis.

Paso 2.-Niveles de significación: símbolo alfa.

Paso 3.-Estadístico de prueba.


Ejemplo 1: Una empresa eléctrica fabrica focos que tienen una duración que se
distribuye de forma aproximadamente normal con una media de 800 horas y una
desviación estándar de 40 horas. Pruebe la hipótesis de que µ≠800 horas si una muestra
aleatoria de 30 focos tiene una duración promedio de 788 horas. Utilice un nivel de
significancia de 0.04.

Con la resolución del ejercicio, se acepta la hipótesis nula y se llega a la conclusión de


que la duración media de los focos si corresponde a 800 horas por lo que la hipótesis
nula es aceptada.
Docimas para la diferencia de medias.

Paso 1.-Planteamiento de hipótesis.

Paso 2.-Niveles de significación. (teórico) ”Símbolo alfa”

Paso 3.-Estadístico de prueba. Para varianza conocida


Paso 4.- Formular la regla de decisión

Si el p-valor < α Se rechaza H0


Si el p-valor ≥ α No se rechaza H0

Paso 5.- Conclusión: En este caso se especifica la hipótesis estadística


que no ha sido rechazada indicando el nivel de significancia teórico
considerado (α)
Ejemplo:

Se lleva a cabo un experimento para comparar el desgaste por abrasivo de


dos diferentes materiales laminados. Se prueban 12 piezas del material 1
mediante la exposición de cada pieza a una máquina para medir el desgaste.
10 piezas del material 2 se prueban de manera similar.

En cada caso, se mide la profundidad del desgaste. Las muestras del material
1 dan un desgaste promedio de 85 unidades con una desviación estándar
muestral de 4, mientras que las muestras del material 2 dan un promedio de
81, desviación estándar muestral de 5.

¿Podemos concluir con un nivel de significancia del 0.05 que el desgaste


abrasivo del material 1 excede el del material 2 en 2 unidades?
Representemos con µ₁ y µ₂ las medias poblacionales del desgaste abrasivo para el material 1 y 2,
respectivamente.
DÓCIMAS DE HIPÓTESIS EN VARIABLES CUALITATIVAS. DÓCIMAS PARA LA
PROPORCIÓN POBLACIONAL. DÓCIMAS PARA LA DIFERENCIA DE PROPORCIONES.

Docimas de hipótesis en variables cualitativas

Existen muchos estadísticos de prueba para nuestro caso utilizaremos los


estadísticos z y t. La elección de uno de estos depende de la cantidad de muestras
que se toman, si las muestras son de la prueba son iguales a 30 o más se utiliza el
estadístico z, en caso contrario se utiliza el estadístico t.

Docimas para la proporción poblacional.

Paso 1.-Planteamiento de hipótesis

Paso 2.-Niveles de significación.” α”


Paso 3.-Estadístico de prueba.

Paso 4.-Formular la regla de decisión


Si el p-valor < α Se rechaza H0
Si el p-valor ≥ α No se rechaza H0

Paso 5.-Conclusión:
En este caso se especifica la hipótesis estadística que no ha sido rechazada
indicando el nivel de significancia teórico considerado (α)
Ejemplo 3

En el pasado, el 15% de las solicitudes de pedidos por correo


para cierta obra de caridad dio lugar a una contribución
financiera. Un nuevo formato de solicitud se ha diseñado y se
envía a una muestra de 200 personas y 45 respondieron con una
contribución. ¿En el nivel de significación del .05 se puede
concluir que la nueva solicitud es más eficaz? Paso 1: Establezca
la hipótesis nula y la hipótesis alternativa

Paso 1: Establezca la hipótesis nula y la hipótesis alternativa


Entonces: H0: π ≤ 0,15 H1: π >0,15
Paso 2: Seleccione el nivel de significancia. Es 0,05.

Paso 3: Encuentre un estadístico de prueba. La distribución de z es el estadístico de


prueba.

Paso 4: Indique la regla de decisión. Se rechaza la hipótesis nula si z es mayor que


1.65.

Paso 5: Tome una decisión e interprete los resultados.

Se rechaza la hipótesis nula. Más de 15% de solicitudes responde con un


compromiso. El nuevo formato es más eficaz.
Docimas para la diferencia de proporciones.

Paso 1.-Planteamiento de hipótesis.

Paso 2.-Niveles de significación. (teórico) ” α”

Paso 3.-Estadístico de prueba.


Paso 4.-Formular la regla de decisión

Si el p-valor < α Se rechaza H0


Si el p-valor ≥ α No se rechaza H0

Paso 5.-Conclusión: En este caso se especifica la hipótesis estadística que no ha sido


rechazada indicando el nivel de significancia teórico considerado (α).
Conclusiones
-El muestreo es una técnica, que nos permite conocer a ciertas poblaciones y en base
a ello se obtienen conclusiones dando como un beneficio directo bajo costo y
resultados en menor tiempo.

-La estimación es una técnica que permite dar un valor aproximado de un parámetro
de una población a partir de los datos proporcionados por una muestra

-El Nivel de confianza con el que deseamos trabajar dependerá de la precisión de la


estimación.

-Las pruebas de hipótesis pueden dar dos resultados: rechazar o aceptar H0. ... Se
rechaza H0 cuando ésta es falsa, una diferencia verdadera es declarada
estadísticamente significativa.

-Una prueba de hipótesis es una regla que especifica cuando se puede aceptar o
rechazar una afirmación sobre una población dependiendo de la evidencia
proporcionada por una muestra de datos.

También podría gustarte