0% encontró este documento útil (0 votos)
3 vistas7 páginas

Modulo 3

El documento aborda la inferencia estadística, que permite realizar afirmaciones sobre una población a partir de una muestra representativa. Se discuten conceptos clave como estimación de parámetros, pruebas de hipótesis, ANOVA y sus supuestos teóricos, así como la importancia de la potencia de la prueba y las pruebas post-hoc. Se enfatiza la necesidad de seguir procedimientos estadísticos rigurosos para tomar decisiones basadas en evidencia científica.
Derechos de autor
© All Rights Reserved
Nos tomamos en serio los derechos de los contenidos. Si sospechas que se trata de tu contenido, reclámalo aquí.
Formatos disponibles
Descarga como DOCX, PDF, TXT o lee en línea desde Scribd
0% encontró este documento útil (0 votos)
3 vistas7 páginas

Modulo 3

El documento aborda la inferencia estadística, que permite realizar afirmaciones sobre una población a partir de una muestra representativa. Se discuten conceptos clave como estimación de parámetros, pruebas de hipótesis, ANOVA y sus supuestos teóricos, así como la importancia de la potencia de la prueba y las pruebas post-hoc. Se enfatiza la necesidad de seguir procedimientos estadísticos rigurosos para tomar decisiones basadas en evidencia científica.
Derechos de autor
© All Rights Reserved
Nos tomamos en serio los derechos de los contenidos. Si sospechas que se trata de tu contenido, reclámalo aquí.
Formatos disponibles
Descarga como DOCX, PDF, TXT o lee en línea desde Scribd

Módulo 3: Inferencia Estadística

La inferencia estadística es el núcleo de la estadística moderna. Su función es


permitir al investigador realizar afirmaciones válidas sobre una población total
basándose únicamente en la observación de una muestra aleatoria y
representativa. Dado que es imposible estudiar a cada individuo de una
población en la mayoría de los casos prácticos, la inferencia proporciona las
herramientas matemáticas para gestionar la incertidumbre y medir el error de
nuestras conclusiones.

Sección del
# Componentes Clave Desarrollados Estado
Informe

Propiedades de los estimadores


Estimación de (Insesgadez, Eficiencia, Consistencia,
1 Incluido
Parámetros Suficiencia), Estimación Puntual e
Intervalos de Confianza.

Definiciones de $H_0$ y $H_1$, Errores


Prueba de
2 Tipo I y II, Significancia ($\alpha$), Región Incluido
Hipótesis
Crítica y P-valor.

Pruebas en
Pruebas para media, diferencia de
3 Poblaciones Incluido
medias, razón de varianza y proporciones.
Normales

Análisis de
Definición del ANOVA de un factor para
4 Varianza Incluido
comparar tres o más grupos.
(ANOVA)

Verificación de Independencia,
Supuestos
4.1 Normalidad y Homocedasticidad (Igualdad Incluido
Teóricos
de varianzas).

Descomposición del modelo: Efecto del


4.2 Modelo Lineal Incluido
factor, media global y error aleatorio.

Pruebas Post- Comparaciones múltiples tras ANOVA:


4.3 Incluido
hoc Procedimientos de Tukey y Scheffé.

[Escriba aquí]
Alcangel Milano
C.I 25.261.2
La estimación es el proceso de asignar valores a los parámetros poblacionales
(como la media \mu o la varianza \sigma^2) que no conocemos.
1.1 Estimación Puntual
Consiste en utilizar un único estadístico de la muestra para estimar el
parámetro de interés. Para que un estimador sea considerado de alta calidad
científica, debe cumplir con cuatro propiedades fundamentales que debes
explicar:
Insesgadez: Se dice que un estimador es insesgado si, en promedio, coincide
con el valor real del parámetro poblacional que intenta medir. No debe tener
una tendencia sistemática a sobreestimar o subestimar el valor.
Eficiencia: Entre varios estimadores que no tienen sesgo, el más eficiente es
aquel que presenta la menor variabilidad (varianza mínima). Esto garantiza que
los resultados sean más precisos y constantes.
Consistencia: Un estimador es consistente si su valor tiende a estabilizarse y
acercarse cada vez más al parámetro real a medida que el tamaño de la
muestra (n) crece hacia el infinito.
Suficiencia: Se considera suficiente si el estimador utiliza toda la información
relevante contenida en la muestra para el cálculo del parámetro, sin
desperdiciar datos que puedan ser útiles.
1.2 Estimación por Intervalos de Confianza
A diferencia de la puntual, esta técnica ofrece un rango de valores razonables
dentro del cual se espera encontrar el parámetro poblacional. Proporciona una
medida de la precisión de nuestra investigación.
Nivel de Confianza (1 - \alpha): Generalmente se fija en un 95% o 99%. Indica
la proporción de intervalos que, si se construyeran de la misma manera
repetidamente, contendrían el valor real del parámetro.
Margen de Error (E): Es la cantidad que se suma y se resta al estimador para
crear el intervalo. Su tamaño depende directamente del error estándar y del
valor crítico de la distribución (Z o t).
2. Prueba de Hipótesis
Es un procedimiento de decisión estadística que busca determinar si una
afirmación sobre la población es compatible con la evidencia de la muestra.
Hipótesis Estadística: Se divide en Hipótesis Nula (H_0), que es la que se
somete a prueba (generalmente de no cambio), e Hipótesis Alternativa (H_1),
que es la sospecha del investigador.
Errores en la Decisión:
Error Tipo I: Consiste en rechazar la hipótesis nula cuando en realidad es
verdadera (falso positivo).
[Escriba aquí]
Alcangel Milano
C.I 25.261.2
Error Tipo II: Consiste en no rechazar la hipótesis nula cuando es falsa (falso
negativo).
Nivel de Significancia (\alpha): Es la probabilidad máxima permitida de cometer
un Error Tipo I.
Región Crítica: Es el área en la distribución que contiene los valores que llevan
al rechazo de la hipótesis nula.
P-valor: Es la probabilidad de que los resultados obtenidos sean fruto del puro
azar. Si es menor que \alpha, se rechaza H_0.
3. Pruebas de Hipótesis en Poblaciones Normales
Estas pruebas se aplican cuando se asume que los datos provienen de una
distribución normal:
Prueba para la Media: Se utiliza para contrastar el promedio de una muestra
contra un valor teórico.
Diferencia de Medias: Es vital para comparar dos poblaciones y determinar si
existe una diferencia real entre ellas (por ejemplo, comparar dos métodos de
producción).
La Razón de Varianza: Utiliza la distribución F para comparar la dispersión de
dos grupos y verificar si sus variabilidades son iguales.
Proposiciones: Se refiere al análisis de variables cualitativas y proporciones en
grandes poblaciones.
3.1 Prueba para la Media (\mu) con Varianza Conocida y Desconocida
La evaluación de la media es el pilar de la inferencia. Dependiendo de la
información disponible, el procedimiento varía:
Caso de Varianza Conocida (\sigma^2): Se utiliza el estadístico Z basado en la
distribución normal estándar. Este escenario es ideal pero poco común en la
práctica, utilizándose principalmente cuando existen datos históricos muy
confiables del proceso.
Caso de Varianza Desconocida: Es el escenario más realista. Aquí se debe
utilizar la desviación estándar de la muestra (s) como estimador de \sigma. Al
introducir esta estimación, se pierde precisión, por lo que se debe emplear la
Distribución t de Student en lugar de la Normal. Esta distribución tiene "colas"
más anchas para compensar la incertidumbre de no conocer la variabilidad real
de la población.
3.2 Prueba para la Diferencia de Medias
Esta prueba es fundamental cuando el objetivo es comparar dos grupos
independientes para determinar si existe una diferencia estadísticamente
significativa entre sus promedios.

[Escriba aquí]
Alcangel Milano
C.I 25.261.2
Aplicación Práctica: Se utiliza para comparar, por ejemplo, si un nuevo método
de producción genera más unidades que el método tradicional.
Consideraciones: El investigador debe decidir si las varianzas de ambas
poblaciones son iguales (homocedasticidad) o diferentes, ya que esto cambia
la fórmula del estadístico de prueba y los grados de libertad.
3.3 La Razón de Varianza (Prueba F)
Antes de comparar medias, a menudo es necesario comparar las variabilidades
de dos poblaciones.
Objetivo: Determinar si un grupo es más disperso o inestable que el otro.
Estadístico F: Se calcula como la razón entre las dos varianzas muestrales
(s_1^2 / s_2^2). Si el valor resultante es cercano a 1, las varianzas son
similares; si es muy alejado, se concluye que las poblaciones tienen
dispersiones distintas.
3.4 Pruebas para Proporciones
No siempre trabajamos con promedios numéricos; a veces el interés reside en
el éxito o fracaso de un evento (datos cualitativos).
Definición: Se utiliza para contrastar hipótesis sobre el porcentaje de una
característica en la población.
Requisito: Para que la aproximación sea válida, el tamaño de la muestra debe
ser lo suficientemente grande para que la distribución binomial de la proporción
pueda aproximarse a una distribución normal.
4. Profundización en el Error y la Región Crítica
Para extender la calidad técnica de tu trabajo, es necesario detallar cómo se
delimita la zona de decisión en estas poblaciones:
4.1 Determinación de la Región Crítica
La región crítica es el conjunto de valores del estadístico de prueba que están
tan alejados de la hipótesis nula (H_0) que es muy improbable que ocurran por
azar.
Pruebas Unilaterales: Se busca detectar si un parámetro es estrictamente
"mayor que" o "menor que" un valor. Toda la región de rechazo se concentra en
una sola cola de la campana.
Pruebas Bilaterales: Se busca detectar cualquier diferencia (ya sea por exceso
o por defecto). La región de rechazo se divide equitativamente en ambas colas
(\alpha / 2).
4.2 Potencia de la Prueba (1 - \beta)
Un concepto avanzado que llenará espacio con valor académico es la
Potencia. Representa la probabilidad de rechazar correctamente una hipótesis
[Escriba aquí]
Alcangel Milano
C.I 25.261.2
nula que es falsa. Una prueba con alta potencia es aquella que tiene una gran
capacidad para detectar efectos o diferencias reales cuando estas existen.

Interlineado: Configura el párrafo con Interlineado Doble (2.0). Esto es estándar


en trabajos de grado y ocupa el doble de espacio.
Márgenes: Asegúrate de que los márgenes sean de 2.5 cm en todos los lados.
Análisis de Resultados: Después de cada punto teórico, agrega un párrafo
titulado "Implicación en la toma de decisiones". Explica que sin estas pruebas
en poblaciones normales, las empresas o investigadores tomarían decisiones
basadas en corazonadas y no en evidencia científica.

4. Análisis de la Varianza (ANOVA) de un Factor (Continuación)


Para que el análisis sea efectivo, no basta con calcular el estadístico, es
necesario profundizar en los pilares que sostienen esta técnica:
4.1 Supuestos Teóricos del ANOVA
Antes de realizar cualquier cálculo, el investigador debe validar que los datos
cumplan con tres "reglas de oro". Si estas no se cumplen, los resultados del
informe no tendrán validez científica:
Independencia de las Observaciones: Los datos recolectados deben ser
independientes entre sí. Esto significa que lo que ocurra en un grupo no debe
afectar el resultado de otro.
Normalidad: Las poblaciones de las que provienen las muestras deben seguir
una distribución normal (forma de campana). Esto se puede verificar mediante
pruebas gráficas como el histograma o pruebas de bondad de ajuste.
Homocedasticidad (Igualdad de Varianzas): Este es el supuesto más crítico.
Establece que la variabilidad interna de todos los grupos debe ser
aproximadamente la misma. Si un grupo es mucho más inestable que los
demás, el ANOVA podría dar resultados erróneos.
4.2 El Modelo Lineal del ANOVA
El ANOVA se basa en una ecuación matemática que intenta explicar el valor de
cada dato observado. El modelo establece que un dato individual es el
resultado de la suma de tres fuerzas:
\mu (Media Global): El valor promedio de todos los datos si no hubiera
diferencias entre grupos.

[Escriba aquí]
Alcangel Milano
C.I 25.261.2
\tau_i (Efecto del Tratamiento o Factor): Es la influencia específica que tiene el
grupo sobre el dato. Por ejemplo, si estamos comparando fertilizantes, este
componente mide cuánto ayudó el fertilizante "A" a que la planta creciera.
\epsilon_{ij} (Error Aleatorio): Representa la variación natural, el azar o factores
externos que no podemos controlar ni explicar.
4.3 Pruebas Post-hoc (Comparaciones Múltiples)
El ANOVA es una prueba "ómnibus", lo que significa que solo nos dice si existe
al menos una diferencia entre todos los grupos comparados. Sin embargo, no
señala cuál grupo es el que difiere. Es aquí donde entran las Pruebas Post-hoc:
Prueba de Tukey (HSD): Es la más popular y balanceada. Compara todos los
pares de medias posibles y nos dice exactamente qué grupos son distintos
entre sí con un nivel de confianza controlado.
Prueba de Scheffé: Es más conservadora y se usa cuando los tamaños de los
grupos son desiguales.
Propósito: Estas pruebas son el paso final necesario para poder concluir, por
ejemplo: "El tratamiento C es superior al A y al B de forma estadísticamente
significativa".

Concepto Descripción

Comparar las medias de tres o más grupos para


Objetivo Principal determinar si al menos una es significativamente diferente
de las demás.

Hipótesis Nula Todas las medias de los grupos son iguales ($\mu_1 = \
($H_0$) mu_2 = \mu_3$).

Hipótesis
Alternativa Al menos una media es diferente a las demás.
($H_a$)

Estadístico de F de Snedecor. Es la razón entre la varianza entre grupos


Prueba y la varianza dentro de los grupos.

[Escriba aquí]
Alcangel Milano
C.I 25.261.2
Concepto Descripción

Criterio de Si el p-valor < $\alpha$ (usualmente 0.05), se rechaza


Decisión $H_0$.

Grados de
Fuente de Suma de Cuadrado
Libertad F
Variación Cuadrados (SS) Medio (MS)
(df)

Variabilidad
Entre $SS_{entre} / $MS_{entre} /
debida al efecto $k - 1$
Grupos df_{entre}$ MS_{error}$
del tratamiento.

Variabilidad
Dentro $SS_{error} /
aleatoria dentro $N - k$ -
(Error) df_{error}$
de los grupos.

Variabilidad total
Total $N - 1$ - -
de los datos.

[Escriba aquí]
Alcangel Milano
C.I 25.261.2

También podría gustarte