Histograma, la curva normal, error normal de la media, intervalo de confianza,
probabilidades y aplicaciones.
Un histograma es un tipo de gráfico de barras que se utiliza para representar la tendencia central
(promedio o media), la dispersión (variabilidad) y el patrón de distribución estadística de una
manera visual y fácil de entender.
Son representaciones gráficas que permiten observar la distribución de un conjunto de datos. En
control de calidad, se usan para identificar la variabilidad de un proceso y detectar posibles causas
de error. Un histograma organiza los datos en intervalos y muestra la frecuencia de cada intervalo.
Esto ayuda a la empresa a evaluar si el proceso productivo cumple con las especificaciones de
calidad.
Un caso de estudio para el desarrollo del histograma.
Un miembro del equipo de pruebas de TI evalúa los productos de trabajo según las especificaciones
para detectar problemas. El equipo puede optar por categorizar los datos sobre problemas de
calidad en las siguientes categorías,
Especificación incompleta o errónea (IES)
Mala interpretación de la comunicación con el cliente (MCC)
Desviación intencional de las especificaciones (IDS)
Violaciones de los estándares de programación. (VPS)
Error en las representaciones de datos (EDR)
Interfaz de componentes inconsistente (ICI)
Error en la lógica de diseño (EDL)
Pruebas incompletas o erróneas (IET)
Documentación inexacta o inconsistente (IID)
Error en la traducción del diseño del lenguaje de programación (PLT)
Interfaz humano-computadora (HCI) ambigua o inconsistente
Varios (MIS)
En este histograma, la frecuencia de los problemas en "IES", "MCC" y "EDR" es mayor; puede
optar por centrarse en mejorar los procesos de "Recopilación de Requisitos" y "Definición del
Alcance" como parte de las iniciativas de mejora.
2. La curva normal
La distribución normal es un gráfico de probabilidad comúnmente utilizado en estadística. Un
gráfico de probabilidad se utiliza para representar la frecuencia (probabilidad) o la improbabilidad
(rara vez) de diversas puntuaciones. Observará que se utilizó el término "puntuaciones"; esto se
debe a que la distribución normal se utiliza para representar las probabilidades de diversas
puntuaciones o intervalos de puntuación para variables cuantitativas, no cualitativas. Este gráfico
se crea univariadamente, lo que significa que solo se espera que se represente una variable a la
vez, aunque se pueden mostrar varias curvas normales juntas para permitir comparaciones entre
diferentes variables o grupos (lo cual veremos en capítulos posteriores sobre pruebas t para
muestras independientes y ANOVA).
Características clave de la curva normal
Hay características clave de la distribución normal que la hacen fácil de distinguir visualmente de
otros gráficos: el pico, la naturaleza asintótica y la simetría del gráfico. La curva normal es
esencialmente un polígono de frecuencia que es más alto (picos) en el centro y se hace
progresivamente más corto a medida que se avanza hacia las colas. La palabra "colas" se refiere a
las porciones externas del gráfico donde la curva adquiere una apariencia o pendiente notablemente
más plana (más horizontal). La altura de la curva corresponde al eje y y representa la frecuencia
con la que se produjeron las puntuaciones. Esto significa que las puntuaciones en el centro de la
distribución (representadas como el vértice de la curva) son las que ocurren con mayor frecuencia.
Esto también significa que las puntuaciones se vuelven menos comunes a medida que nos alejamos
del centro en cualquier dirección. Otra forma de decir esto es que las puntuaciones son más
comunes en las partes altas del gráfico y menos comunes en las partes más cortas (cola). Cuando
los datos se distribuyen perfectamente de forma normal, la moda, la mediana y la media serán el
mismo número y se ubicarán en el eje x, justo debajo del vértice o pico de la curva. La distribución
normal también es simétrica. Esto significa que el lado izquierdo del gráfico es un reflejo del lado
derecho.
La estructura de la curva normal
Los ejes. El eje x de la curva normal se utiliza para mostrar puntuaciones brutas cuantitativas,
desde las más bajas a la izquierda hasta las más altas a la derecha. Dado que la gráfica es asintótica,
teóricamente se extiende hasta el infinito en ambas direcciones; sin embargo, sería imposible
dibujarla hasta el infinito. Por lo tanto, la gráfica suele representarse extendiéndose solo lo
suficiente como para mostrar que las colas se acercan bastante al eje x. En esencia, la sección del
eje x que se muestra representa el segmento más relevante de una recta numérica, que se extiende
de -3 a 3. El eje y se utiliza para representar las frecuencias con las que se produjo cada puntuación,
siendo 0 el valor y teóricamente más bajo posible para representar la ausencia de una puntuación
en particular. Estos son los mismos elementos que se representan en los ejes x e y de los
histogramas y polígonos de frecuencias (que se trataron en el capítulo 2). De hecho, ¡podría
observar que la curva normal es en realidad un polígono de frecuencias muy suave!
La posición de la media y la desviación estándar
La media y la desviación estándar se utilizan para definir y diferenciar las áreas de la curva normal.
La media se encuentra en el eje x, justo debajo del centro o pico de la curva, lo que provoca que
la mitad del gráfico se encuentre a la izquierda de la media y la otra mitad a la derecha. Esto
significa que, proporcionalmente, la mitad de las puntuaciones brutas son inferiores al valor de la
media (que corresponde al área a la izquierda del centro de la curva) y la otra mitad son superiores
al valor de la media (que corresponde al área a la derecha del centro de la curva).
La desviación estándar ( DE ) se utiliza para distinguir las distintas ubicaciones a la izquierda o a
la derecha del centro de la curva normal. Recordemos que la desviación estándar se refiere a la
tendencia a la caída de las puntuaciones brutas individuales de una muestra con respecto a su media
muestral (véase el capítulo 4 para una revisión). Por lo tanto, la desviación estándar describe la
magnitud de las puntuaciones individuales para una variable.
Fórmula de la curva normal: f(x) = (1/(σ√(2π))) * exp(-(x-μ)²/(2σ²)), donde μ es la media y σ la
desviación estándar.
3. Error normal de la media
El error estándar de la media te indica qué tan precisa es probable que sea tu estimación de la
media.
Cuando tomas una muestra de observaciones de una población y calculas la media muestral, estás
estimando la media paramétrica, o media de todos los individuos de la población. Tu media de
muestra no será exactamente igual a la media paramétrica que intentas estimar, y te gustaría tener
una idea de lo cerca que es probable que esté la media de tu muestra. Si el tamaño de su muestra
es pequeño, su estimación de la media no será tan buena como una estimación basada en un tamaño
de muestra más grande. Aquí hay muestras10 aleatorias de un conjunto de datos simulados con
una media verdadera (paramétrica) de5. Los𝑋 ′ 𝑠 representan las observaciones individuales, los
círculos rojos son las medias de la muestra y la línea azul es la media paramétrica.
Observaciones individuales (X's) y medias (puntos rojos) para muestras aleatorias de una
población con una media paramétrica de 5 (línea horizontal).
Fórmula del error estándar: SE = σ / √n, donde σ es la desviación estándar y n el tamaño de la
muestra.
4. Intervalo de confianza
El intervalo de confianza es un rango de valores dentro del cual se espera que se encuentre el
parámetro poblacional con un nivel de confianza específico (por ejemplo, 95%).
Intervalos de Confianza sobre la Media (μ) cuando se conoce la Desviación Estándar de la
Población (σ)
Un intervalo de confianza toma la forma de: ±margen de error estimado de punto.
La estimación del punto
La estimación puntual proviene de los datos de la muestra.
Para estimar la media poblacional (𝑢), utilice la media muestral (𝑥) como estimación puntual.
El margen de error
Depende del nivel de confianza, el tamaño de la muestra y la desviación estándar de la población.
𝜎
Se calcula como 𝐸 = 𝑍𝑎 × donde𝑧𝑎 está el valor crítico de la tabla normal estándar asociada
2 √𝑛 2
con α (el nivel de significancia).
El valor crítico𝒛𝒂
𝟐
Este es un puntaje Z que borra el nivel de confianza.
Los intervalos de confianza son SIEMPRE de dos caras y los puntajes Z son los límites del área
asociada con el nivel de confianza.
El nivel de significancia (α) se divide en mitades porque estamos mirando el 95% medio del área
bajo la curva.
Acude a tu tabla normal estándar y encuentra el área de 0.025 en el cuerpo de valores.
¿Cuál es el puntaje Z para esa área?
Las puntuaciones Z de ± 1.96 son las puntuaciones Z críticas para un intervalo de confianza del
95%.
Ejemplo
5. Probabilidades
La probabilidad permite estimar la ocurrencia de eventos en un proceso. En control de calidad se
utiliza para anticipar defectos y evaluar riesgos.
𝑛𝑢𝑚𝑒𝑟𝑜 𝑑𝑒 𝑐𝑎𝑠𝑜𝑠 𝑓𝑎𝑏𝑜𝑟𝑎𝑏𝑙𝑒𝑠
Probabilidad = 𝑡𝑜𝑡𝑎𝑙 𝑑𝑒 𝑐𝑎𝑠𝑜𝑠 𝑝𝑜𝑠𝑖𝑏𝑙𝑒𝑠
6. Aplicaciones en Control de Calidad
Las herramientas estadísticas se aplican en Ecuador en industrias como alimentos, textiles y
manufactura. Permiten monitorear procesos, mejorar la calidad, reducir desperdicios y cumplir con
normas internacionales.
Ejemplo: Un fabricante de lácteos puede usar histogramas para controlar el contenido de grasa en
la leche, curvas normales para establecer límites de control, y probabilidades para estimar la
ocurrencia de lotes defectuosos.
Conclusión
El uso de herramientas estadísticas en el control de calidad permite a las empresas ecuatorianas
garantizar productos consistentes y confiables. Histogramas, curvas normales, error de la media,
intervalos de confianza y probabilidades proporcionan una base objetiva para la toma de
decisiones. Estas técnicas contribuyen a optimizar procesos, reducir desperdicios y cumplir
estándares internacionales, asegurando la competitividad de la industria local.