República Bolivariana De Venezuela
Ministerio Del Poder Popular Para La Educación Superior
Universidad Nacional Experimental De Los Llanos Occidentales
“Ezequiel Zamora”
Extensión Esteller
Modulo II
Participantes:
Dayana Galindez C.I 20810628
Juliana Peña C.I 23577157
Prof: Luis Duran
Sub-Proyecto: Estadística
Turno: Nocturno
Promedio: Un promedio es un valor representativo que se calcula a
partir de un conjunto de números. Sirve para obtener una idea
general de cómo se distribuyen esos datos. Imagina que tienes las
notas de un examen de varios estudiantes. El promedio te dirá cuál
es la nota "típica" o "representativa" de ese grupo.
Utilidad
Simplificar datos: Nos ayuda a entender mejor grandes conjuntos de
datos al reducirlos a un solo valor.
Comparar: Permite comparar diferentes grupos de datos. Por ejemplo,
podemos comparar el promedio de ventas de un producto en dos
meses diferentes.
Tomar decisiones: Es una herramienta útil para tomar decisiones
basadas en datos. Por ejemplo, un gerente puede usar el promedio de
ventas para establecer metas de ventas para el próximo mes.
Media Aritmética Simple: La media aritmética simple,
comúnmente conocida como promedio, es un valor numérico que
representa el centro de un conjunto de datos. Se calcula sumando
todos los valores y dividiéndolos entre el número total de valores.
Propiedades:
Punto de equilibrio: La suma de las desviaciones de cada dato
respecto a la media es siempre cero.
Sensibilidad a valores extremos: Valores muy altos o muy bajos
pueden influir significativamente en el valor de la media.
Fácil de calcular: Es un cálculo directo y sencillo.
Media Aritmética en Datos Agrupados y No Agrupados
Datos no agrupados:
Cálculo directo: Se aplica la fórmula general directamente a cada
valor individual del conjunto de datos.
Ejemplo: Si tienes las notas de un examen: 85, 92, 78, 95, sumas
todos los valores y divides entre 4.
Datos agrupados:
Datos organizados en intervalos: Los datos se agrupan en intervalos
de clase, con una frecuencia asociada a cada intervalo.
Cálculo:
Marca de clase: Se determina el punto medio de cada intervalo.
Producto: Se multiplica cada marca de clase por su frecuencia.
Suma: Se suman todos los productos obtenidos en el paso anterior.
División: Se divide la suma total entre el número total de datos (suma
de las frecuencias).
Fórmula para datos agrupados: Media (X̄) = Σ(fᵢ * xᵢ) / Σfᵢ
Interpretación
La media aritmética nos proporciona un valor representativo del
conjunto de datos. Sin embargo, es importante considerar:
No representa la frecuencia: No indica cuántas veces aparece cada
valor.
Sensibilidad a valores extremos: Valores atípicos pueden distorsionar
la media.
No siempre es el valor más representativo: En algunos casos, la
mediana o la moda pueden ser más adecuadas.
La mediana: Es un valor que divide un conjunto de datos ordenados
en dos partes iguales. Es decir, la mitad de los datos son menores
que la mediana y la otra mitad son mayores.
Propiedades de la mediana:
Robustez: La mediana no se ve afectada por valores extremos
(outliers), a diferencia de la media.
Fácil de interpretar: Representa el valor central de los datos.
Útil para datos asimétricos: Es especialmente útil cuando los datos
están sesgados hacia un lado.
Interpretación:
Valor central: La mediana indica el punto medio de los datos.
Distribución: Puede proporcionar información sobre la forma de la
distribución de los datos.
Comparación: Se puede utilizar para comparar diferentes conjuntos
de datos.
Moda: La moda es el valor que aparece con mayor frecuencia en un
conjunto de datos. Es decir, es el valor que más se repite.
Propiedades de la moda:
Sensibilidad a valores repetidos: La moda se ve directamente
afectada por la frecuencia con la que aparece cada valor.
Puede haber múltiples modas: Un conjunto de datos puede tener una
moda (unimodal), dos modas (bimodal) o más de dos modas
(multimodal).
Interpretación:
Valor más común: La moda representa el valor más típico o frecuente
en el conjunto de datos.
Tendencias: Puede indicar tendencias o patrones en los datos.
Moda en datos agrupados y no agrupados:
Datos no agrupados: La moda es simplemente el valor que aparece
con mayor frecuencia.
Datos agrupados: En datos agrupados en intervalos, la moda se
encuentra en el intervalo con mayor frecuencia. La moda de un
intervalo se estima como el punto medio de ese intervalo.
Las medidas de dispersión: son estadísticas que describen la
variabilidad o dispersión de un conjunto de datos. que proporcionan
una comprensión más completa de la distribución de los datos, más
allá de la mera media. La elección de la medida adecuada depende
del tipo de datos y del contexto del análisis
Tipos de Medidas de Dispersión
Rango (Range): Es la diferencia entre el valor máximo y el valor
mínimo de un conjunto de datos.
-Fórmula: Rango = Valor máximo - Valor mínimo.
Propiedades: Es fácil de calcular, pero puede ser muy sensible a
los valores extremos.
Varianza (Variance):Es el promedio de las diferencias al cuadrado con
respecto a la media.
Propiedades: Mide la dispersión, pero está en unidades al cuadrado,
lo que puede dificultar su interpretación.
Interpretación:
Baja desviación típica: Los datos están muy cerca de la media, es
decir, son poco dispersos.
Alta desviación típica: Los datos están muy dispersos alrededor de la
media
Coeficiente de Variación: Es una medida estadística que nos indica
qué tan dispersos están los datos con respecto a la media. A
diferencia de la desviación estándar, que nos da una medida absoluta
de dispersión.
Interpretación del Coeficiente de Variación
Valores bajos: Indican que los datos están poco dispersos y están
muy cerca de la media.
Valores altos: Indican que los datos están muy dispersos y hay una
gran variabilidad alrededor de la media.
Utilidad
Comparación de conjuntos de datos: Permite comparar la dispersión
de diferentes conjuntos de datos, incluso si tienen diferentes
unidades de medida o escalas.
Evaluación de la precisión: Se utiliza para evaluar la precisión de un
instrumento de medición o de un proceso.
Análisis de la homogeneidad de los datos: Ayuda a determinar si los
datos provienen de la misma población.
Tabla de Interpretación (Aproximada)
| Rango del CV | Interpretación |
|---|---|
| 0% - 10% | Muy baja variabilidad |
| 10% - 20% | Baja variabilidad |
| 20% - 30% | Variabilidad moderada |
| > 30% | Alta variabilidad |
Cuantiles: Son valores que dividen un conjunto de datos ordenados
en parte
iguales.
Cuartil: son tres valores que dividen un muestra en 4 partes iguales
cuando los datos están ordenados de menor a mayor,estos tres
valores se denotan en Q1, Q2 y Q3 .
Deciles:Dividen un conjunto de datos en 10 partes [Link]
numeran del D1 al D10.
El primer decil (D1) es igual al primer decil, el segundo decil (D2) es
igual al percentil 20, y así sucesivamente.
Percentiles: Dividen un conjunto de datos en 100 partes [Link]
numeran del P1 al P99.
Desviación cuartílica: Es una medida de dispersión que utiliza los
cuartiles.
Se calcula como la diferencia entre el tercer y primer cuartil y se
divide por dos. Indica la amplitud de la mitad central de los datos
Las medidas de asimetría y curtosis son herramientas estadísticas
fundamentales para describir la forma de una distribución de datos.