ESTADISTICA
c. 24
CLASE N°3
Cuando se tiene un grupo de observaciones, se desea describirlo a través de un
sólo número. Para tal fin, no se usa el valor más elevado ni el valor más pequeño
como único representante, ya que sólo representan los extremos. Una de las
propiedades más sobresalientes de la distribución de datos es su tendencia a
acumularse hacia el centro de la misma. Esta característica se denomina tendencia
central.
Las medidas de tendencia central más usuales son: la media aritmética, la mediana
y la moda.
MEDIA ARITMÉTICA
La media aritmética de n valores, es igual a la suma de todos ellos dividida entre n.
Se denota por x.
Esto es:
Ejemplo.
Con los datos: 10, 8, 6, 15, 10, 5, hallar la media aritmética.
Cuando los datos tienen más de una frecuencia, para obtener la media aritmética
se agrega otra columna a la tabla estadística con el producto de las
observaciones y sus frecuencias. Es decir, si se cuenta con una distribución de
datos entonces se aplica la fórmula:
fi = es la frecuencia absoluta simple.
Xi = es la clase de variable.
n = es la cantidad de observaciones.
Ejemplo.
Mediante la siguiente distribución de frecuencias que muestra las estaturas en metros de los
alumnos de un grupo de la Facultad de Contaduría y Administración, hallar la media
aritmética.
MEDIANA
La mediana es el punto central de una serie de datos ordenados de forma ascendente o
descendente. De acuerdo al número de casos o datos, hay dos formas para calcular la
mediana: para número impar y para número par:
Número impar de datos ordenados de menor a mayor o de mayor a menor: la mediana es el
valor que queda justo al centro.
Ejemplo.
Obtener la mediana de los siguientes datos: 4, 7, 1, 9, 2, 5, 6.
Ordenando de forma ascendente: 1, 2, 4, 5, 6, 7, 9.
El valor que queda al centro es el 5, porque hay tres datos antes y tres datos después de él,
entonces la mediana es 5.
Número de datos par: en este caso se busca la media aritmética entre los dos valores
centrales.
Ejemplo.
Obtener la mediana de los siguientes datos: -3, 5, 18, 4, 11, -6, 9, 10, -1, 2.
Ordenando de forma ascendente: -6, -3, -1, 2, 4, 5,9, 10, 11, 18.
Los valores centrales son 4 y 5. Su media aritmética es:
MODA
La moda de un conjunto de datos numéricos es el valor que más se repite, es decir, el que
tiene el mayor número de frecuencias absolutas. La moda puede ser no única e inclusive no
existir.
Ejemplo 1.
Obtener la moda de los siguientes datos: -3, 3, -2, 0, 3, -1, -2, 4, 5, -2, 0, 1.
Ordenando de forma ascendente: -3, -2, -2, -2, -1, 0, 0, 1, 3, 3, 4, 5.
El valor que más se repite es el -2, por lo tanto ese valor es su moda.
Ejemplo 2.
Obtener la moda de los siguientes datos: 6, 2, -1, -5, 3, -3, -2, 5, 0, -4, 4, 1.
Ordenando de forma ascendente: -5, -4, -3, -2, -1, 0, 1, 2, 3, 4, 5, 6.
Ningún valor se repite, es decir, su moda no existe.
MEDIDAS DE DISPERCIÓN
La dispersión mide que tan alejados están un conjunto de valores respecto a su media
aritmética. Así, cuanto menos disperso sea el conjunto, más cerca del valor medio se
encontrarán sus valores. Este aspecto es de vital importancia para el estudio de
investigaciones, dado que es una medida de variabilidad de los datos.
Se llaman medidas de dispersión aquellas que permiten retratar la distancia de los valores
de la variable a un cierto valor central, o que permiten identificar la concentración de los
datos en un cierto sector del recorrido de la variable.
El rango de una distribución es la diferencia entre el valor máximo (M) y el valor
mínimo (m) de la variable estadística.
Ejemplo.
Si se conoce que el valor promedio de días de espera para obtener una respuesta de
una cotización, es de 5 días en el almacén A, y de 7 días en el alamacén B, con esta
única información no es posible hacer una elección adecuada. Sin embargo, si se
sabe que en el almacén A, el número mínimo de días de espera es de 3 y el máximo
de 15, mientras que en el almacén B, los valores son 3 y 8 días respectivamente, se
podrá tomar una decisión más adecuada para acudir a obtener la cotización, gracias a
esta información adicional.
CUANTILES
Los cuantiles son los valores de la distribución que la dividen en partes iguales, es decir, en
intervalos que comprenden el mismo número de valores. Cuando la distribución contiene un
número alto de intervalos o de marcas y se requiere obtener un promedio de una parte de ella.
Generalmente, se divide la distribución en cuatro, en diez o en cien partes.
Los cuantiles más usados son los percentiles, cuando dividen la distribución en cien partes,
los deciles, cuando dividen la distribución en diez partes y los cuartiles, cuando dividen la
distribución en cuatro partes.
VARIANZA
La varianza mide la mayor o menor dispersión de los valores de la variable respecto a
la media aritmética. Cuanto mayor sea la varianza mayor dispersión existirá y por
tanto, menor representatividad tendrá la media aritmética. La varianza se expresa en
las mismas unidades que la variable analizada, pero elevadas al cuadrado.
DESVIACIÓN ESTÁNDAR
La desviación estándar es una medida estadística de la dispersión de un grupo o
población. Una gran desviación estándar indica que la población esta muy dispersa
respecto de la media. Una desviación estándar pequeña indica que la población está
muy compacta alrededor de la media.
ERROR ESTÁNDAR
Es la corrección de la desviación estándar por el número de datos, a mayor
numero de datos más representativa es la muestras y el error de la estimación
disminuye.
ξ
Media, Mediana y Moda para Datos
Agrupados
¡Gracias!