MEDIDAS DE TENDENCIA CENTRAL O POSICIÓN
Media: Esta es la medida que te parecerá más familiar pues seguramente la has empleado
en diversas ocasiones y es que es la que conocemos comúnmente como “promedio”, es muy
sencilla de obtener puesto que lo único que debes hacer es sumar todos los valores y
dividirlos por el total de datos, es decir:
*Obtener la media del siguiente grupo:
4+5+3+7+8+4+5+6+8+2+1= 53 ahora lo debemos de dividir por el número de valores
que sumamos, o sea 11 de ese modo obtenemos que 53/11=4.8
Ventajas de la media:
Es una representación rápida y sencilla de un grupo de datos lo cual podría llegar a
darnos una aproximación del mismo.
Ejemplo: En una empresa se obtiene una media semestral para ver la producción de las
ocho plantas que tienen. Dicho valor puede dar una idea a supervisores y directivos del
rendimiento de cada planta.
¿Qué ganaríamos con ello? Podríamos ver qué plantas estuvieron por arriba y por debajo
de la media y ello podría llevar a los supervisores y directivos a cuestionarse sobre las
causas de dicha irregularidad, observando cuáles son las cualidades que hacen que una
planta produzca más y otras menos para después emprender acciones al respecto.
Desventajas de la media:
Al ser sólo una medida dentro de un grupo de datos no nos habla de la dispersión, es decir
de la distancia que hay entre valores ni qué valores se sitúan más cercanos y cuáles más
lejanos y por lo tanto podría llegar a darnos una impresión de la cual no nos podemos
confiar.
Ejemplo: Tomando en cuenta que de las 8 plantas 4 se encuentran dentro de la media, dos
por arriba y dos debajo, podemos correr el riesgo de tomar medidas poco favorables si
desconocemos la dispersión de los datos. Imaginemos que en las dos plantas en las que se
produce menos cuentan con una alta rotación, lo que no les permite tener a los
trabajadores necesarios para sacar la producción requerida y dicha baja constante de
empleados hace que además estén en constante capacitación por lo que aun cuando
contraten trabajadores estos no pueden alcanzar de inmediato su meta asignada, además
se ven afectados por la zona en la que se encuentran ya que el acceso por transporte
público es escaso.
Esta desventaja se hace más presente conforme tenemos mayor cantidad de datos.
Mediana: Corresponde a un valor que divide el grupo de datos que tenemos exactamente a
la mitad así, tenemos al mismo número de datos por arriba que debajo.
Obtener la mediana del siguiente grupo de datos: 12, 23, 7, 3, 31, 35, 38, 42, 15.
Lo primero que se debe hacer es ordenar este conjunto de datos, da igual de qué forma lo
haces si de menor a mayor o de mayor a menor, pues recuerda que lo que nos interesa es el
valor que está justo a la mitad.
3, 7, 12, 15, 23, 31, 35, 38, 42
El valor que tenemos en medio es el 23, esa es la mediana.
Ahora supongamos que el número total de datos que debemos ordenar sea par y por lo
tanto encontremos dos valores en la parte central, bueno la solución es muy sencilla, pues
basta con sumar los dos valores y dividirlos entre dos.
3, 7, 12, 15, 23, 31, 35, 38, 42, 45
Tenemos 23+31=54 54/2=27, esa sería la mediana.
Ventaja: Podemos obtener un valor que nos acerca de forma rápida al grupo de datos que
tenemos y como es un valor exactamente a la mitad no se ve afectado por la falta de
homogeneidad en los datos, es decir que si quisiéramos observar un grupo de datos que
representan las calificaciones de un examen aplicado a 15 estudiantes y la mediana se
sitúa en 7.5, sabemos que hay 7 valores debajo de éste y 7 por arriba debido a que como se
explicaba antes es el dato numérico que se encuentra exactamente a la mitad, de tal modo
que no importa si la dispersión (diferencia de posicionamiento entre los valores) es mucha
o poca, pues bien podríamos tener que los 7 que se encuentran por debajo van del 0 hasta
el 7, o que todos fueron arriba de 6 pero por debajo de 7.5, y la misma variabilidad se
podría suponer para los que se encuentren por arriba, como sea sigue siendo el valor que
divide a la muestra por la mitad.
Desventaja: No podemos hacer mayores cálculos con ella.
Moda: Es el valor o en ocasiones valores, que más se repiten dentro de nuestro grupo de
datos. Si es un solo valor se le puede llegar a llamar unimodal o simplemente moda, si
tiene dos modas se llama bimodal., para tres o más se determina que es multimodal.
Este término lo puedes emplear tanto para datos cuantitativos como cualitativos.
Obtener la moda del siguiente grupo de datos:
4,7,8,5,2,1,4,5,6,3,4,7,4,1,2,4,9. Moda=4.
Ventajas: se obtiene fácilmente, nos da una idea clara sobre una característica de la
población.
Por ejemplo si tuviéramos un restaurante y quisiéramos saber cuál es el platillo que más se
vende, estaríamos obteniendo la moda y con ello podríamos tomar una decisión como
invertir un poco más en ese producto o ponerlo como uno de los primeros del menú.
Evidentemente como con las otras medidas debemos tener cuidado en la interpretación ya
que solo tomará mayor claridad en la interpretación de resultados en conjunto con otros
índices estadísticos ya que-siguiendo el ejemplo del restaurante- el que sea el platillo más
popular no necesariamente es lo mejor para el lugar puesto que hay otros platillos que
dejan mayor margen de ganancia.
MEDIDAS DE DISPERSIÓN
La gran diferencia entre las medidas de dispersión y las de tendencia central es que -como
el nombre lo indica en ambos casos- la media, mediana y moda van a darnos un dato rápido
y representativo sobre lo más frecuente, el valor medio y el promedio de la muestra, pero
no nos hablan de la variabilidad que existe entre un dato y otro, qué tan lejanos o cercanos
se encuentran y cómo se distribuyen. Esto lo podemos conocer gracias a las medidas de
dispersión o también conocidas como de variabilidad, estas son con las que se trabaja
frecuentemente ya que si no existiera dicha variación entre datos no tendría sentido la
estadística descriptiva además son las que nos indicarán qué tan representativas pueden ser
las medidas de tendencia central.
Si las puntuaciones se encuentran alejadas de la media tenemos una gran variabilidad, en
cambio si se encuentran cercanas a la media tenemos una distribución más homogénea.
Las medidas de dispersión más empleadas son:
Rango: esta es una medida muy fácil de obtener y es la diferencia entre el valor más grande
y el menor.
De este modo tenemos que:
Rango= Valor máximo-valor mínimo
O también la puedes encontrar en algunas fuentes como X M – Xm que es Puntuación
mayor menos puntuación menor.
Obtener el rango del siguiente grupo de datos:
12 13 14 15 16 17 18 19 20 21 22 23 24 25
25-12= 13
Rango=13
La utilidad de esta medida es que nos podemos dar cuenta de qué tan dispersos están los
datos en la distribución.
Desviación estándar: Es la desviación promedio de las puntuaciones respecto de la media
aritmética, es decir de la media que ya sacamos antes, la perteneciente a las medidas de
tendencia central. Con esta medida nos damos cuenta cómo es que los datos se encuentran
alejados de la media de tal modo que entre más grande sea la dispersión respecto a la media,
mayor es la desviación estándar.
La puedes encontrar representada por alguna de las siguientes fórmulas:
Explicación de la fórmula: a cada valor de la puntuación se le resta la media aritmética y su
resultado es elevado al cuadrado. Se hace lo mismo con cada una de las puntuaciones y se
suman para después dividirla entre el número total de datos que tengamos y a ese resultado
le sacamos la raíz cuadrada. Para comprenderle mejor hagamos un ejercicio.
Obtener la desviación estándar de la siguiente distribución:
734851338
1.- Lo primero que debemos hacer es ordenar los datos:
133345788
2.- Calcular la media:
= 1+3+3+3+4+5+7+8+8/ 9= 4.6
3.- Vamos a determinar la desviación (diferencia) que existe entre cada puntuación de
nuestra distribución (conjunto de datos) y la media aritmética que acabamos de obtener.
X
X- X
1 1-4.6= -3.6
3 3-4.6= -1.6
3 3-4.6= -1.6
3 3-4.6= -1.6
4 4-4.6= -.6
5 5-4.6= .4
7 7-4.6= 2.4
8 8-4.6= 3.4
8 8-4.6= 3.4
4.- Ahora elevaremos al cuadrado cada una de las desviaciones y al final las sumamos.
X
X- X
1 -3.62 = 12.96
3 -1.62=2.56
3 -1.62=2.56
3 -1.62=2.56
4 -.62= .36
5 .42 =.16
7 2.42 = 5.76
8 3.42 = 11.56
8 3.42 =11.56
42 50.04
5.- Ahora podemos aplicar la fórmula
σ =√ 50.04∕9
σ =2.35
Varianza: Obtener este valor es muy simple ya que sólo debes de elevar al cuadrado la
desviación estándar y la puedes encontrar representada comúnmente así: s2. Su importancia
radica en que muchos métodos estadísticos la emplean y muchas pruebas cuantitativas se
fundamentan en ella.
Así, siguiendo con el ejemplo anterior si quisiéramos obtener la Varianza sólo debemos
elevar al cuadrado el resultado de la desviación estándar.
s= 2.352 s=5.52
Ahora podrías preguntarte cómo es que se interpretan todas estas medidas en una
investigación, cómo puedes leer dichos datos e interpretar un resultado. Para ello revisemos
el siguiente ejemplo tomado del libro Metodología de la investigación (Hernández,
Fernández y Baptista, año).
Se tomarán en cuenta todas las medidas, y para interpretarlas lo primero que se hace es
tomar en cuenta el rango potencial de la escala. Supongamos que aplicamos una escala de
actitudes del tipo Likert para medir la “actitud hacia el presidente” de un nación (digamos
que la escala tuviera 18 ítems y se promediaran sus resultados). El rango potencial es de 1 a
5:
1 2 3 4 5
(Actitud totalmente
(Actitud totalmente
desfavorable)
favorable)
Si obtuviéramos los siguientes resultados:
Variable: actitud hacia el presidente.
Moda: 4.0
Mediana: 3.9
Media (X): 4.2
Desviación estándar: 0.7
Puntuación más alta observada (máximo): 5.0
Puntuación más baja observada (mínimo): 2.0
Rango: 3
Podríamos hacer la siguiente interpretación descriptiva: la actitud hacia el presidente es
favorable. La categoría que más se repitió fue 4 (favorable). El 50% de los siujetos está por
encima del valor 3.9 y el restante 50% se sitúa por debajo de éste valor. En promedio, los
sujetos se ubican en 4.2 (favorable). Asimismo, se desvían de 4.2, en promedio, 0.7
unidades de la escala. Ninguna persona calificó al presidente de una manera desfavorable
(no hay “1”). Las puntuaciones tienden a ubicarse en valores medios o elevados.
En cambio si los resultados fueran:
Variable: actitud hacia el presidente.
Moda: 1
Mediana: 1.5
Media (X): 1.3
Desviación estándar: 0.4
Varianza: 0.16
Puntuación más alta observada (máximo): 3.0
Puntuación más baja observada (mínimo): 1.0
Rango: 2.0
La interpretación es que la actitud hacia el presidente es muy desfavorable.
En la siguiente figura puedes ver la comparación de resultados:
La variabilidad también es menor en el caso de la actitud muy desfavorable (los datos se
encuentran menos dispersos).
Ahora pasemos a otra parte de la estadística descriptiva, la asimetría y curtosis, pero antes
de explicarlas vamos a detenernos un poco sólo para que conozcas el polígono de
frecuencias o también llamada curva normal o campana de Gauss.
Ella nos permite ver cómo es que se distribuyen los datos, la parte de en medio en donde se
encuentra la línea divisoria corresponde a la media. En ésta imagen podemos decir
claramente que hay una simetría, pues parece que existe la misma cantidad de puntuaciones
por debajo y por arriba de la media, pero ello no siempre es así.
Así que en resumen, estas medidas de dispersión nos van a decir qué tanto los valores se alejan de la
media en una distribución normal y también nos brindan información sobre la diferencia en el
comportamiento de una muestra o población.