0% encontró este documento útil (0 votos)
27 vistas23 páginas

Medidas de Tendencia Central y Dispersión

El documento define conceptos estadísticos como medidas de tendencia central (media, mediana y moda), localización (cuartiles, deciles y percentiles) y dispersión (rango, varianza y desviación estándar). Explica que las medidas de tendencia central resumen un conjunto de valores en un solo valor central, mientras que las medidas de dispersión miden qué tan dispersos están los datos. También describe los procedimientos para calcular estas medidas en datos agrupados y no agrupados y la interpretación de los resultados.
Derechos de autor
© All Rights Reserved
Nos tomamos en serio los derechos de los contenidos. Si sospechas que se trata de tu contenido, reclámalo aquí.
Formatos disponibles
Descarga como PDF, TXT o lee en línea desde Scribd
0% encontró este documento útil (0 votos)
27 vistas23 páginas

Medidas de Tendencia Central y Dispersión

El documento define conceptos estadísticos como medidas de tendencia central (media, mediana y moda), localización (cuartiles, deciles y percentiles) y dispersión (rango, varianza y desviación estándar). Explica que las medidas de tendencia central resumen un conjunto de valores en un solo valor central, mientras que las medidas de dispersión miden qué tan dispersos están los datos. También describe los procedimientos para calcular estas medidas en datos agrupados y no agrupados y la interpretación de los resultados.
Derechos de autor
© All Rights Reserved
Nos tomamos en serio los derechos de los contenidos. Si sospechas que se trata de tu contenido, reclámalo aquí.
Formatos disponibles
Descarga como PDF, TXT o lee en línea desde Scribd

DEFINIR LOS CONCEPTOS DE MEDIDAS DE:

Tendencia Central
• Media: Es una medida de tendencia central. Resulta al efectuar una serie
determinada de operaciones con un conjunto de números y que, en
determinadas condiciones, puede representar por sí solo a todo el conjunto.
Existen distintos tipos de medias, tales como la media geométrica, la media
ponderada y la media armónica aunque en el lenguaje común, tanto en
estadística como en matemáticas la elemental de todas ellas es el término
que se refiere generalmente a la media aritmética.
• Mediana: Es un estadístico de posición central que parte la distribución en
dos, es decir, deja la misma cantidad de valores a un lado que a otro. Para
calcular la mediana es importante que los datos estén ordenados de mayor
a menor, o al contrario de menor a mayor. Esto es, que tengan un orden. La
mediana, junto con la media y la varianza es un estadístico muy ilustrativo de
una distribución. Al contrario que la media que puede estar desplazada hacia
un lado o a otro, según la distribución, la mediana siempre se sitúa en el
centro de esta. Dicho sea, paso, a la forma de la distribución se le conoce
como curtosis. Con la curtosis podemos ver hacia dónde está desplaza la
distribución.
• Moda: La moda es el valor con mayor frecuencia en una de las distribuciones
de datos. Esto va en forma de una columna cuando encontremos dos modas,
es decir, dos datos que tengan la misma frecuencia absoluta máxima. Una
distribución trimodal de los datos es en la que encontramos tres modas. En
el caso de la distribución uniforme discreta, cuando todos los datos tienen la
misma frecuencia, se puede definir las modas como indicado, pero estos
valores no tienen utilidad. Por eso algunos matemáticos califican esta
distribución como «sin moda». El intervalo modal es el de mayor frecuencia
absoluta. Cuando tratamos con datos agrupados antes de definir la moda, se
ha de definir el intervalo modal.

Localización
• Cuartiles: Los cuartiles corresponden a los valores que tiene una variable y
que cumplen con la función de dividir los datos ordenados en cuartos o cuatro
partes con igual valor porcentual. Se distinguen en principio tres cuartiles,
que se denotan regularmente con la letra Q: Q1, Q2 y Q3. Sin embargo, hay
que prestar atención también a las definiciones que la teoría estadística da a
cada uno de estos cuartiles.
• Deciles: Por su parte los Deciles constituyen otro tipo de Medidas de
Posición, conformados por ciertos valores que dividen la sucesión de datos
que han sido ordenadas en diez partes, que son equitativas porcentualmente
hablando. Ellos se denotan de la siguiente forma: D1, D2, D3….D9, aun
cuando se leen “primer decil”, “cuarto decil”, etc. De acuerdo a las fuentes
estadísticas son utilizados sobre todo para calcular el aprovechamiento
académico.

• Percentiles: también conocidos como centiles son otras de las Medidas de


Posición más comunes y empleadas, utilizadas sobre todo para clasificación
de datos correspondientes a las medidas de las personas, como la estatura,
el peso, el diámetro craneal, etc. Igualmente, técnicamente, son definidos
como ciertos valores que dividen en cien partes idénticas porcentualmente
hablando los datos que han sido ordenados de forma sucesiva de menor a
mayor. En cuanto a su denotación, ésta corresponde a la forma P1, P2….
Pn, no obstante son leídas como Percentil 10, Percentil 90, etc.

Dispersión
• Rango: El Rango es el intervalo entre el valor máximo y el valor mínimo; por
ello, comparte unidades con los datos. Permite obtener una idea de
la dispersión de los datos, cuanto mayor es el rango, aún más dispersos
están los datos (sin considerar la afectación de los valores extremos). El
rango, también es llamado amplitud o recorrido de medida.
• Varianza:
• Desviación Estándar: La desviación estándar es la medida de dispersión más
común, que indica qué tan dispersos están los datos con respecto a la media.
Mientras mayor sea la desviación estándar, mayor será la dispersión de los
datos.
El símbolo σ (sigma) se utiliza frecuentemente para representar la desviación
estándar de una población, mientras que s se utiliza para representar la
desviación estándar de una muestra. La variación que es aleatoria o natural
de un proceso se conoce comúnmente como ruido.
La desviación estándar se puede utilizar para establecer un valor de
referencia para estimar la variación general de un proceso.
• Desviación Media: La desviación media es una medida de dispersión, que lo
que hace es expresar que tanto varían en promedio los elementos dentro de
un conjunto de datos con respecto a su media aritmética, la desviación media
no hace diferencia entre números que se desvían hacia arriba de la media o
números que se desvían hacia abajo de la media, lo único que importa es el
valor promedio que se desvían los datos, sin importar si son números mucho
mayores o mucho menores al promedio, por este motivo en la fórmula de la
desviación media hace uso de valores absolutos.
EXPLICAR EL PROCESO DEL CÁLCULO DE LAS MEDIDAS DE TENDENCIA
CENTRAL, LOCALIZACIÓN Y DISPERSIÓN PARA DATOS AGRUPADOS Y NO
AGRUPADOS Y SU INTERPRETACIÓN

Las medidas de tendencia central son medidas estadísticas que pretenden resumir
en un solo valor a un conjunto de valores. Representan un centro en torno al cual
se encuentra ubicado el conjunto de los datos. Las medidas de tendencia central
más utilizadas son: media, mediana y moda. Las medidas de dispersión en cambio
miden el grado de dispersión de los valores de la variable. Dicho en otros términos
las medidas de dispersión pretenden evaluar en qué medida los datos difieren entre
sí. De esta forma, ambos tipos de medidas usadas en conjunto permiten describir
un conjunto de datos entregando información acerca de su posición y su dispersión.
Los procedimientos para obtener las medidas estadísticas difieren levemente
dependiendo de la forma en que se encuentren los datos. Si los datos se encuentran
ordenados en una tabla estadística diremos que se encuentran “agrupados” y si los
datos no están en una tabla hablaremos de datos “no agrupados”.
Según este criterio, haremos primero el estudio de las medidas estadísticas para
datos no agrupados y luego para datos agrupados.
Medidas estadísticas en datos no agrupado
Medidas de tendencia central
Promedio o media
La medida de tendencia central más conocida y utilizada es la media aritmética o
promedio aritmético. Se representa por la letra griega µ cuando se trata del
promedio del universo o población y por Ȳ (léase Y barra) cuando se trata del
promedio de la muestra. Es importante destacar que µ es una cantidad fija mientras
que el promedio de la muestra es variable puesto que diferentes muestras extraídas
de la misma población tienden a tener diferentes medias. La media se expresa en
la misma unidad que los datos originales: centímetros, horas, gramos, etc.
Si una muestra tiene cuatro observaciones: 3, 5, 2 y 2, por definición el estadígrafo
será:

Estos cálculos se pueden simbolizar:


Donde Y1 es el valor de la variable en la primera observación, Y2 es el valor de la
segunda observación y así sucesivamente. En general, con “n” observaciones, Yi
representa el valor de la i-ésima observación. En este caso el promedio está dado
por

De aquí se desprende la fórmula definitiva del promedio:

Desviaciones: Se define como la desviación de un dato a la diferencia entre el valor


del dato y la media:

Ejemplo de desviaciones:

Una propiedad interesante de la media aritmética es que la suma de las


desviaciones es cero.
Mediana
Otra medida de tendencia central es la mediana. La mediana es el valor de la
variable que ocupa la posición central, cuando los datos se disponen en orden de
magnitud. Es decir, el 50% de las observaciones tiene valores iguales o inferiores a
la mediana y el otro 50% tiene valores iguales o superiores a la mediana.
Si el número de observaciones es par, la mediana corresponde al promedio de los
dos valores centrales. Por ejemplo, en la muestra 3, 9, 11, 15, la mediana es
(9+11)/2=10.

Moda
La moda de una distribución se define como el valor de la variable que más se repite.
En un polígono de frecuencia la moda corresponde al valor de la variable que está
bajo el punto más alto del gráfico. Una muestra puede tener más de una moda.
Medidas de dispersión
Las medidas de dispersión entregan información sobre la variación de la variable.
Pretenden resumir en un solo valor la dispersión que tiene un conjunto de datos.
Las medidas de dispersión más utilizadas son: Rango de variación, Varianza,
Desviación estándar, Coeficiente de variación.

Rango de variación
Se define como la diferencia entre el mayor valor de la variable y el menor valor de
la variable.

La mejor medida de dispersión, y la más generalizada es la varianza, o su raíz


cuadrada, la desviación estándar. La varianza se representa con el símbolo σ²
(sigma cuadrada) para el universo o población y con el símbolo s2 (s cuadrado),
cuando se trata de la muestra. La desviación estándar, que es la raíz cuadrada de
la varianza, se representa por σ (sigma) cuando pertenece al universo o población
y por “s”, cuando pertenece a la muestra. σ² y σ son parámetros, constantes para
una población particular; s2 y s son estadígrafos, valores que cambian de muestra
en muestra dentro de una misma población. La varianza se expresa en unidades de
variable al cuadrado y la desviación estándar simplemente en unidades de variable.

Fórmulas
Donde µ es el promedio de la población.
Donde Ȳ es el promedio de la muestra.

Consideremos a modo de ejemplo una muestra de 4 observaciones


Según la fórmula el promedio calculado es 7, veamos ahora el cálculo de las
medidas de dispersión:

s2 = 34 / 3 = 11,33 Varianza de la muestra


La desviación estándar de la muestra (s) será la raíz cuadrada de 11,33 = 3,4.
Interpretación de la varianza (válida también para la desviación estándar): un alto
valor de la varianza indica que los datos están alejados del promedio. Es difícil hacer
una interpretación de la varianza teniendo un solo valor de ella. La situación es más
clara si se comparan las varianzas de dos muestras, por ejemplo, varianza de la
muestra igual 18 y varianza de la muestra b igual 25. En este caso diremos que los
datos de la muestra b tienen mayor dispersión que los datos de la muestra a. esto
significa que en la muestra a los datos están más cerca del promedio y en cambio
en la muestra b los datos están más alejados del promedio.

Coeficiente de variación
Es una medida de la dispersión relativa de los datos. Se define como la desviación
estándar de la muestra expresada como porcentaje de la media muestral.
Es de particular utilidad para comparar la dispersión entre variables con distintas
unidades de medida. Esto porque el coeficiente de variación, a diferencia de la
desviación estándar, es independiente de la unidad de medida de la variable de
estudio.
Medidas de tendencia central y de dispersión en datos agrupados
Se identifica como datos agrupados a los datos dispuestos en una distribución de
frecuencia. En tal caso las fórmulas para el cálculo de promedio, mediana, modo,
varianza y desviación estándar deben incluir una leve modificación. A continuación
se entregan los detalles para cada una de las medidas.
Promedio en datos agrupados La fórmula es la siguiente:

Donde ni representa cada una de las frecuencias correspondientes a los diferentes


valores de Yi.
Consideremos como ejemplo una distribución de frecuencia de madres que asisten
a un programa de lactancia materna, clasificadas según el número de partos. Por
tratarse de una variable en escala discreta, las clases o categorías asumen sólo
ciertos valores: 1, 2, 3, 4, 5.
Entonces las 42 madres han tenido, en promedio, 2,78 partos.
Si la variable de interés es de tipo continuo será necesario determinar, para cada
intervalo, un valor medio que lo represente. Este valor se llama marca de clase (Yc)
y se calcula dividiendo por 2 la suma de los límites reales del intervalo de clase. De
ahí en adelante se procede del mismo modo que en el ejercicio anterior,
reemplazando, en la formula de promedio, Yi por Yc.
Mediana en datos agrupados
Si la variable es de tipo discreto la mediana será el valor de la variable que
corresponda a la frecuencia acumulada que supere inmediatamente a n/2. En los
datos de la tabla 1 Me=3, ya que 42/2 es igual a 21 y la frecuencia acumulada que
supera inmediatamente a 21 es 33, que corresponde a un valor de variable (Yi) igual
a 3.
Si la variable es de tipo continuo es necesario, primero, identificar la frecuencia
acumulada que supere en forma inmediata a n/2, y luego aplicar la siguiente
fórmula:

Donde:

Moda en datos agrupados


Si la variable es de tipo discreto la moda o modo será al valor de la variable (Yi) que
tenga la mayor frecuencia absoluta ( ). En los datos de la tabla 1 el valor de la moda
es 3 ya que este valor de variable corresponde a la mayor frecuencia absoluta =16.
Más adelante se presenta un ejemplo integrado para promedio, mediana, varianza
y desviación estándar en datos agrupados con intervalos.
Varianza en datos agrupados
Para el cálculo de varianza en datos agrupados se utiliza la fórmula
Con los datos del ejemplo y recordando que el promedio (Y) resultó ser 2,78 partos
por madre,

Cuando los datos están agrupados en intervalos de clase, se trabaja con la marca
de clase (Yc), de tal modo que la fórmula queda:

Donde Yc es el punto medio del intervalo y se llama marca de clase del intervalo
Yc= (Límite inferior del intervalo + limite superior del intervalo)/2.
Percentiles
Los percentiles son valores de la variable que dividen la distribución en 100 partes
iguales. De este modo si el percentil 80 (P80) es igual a 35 años de edad, significa
que el 80% de los casos tiene edad igual o inferior a 35 años.
Su procedimiento de cálculo es relativamente simple en datos agrupados sin
intervalos.
Retomemos el ejemplo de la variable número de partos:

El percentil j (Pj) corresponde al valor de la variable (Yi ) cuya frecuencia acumulada


supera inmediatamente al “j” % de los casos (jxn/100).
El percentil 80, en los datos de la tabla, será el valor de la variable cuyo Ni sea
inmediatamente superior a 33,6 ((80x42) /100).
El primer Ni que supera a 33,6 es 39. Por lo tanto al percentil 80 le corresponde el
valor 4. Se dice entonces que el percentil 80 es 4 partos (P80=4). Este resultado
significa que un 80% de las madres estudiadas han tenido 4 partos o menos.
Si los datos están agrupados en una tabla con intervalos, el procedimiento es
levemente más complejo ya que se hace necesaria la aplicación de una fórmula.

Se aplica a los datos del intervalo cuya frecuencia acumulada ( Ni ) sea


inmediatamente superior al “j” % de los casos (jxn/100).
En la siguiente tabla se muestra la distribución de 40 familias según su ingreso
mensual en miles de pesos. Nótese que para calcular el centro de clase se usaron
los límites reales de cada intervalo.
1. El ingreso mensual promedio será:

2. La mediana será:

Esto significa que un 50% de las familias tiene ingreso mensual igual o inferior a
$127.270.
3. El percentil 78 será:

Por lo tanto se puede decir que 78% de las familias tienen ingreso igual o inferior a
$174.660.
4. Los percentiles 10 y 90 serán:

A base de los valores de los percentiles 10 y 90 se pueden hacer tres afirmaciones:


• El 10% de las familias tiene ingreso igual o inferior a $90.000.
• El 90% de las familias tiene ingreso igual o inferior a $210.000.
• El 80% central, de las familias, tiene ingreso entre $90.000 y $210.000

5. - La varianza será:

CUANTILES
Los cuantiles son medidas de posición que se determinan mediante un método que
determina la ubicación de los valores que dividen un conjunto de observaciones en
partes iguales.
Los cuantiles son los valores de la distribución que la dividen en partes iguales, es
decir, en intervalos que comprenden el mismo número de valores. Cuando la
distribución contiene un número alto de intervalos o de marcas y se requiere obtener
un promedio de una parte de ella, se puede dividir la distribución en cuatro, en diez
o en cien partes.
Los más usados son los cuartiles, cuando dividen la distribución en cuatro partes;
los deciles, cuando dividen la distribución en diez partes y los centiles o percentiles,
cuando dividen la distribución en cien partes. Los cuartiles, como los deciles y los
percentiles, son en cierta forma una extensión de la mediana.
Para algunos valores u , se dan nombres particulares a los cuantiles, Q (u): u Q(u)

CUARTILES
Los cuartiles son los tres valores que dividen al conjunto de datos ordenados en
cuatro partes porcentualmente iguales.
Hay tres cuartiles denotados usualmente Q1, Q2, Q3. El segundo cuartil es
precisamente la mediana. El primer cuartil, es el valor en el cual o por debajo del
cual queda un cuarto (25%) de todos los valores de la sucesión (ordenada); el tercer
cuartil, es el valor en el cual o por debajo del cual quedan las tres cuartas partes
(75%) de los datos.

Datos Agrupados

Como los cuartiles adquieren su mayor importancia cuando contamos un número


grande de datos y tenemos en cuenta que en estos casos generalmente los datos
son resumidos en una tabla de frecuencia. La fórmula para el cálculo de los cuartiles
cuando se trata de datos agrupados es la siguiente:
k= 1,2,3
Donde:
Lk = Límite real inferior de la clase del cuartil k
n = Número de datos
Fk = Frecuencia acumulada de la clase que antecede a la clase del cuartil k.
fk = Frecuencia de la clase del cuartil k
c = Longitud del intervalo de la clase del cuartil k
Si se desea calcular cada cuartil individualmente, mediante otra fórmula se tiene lo
siguiente:
• El primer cuartil Q1, es el menor valor que es mayor que una cuarta parte de
los datos; es decir, aquel valor de la variable que supera 25% de las
observaciones y es superado por el 75% de las observaciones.
Fórmula de Q1, para series de Datos agrupados:

Donde:
L1 = limite inferior de la clase que lo contiene
P = valor que representa la posición de la medida
f1 = la frecuencia de la clase que contiene la medida solicitada.
Fa-1 = frecuencia acumulada anterior a la que contiene la medida solicitada.
Ic = intervalo de clase
• El segundo cuartil Q2, (coincide, es idéntico o similar a la mediana, Q2 = Md),
es el menor valor que es mayor que la mitad de los datos, es decir el 50% de
las observaciones son mayores que la mediana y el 50% son menores.
Fórmula de Q2, para series de Datos agrupados:

Donde:
L1 = limite inferior de la clase que lo contiene
P = valor que representa la posición de la medida
f1 = la frecuencia de la clase que contiene la medida solicitada.
Fa-1 = frecuencia acumulada anterior a la que contiene la medida solicitada.
Ic = intervalo de clase
• El tercer cuartil Q3, es el menor valor que es mayor que tres cuartas partes
de los datos, es decir aquel valor de la variable que supera al 75% y es
superado por el 25% de las observaciones.

Fórmula de Q3, para series de Datos agrupados:

Donde:
L1 = limite inferior de la clase que lo contiene
P = valor que representa la posición de la medida
f1 = la frecuencia de la clase que contiene la medida solicitada.
Fa-1 = frecuencia acumulada anterior a la que contiene la medida solicitada.
Ic = intervalo de clase.
Otra manera de verlo es partir de que todas las medidas no son sino casos
particulares del percentil, ya que el primer cuartil es el 25% percentil y el tercer cuartil
75% percentil.
Para Datos No Agrupados
Si se tienen una serie de valores X1, X2, X3 ... Xn, se localiza mediante las
siguientes fórmulas:
- El primer cuartil:
Cuando n es par:

Cuando n es impar:
• Para el tercer cuartil
Cuando n es par:

Cuando n es impar:

DECILES
Los deciles son ciertos números que dividen la sucesión de datos ordenados en
diez partes porcentualmente iguales. Son los nueve valores que dividen al conjunto
de datos ordenados en diez partes iguales, son también un caso particular de los
percentiles. Los deciles se denotan D1, D2,..., D9, que se leen primer decil, segundo
decil, etc.
Los deciles, al igual que los cuartiles, son ampliamente utilizados para fijar el
aprovechamiento académico.
Datos Agrupados
Para datos agrupados los deciles se calculan mediante la fórmula.

k= 1,2,3,... 9
Donde:
Lk = Límite real inferior de la clase del decil
k n = Número de datos
Fk = Frecuencia acumulada de la clase que antecede a la clase del decil k.
fk = Frecuencia de la clase del decil k
c = Longitud del intervalo de la clase del decil k
Otra fórmula para calcular los deciles:
• El cuarto decil, es aquel valor de la variable que supera al 40%, de las
observaciones y es superado por el 60% de las observaciones.

• El quinto decil corresponde a la mediana.

• El noveno decil supera al 90% y es superado por el 10% restante.

Donde (para todos):


L1 = limite inferior de la clase que lo contiene
P = valor que representa la posición de la medida
f1 = la frecuencia de la clase que contiene la medida solicitada.
Fa-1 = frecuencia acumulada anterior a la que contiene la medida solicitada.
Ic = intervalo de clase.

Fórmulas Datos No Agrupados


Si se tienen una serie de valores X1, X2, X3 ... Xn, se localiza mediante las
siguientes fórmulas:
CENTILES O PERCENTILES
Los percentiles son, tal vez, las medidas más utilizadas para propósitos de ubicación
o clasificación de las personas cuando atienden características tales como peso,
estatura, etc.
Los percentiles son ciertos números que dividen la sucesión de datos ordenados en
cien partes porcentualmente iguales. Estos son los 99 valores que dividen en cien
partes iguales el conjunto de datos ordenados. Los percentiles (P1, P2,... P99),
leídos primer percentil,..., percentil 99.
Datos Agrupados
Cuando los datos están agrupados en una tabla de frecuencias, se calculan
mediante la fórmula:

k= 1,2,3,... 99
Donde:
Lk = Límite real inferior de la clase del decil k
n = Número de datos
Fk = Frecuencia acumulada de la clase que antecede a la clase del decil k.
fk = Frecuencia de la clase del decil k
c = Longitud del intervalo de la clase del decil k
Otra forma para calcular los percentiles es:
• Primer percentil, que supera al uno por ciento de los valores y es superado
por el noventa y nueve por ciento restante.
• El 60 percentil, es aquel valor de la variable que supera al 60% de las
observaciones y es superado por el 40% de las observaciones.

• El percentil 99 supera 99% de los datos y es superado a su vez por el 1%


restante.

Fórmulas Datos No Agrupados


Si se tienen una serie de valores X1, X2, X3 ... Xn, se localiza mediante las
siguientes fórmulas:

Para los percentiles, cuando n es par:

Cuando n es impar:
Siendo A, el número del percentil.
Es fácil ver que el primer cuartil coincide con el percentil 25; el segundo cuartil con
el percentil 50 y el tercer cuartil con el percentil 75.
3. EJEMPLO
Determinación del primer cuartil, el séptimo decil y el 30 percentil, de la siguiente
tabla:
Como son datos agrupados, se utiliza la fórmula

Siendo,

La posición del primer cuartil.

La posición del 7 decil.

La posición del percentil 30.


Entonces,

El primer cuartil:
115.5 – 85 = 30.75
Li = 300, Ic = 100 , fi = 90

El 7 decil:

Posición:
324.1 – 295 = 29.1
Li = 500, fi = 70

El percentil 30
Posición:

138.9 – 85 = 53.9
fi = 90

Estos resultados nos indican que el 25% de los empleados ganan salarios por
debajo de $ 334; que bajo 541.57 gana el 57%de los empleados y sobre $359.88,
gana el 70% de los empleados

EN UN DOCUMENTO DE WORD, DEFINIR TODOS LOS CONCEPTOS


ANTERIORES, ESCRIBIR, LA FORMULA CORRESPONDIENTE Y UN EJEMPLO
DE CÓMO SE CALCULAN LAS MEDIDAS DE TENDENCIA CENTRAL Y
DISPERSIÓN.
ESTADÍSTICA EN EXCEL – FUNCIONES DE DISPERSIÓN
Las medidas de dispersión nos permiten ver la variabilidad de una distribución
basadas en la distancia de sus datos respecto al promedio o media. Cuanto mayor
sean los valores de resultado, mayor será la variabilidad, mientras que a menor
valor más homogénea será la distribución a la media. De esta forma podemos
comprobar si todos los datos son similares o existe mucha variación entre ellos. En
excel podemos hacer uso de estas mediciones mediante múltiples fórmulas. En este
artículo examinaremos las más populares basadas en el cálculo de la DESVIACIÓN
ESTÁNDAR o TÍPICA, VARIANZA, RECORRIDO O AMPLITUD TOTAL y
COEFICIENTE DE VARIACIÓN, y utilizaremos las fórmulas de versiones
posteriores a Excel 2007.
Es importante resaltar que, para el cálculo de las mediciones de dispersión, se debe
analizar previamente si la totalidad de los datos corresponden a la población total
de datos o bien a una muestra que es representativa del total. En el video tutorial
ejemplificamos un caso de población total mediante la comparación de la totalidad
de notas para una materia de dos alumnos distintos.
En este artículo se menciona al PROMEDIO o MEDIA ARITMÉTICA que
corresponde a una de las mediciones de tendencia central, te recomiendo ver
también el artículo de funciones en Excel para estas mediciones aquí: FUNCIONES
DE TENDENCIA CENTRAL
DESVIACIÓN ESTÁNDAR O TÍPICA
La desviación estándar o típica es un indicador de que tan dispersos están los datos
respecto al promedio. A mayor desviación estándar mayor dispersión de datos, y a
menor desviación mayor homogeneidad de datos sobre la media.
En Excel podemos hacer uso de las funciones DESVEST.P y DESVEST.M para
obtener un valor indicativo del grado de variabilidad de los conjuntos de datos,
siendo DESVEST.P la función para el cálculo en poblaciones totales y DESVEST.M
para el cálculo en muestras representativas.
VARIANZA
La varianza es el promedio del cuadrado de las desviaciones respecto al promedio.
En otras palabras es la desviación estándar elevada al cuadrado, y se utiliza
principalmente para cálculos avanzados donde la desviación estándar no es precisa
y también para evitar números negativos que reduzcan la varianza, dado que al
elevar cada diferencia al cuadrado hace que todos los números sean positivos.
En Excel podemos hacer uso de las funciones VAR.P y VAR.M para obtener un
valor de varianza, siendo VAR.P la función para el cálculo en poblaciones totales y
VAR.M para el cálculo en muestras representativas.
RECORRIDO O AMPLITUD TOTAL
El recorrido o amplitud total es la diferencia aritmética entre el máximo y mínimo de
una serie de valores. En otras palabras, permite comparar dos series de datos para
evaluar cuál de las dos tiene mayor diferencia numérica entre su mayor valor y su
menor valor.
En Excel no existe una función específica para obtener el recorrido o amplitud total,
sin embargo, se utiliza la conjunción de las funciones MAX y MIN aplicada al rango
de valores para su cálculo.
La fórmula que utilizaremos es la siguiente:

=MAX(A2:A11)-MIN(A2:A11)

Donde A2:A11 corresponde al rango total de valores, en el video tutorial representa


la población total de notas del alumno A.
COEFICIENTE DE VARIACIÓN
El coeficiente de variación (CV) mide la dispersión relativa de un conjunto de datos
expresada en términos porcentuales. Permite comprara conjuntos de datos entre sí
para ver niveles de variabilidad en sus datos.
En Excel. y al igual que con el recorrido o amplitud total, no existe una función
específica para su cálculo. Para obtener dicho coeficiente deberemos dividir la
desviación estándar sobre el promedio, y al resultado lo multiplicaremos por 100%.
La fórmula que utilizaremos es la siguiente:

=(E5/E2)*100%
Donde E5 corresponde al valor de la desviación estándar, y E2 corresponde al valor
del promedio o media de la serie de valores

También podría gustarte