Asignatura:
Métodos Estadísticos
Tema : Medidas de Tendencia, Dispersión
Organización para la Cooperación y el Desarrollo Económicos
ESTADISTICA
El método que permite organizar, sintetizar, presentar, analizar, cuantificar e interpretar
una gran cantidad de datos, de tal forma que se puedan tomar decisiones, realizar
generalizaciones y obtener conclusiones válidas (dar información) sobre los fenómenos o
líneas de investigación en estudio.
Estadística descriptiva.
Conjunto de métodos que se utilizan para organizar, clasificar y presentar la información contenida en los datos
por medio de gráficas o tablas, así como el conjunto de medidas para indicar su dispersión y su localización. Esta
rama de la estadística presenta una descripción de la información contenida en los datos.
Ejemplo: El jefe de personal de una empresa quiere conocer las aptitudes promedio de diez empleados. Para ello
debe aplicar una prueba de aptitudes. El estadístico a utilizar es: la media aritmética, y el resultado obtenido es
de 92 puntos, el cual sólo será válido para los diez cuestionarios aplicados.
Estadística inferencial.
Conjunto de métodos que se utilizan para deducir alguna característica de la población con únicamente
información parcial. Con esta rama de la estadística se infiere cómo es la población de donde se obtuvo un
subconjunto de datos.
El ingeniero de control de calidad de una fábrica de hornos de microondas, al recibir un nuevo embarque de
bases de vidrio, se pregunta si lo acepta o no, ya que el encar - gado del almacén le informa que en una caja de
50 bases, cuatro están defectuosas.
¿Qué es un Dato?
Un dato es un elemento de todo un conjunto que posee una o más características o valores con los cuales
podemos distinguirlo de los demás.
Los datos pueden ser producto de un conteo o una medición, por ejemplo: número de casas en un municipio,
número de alumnos reprobados en una asignatura, el número de Pymes en un país, el peso de una computadora
portátil, la temperatura que se registra en un día, el sexo y nombre de una persona, etcétera.
Los datos son cuantitativos o cualitativos.
Los datos cuantitativos, aquellos que se pueden contar o medir mediante una expresión numérica
Ejemplos: Precios de determinados bienes o servicios, ingreso per cápita en soles, …
Los datos cualitativos, aquellos cuyos valores no se pueden cuantificar, sino únicamente expresan un nivel de
calidad o señalan un atributo por el que se puede identificar a cada elemento , es decir, en aquellos datos en los
que a cada uno se le tiene que asignar etiquetas o valores para identificarlos entre sí.
Ejemplos: Tipo de universidad de la que un profesionista fue egresado (pública o privada), género,
nacionalidad, color de ojos, nivel social, ….
VARIABLES
Los caracteres o características son los rasgos comunes a todos los elementos de la población en los
que se centra el interés del investigador.
Caracteres cualitativos :
Estos rasgos no se pueden medir, sólo es posible observar de qué manera se presentan en los elementos de la población.
Reciben también el nombre de atributos .
Las distintas formas que tiene el atributo de expresarse en los elementos de la población reciben el nombre de
modalidades y se describen mediante palabras.
Éstas son categorías no numéricas, que cumplen las propiedades de ser exhaustivas (todos los elementos pueden ser
catalogados en alguna de ellas) y mutuamente excluyentes (un elemento de la población no puede ser catalogado en dos
modalidades distintas).
Ejemplos : estado civil (casado, soltero, separado, divorciado, viudo), sexo (hombre, mujer), profesiones (ingeniero,
arquitecto, electricista…), nivel de estudios alcanzado (sin estudios, estudios primarios, medios o superiores).
Los atributos a veces vienen expresados numéricamente mediante una escala nominal u ordinal:
Escala nominal : con los valores numéricos de este tipo de escala pueden establecerse claramente equivalencias o
diferencias, pero no se puede afirmar que uno sea superior a otro (no se pueden ordenar).
Ejemplo : sexo (hombre=0, mujer=1), religión (católica=1, protestante=2, musulmana=3, etc.), nivel educativo (sin
estudios=1, estudios primarios=2, secundarios=3, universitarios=4).
Escala ordinal : Se tiene una medida ordinal cuando, además de incluir las propiedades de la medida nominal (equivalencia
o diferencia), se incluye la propiedad de que las categorías pueden ser ordenadas en el sentido de menor que, mayor que
o igual que. No tienen sentido operaciones aritméticas como la sustracción o la adición.
b) Ejemplos : grado de satisfacción con el trabajo medida en una escala de 1 a 4 (1=muy insatisfecho, 2=insatisfecho,
3=satisfecho, 4=muy satisfecho), calidad de un determinado servicio (1=muy mala, 2=mala, 3=buena, 4=muy buena).
Caracteres cuantitativos :
Por su propia naturaleza, se expresan mediante números. También reciben el nombre de variables .
Ejemplos: peso, altura, edad, renta, número de hijos, etc. De su observación en los elementos de la población se
obtienen valores , que reflejan la intensidad con la que el carácter está presente en cada elemento.
La medición de esa intensidad puede llevarse a cabo mediante la utilización de dos tipos de escala:
Escala de intervalo : Los valores representan magnitudes y la distancia entre los números de su escala es igual. Por lo
tanto pueden establecerse intervalos iguales entre sus valores. Las operaciones posibles son las de las escalas
referidas con anterioridad (equivalencia y ordenación), más la suma y la resta. Esta escala carece de cero absoluto,
por lo que las operaciones como la multiplicación y la división no son realizables.
Ejemplos : la fecha, la temperatura, las puntuaciones de una prueba, las puntuaciones de coeficiente intelectual.
Escala de razón : Posee las mismas características que la escala de intervalo con la diferencia que cuentan con un
cero absoluto; es decir, el valor cero representa la ausencia total de medida, por lo que se puede realizar cualquier
operación aritmética y lógica. Este tipo de escala permite el nivel más alto de medición.
Ejemplos: la altura, el peso, la longitud, el salario.
POBLACIÓN
μ
INFERENCIA ESTADISTICA
x MUESTRA
Regla de Sturges
Existe un método formal para determinar el número de clases que
deben de existir para clasificar un conjunto de datos, este método es
la regla de Sturges:
C = 3.3 (log n) +1
Donde:
C = número de clases
n= tamaño del conjunto de datos que se examinan.
X: Niveles de colesterol en sangre medidos en miligramos de 135 personas:
145 175 192 204 209 217 225 238 253 267 292 145 175 194 204 211 217 227 239 253 267 294 146 175 194 204 211 218
277 241 253 268 296 158 175 195 205 211 218 227 242 254 268 300 158 175 196 205 212 218 227 242 254 268 345 163
178 196 205 212 218 228 243 254 268 168 180 198 205 212 221 230 243 256 273 168 180 198 205 214 221 235 245 256
274 168 180 198 206 214 221 235 245 257 278 168 181 198 206 214 221 235 245 257 283 172 181 201 206 216 223 236
247 261 284 174 187 201 207 217 224 237 248 262 285 175 187 201 208 217 225 238 252 266 289
Medida de tendencia central: La Media ó Promedio
MEDIA ( X ) Se define como la suma de todas las
observaciones dividida por el número total de las
mismas.
Datos No Datos
Agrupados Agrupados
n k
x i x i fi
x i 1
x i 1
n n
Cuando la variable esta
agrupada en intervalos, la
media aritmética se calcula
utilizando las marcas de clase.
MEDIA ARITMÉTICA (DATOS SIN AGRUPAR)
La media aritmética de un conjunto de datos es el cociente entre la suma
de todos los datos y el número de estos.
Ejemplo: las notas de Juan el año pasado fueron:
15, 16, 14, 17, 18, 14, 16 Hay 7 datos
La nota media de Juan es:
15 16 14 17 18 14 16 110
15,7
7 7
PROMEDIO (VARIABLE CUANTITATIVA DISCRETA)
La media de un conjunto de datos para la variable cuantitativa discreta se
encuentra con el cociente entre la suma de los valores de la variable con la
frecuencia absoluta dividida entre el tamaño de la muestra.
Ejemplo. Si se estudia el número de hermanos, en 20 estudiantes de
la Universidad Señor de Sipán, del primer año en
psicología, cual es el valor típico:
Hermano Frecuencia Xi*fi
Xi Absoluta fi
k
0 5 0
x i fi
1 7 7 x i 1
= 30/ 20 =1.5
2 3 6
n
3 3 9
La media aritmética es 1.5
4 2 8
hermanos.
Total 20 30
CÁLCULO DEL PROMEDIO O MEDIA DATOS AGRUPADOS:
Tiempos (hr) uso de Marca de clase: Xi
internet quincenal Frecuencia Xi*fi
gerentes de mypes absoluta: fi
68 - 74.8 (68+74.8)/2 = 71.4 1 71.4
74.8 - 81.6 78.2 2 156.4
81.6 - 88.4 85.0 4 340
88.4 - 95.2 91.8 8 734.4
95.2 - 102 98.6 26 2563.6
102 - 108.8 105.4 4 421.6
108.8 - 115.6 112.2 5 561
Total ------ 50 4848.4
Media
k
x i fi
x i 1
= 4848.4 / 50 = 96.97
n
Interpretación: El tiempo de uso quincenal de los gerentes de mypes es es
de 96.97 horas
Medida de tendencia central: La Mediana
MEDIANA (Me) El valor de la variable que divide al total de
observaciones en dos partes de igual tamaño.
Datos No Datos
Agrupados Agrupados
Ordenando de menor a
n
mayor y eligiendo el central. Fi 1
Si no hubiese un dato Md Li 2 A
central, entonces será igual fi
a la media de los dos valores
centrales.
Li : Límite inferior del intervalo Mediano
n: Es el numero de datos trabajados, el tamaño muestra.
Fi-1 : Frecuencia Acumulada del intervalo inmediato anterior
al intervalo mediano
fi : Frecuencia Absoluta del intervalo mediano
C: Ai : Amplitud intervalo mediano
LA MEDIANA (DATOS SIN AGRUPAR)
La mediana de un conjunto de datos es un valor del mismo tal que el número de
datos menores que él es igual al número de datos mayores que él.
Los pesos, en kilogramos, de 7 jugadores de un
Ejemplo:
equipo de fútbol son: 72, 65, 71, 56, 59, 63, 72
1º. Ordenamos los datos: 56, 59, 63, 65, 71, 72, 72
2º. El dato que queda en el centro es 65. La mediana vale 65.
Caso: Si el número de datos fuese par, la mediana es la
semisuma de los dos valores centrales.
Para el conjunto 56, 57, 59, 63, 65, 71, 72, 72, la mediana es: 63 65
64
2
MEDIANA (VARIABLE CUANTITATIVA DISCRETA)
La mediana de un conjunto de datos para la variable cuantitativa discreta se
encuentra en la mitad de la información n/2 Me = xi, se determina con la
ubicación de la frecuencia acumulada absoluta Fi.
Ejemplo. Si se estudia el número de hermanos, en 20 estudiantes de
la Universidad Señor de Sipán, del primer año en
psicología, cual es el valor típico:
Hermano Frecuencia Frecuencia Acumulada
Xi Absoluta fi Absoluta Fi
La media de los datos
0 5 5 está en el valor n/2 =
20/2=10; el cual se
Xi = 1 7 12 encuentra en la
2 3 15 segunda frecuencia
3 3 18 acumulada.
4 2 20
Total 20 ----
La mediana es el valor 1
Medida de tendencia central: La Moda
La Moda es el valor de la variable que más se repite, o
MODA (Mo)
la mayor frecuencia de un conjunto de datos.
Datos No Datos
Agrupados Agrupados
Se toma el dato que
más se repite, existen d1
Mo Li A
d1 d 2
distribuciones que
pueden tener más de
una moda.
Li : Limite inferior intervalo modal
d1: fi - fi-1 diferencia de la frecuencia del intervalo modal
menos la frecuencia del intervalo inmediatamente anterior
d2: fi - fi+1 diferencia de la frecuencia del intervalo modal
menos la frecuencia del intervalo inmediatamente
posterior
C =Ai : Amplitud intervalo modal.
Ejercicio para encontrar medidas de tendencia central datos No Agrupados
Con la muestra se describen la edad de los jefes de pymes de la zona urbana
de Chiclayo, ¿cuál es la moda de los datos?
24, 30, 28, 23, 25, 22, 22, 26, 27, 28, 25, 26, 33, 29, 28
El valor de la moda se encuentra:
Se ordenan los datos 22 22 23 24 25 25 26 26 27 28 28 28 29 30 33
El valor modal es el dato que más se repite, Mo = 28; Es la edad de los
jefes de mypes.
22 22 23 24 25 25 26 26 27 28 28 28 29 30 33
MODA (VARIABLE CUANTITATIVA DISCRETA)
La moda es el valor de la variable de mayor frecuencia absoluta.
Ejemplo. Si se estudia el número de hermanos, en 20 estudiantes de
la Universidad Señor de Sipán, del primer año en
psicología, cual es el valor típico:
Hermano Frecuencia
Xi Absoluta
fi
0 5
El tamaño de hermanos 7 es la
que es más frecuente, es 1 7 frecuencia
de 1 (un) hermano. que más se
2 3 repite.
La moda es 1 3 3
hermano. 4 2
Total 20
CÁLCULO DE LA MODA, DATOS AGRUPADOS:
Dado los coeficientes intelectuales de aspirantes a puesto de trabajo, se pide el valor modal
Tiempos (hr) uso de internet Frecuencia
quincenal gerentes de mypes absoluta : fi
68 - 74.8 1
74.8 - 81.6 2
d1
81.6 - 88.4 4
Mo Li A
88.4 - 95.2 fi-1 : 8 d1 d 2
Li: 95.2 - 102.0 fi : 26
102.0 - 108.8 fi+1 :4
108.8 - 115.6 5
Total 50
Con los datos de la distribución de frecuencias
Li= 95.2,
d1= fi - fi-1 = 26-8=18; d2 = fi - fi+1 = 26- 4= 22; A= 102.0- 95.2= 6.8.
Luego la moda de la distribución es:
Mo = 95.2 + (18 / (18 + 22))*6.8 Mo = 98.26,
Interpretación: El tiempo de uso de internet que mayormente se presenta en
los gerentes de mypes es de 98.26
Considerando la colección 5 11 18 35 52 52 72 Determina el valor de la media.
Considerando la colección 5 11 18 35 52 52 72 Determina el valor de la mediana.
Considerando la colección 5 11 18 35 52 52 72 Determina el valor de la moda.
Medidas de Dispersión
Recorrido: es la diferencia entre el mayor y el menor valor de la variable: Rango o Amplitud
total ; R= Máximo – Mínimo
Varianza y Desviación Estándar
La varianza (s2) es la media aritmética de los cuadrados de las desviaciones de los
datos respecto a la media: n
(x x)
i
2
s x2 i 1
n
Varianza datos sin agrupar Varianza datos agrupados
n 2 n
i f i xi
2
x
S 2 i 1 x S 2 i 1 x
2 2
n n
Desviación típica o estándar (s) : Se define la desviación típica como
la raiz cuadrada positiva de la varianza: S S2