TICA
MINISTERIO DEL INTERIOR
POLICÍA NACIONAL DEL ECUADOR
DIRECCIÓN NACIONAL DE EDUCACIÓN
ESCUELA DE ESPECIALIZACIÓN Y PERFECCIONAMIENTO
MÓDULO DE ESTADÍSTICA III
Capitán - Mayor
DAID-CG
2019-2020
PRESENTACIÓN
UNIDAD II
MEDIDAS DE TENDENCIA CENTRAL.
Las medidas de tendencia central nos sirven para describir características
básicas de un estudio con datos cuantitativos; muestra promedios,
compara resultados, o interpreta puntajes en relación a otra medida
central, entre las medidas de tendencia central tenemos: la media
aritmética, la mediana y la moda.
1.1. Media aritmética
Se le conoce como promedio, es el valor obtenido al sumar todos los
datos y dividir el resultado entre el número total de datos.
𝑋1 + 𝑋2 + 𝑋3 + 𝑋4 + ⋯ … … . 𝑋𝑛
̅
X=
𝑛
Constituye el centro de gravedad de una distribución de frecuencias. Es
la medida de tendencia central de mayor utilidad a pesar de que pierde
representatividad por los valores extremos, posee propiedades
matemáticas que le dan la característica de ser el promedio más
confiable en los análisis estadísticos más avanzados. En ella influyen
mucho los elementos extremos y mide la magnitud del conjunto de
valores. Media aritmética se representa por medio de la letra X con una
línea en la parte superior𝑋̅.
Ejemplo:Las notas del señor Aspirante de Policía Santillán Gómez José
Alejandro, en la materia de Doctrina Policial son las siguientes:
Enero: 8,25; febrero 7,13; marzo 9,55; abril 5,85; mayo 6,75 y junio 7,70;
calcular el promedio:
8,25 + 7,13 + 9,55 + 5,85 + 6,75 + 7,70
̅=
X
6
45,23
̅
X=
6
̅
X = 7,53
El promedio o la media del señor Aspirante Santillán en el semestre de
enero a junio son de 7,53 en la materia de Doctrina Policial.
1.2 Mediana
Es el valor central de un conjunto de valores ordenados en forma
creciente o decreciente. La mediana solo se puede hallar para variables
de tipo cuantitativo. Es decir la mediana deja un mismo número de
valores antes y después de él, en un conjunto de valores ordenados, se
representa con las letras Md.
Si el número de valores es par, la mediana será el promedio de los
valores centrales. Si el número de valores es impar, la mediana será el
valor central.
Ejemplo:Las notas del señor Aspirante de Policìa Santillán Gómez José
Alejandro, en la materia de Doctrina Policial son las siguientes:
Enero: 8,25; febrero 7,13; marzo 9,55; abril 5,85; mayo 6,75 y junio 7,70;
calcular el promedio:
MES NOTA
Enero 8,25
Febrero 7,13
Marzo 9,55
Abril 5,85
Mayo 6,75
Junio 7,70
En primer lugar ordenamos la tabla de datos sea de manera ascendente
o descendente.
MES NOTA
Marzo 9,55
Enero 8,25
Junio 7,70
Febrero 7,13
Mayo 6,75
Abril 5,85
Como tenemos una serie de datos par seleccionamos los dos valores
intermedios para calcular la mediana.
7,70 + 7,13
𝑀𝑑 =
2
14,83
𝑀𝑑 =
2
𝑀𝑑 = 7,42
El valor de la mediana para este ejercicio es de 7,42
En el caso de tener una serie de datos impar como se ha mencionado
anteriormente, la mediana será el valor central de la serie.
MES NOTA
Marzo 9,55
Enero 8,25
Junio 7,70
Febrero 7,13
Mayo 6,75
1.3 Moda
Es el valor que más se repite en un conjunto de datos, si en un conjunto de
valores, no se repite ningún valor, entonces no hay moda o también puede existir
más de una moda en una serie de datos; esta medida se puede utilizar para
datos cualitativos identificando el dato modal como el que más se repite.
Ejemplos:
La serie de datos:
2 2 5 7 9 9 9 10 10 11 12 18
En el caso anterior se puede observar que el valor que más se repite en
la serie de datos es el número nueve y como se tiene una sola moda se
llama unimodal.
La serie de datos:
3 5 8 10 12 15 16
En el ejemplo anterior la serie de datos no tiene moda.
La serie de datos:
2 3 4 4 4 5 5 7 7 7 9
En este caso tenemos dos modas en la serie de datos, por lo tanto se
llamará bimodal.
Para datos cualitativos tenemos:
Lunes, martes, martes, martes, miércoles, miércoles, jueves.
En este caso el dato modal seria “martes”.
MEDIDAS DE DISPERSIÓN.
La dispersión es la variación en un conjunto de datos que proporciona
información adicional y permite juzgar la confiabilidad de la medida de
tendencia central.
Las medidas de dispersión nos permiten conocer si los valores en general
están cerca o alejados de los valores centrales, muestran la variabilidad de
una distribución de datos, indicando por medio de un número si las diferentes
puntuaciones de una variable están muy alejadas de la medida de tendencia
central.
Entre las medidas de dispersión tenemos las siguientes:
2.1 Rango.
Es la diferencia entre el valor máximo y el mínimo en nuestros datos, esta
medida de dispersión aunque es la más fácil de obtener, pon lo general
es muy poco usada, se puede simbolizar con la letra R.
Ejemplo: Supóngase que en el Hospital de la Policía el pulso de cada
paciente se mide tres veces al día y que cierto día los registros de los
pacientes muestran:
Paciente 1: 73 77 74
Paciente 2: 64 90 73
¿Cuál es el rango en pulsaciones para cada paciente?
Para calcular el rango de los datos es necesario identificar el valor más
grande y el valor más pequeño del conjunto de datos, de cada uno de los
pacientes.
Para el paciente 1:
R =77 – 73 = 4
Para el paciente 2:
R =90 –64 = 26
2.2 Varianza.
Varianza Simple.- la varianza es una medida estadística que mide la
dispersión de los valores respecto a un valor central (media), es decir,
es el cuadrado de las desviaciones. Su fórmula de cálculo es la siguiente:
(𝑋1 − 𝑋̅ )2 + (𝑋2 − 𝑋̅)2 + (𝑋3 − 𝑋̅ )2 + ⋯ + (𝑋𝑛 − 𝑋̅ )2
𝜎2 =
𝑁
∑𝑛𝑖=1(𝑋𝑖 − 𝑋̅ )2
𝜎2 =
𝑁
Ejemplo: Se tiene la siguiente serie de datos:
9 3 8 8 9 8 9 18
̅ = 9 + 3 + 8 + 8 + 9 + 8 + 9 + 18 = 9
X
8
𝜎2
(9 − 9) + (3 − 9) + (8 − 9) + (8 − 9) + (9 − 9)2 + (8 − 9)2 + (9 − 9)2 + (18 − 9)2
2 2 2 2
=
8
𝜎 2 = 15
2.3 Varianza datos agrupados
Se expresa mediante la siguiente fórmula:
(𝑥1 − 𝑥̅ )2 ∗ 𝑓1 + (𝑥2 − 𝑥̅ )2 ∗ 𝑓2 + (𝑥3 − 𝑥̅ )2 ∗ 𝑓3 … + (𝑥𝑛 − 𝑥̅ )2 ∗ 𝑓𝑛
𝜎2 =
𝑁
2
∑𝑛𝑖=1(𝑋𝑚 − 𝑋̅)2 ∗ 𝑓𝑖
𝜎 =
𝑁
Intervalo Marca de clase (𝑋𝑚 ) fi Xm *fi (𝑋𝑚 − 𝑋̅ )2 ∗ 𝑓𝑖
(10 – 20) 15 1 15 802,5889
(20 – 30) 25 8 200 2.687,9112
(30 – 40) 35 10 350 693,889
(40 – 50) 45 9 405 25,1001
(50 – 60) 55 8 440 1.089,5112
(60 – 70) 65 4 260 1.878,3556
(70 – 80) 75 2 150 2.005,9778
TOTAL 42 1.820 9.183,3338
1.820
̅
X=
42
̅ = 43.33
X
𝜎2
(15 − 43,33)2 ∗ 1 + (25 − 43,33)2 ∗ 8 + ⋯ + (75 − 43,33)2 ∗ 2
=
42
9.183,3338
𝜎2 =
42
𝜎 2 = 218.6508
2.4 Desviación típica o estándar
Es la raíz cuadrada de la varianza, se representa a través de la siguiente
expresión: 𝜎 𝑜 𝑆
(𝑋1 − 𝑋̅ )2 + (𝑋2 − 𝑋̅ )2 + (𝑋3 − 𝑋̅)2 + ⋯ + (𝑋𝑛 − 𝑋̅)2
𝜎𝑜𝑆=√
𝑁
∑𝑛 (𝑋𝑖 − 𝑋̅)2
𝜎 𝑜 𝑆 = √ 𝑖=1
𝑁
Ejemplo:
Intervalo Marca de clase (𝑋𝑚 ) fi Xm *fi (𝑋𝑚 − 𝑋̅)2 ∗ 𝑓𝑖
(10 – 20) 15 1 15 802,5889
(20 – 30) 25 8 200 2.687,9112
(30 – 40) 35 10 350 693,889
(40 – 50) 45 9 405 25,1001
(50 – 60) 55 8 440 1.089,5112
(60 – 70) 65 4 260 1.878,3556
(70 – 80) 75 2 150 2.005,9778
TOTAL 42 1.820 9.183,3338
1.820
̅=
X = 43.33
42
9.183,3338
𝜎2 = = 218.6508
42
𝜎 = √218.6508 = 14.7868
2.5 Coeficiente de Variación.
Es una medida de dispersión relativa que permite comparar el nivel de
dispersión de las, cuando más apegado a 0 los datos son más
idénticos.
𝜎
𝐶𝑉 = ̅
X
14.7868
𝐶𝑉 =
43.33
CV=0,3412