FÓRMULA DE ESTADÍSTICA Y PROBABILIDADES
21 de agosto de 2022
1. Organización de datos 4. Se construir los intervalos
1.1. Distribución de frecuencias de va- Intervalo Ii mi fi hi pi
riable cualitativa [L1 , U1 [ m1 f1 h1 p1
.. .. .. .. ..
Frecuencia absoluta fi . . . . .
fi [Lk , Uk [ mk fk hk pk
Frecuencia relativa hi ; hi =
n Total n 1.00 100
Frecuencia porcentaje pj ; pi = hi × 100 %
variable X fi hi pi
Marca de clase. Del intervalo Ii = [Li , Ui [, entonces
C1 f1 h1 p1 Li + Ui
.. .. mi =
.. .. 2
. . . .
Gráfica. Histograma, basado en frecuencias.
Ck fk hk pk
Total n 1.00 100
Gráfica: Barra separadas y la de sectores circulares. 1.4. Distribución de frecuencias acu-
muladas
1.2. Distribución de frecuencias de va-
riable cuantitativa discreta 1. Frecuencia acumulada absoluta.
Variable X fi hi pi Fi = f1 + f2 + · · · + fi , donde i = 1, 2, ... , k
C1 f1 h1 p1
.. .. .. ..
. . . . 2. Frecuencia acumulada relativa.
Ck fk hk pk
F1 + · · · + Fi
Total n 1.00 100 Hi = h1 + · · · + hi = , i = 1, 2, ..., k
n
Gráfica: Bastón
3. Frecuencia acumulada porcentual
1.3. Distribución de frecuencias por in-
tervalos Pi = p1 + p2 + · · · + pi , i = 1, 2, ..., k
Para construir se sigue los siguientes pasos:
Frecuencia Frec. acumuladas
1. Rango: R = Xmax − Xmin x fi hi pi % Fi Hi Pi %
2. N° de intervalos. Regla de Sturges: k = 1 + x1 f1 h1 p1 F1 H1 P1
3.3 log(n), n ≥ 10, redondeando el número ob- .. .. .. .. .. .. ..
. . . . . . .
tenido al entero inmediato mayor. xk fk hk pk Fk Hk Pk
R Total n 1 100
3. Amplitud: A ∼ = , sometida a la condición kA ≥
k
R; se aproxima por exceso de manera que el nú-
mero de intervalos logre cubrir todo el rango Gráfica. Ojiva
1
2. Medida de tendencia central 1. Cálculo de cuartiles para datos no agrupa-
dos
2.1. Media aritmética Paso 1. Ordenar los datos de menor a mayor.
2.1.1. Media aritmética de datos no agrupa- Paso 2. Dividir los datos en 4 partes.
dos Ejemplo 1. Dado los datos:
1, 1, 2, | 3, 3, 4, | 5, 6, 7, | 8, 8, 9. De donde
n ↓ ↓ ↓
P
xi 2+3 4+5
i=1 Q1 = = 2.5; Q2 = M e = = 4.5;
x̄ = 2 2
n 7+8
Q3 = = 7.5
2
2.1.2. Media aritmética de datos agrupados Ejemplo 2. Datos los datos:
1. Datos agrupados para variable discreta 1, 2, 3, 4, 5, | 7, 7, 8, 9, 10.
↓ ↓ ↓
De donde:
k
P 5+7
fi xi Q1 = 3; Q2 = M e = = 6; Q3 = 8
i=1 2
x̄ =
n Ejemplo 3. Dado los datos:
2. Datos agrupados para intervalos 1, 2, 3, 4, 5, 7, 7, 8, 9.
|
↓ ↓
|
↓
De donde
k
P 2+3 7+8
fi mi Q1 = = 2.5; Q2 = M e = 5; Q3 = = 7.5
i=1 2 2
x̄ =
n Ejemplo 4. Dado los datos:
Donde m1 , m2 , . . . , mk son la marcas de clase. 1, 2, 3, 4, 5, 6, 7, 8, 9, 10, 11.
↓ ↓ ↓
De donde
2.2. Mediana
Q1 = 3; Q2 = M e = 6; Q3 = 9
Ordenados los datos los divide en dos partes iguales.
2. Cálculo de cuartiles para datos agrupados
Datos agrupados por intervalos por intervalos
n Para determinar los cuartiles lo hacemos a través
− Fi−1
M e = Li + 2 A de la siguiente fórmula:
Fi − Fi−1
jn
− Fi−1
2.3. Moda Qj = Li + 4 A, donde j = 1, 2, 3
fi
Datos agrupados por intervalos
3.2. Deciles
d1
M o = Li + A Dividen a la serie de datos en diez partes iguales. Se
d1 + d2
les identifica con D1 , D2 , D3 , . . . , D9
Donde Li es el límite inferior del intervalo modal.
1. Cálculo de deciles para datos no agrupa-
d1 = fi − fi−1
dos
d2 = fi − fi+1
Para n datos no agrupados de la variable X, el
valor del decil Di se calcula mediante los siguien-
tes pasos:
3. Medida de posición
Paso 1. Ordenar los datos de menor a mayor, es
3.1. Cuartiles decir x1 , x2 , x3 .
i(n + 1)
Paso 2. Se calcula: k =
Dividen a la serie de datos en cuatro partes iguales 10
(cada parte contiene el 25 % de la observaciones). Se a) Si k es un número entero, el decil Di es el
les identifica con Q1 , Q2 , Q3 . valor en la posición k. Es decir Di = xk .
2
b) Si k no es un entero, el decil Di se calcula 4. Medida de dispersión
con la siguiente fórmula
4.1. Rango o recorrido de una variable
Di = xj + g (xj+1 − xj )
Donde j es la parte entera de k y g es la R = xmax − xminn
parte decimal de k.
4.2. Rango intercuartil
2. Cálculo de deciles para datos agrupados
por intervalos
RI = Q3 − Q1
Para determinar los deciles lo hacemos a través
de la siguiente fórmula:
4.3. Varianza
jn
− Fi−1
Datos no agrupados:
Qj = Li + 10 A, donde j = 1, 2, ... , 3
fi
n
P 2
(xi − x̄)
i=1
3.3. Percentiles s2 =
n−1
Datos agrupados
Dividen a la serie de datos en 100 partes iguales. Se
les identifica con P1 , P2 , P3 , ... , P99 . k
P 2
fi (xi − x̄)
i=1
s2 =
1. Cálculo del percentil para datos no agru- n−1
pados
4.4. Desviación estándar
Para n datos no agrupados de la variable X, el
valor del decil Pi se calcula mediante los siguien- Datos no agrupados:
tes pasos:
v
u n
uP
Paso 1. Ordenar los datos de menor a mayor, es (x − x̄)
2
t i=1 i
u
decir x1 , x2 , ... , xn . s=
n−1
i(n + 1)
Paso 2. Se calcula: k = Datos agrupados
100
v
a) Si k es un número entero, el percentil Pi es u k
uP 2
f (x − x̄)
el valor en la posición k. Es decir Pi = xk . t i=1 i i
u
s=
n−1
b) Si k no es un entero, el percentil Di se cal-
cula con la siguiente fórmula
4.5. Coeficiente de variación
Pi = xj + g (xj+1 − xj )
s
CV = × 100 %
Donde j es la parte entera de k y g es la x
parte decimal de k.
5. Medidas de forma de la dis-
2. Cálculo del percentil para datos agrupados
tribución
Para determinar los percentiles se hace a través
de la fórmula: 5.1. Asimetría
jn
− Fi−1
Pk = Li + 100 A, donde j = 1, 2, 3, ... , 99 3 (x − M e)
fi As =
s
3
Nota. x − M o ≈ 3 (x − M e) Si K tiende a 0, es normal o mesocúrtica.
Interpretación de la asimetría: Si K tiende a 0.5, es leptocúrtica.
Si As = 0, no siempre la distribución es simétri- Si K tiende a −0, 5, es platicúrtica
ca. (x = M e = M o)
Si As > 0, la distribución es asimetría posi- 6. Diagrama de cajas
tiva (sesgada o cola hacia la derecha, donde
M o < M e < x) 1. La centralización.
Si As < 0, la distribución es asimetría nega- 2. La dispersión.
tiva (sesgada o cola hacia la izquierda, donde
3. La simetría de la distribución
x < M e < M o)
5.2. Curtosis
P75 − P25
K= − 0.5
P90 − P10
Interpretación de la Curtosis; A = Q1 − 1.5d; B = Q3 + 1.5d, donde d = Q3 − Q1 .