“Año del Bicentenario, de la consolidación de
nuestra Independencia, y de la conmemoración de
las heroicas batallas de Junín y Ayacucho”
UNIVERSIDAD NACIONAL DE UCAYALI
FACULTAD DE EDUCACIÓN Y CIENCIAS SOCIALES
ESCUELA PROFESIONAL DE EDUCACIÓN SECUNDARIA
MATEMÁTICA, FÍSICA E INFORMÁTICA
ESTADIGRAFOS DE LA INVESTIGACIÓN
Presentado por:
- Aranda Ramos Regina Marisol
- Maynas Lino , Jeyson Leandro
- Rojas Vada, Vanesa
- Tapia Sangama, Pedro Manuel
Curso : Tesis II
Ciclo : VIII
Docente : Mg. Elia Karina Pardo Ruiz
10 de diciembre del 2024
2
Dedicatoria
Dedicamos este presente trabajo a Dios ,
a nuestros padres , familiares , maestros y
amigos .
3
Agradecimiento
A Dios por su misericordia, bondad y permitir la realización de este presente trabajo.
A nuestros padres que son inspiración para superarnos, por su comprensión y apoyo
incondicional.
A la maestra por su labor diario en compartir su conocimiento con cada
uno de nosotros.
4
Índice
Contenido
ESTADÍGRAFOS DE POSICIÓN................................................................................5
Clasificación............................................................................................................. 5
Media Aritmética...................................................................................................5
Mediana................................................................................................................6
Moda.....................................................................................................................6
ESTADÍGRAFOS DE DISPERSIÓN...........................................................................6
Rango.......................................................................................................................6
Varianza................................................................................................................... 6
Desviación Estándar................................................................................................ 7
Coeficiente de Variación..........................................................................................7
Estadígrafos Secundarios........................................................................................7
Amplitud Intercuartílica.........................................................................................7
Desviación Media.....................................................................................................7
COEFICIENTE DE SIMETRÍA.....................................................................................8
Coeficiente de asimetría de Pearson.....................................................................10
Coeficiente de asimetría de Pearson (versión 1)...................................................10
Coeficiente de asimetría de Pearson (versión 2)................................................10
Coeficiente de asimetría de Fisher.........................................................................11
COEFICIENTE DE ASIMETRÍA DE BOWLEY......................................................13
ESTADÍGRAFOS DE CURTOSIS.............................................................................15
IMPORTANCIA DE LA CURTOSIS EN EL ANÁLISIS ESTADÍSTICO..................16
Tipos de curtosis....................................................................................................16
Coeficiente de Curtosis..........................................................................................18
CONCLUSIÓN...........................................................................................................20
REFERENCIAS.........................................................................................................21
5
ESTADIGRAFOS DE LA INVESTIGACIÓN
ESTADÍGRAFOS DE POSICIÓN
Es un indicador o medidas de resumen, que permite hallar un valor
numérico, el mismo que representa a toda la población o muestra de
estudio, el estadígrafo de posición o también conocidos como “Medidas de
tendencial Central “, son los valores numéricos que indican el “Centro” de
un conjunto de datos (sin que signifique que es el centro exactamente),
describen a todo el conjunto señalando una característica que destaca, Son
puntos o valores característicos de un conjunto de datos. Un estadígrafo de
posición es “representante de un conjunto de datos “
Las medidas de posición tienen por objeto proporcionar valores en torno a
los cuales se encuentran las observaciones muestrales. Alguna de ellas,
como la media, mediana y moda suelen denominarse medidas de posición,
porque suelen situarse por el centro del conjunto de datos
Clasificación
Media Aritmética
Este es la medida más famosa y utilizada. Es el centro de la
gravedad de la distribución. La media aritmética es también
conocida como el promedio. No es más que el cociente entre
la suma de los n valores y n. Es decir:
Datos simples
n
∑x
x= i=1 ⅈ
n
Datos agrupados
∑ f ix ⅈ
x= i=1
n
6
Mediana :
Es el valor central de una serie de datos ordenados
conforme a sus valores creciente y decreciente , es un valor
que ocupa en el lugar central. Para reconocer la mediana ,
es necesario tener los valores ordenados sea de mayor a
menor o lo contrario. Usted divide el total de casos entre dos
y el valor resultante corresponde al número de caso que
representa la mediana de distribución.
Moda
La moda es el valor más frecuente en una serie , existen
métodos elementales para calcular esta medida en una
distribución :
Método aproximado
Método por interpolación algebraica
Método por interpolación geométrica
Método empírico
ESTADÍGRAFOS DE DISPERSIÓN
Los estadígrafos de dispersión son herramientas estadísticas
fundamentales que permiten analizar la variabilidad de un conjunto de
datos. Su estudio es crucial en el ámbito educativo y en el área de
matemáticas, ya que ayudan a comprender cómo se distribuyen los datos
en relación con su tendencia central. A continuación, se presenta un
análisis profundo de los principales y secundarios estadígrafos de
dispersión, incluyendo gráficos y referencias a autores relevantes.
Principales Estadígrafos de Dispersión
7
Rango
El rango es la medida más simple de dispersión y se calcula restando el
valor mínimo del valor máximo en un conjunto de datos. Indica la amplitud
total de los datos.
R=Vmax−VminR
Ejemplo: Para los datos [12,15,22,30], el rango sería 30−12=18.
Varianza
La varianza mide la dispersión de los datos respecto a la media. Se
calcula como el promedio de las diferencias al cuadrado entre cada dato y
la media.
∑ (xi−μ)2
σ 2=
N
donde xi son los valores individuales, μ es la media y N es el número total
de observaciones.
Ejemplo: Para los datos [10,12,23]:
Media: μ= (10+12+23) /3 =15
Varianza: σ2= [(10−15)2+(12−15)2+(23−15)2]/3=36
Desviación Estándar
La desviación estándar es la raíz cuadrada de la varianza y proporciona
una medida más intuitiva de dispersión en las mismas unidades que los
datos originales.
σ=σ2
Ejemplo: Usando la varianza anterior, la desviación estándar
sería σ=36=6.
Coeficiente de Variación
El coeficiente de variación (CV) es una medida relativa de dispersión que
se expresa como un porcentaje. Se calcula dividiendo la desviación
estándar por la media.
8
CV=σμ×100
Este estadígrafo es útil para comparar la variabilidad entre diferentes
conjuntos de datos.
Estadígrafos Secundarios
Amplitud Intercuartílica
La amplitud intercuartílica (AIQ) mide la dispersión en el rango del
segundo y cuarto cuartil, proporcionando una idea más robusta sobre la
variabilidad al ignorar valores extremos.
AIQ=Q3−Q1
donde Q1Q1 y Q3Q3 son el primer y tercer cuartil, respectivamente.
Desviación Media
La desviación media es el promedio de las diferencias absolutas entre
cada valor y la media.
DM=∑∣xi−μ∣NDM=N∑∣xi−μ∣
Este estadígrafo proporciona una medida clara de cuánto se desvían los
datos en promedio respecto a la media.
9
COEFICIENTE DE SIMETRÍA
Se dice que una distribución de frecuencias es simétrica cuando los
valores de la variable equidistantes, a uno y otro lado, del valor central
tienen la misma frecuencia absoluta (𝑛𝑖) o relativa (ℎ𝑖). Es decir, en este
caso tendremos simetría en el histograma (o en el diagrama de barras)
alrededor de una vertical trazada por el punto central. En el caso de una
distribución perfectamente simétrica los valores de la media aritmética,
mediana y moda coinciden (𝑋̅ = Me = Mo). En el caso de no tener
simetría, diremos que tenemos asimetría a la derecha (o positiva) o a la
izquierda (o negativa) dependiendo de que el histograma muestre una cola
de medidas hacia valores altos o bajos de la variable respectivamente.
También se puede decir que la distribución está sesgada a la derecha
(sesgo positivo) o a la izquierda (sesgo negativo). En el caso de una
distribución asimétrica, la media, mediana y moda no coinciden, siendo 𝑋
> Me > Mo para una asimetría positiva y 𝑋̅ < Me < Mo para una asimetría
negativa, ver el grafico presentado anteriormente. Con el fin de cuantificar
el grado de asimetría de una distribución de frecuencias se pueden definir
los coeficientes de asimetría
10
a asimetría es el sesgo o la distorsión de la simetría de una distribución. Si la curva
que representa la distribución de los datos tiene una cola más larga hacia la derecha
del máximo central, que, hacia la izquierda, se dice que está sesgada hacia la
derecha o que es positivamente asimétrica. Si sucede lo contrario, se considera que
está sesgada hacia la izquierda o que es negativamente asimétrica. En las
distribuciones asimétricas los valores de la media, la mediana y la moda son
diferentes, como se observa a continuación:
Un ejemplo de una curva sesgada a la derecha puede ser la distribución de
frecuencias de las edades de los asistentes a un concierto de KPOP, pues muchos
valores estarían situados en el extremo inferior y pocos en el extremo superior, ya
que la mayoría de los asistentes serian personas jóvenes. De manera análoga, una
curva sesgada a la izquierda podría representar la frecuencia del número de días
que un corredor de bienes raíces necesita para vender una casa, pues como las
casas no se venden inmediatamente muchos valores estarían situados en el
extremo superior y pocos en el extremo inferior.
A continuación, se introducen las dos medidas de asimetría más comúnmente
empleadas para el análisis de datos, estas son los coeficientes de asimetría de
Pearson y de Bowley.
11
Coeficiente de asimetría de Pearson
El coeficiente de asimetría de Pearson (Karl Pearson, 1857-1936) es una medida de
asimetría estadística que se basa en la diferencia entre media aritmética, mediana y
moda para cuantificar la dirección y el nivel de asimetría de una distribución
estadística, normalizando el resultado dividiendo el resultado entre la desviación
típica. Generalmente, para variables continuas y una distribución unimodal, en
distribuciones asimétricas a la derecha la media aritmética es superior a la mediana
y esta, a su vez, superior a la moda y a la inversa en distribuciones asimétricas a la
izquierda.
Existen dos versiones del coeficiente de asimetría de Pearson que comparan
respectivamente media y moda, por un lado, y media y mediana, por el otro.
Coeficiente de asimetría de Pearson (versión 1)
Coeficiente de asimetría de Pearson (versión 2)
Esta última versión que utiliza como referencia la mediana es especialmente útil
cuando no es posible el cálculo de la moda, cuando por ejemplo cuando tomos los
datos toman valores diferentes en un grupo de datos pequeño.
El coeficiente, en cualquiera de sus dos versiones, se interpreta haciendo uso de la
diferencia entre media y moda, y media y mediana, respectivamente, que hemos
12
citado antes, siempre para distribuciones continuas, unimodales y teniendo en
cuenta que siempre puede haber distribuciones que no cumplen esta regla:
si el valor del coeficiente, para cualquiera de sus dos versiones, es
aproximadamente 0, la distribución puede considerarse simétrica o casi
simétrica;
si el valor del coeficiente es significativamente positivo, la distribución
presenta asimetría positiva o a la derecha;
si el valor del coeficiente es significativamente negativo, la distribución
presenta asimetría negativa o a la izquierda.
Coeficiente de asimetría de Fisher
El coeficiente de asimetría de Fisher es una medida estadística de asimetría de una
distribución estadística que establece hasta qué punto esta es simétrica o asimétrica
y en qué dirección, a la izquierda o a la derecha. Puede calcularse tanto para
distribuciones de datos como para una distribución de probabilidad.
Para una muestra o conjunto de datos se calcula desarrollando esta fórmula:
siendo x la desviación típica o estándar poblacional, aunque también puede
sustituirse por la desviación típica muestral o corregida, y m3 el momento muestral
central de orden 3 o tercer momento central. La expresión del numerador coincide
con el momento muestral de tercer orden respecto de la media. La fórmula completa
coincide, por otra parte, con el momento estándar de orden 3.
Este coeficiente se interpreta de la siguiente forma:
13
si el coeficiente toma valores cerca de 0, se deduce que la distribución es
simétrica o presenta un alto grado de simetría, si bien la cercanía a 0 debería
evaluarse a través de una prueba de hipótesis;
si el coeficiente toma un valor positivo relativamente lejano de 0, la
distribución estadística es asimétrica a la derecha (se dice también que
presenta una asimetría positiva);
si el coeficiente toma un valor negativo relativamente lejano de 0, la
distribución estadística es asimétrica a la izquierda (se dice también que
presenta una asimetría negativa).
Ejemplo
Se ha preguntado por el número de asignaturas pendientes de cursos anteriores a
una muestra de alumnos universitarios obteniendo las siguientes respuestas: 1-2-2-
2-2-3-3-4-5-6. A continuación se desarrolla el cálculo del coeficiente de asimetría de
Fisher:
14
De esta forma, al ser el coeficiente de Fisher ostensiblemente mayor que 0, puede
afirmarse que la distribución presenta asimetría positiva o es asimétrica a la
derecha.
15
COEFICIENTE DE ASIMETRÍA DE BOWLEY
El coeficiente de asimetría de Bowley (Arthur Lyon Bowley, economista y estadístico
inglés, 1869 – 1957), a veces también llamado coeficiente de asimetría de Yule-
Bowley o índice de asimetría intercuartílico, es una medida de asimetría de una
variable estadística unidimensional, que se basa en la diferencia relativa entre
recorridos tercer cuartil-segundo cuartil (Q3−Q2) y segundo cuartil-primer cuartil
(Q2−Q1). La fórmula del coeficiente es la siguiente (consúltese, además, cuartiles):
El resultado del coeficiente se interpreta de la siguiente forma:
si el coeficiente es positivo, se afirma que la distribución de datos es
asimétrica a la derecha o presenta asimetría positiva;
16
si el coeficiente es negativo, se afirma que la distribución de datos es
asimétrica a la izquierda o presenta asimetría negativa;
si el coeficiente es nulo o aproximadamente nulo, se afirma que la distribución
de datos es simétrica o casi simétrica.
Como se deduce de la fórmula, el coeficiente tiene en cuenta únicamente el 50%
central de la distribución para la medición de la asimetría, esto es, ignora las colas
con un 25% de datos a cada extremo , por lo que puede afirmarse que es
una medida robusta frente a la aparición de datos atípicos, aunque como
inconveniente no utiliza toda la información contenida en el conjunto de datos al
ignorar los datos extremos.
Una medida similar es el coeficiente de asimetría de Kelly, que sustituye el primer y
el tercer cuartil por el primer y el noveno decil, ignorando de esta forma las colas de
un tamaño del 10% de la distribución, en lugar del 25% en el caso del coeficiente de
Bowley. El coeficiente de asimetría de Kelly se interpreta de la misma forma que el
coeficiente de asimetría de Bowley. De forma general, se define el coeficiente de
asimetría de Groeneveld-Meeden (1984), del que el coeficiente de Bowley y el
coeficiente son casos particulares de esta forma:
donde Pp y P(1−p) son los percentiles de orden p, cumpliéndose 0<p<1/2. La
interpretación de este coeficiente es la misma que la del coeficiente de Bowley.
17
ESTADÍGRAFOS DE CURTOSIS.
(Ortega, 2024) define la importancia de las Curtosis y sus tipos:
La curtosis se refiere a la medida de la forma de una distribución en comparación
con la distribución normal, también conocida como campana de Gauss. A través de
esta medida, podemos descubrir si una distribución tiene colas pesadas o ligeras,
así como si su pico es más pronunciado o suave. En esencia, nos proporciona
información sobre cómo se distribuyen los datos alrededor de la media y la
presencia de valores atípicos.
18
Si una distribución tiene una curtosis positiva, significa que tiene colas más pesadas
y un pico más pronunciado en comparación con la distribución normal esto indica
que los valores de los datos están más concentrados alrededor de la media y hay
menos valores atípicos. Si una distribución tiene una curtosis negativa, significa que
tiene colas más ligeras y un pico más suave en comparación con la distribución
normal , esto indica que los valores de los datos están menos concentrados
alrededor de la media y hay más valores atípicos.
IMPORTANCIA DE LA CURTOSIS EN EL ANÁLISIS ESTADÍSTICO
La importancia radica en su capacidad para proporcionar información adicional sobre
la forma de una distribución de datos. Aunque medidas como la media y la
desviación estándar son ampliamente utilizadas, la curtosis nos permite comprender
mejor cómo se distribuyen los datos alrededor de la media y si hay valores atípicos.
La información proporcionada puede ser útil en diferentes situaciones. Por ejemplo,
en finanzas, la curtosis puede ayudarnos a comprender la volatilidad de los precios
de las acciones. Una curtosis alta podría indicar un mayor riesgo y la posibilidad de
eventos extremos, mientras que una curtosis baja podría señalar una mayor
estabilidad en los precios.
19
Tipos de curtosis
Existen tres tipos principales: leptocúrtica, mesocúrtica y platicúrtica. Estos términos
describen las características de la forma de una distribución en relación con la
distribución normal (campana de Gauss).
a. Leptocúrtica: Una distribución leptocúrtica tiene una curtosis positiva. Esto
significa que tiene colas más pesadas y un pico más pronunciado en
comparación con la distribución normal. En una distribución leptocúrtica, los
valores de los datos están más concentrados alrededor de la media y hay menos
valores atípicos. Esto indica una mayor concentración de datos en un rango
estrecho.
b. Mesocúrtica: Una distribución mesocúrtica tiene una curtosis cercana a cero.
En este caso, la forma de la distribución es similar a la de una distribución
normal. Tiene colas y picos moderados, lo que indica una dispersión y
concentración de datos que se ajusta a lo esperado en una distribución típica.
c. Platicúrtica: Una distribución platicúrtica tiene una curtosis negativa. Esto
significa que tiene colas más ligeras y un pico más suave en comparación con la
distribución normal. En una distribución platicúrtica, los valores de los datos
están menos concentrados alrededor de la media y hay más valores atípicos.
Esto indica una dispersión más amplia de datos y una mayor probabilidad de
encontrar valores extremos.
Coeficiente de Curtosis
La Academia Balderix (2022) menciona que el coeficiente de curtosis es un
coeficiente que permite determinar la curtosis de una distribución. Es decir, el
coeficiente de curtosis sirve para averiguar si una distribución es leptocúrtica,
platicúrtica o mesocúrtica.
20
La curtosis es una característica de una distribución que indica su grado de
concentración alrededor de la media, por lo tanto, el cálculo del coeficiente de
curtosis permite cuantificar la curtosis de
una distribución.
a) Fórmula del coeficiente de
curtosis
Para calcular el coeficiente de curtosis primero se deben sumar todas las diferencias
entre los datos y la media elevadas a la cuatro, luego dividir entre el número total de
datos y la desviación típica elevada a la cuatro y, finalmente, restar tres.
Es decir, la fórmula del coeficiente de curtosis es:
La fórmula del coeficiente de curtosis para datos agrupados en tablas de
frecuencias
Por último, la fórmula del coeficiente de curtosis para datos agrupados en
intervalos:
21
Donde:
g2 es el coeficiente de curtosis.
N es el número total de datos.
xi es el dato i-ésimo de la serie.
μ es la media aritmética de la distribución.
σ es la desviación estándar (o desviación típica) de la distribución.
fi es la frecuencia absoluta del grupo de datos i-ésimo.
ci es la marca de clase del grupo i-ésimo.
Ten en cuenta que en todas las fórmulas del coeficiente de curtosis se resta 3
porque es el valor de la curtosis de la distribución normal. De modo que el cálculo
del coeficiente de curtosis se hace tomando como referencia la curtosis de la
distribución normal. Por eso en ocasiones en estadística se dice que se calcula el
exceso de curtosis
CONCLUSIÓN
a. las medidas de posición nos facilitan una serie de información , sobre la serie
de datos que estamos analizando . La descripción de un conjunto de datos
incluye como elementos de suma importancia en la ubicación dentro de un
contexto de valores.
b. Los estadígrafos de dispersión son herramientas esenciales en el análisis
estadístico que permiten evaluar cómo varían los datos en relación con su
tendencia central. En educación, su comprensión es vital para interpretar
resultados académicos y realizar comparaciones significativas entre diferentes
grupos o periodos. La correcta aplicación e interpretación de estos estadígrafos
22
contribuye a mejorar la calidad educativa y a tomar decisiones informadas
basadas en datos.
c. La estadística de asimetría es una medida que permite evaluar la simetría de
una distribución de datos. Un valor de asimetría cercano a cero indica que la
distribución es relativamente simétrica, mientras que valores positivos o
negativos sugieren asimetría a la derecha o a la izquierda, respectivamente.
Esto tiene implicaciones significativas en el análisis de datos, ya que una
distribución asimétrica puede afectar la interpretación de las medidas de
tendencia central y dispersión. Por lo tanto, la estadística de asimetría no solo
ayuda a describir la forma de los datos, sino que también guía a los
investigadores en la toma de decisiones informadas sobre cómo abordar y
analizar su información, destacando la importancia de considerar la asimetría
como un componente clave en el análisis estadístico.
d. La curtosis es una medida estadística valiosa que nos proporciona información
sobre la forma de una distribución de datos y la presencia de valores atípicos.
Su comprensión nos permite obtener una visión más completa de nuestros
conjuntos de datos y aprovechar todo su potencial informativo. Al analizar la
curtosis, podemos evaluar la concentración de datos alrededor de la media, la
presencia de valores extremos y la volatilidad de una distribución.
REFERENCIAS
Serra, B. R. (2014, abril 13). Asimetría y curtosis. Universo
Formulas. [Link]
[Link]
[Link]
23
[Link]
estadistica/concepto-de-asimetria-y-apuntamiento/21979731
Economipedia. (2024). Medidas de dispersión: Qué son, para qué sirven y
fórmulas. Recuperado de [Link]
[Link]
Esan. (2024). Diagrama de dispersión: ¿cómo usar esta herramienta de
control de calidad? Recuperado de
[Link]
esta-herramienta-de-control-de-calidad
Levin, J. (2006). Statistics for Managers. Pearson.
Khan Academy. (2024). Introduction to Standard Deviation.
OACampus Virtual. Estadígrafos de Dispersión [PDF].
Espinosa, M. [@SoloPapelyBoli]. (2018, diciembre 12). COEFICIENTE DE ASIMETRÍA.
Youtube. [Link]
LLinás, H., Rojas, C. (2005); Estadística descriptiva y distribuciones de probabilidad.
Barranquilla: Editorial Universidad del Norte.
Serra, B. R. (2014, abril 13). Asimetría y curtosis. Universo
Formulas. [Link]
Coeficiente de asimetría de Pearson - definición y noticias relacionadas - Ikusmira.
(s. f.). [Link]
Asimetrías. (s. f.). Issuu. [Link]
[Link]
[Link]