Probabilidad y Estadística
Taller #3
Datos estadisticos
Profesora: Dra. Monica Valenzuela Delgado
Alumno: Armenta Ramirez Adrian Alexander
No. De Control: 25490974
Fecha: 28 de mayo del 2026 Mexicali B.C.
Indice
Introducción
La probabilidad y la estadística son ramas de las matemáticas que
permiten analizar datos y tomar decisiones en situaciones de
incertidumbre. La probabilidad estudia la posibilidad de que ocurra un
evento, asignándole un valor entre 0 y 1; mientras más cercano a 1,
mayor es la posibilidad de ocurrencia. Por otro lado, la estadística se
encarga de recolectar, organizar, representar e interpretar datos para
obtener conclusiones útiles.
Estas disciplinas tienen aplicaciones en muchas áreas como la
economía, medicina, ingeniería, educación y ciencias sociales.
Gracias a ellas es posible estudiar comportamientos, predecir
resultados y comprender fenómenos a partir de la información
obtenida en investigaciones o experimentos.
Objetivo
El objetivo de la probabilidad y la estadística es recopilar, organizar,
analizar e interpretar datos para comprender fenómenos y apoyar la
toma de decisiones. Además, permiten medir la incertidumbre y
predecir posibles resultados a partir de la información disponible.
Estas herramientas ayudan a resolver problemas en distintas áreas
como la ciencia, la economía, la ingeniería y la vida cotidiana.
Fundamentos
Que es la estadistica?
La estadística es la rama de las matemáticas que se encarga de
recolectar, organizar, presentar, analizar e interpretar datos con el fin
de obtener información útil y apoyar la toma de decisiones.
Permite estudiar fenómenos o características de una población o
muestra mediante tablas, gráficas y medidas numéricas, facilitando la
comprensión de los datos y la identificación de tendencias, relaciones
o comportamientos.
Cual es su importancia?
La importancia de la estadística radica en que permite transformar
datos en información útil para comprender situaciones, resolver
problemas y tomar decisiones fundamentadas. Gracias a la estadística
es posible analizar grandes cantidades de información, identificar
tendencias, realizar comparaciones y hacer predicciones sobre
eventos futuros.
Su aplicación es fundamental en áreas como la ciencia, la medicina, la
economía, la ingeniería, la educación y los negocios, ya que ayuda a
evaluar resultados, mejorar procesos y reducir la incertidumbre al
momento de tomar decisiones.
Ejemplo: Una empresa puede utilizar la estadística para analizar la
duración de sus neumáticos y determinar el kilometraje promedio
antes de que fallen.
Tablas de datos agrupados: Definición y utilidad
Las tablas de datos agrupados son tablas estadísticas en las que los
datos se organizan en intervalos o clases, en lugar de presentar cada
valor individualmente. Se utilizan cuando se tiene una gran cantidad de
datos, lo que facilita su análisis e interpretación.
Utilidad de las tablas de datos agrupados
• Organizan grandes cantidades de información de manera
ordenada.
• Facilitan la construcción de gráficas, como histogramas y
polígonos de frecuencia.
• Permiten identificar tendencias y patrones en los datos.
• Simplifican el cálculo de medidas estadísticas como la media,
mediana, moda y desviación estándar.
• Ayudan a resumir la información, haciendo más fácil su
comprensión y presentación.
Medidas de tendencia central: Media, mediana y moda
Las medidas de tendencia central son valores estadísticos que indican
alrededor de qué valor se concentran los datos de un conjunto. Las
principales son la media, la mediana y la moda.
1. Media aritmética
La media es el promedio de todos los datos. Se obtiene sumando todos
los valores y dividiendo el resultado entre el número total de datos.
Utilidad: Representa el valor promedio del conjunto de datos.
2. Mediana
La mediana es el valor que ocupa la posición central cuando los datos
se ordenan de menor a mayor.
• Si el número de datos es impar, la mediana es el dato central.
• Si el número de datos es par, la mediana es el promedio de los
dos valores centrales.
Utilidad: Divide los datos en dos grupos iguales: el 50% de los datos
queda por debajo y el otro 50% por encima.
3. Moda
La moda es el valor que aparece con mayor frecuencia en un conjunto
de datos.
• Puede haber una moda (unimodal).
• Dos modas (bimodal).
• Más de dos modas (multimodal).
• O no existir moda si ningún valor se repite.
Utilidad: Indica el valor más común o frecuente.
Cálculo de la media a partir de datos agrupados:
Explicar y dar un ejemplo
Cuando los datos están agrupados en intervalos, no se conocen los
valores individuales de cada observación. Por ello, la media aritmética
se calcula utilizando las marcas de clase (punto medio de cada
intervalo) y sus frecuencias.
Formula de la media:
Ejemplo
Supongamos la siguiente tabla de frecuencias:
Intervalo Frecuencia
((f_i))
10 – 20 5
20 – 30 8
30 – 40 12
40 – 50 5
Paso 1. Calcular las marcas de clase
Intervalo (f_i) (x_i)
10 – 20 5 15
20 – 30 8 25
30 – 40 12 35
40 – 50 5 45
Paso 2. Calcular fi xi
(f_i) (x_i) (f_i x_i)
Intervalo
10 – 20 5 15 75
20 – 30 8 25 200
30 – 40 12 35 420
40 – 50 5 45 225
Paso 3. Aplicar la fórmula
X = 920 / 30
X = 30.67
Resultado
La media aritmética de los datos agrupados es aproximadamente 30.67.
Interpretación: En promedio, los valores del conjunto de datos se encuentran
alrededor de 30.67 unidades.
Cómo encontrar la mediana en datos agrupados
La mediana es el valor que divide el conjunto de datos en dos partes
iguales: el 50% de los datos queda por debajo de ella y el otro 50% por
encima.
Cuando los datos están agrupados en intervalos, la mediana se
calcula con la siguiente fórmula:
Ejemplo
Intervalo (f_i) (F_i)
10 – 20 5 5
20 – 30 8 13
30 – 40 12 25
40 – 50 5 30
Paso 1. Calcular N / 2
N = 30
N / 2 = 15
Paso 2: Identificar la clase mediana
Buscamos en la frecuencia acumulada el primer valor que sea igual o
mayor que 15.
Intervalo (F_i)
10 – 20 5
20 – 30 13
30 – 40 25
Como 25 es el primer valor que supera 15, la clase mediana es 30 – 40.
Por lo tanto:
• L = 30
• Fa = 13
• Fm = 12
• C = 10
Paso 3: Sustituir en la fórmula
Resultado
Me = 31.67
Interpretación: aproximadamente el 50% de los datos es menor que
31.67 y el otro 50% es mayor que ese valor.
Determinar la moda en conjuntos de datos
La moda es el valor o categoría que aparece con mayor frecuencia en
un conjunto de datos. Es una medida de tendencia central que indica
cuál es el dato más común.
Datos no agrupados
Para encontrar la moda, se identifica el valor que más se repite.
Ejemplo:
Datos: 4, 6, 6, 8, 10, 6, 12
• 4 → 1 vez
• 6 → 3 veces
• 8 → 1 vez
• 10 → 1 vez
• 12 → 1 vez
La moda es = 6
Moda en datos agrupados
Cuando los datos están agrupados en intervalos, la moda se estima
mediante la clase modal, es decir, el intervalo con mayor frecuencia.
La fórmula es:
Ejemplo
Intervalo Frecuencia
10 – 20 5
20 – 30 8
30 – 40 12
40 – 50 5
La frecuencia más alta es 12, por lo que la clase modal es:
30-40
Datos
• L
• FM
• F anterior
• F siguiente
• C = 10
Calculamos
Sustituyendo
Resultado
La moda estimada es aproximadamente 33.64, lo que indica que los datos tienden a
concentrarse alrededor de ese valor. En datos agrupados, primero se identifica la
clase modal y luego se aplica la fórmula para obtener una estimación más precisa.
Medidas de dispersión: Desviación media y varianza
Las medidas de dispersión permiten conocer qué tan alejados o
dispersos están los datos respecto a una medida central,
generalmente la media. Entre las más utilizadas se encuentran la
desviación media y la varianza.
1. Desviación media
La desviación media es el promedio de las distancias absolutas entre
cada dato y la media aritmética.
Su fórmula para datos no agrupados es:
• DM = Desviación media
• Xi = Cada dato
• X = media aritmética
• N = número de datos
Ejemplo
Datos: 2, 4, 6, 8, 10
Media:
Desviaciones absolutas
Resultado:
DM = 2.4
Varianza
La varianza mide el promedio de los cuadrados de las desviaciones
respecto a la media. Indica el grado de dispersión de los datos.
La fórmula para una población es:
Ejemplo
Utilizando los mismos datos: 2, 4, 6, 8, 10
Media:
Calculamos los cuadrados de las desviaciones:
(x_i) ((x_i-
\bar{x})^2)
2 16
4 4
6 0
8 4
10 16
Resultado
S=8
Interpretación
• Desviación media: muestra cuánto se alejan los datos de la media en
promedio.
• Varianza: mide la dispersión considerando el cuadrado de las desviaciones;
mientras mayor sea la varianza, más dispersos estarán los datos.
Estas medidas complementan a la media, mediana y moda, ya que no solo indican
dónde se concentran los datos, sino también qué tan separados están entre sí.
El coeficiente de variación de Pearson y para qué sirve
El coeficiente de variación de Pearson (CV) es una medida de
dispersión relativa que indica qué tan grande es la variabilidad de los
datos en comparación con su media. Se expresa como un porcentaje,
lo que permite comparar la dispersión de diferentes conjuntos de
datos, aunque tengan distintas unidades o escalas.
La fórmula es:
Ejemplo
Supongamos que un conjunto de datos tiene:
• Media: xˉ = 50
• Desviación estándar: S = 10
Sustituyendo en la fórmula:
¿Para qué sirve?
• Comparar la dispersión de distintos conjuntos de datos.
• Evaluar qué tan representativa es la media.
• Determinar la homogeneidad o heterogeneidad de los datos.
• Analizar la precisión y estabilidad de mediciones o procesos.
Por ejemplo, si dos grupos tienen diferentes medias, el coeficiente de
variación permite identificar cuál presenta una mayor dispersión
relativa respecto a su promedio.
Cuartiles, deciles y percentiles: Cómo calcularlos y ejemplo
Los cuartiles, deciles y percentiles son medidas de posición que
permiten dividir un conjunto de datos ordenados en partes iguales y
determinar la ubicación relativa de un dato dentro de la distribución.
1. Cuartiles
Los cuartiles dividen los datos en cuatro partes iguales:
• Q1: deja por debajo al 25% de los datos.
• Q2: corresponde a la mediana (50%).
• Q3: deja por debajo al 75% de los datos.
Cálculo
La posición de un cuartil se obtiene con:
Donde
• K = 1,2,3
• N = número de datos
Ejemplo
Datos ordenados:
2, 4, 6, 8, 10, 12, 14, 16
N=8
Posición de Q1 =
El cuartil se encuentra entre el segundo y el tercer dato, por lo que Q1 = 4.5
2. Deciles
Los deciles dividen los datos en diez partes iguales.
• D1 deja por debajo al 10%.
• D5 deja por debajo al 50%.
• D9 deja por debajo al 90%.
Calculo
Donde:
• K = 1,2, ......,9
Ejemplo
Para los mismos datos:
Posición de D3
El tercer decil se encuentra entre el segundo y tercer dato.
D3 = 5.4
3. Percentiles
Los percentiles dividen los datos en 100 partes iguales.
• P 25 equivale al primer cuartil.
• P 50 equivale a la mediana.
• P 75 equivale al tercer cuartil.
Cálculo
Donde:
• K = 1,2, ......, 9
Ejemplo:
Posición del percentil 60:
Se encuentra entre el quinto dato (10) y el sexto dato (12):
P60 = 10.8
Importancia
• Permiten conocer la posición de un dato dentro de una
distribución.
• Facilitan comparaciones entre individuos o grupos.
• Son muy utilizados en educación, economía, medicina e
investigaciones estadísticas.
• Ayudan a interpretar resultados y a identificar valores altos,
medios o bajos dentro de un conjunto de datos
Desarrollo
Planteamiento del problema
En este trabajo se realizó una encuesta a 22 personas, esto con el fin
de conocer información sobre sus horas de sueño y posteriormente
analizar los resultados utilizando las diferentes herramientas que nos
brinda la estadística.
Con los datos obtenidos se elaboraron tablas de frecuencias y se
calcularon diferentes medidas estadísticas, como la media, la
mediana y la moda, las cuales permiten interpretar de mejor manera
cómo se distribuyen las edades dentro del grupo encuestado.
Encuesta realizada
Aqui podemos observar la encuesta que se realizó y las respuestas de esta
Las respuestas que obtuve fueron las siguientes
5-6 horas = 9 personas
6-8 horas = 10 personas
8-10 = 3 personas
Construcción de tablas de frecuencias
Horas de Frecuencia Frecuencia Frecuencia Frecuencia
sueño absoluta (ni) relativa (fi) Relativa acumulada
acumulada (Ni)
5 – 6 horas 9 0.409 0.409 9
6 – 8 horas 10 0.455 0.864 19
8 – 10 horas 3 0.136 1.000 22
Total 22 1.000 1.000 22
Interpretación de la tabla
• La categoría con mayor frecuencia es 6–8 horas, ya que 10
personas (45.5%) duermen en ese intervalo.
• 9 personas (40.9%) duermen entre 5 y 6 horas.
• Solo 3 personas (13.6%) duermen entre 8 y 10 horas.
• La frecuencia acumulada muestra que 19 de las 22 personas
(86.4%) duermen como máximo 8 horas diarias.
• En general, la mayoría de los encuestados duerme entre 5 y 8
horas al día, siendo más común el intervalo de 6 a 8 horas
Tabla de frecuencia acumulada ascendente y descendente
Horas de ni Fi Fi
sueño ascendente descendente
5–6 horas 9 9 22
6–8 horas 10 19 13
8–10 horas 3 22 3
Total 22 22
Cálculo
Frecuencia acumulada ascendente (Fi↑)
Se suma de arriba hacia abajo:
• 9
• 9 + 10 = 19
• 19 + 3 = 22
Frecuencia acumulada descendente (Fi↓)
Se suma de abajo hacia arriba:
• 3
• 10 + 3 = 13
• 9 + 10 + 3 = 22
Histograma
Con el histograma nos podemos dar cuenta de manera grafica cuales son los datos
que más aparecen en la encuesta
La barra más grande o alta corresponde a el rango de 6-8 horas de sueño mientras
que la más baja a el rango de 5-6 horas de sueño
Cálculo de las principales medias de tendencia
Media aritmética
La fórmula para datos agrupados es:
Primero calculamos fixi
(x_i) (f_i) (f_i
x_i)
5.5 9 49.5
7.0 10 70
9.0 3 27
Total 22 146.5
Ahora sustituimos los datos en la formula
Dando como resultado que la media es de 6.66
Lo cual nos dice que en promedio las personas duermen
aproximadamente 6.7 horas al día
Mediana
Para esto dividiremos el número total de datos entre dos
La frecuencia acumulada es la siguiente
Intervalo Fi
5–6 9
6–8 19
8–10 22
El dato número 11 cae en el intervalo 6–8 horas, por lo que esta es la
clase mediana.
Aplicando la fórmula
Sustituiremos los valores en la formula
Mediana = 6.4
Esto nos daría a entender que el 50% de los encuestados duerme
menos de 6.4 horas y el otro 50% duerme más de esa cantidad
Moda
La clase con mayor frecuencia es
6-8 horas
Esto porque su frecuencia es de 10
Entonces el rango de sueño más frecuente fue el 6-8 horas
Medidas de dispersión
Desviación estándar
La fórmula para datos agrupados es:
Sustituyendo
La desviación estándar es de 1.19 horas
En promedio, las horas de sueño de los encuestados se alejan
aproximadamente 1.19 horas de la media de 6.66 horas.
Varianza
La fórmula para datos agrupados es:
Resultado = 1.35 horas
La varianza de 1.35 horas muestra una dispersión baja a moderada de
las horas de sueño.
Calcular el coeficiente de Pearson
Para eso utilizaremos la siguiente formula
Sustituyendo
El coeficiente de variación de Pearson fue de 17.87%, lo que indica que
las horas de sueño de los encuestados presentan una dispersión
relativamente baja respecto a la media de 6.66 horas. Esto significa que
la mayoría de las respuestas se concentra cerca del promedio, por lo
que los hábitos de sueño del grupo son bastante homogéneos y la
media puede considerarse una medida representativa del conjunto de
datos.
Calcular cuartiles, deciles y percentiles
Cuartiles
Primer cuartil Q1
Posición
La posición 5.5 cae en el intervalo 5-6 horas
Aplicando la formula
El primer cuartil seria 5.61
Segundo cuartil Q2
Este vendría siendo lo mismo que la mediana
Por lo tanto, Q2 = 6.40
Tercer cuartil
Posición:
La posición 16.5 cae en el intervalo 6-8 horas
Por lo cual el tercer cuartil seria
Q3 = 7.50
Deciles
Decil 1
Decil 5
Coincide con la mediana 6.40
Decil 9
La posición cae en el intervalo 8-10 horas
Percentiles
Percentil 25
Coincide con Q1 = 5.60
Percentil 50
Coincide con la mediana = 6.40
Percentil 75
Coincide con Q3 = 7.50
El 25% de los encuestados duerme menos de 5.61 horas diarias, el 50%
duerme menos de 6.40 horas y el 75% duerme menos de 7.50 horas.
Además, el 90% de los participantes duerme menos de 8.53 horas, lo
que indica que la mayoría de las horas de sueño se concentra entre 6 y
8 horas diarias.
Proceso
Primero se realizó la encuesta, para luego compartirla con diferentes
personas al final logre obtener 22 respuestas en esta encuesta.
Organice los datos que me dio la encuesta y luego saque las distintas
tablas de frecuencias y el histograma
Posteriormente calcule los siguientes datos
• Media
• Mediana
• Moda
• Varianza
• Desviación estándar
• Coeficiente de variación
• Cuartiles, deciles y percentiles
Resultados
Media 6.66 horas
Mediana 6.40 horas
Moda 6-8 horas
Desviación media 1.19 horas
Varianza 1.35 horas
Coeficiente de variación de Pearson 17.87
Q1 = 5.60
Q2 = 6.40
Q3 = 7.50
D1 = 5.24
D5 = 6.40
D9 = 8.53
P25 = 5.60
P50 = 6.40
P75 = 7.50
Conclusión
El análisis de la encuesta realizada a 22 personas sobre sus horas de
sueño muestra que la mayoría de los participantes duerme entre 6 y 8
horas diarias, siendo este el intervalo más frecuente. La media de 6.66
horas, la mediana de 6.40 horas y la moda de 6 a 8 horas indican que el
tiempo de sueño típico de los encuestados se encuentra alrededor de
las 6 a 7 horas por día. Además, las medidas de dispersión obtenidas,
como la desviación media de 0.95 horas, la desviación estándar de 1.19
horas y el coeficiente de variación de 17.87%, muestran que las
respuestas presentan una variabilidad relativamente baja, por lo que
los hábitos de sueño del grupo son bastante homogéneos. Por otra
parte, los cuartiles, deciles y percentiles confirman que la mayor parte
de los encuestados concentra sus horas de descanso entre
aproximadamente 5.6 y 7.5 horas, mientras que solo una pequeña
proporción supera las 8 horas de sueño. En conjunto, los resultados
indican que los participantes mantienen patrones de sueño similares y
que la mayoría duerme una cantidad de horas cercana a la
recomendada para adultos.
Referencias
[Link]
[Link]
datastatistics/mean-and-median/v/statistics-intro-mean-median-and-
mode?utm_source
[Link]
quantitative-data/mean-median-basics/a/mean-median-and-mode-
review?qa_expand_type=question&utm_source
[Link]
statistics/[Link]?utm_source=
OpenAi
Anexos
Gráfico de la encuesta en Google forms
histograma