0% encontró este documento útil (0 votos)
3 vistas34 páginas

Document 2

El documento aborda la probabilidad y la estadística, destacando su importancia en la toma de decisiones y el análisis de datos en diversas áreas. Se explican conceptos fundamentales como la media, mediana, moda, y medidas de dispersión, además de la utilidad de tablas de datos agrupados. También se presenta un estudio de caso sobre horas de sueño, mostrando la aplicación práctica de las herramientas estadísticas en la recolección y análisis de datos.
Derechos de autor
© All Rights Reserved
Nos tomamos en serio los derechos de los contenidos. Si sospechas que se trata de tu contenido, reclámalo aquí.
Formatos disponibles
Descarga como PDF, TXT o lee en línea desde Scribd
0% encontró este documento útil (0 votos)
3 vistas34 páginas

Document 2

El documento aborda la probabilidad y la estadística, destacando su importancia en la toma de decisiones y el análisis de datos en diversas áreas. Se explican conceptos fundamentales como la media, mediana, moda, y medidas de dispersión, además de la utilidad de tablas de datos agrupados. También se presenta un estudio de caso sobre horas de sueño, mostrando la aplicación práctica de las herramientas estadísticas en la recolección y análisis de datos.
Derechos de autor
© All Rights Reserved
Nos tomamos en serio los derechos de los contenidos. Si sospechas que se trata de tu contenido, reclámalo aquí.
Formatos disponibles
Descarga como PDF, TXT o lee en línea desde Scribd

Probabilidad y Estadística

Taller #3

Datos estadisticos

Profesora: Dra. Monica Valenzuela Delgado

Alumno: Armenta Ramirez Adrian Alexander

No. De Control: 25490974

Fecha: 28 de mayo del 2026 Mexicali B.C.

Indice
Introducción
La probabilidad y la estadística son ramas de las matemáticas que
permiten analizar datos y tomar decisiones en situaciones de
incertidumbre. La probabilidad estudia la posibilidad de que ocurra un
evento, asignándole un valor entre 0 y 1; mientras más cercano a 1,
mayor es la posibilidad de ocurrencia. Por otro lado, la estadística se
encarga de recolectar, organizar, representar e interpretar datos para
obtener conclusiones útiles.

Estas disciplinas tienen aplicaciones en muchas áreas como la


economía, medicina, ingeniería, educación y ciencias sociales.
Gracias a ellas es posible estudiar comportamientos, predecir
resultados y comprender fenómenos a partir de la información
obtenida en investigaciones o experimentos.
Objetivo
El objetivo de la probabilidad y la estadística es recopilar, organizar,
analizar e interpretar datos para comprender fenómenos y apoyar la
toma de decisiones. Además, permiten medir la incertidumbre y
predecir posibles resultados a partir de la información disponible.
Estas herramientas ayudan a resolver problemas en distintas áreas
como la ciencia, la economía, la ingeniería y la vida cotidiana.
Fundamentos
Que es la estadistica?

La estadística es la rama de las matemáticas que se encarga de


recolectar, organizar, presentar, analizar e interpretar datos con el fin
de obtener información útil y apoyar la toma de decisiones.

Permite estudiar fenómenos o características de una población o


muestra mediante tablas, gráficas y medidas numéricas, facilitando la
comprensión de los datos y la identificación de tendencias, relaciones
o comportamientos.

Cual es su importancia?

La importancia de la estadística radica en que permite transformar


datos en información útil para comprender situaciones, resolver
problemas y tomar decisiones fundamentadas. Gracias a la estadística
es posible analizar grandes cantidades de información, identificar
tendencias, realizar comparaciones y hacer predicciones sobre
eventos futuros.

Su aplicación es fundamental en áreas como la ciencia, la medicina, la


economía, la ingeniería, la educación y los negocios, ya que ayuda a
evaluar resultados, mejorar procesos y reducir la incertidumbre al
momento de tomar decisiones.

Ejemplo: Una empresa puede utilizar la estadística para analizar la


duración de sus neumáticos y determinar el kilometraje promedio
antes de que fallen.
Tablas de datos agrupados: Definición y utilidad
Las tablas de datos agrupados son tablas estadísticas en las que los
datos se organizan en intervalos o clases, en lugar de presentar cada
valor individualmente. Se utilizan cuando se tiene una gran cantidad de
datos, lo que facilita su análisis e interpretación.

Utilidad de las tablas de datos agrupados

• Organizan grandes cantidades de información de manera


ordenada.
• Facilitan la construcción de gráficas, como histogramas y
polígonos de frecuencia.
• Permiten identificar tendencias y patrones en los datos.
• Simplifican el cálculo de medidas estadísticas como la media,
mediana, moda y desviación estándar.
• Ayudan a resumir la información, haciendo más fácil su
comprensión y presentación.
Medidas de tendencia central: Media, mediana y moda
Las medidas de tendencia central son valores estadísticos que indican
alrededor de qué valor se concentran los datos de un conjunto. Las
principales son la media, la mediana y la moda.

1. Media aritmética

La media es el promedio de todos los datos. Se obtiene sumando todos


los valores y dividiendo el resultado entre el número total de datos.

Utilidad: Representa el valor promedio del conjunto de datos.

2. Mediana

La mediana es el valor que ocupa la posición central cuando los datos


se ordenan de menor a mayor.

• Si el número de datos es impar, la mediana es el dato central.


• Si el número de datos es par, la mediana es el promedio de los
dos valores centrales.

Utilidad: Divide los datos en dos grupos iguales: el 50% de los datos
queda por debajo y el otro 50% por encima.

3. Moda

La moda es el valor que aparece con mayor frecuencia en un conjunto


de datos.

• Puede haber una moda (unimodal).


• Dos modas (bimodal).
• Más de dos modas (multimodal).
• O no existir moda si ningún valor se repite.

Utilidad: Indica el valor más común o frecuente.


Cálculo de la media a partir de datos agrupados:
Explicar y dar un ejemplo
Cuando los datos están agrupados en intervalos, no se conocen los
valores individuales de cada observación. Por ello, la media aritmética
se calcula utilizando las marcas de clase (punto medio de cada
intervalo) y sus frecuencias.

Formula de la media:

Ejemplo

Supongamos la siguiente tabla de frecuencias:

Intervalo Frecuencia
((f_i))
10 – 20 5

20 – 30 8

30 – 40 12

40 – 50 5
Paso 1. Calcular las marcas de clase

Intervalo (f_i) (x_i)


10 – 20 5 15
20 – 30 8 25
30 – 40 12 35
40 – 50 5 45

Paso 2. Calcular fi xi

(f_i) (x_i) (f_i x_i)


Intervalo
10 – 20 5 15 75
20 – 30 8 25 200
30 – 40 12 35 420
40 – 50 5 45 225

Paso 3. Aplicar la fórmula

X = 920 / 30

X = 30.67

Resultado

La media aritmética de los datos agrupados es aproximadamente 30.67.

Interpretación: En promedio, los valores del conjunto de datos se encuentran


alrededor de 30.67 unidades.
Cómo encontrar la mediana en datos agrupados
La mediana es el valor que divide el conjunto de datos en dos partes
iguales: el 50% de los datos queda por debajo de ella y el otro 50% por
encima.

Cuando los datos están agrupados en intervalos, la mediana se


calcula con la siguiente fórmula:

Ejemplo
Intervalo (f_i) (F_i)
10 – 20 5 5
20 – 30 8 13
30 – 40 12 25
40 – 50 5 30

Paso 1. Calcular N / 2

N = 30
N / 2 = 15

Paso 2: Identificar la clase mediana

Buscamos en la frecuencia acumulada el primer valor que sea igual o


mayor que 15.

Intervalo (F_i)
10 – 20 5
20 – 30 13
30 – 40 25
Como 25 es el primer valor que supera 15, la clase mediana es 30 – 40.

Por lo tanto:

• L = 30
• Fa = 13
• Fm = 12
• C = 10

Paso 3: Sustituir en la fórmula

Resultado

Me = 31.67

Interpretación: aproximadamente el 50% de los datos es menor que


31.67 y el otro 50% es mayor que ese valor.
Determinar la moda en conjuntos de datos
La moda es el valor o categoría que aparece con mayor frecuencia en
un conjunto de datos. Es una medida de tendencia central que indica
cuál es el dato más común.

Datos no agrupados

Para encontrar la moda, se identifica el valor que más se repite.

Ejemplo:

Datos: 4, 6, 6, 8, 10, 6, 12

• 4 → 1 vez
• 6 → 3 veces
• 8 → 1 vez
• 10 → 1 vez
• 12 → 1 vez
La moda es = 6

Moda en datos agrupados

Cuando los datos están agrupados en intervalos, la moda se estima


mediante la clase modal, es decir, el intervalo con mayor frecuencia.

La fórmula es:

Ejemplo
Intervalo Frecuencia
10 – 20 5
20 – 30 8
30 – 40 12
40 – 50 5

La frecuencia más alta es 12, por lo que la clase modal es:

30-40
Datos

• L
• FM
• F anterior
• F siguiente
• C = 10

Calculamos

Sustituyendo

Resultado

La moda estimada es aproximadamente 33.64, lo que indica que los datos tienden a
concentrarse alrededor de ese valor. En datos agrupados, primero se identifica la
clase modal y luego se aplica la fórmula para obtener una estimación más precisa.
Medidas de dispersión: Desviación media y varianza
Las medidas de dispersión permiten conocer qué tan alejados o
dispersos están los datos respecto a una medida central,
generalmente la media. Entre las más utilizadas se encuentran la
desviación media y la varianza.

1. Desviación media

La desviación media es el promedio de las distancias absolutas entre


cada dato y la media aritmética.

Su fórmula para datos no agrupados es:

• DM = Desviación media
• Xi = Cada dato
• X = media aritmética
• N = número de datos

Ejemplo

Datos: 2, 4, 6, 8, 10

Media:
Desviaciones absolutas

Resultado:

DM = 2.4

Varianza

La varianza mide el promedio de los cuadrados de las desviaciones


respecto a la media. Indica el grado de dispersión de los datos.

La fórmula para una población es:

Ejemplo

Utilizando los mismos datos: 2, 4, 6, 8, 10

Media:

Calculamos los cuadrados de las desviaciones:


(x_i) ((x_i-
\bar{x})^2)
2 16
4 4
6 0
8 4
10 16

Resultado

S=8

Interpretación

• Desviación media: muestra cuánto se alejan los datos de la media en


promedio.
• Varianza: mide la dispersión considerando el cuadrado de las desviaciones;
mientras mayor sea la varianza, más dispersos estarán los datos.

Estas medidas complementan a la media, mediana y moda, ya que no solo indican


dónde se concentran los datos, sino también qué tan separados están entre sí.

El coeficiente de variación de Pearson y para qué sirve


El coeficiente de variación de Pearson (CV) es una medida de
dispersión relativa que indica qué tan grande es la variabilidad de los
datos en comparación con su media. Se expresa como un porcentaje,
lo que permite comparar la dispersión de diferentes conjuntos de
datos, aunque tengan distintas unidades o escalas.

La fórmula es:

Ejemplo

Supongamos que un conjunto de datos tiene:

• Media: xˉ = 50
• Desviación estándar: S = 10

Sustituyendo en la fórmula:

¿Para qué sirve?

• Comparar la dispersión de distintos conjuntos de datos.


• Evaluar qué tan representativa es la media.
• Determinar la homogeneidad o heterogeneidad de los datos.
• Analizar la precisión y estabilidad de mediciones o procesos.

Por ejemplo, si dos grupos tienen diferentes medias, el coeficiente de


variación permite identificar cuál presenta una mayor dispersión
relativa respecto a su promedio.

Cuartiles, deciles y percentiles: Cómo calcularlos y ejemplo


Los cuartiles, deciles y percentiles son medidas de posición que
permiten dividir un conjunto de datos ordenados en partes iguales y
determinar la ubicación relativa de un dato dentro de la distribución.

1. Cuartiles

Los cuartiles dividen los datos en cuatro partes iguales:

• Q1: deja por debajo al 25% de los datos.


• Q2: corresponde a la mediana (50%).
• Q3: deja por debajo al 75% de los datos.

Cálculo

La posición de un cuartil se obtiene con:

Donde

• K = 1,2,3
• N = número de datos

Ejemplo

Datos ordenados:

2, 4, 6, 8, 10, 12, 14, 16

N=8
Posición de Q1 =

El cuartil se encuentra entre el segundo y el tercer dato, por lo que Q1 = 4.5


2. Deciles

Los deciles dividen los datos en diez partes iguales.

• D1 deja por debajo al 10%.


• D5 deja por debajo al 50%.
• D9 deja por debajo al 90%.
Calculo

Donde:
• K = 1,2, ......,9
Ejemplo

Para los mismos datos:

Posición de D3

El tercer decil se encuentra entre el segundo y tercer dato.

D3 = 5.4
3. Percentiles

Los percentiles dividen los datos en 100 partes iguales.

• P 25 equivale al primer cuartil.


• P 50 equivale a la mediana.
• P 75 equivale al tercer cuartil.

Cálculo

Donde:

• K = 1,2, ......, 9
Ejemplo:

Posición del percentil 60:

Se encuentra entre el quinto dato (10) y el sexto dato (12):

P60 = 10.8

Importancia

• Permiten conocer la posición de un dato dentro de una


distribución.
• Facilitan comparaciones entre individuos o grupos.
• Son muy utilizados en educación, economía, medicina e
investigaciones estadísticas.
• Ayudan a interpretar resultados y a identificar valores altos,
medios o bajos dentro de un conjunto de datos
Desarrollo

Planteamiento del problema

En este trabajo se realizó una encuesta a 22 personas, esto con el fin


de conocer información sobre sus horas de sueño y posteriormente
analizar los resultados utilizando las diferentes herramientas que nos
brinda la estadística.
Con los datos obtenidos se elaboraron tablas de frecuencias y se
calcularon diferentes medidas estadísticas, como la media, la
mediana y la moda, las cuales permiten interpretar de mejor manera
cómo se distribuyen las edades dentro del grupo encuestado.

Encuesta realizada

Aqui podemos observar la encuesta que se realizó y las respuestas de esta

Las respuestas que obtuve fueron las siguientes

5-6 horas = 9 personas

6-8 horas = 10 personas

8-10 = 3 personas
Construcción de tablas de frecuencias
Horas de Frecuencia Frecuencia Frecuencia Frecuencia
sueño absoluta (ni) relativa (fi) Relativa acumulada
acumulada (Ni)
5 – 6 horas 9 0.409 0.409 9

6 – 8 horas 10 0.455 0.864 19

8 – 10 horas 3 0.136 1.000 22

Total 22 1.000 1.000 22

Interpretación de la tabla

• La categoría con mayor frecuencia es 6–8 horas, ya que 10


personas (45.5%) duermen en ese intervalo.
• 9 personas (40.9%) duermen entre 5 y 6 horas.
• Solo 3 personas (13.6%) duermen entre 8 y 10 horas.
• La frecuencia acumulada muestra que 19 de las 22 personas
(86.4%) duermen como máximo 8 horas diarias.
• En general, la mayoría de los encuestados duerme entre 5 y 8
horas al día, siendo más común el intervalo de 6 a 8 horas

Tabla de frecuencia acumulada ascendente y descendente


Horas de ni Fi Fi
sueño ascendente descendente

5–6 horas 9 9 22

6–8 horas 10 19 13

8–10 horas 3 22 3

Total 22 22
Cálculo

Frecuencia acumulada ascendente (Fi↑)

Se suma de arriba hacia abajo:

• 9
• 9 + 10 = 19
• 19 + 3 = 22

Frecuencia acumulada descendente (Fi↓)

Se suma de abajo hacia arriba:

• 3
• 10 + 3 = 13
• 9 + 10 + 3 = 22

Histograma

Con el histograma nos podemos dar cuenta de manera grafica cuales son los datos
que más aparecen en la encuesta

La barra más grande o alta corresponde a el rango de 6-8 horas de sueño mientras
que la más baja a el rango de 5-6 horas de sueño
Cálculo de las principales medias de tendencia

Media aritmética
La fórmula para datos agrupados es:

Primero calculamos fixi

(x_i) (f_i) (f_i


x_i)
5.5 9 49.5

7.0 10 70

9.0 3 27

Total 22 146.5

Ahora sustituimos los datos en la formula

Dando como resultado que la media es de 6.66


Lo cual nos dice que en promedio las personas duermen
aproximadamente 6.7 horas al día

Mediana
Para esto dividiremos el número total de datos entre dos
La frecuencia acumulada es la siguiente
Intervalo Fi

5–6 9

6–8 19

8–10 22

El dato número 11 cae en el intervalo 6–8 horas, por lo que esta es la


clase mediana.

Aplicando la fórmula

Sustituiremos los valores en la formula

Mediana = 6.4

Esto nos daría a entender que el 50% de los encuestados duerme


menos de 6.4 horas y el otro 50% duerme más de esa cantidad

Moda

La clase con mayor frecuencia es

6-8 horas

Esto porque su frecuencia es de 10

Entonces el rango de sueño más frecuente fue el 6-8 horas


Medidas de dispersión
Desviación estándar

La fórmula para datos agrupados es:

Sustituyendo

La desviación estándar es de 1.19 horas

En promedio, las horas de sueño de los encuestados se alejan


aproximadamente 1.19 horas de la media de 6.66 horas.
Varianza

La fórmula para datos agrupados es:

Resultado = 1.35 horas

La varianza de 1.35 horas muestra una dispersión baja a moderada de


las horas de sueño.
Calcular el coeficiente de Pearson
Para eso utilizaremos la siguiente formula

Sustituyendo

El coeficiente de variación de Pearson fue de 17.87%, lo que indica que


las horas de sueño de los encuestados presentan una dispersión
relativamente baja respecto a la media de 6.66 horas. Esto significa que
la mayoría de las respuestas se concentra cerca del promedio, por lo
que los hábitos de sueño del grupo son bastante homogéneos y la
media puede considerarse una medida representativa del conjunto de
datos.
Calcular cuartiles, deciles y percentiles

Cuartiles

Primer cuartil Q1

Posición

La posición 5.5 cae en el intervalo 5-6 horas

Aplicando la formula

El primer cuartil seria 5.61

Segundo cuartil Q2

Este vendría siendo lo mismo que la mediana

Por lo tanto, Q2 = 6.40

Tercer cuartil
Posición:
La posición 16.5 cae en el intervalo 6-8 horas

Por lo cual el tercer cuartil seria


Q3 = 7.50

Deciles
Decil 1

Decil 5

Coincide con la mediana 6.40

Decil 9

La posición cae en el intervalo 8-10 horas


Percentiles
Percentil 25

Coincide con Q1 = 5.60


Percentil 50

Coincide con la mediana = 6.40


Percentil 75

Coincide con Q3 = 7.50


El 25% de los encuestados duerme menos de 5.61 horas diarias, el 50%
duerme menos de 6.40 horas y el 75% duerme menos de 7.50 horas.
Además, el 90% de los participantes duerme menos de 8.53 horas, lo
que indica que la mayoría de las horas de sueño se concentra entre 6 y
8 horas diarias.
Proceso
Primero se realizó la encuesta, para luego compartirla con diferentes
personas al final logre obtener 22 respuestas en esta encuesta.

Organice los datos que me dio la encuesta y luego saque las distintas
tablas de frecuencias y el histograma
Posteriormente calcule los siguientes datos
• Media
• Mediana
• Moda
• Varianza
• Desviación estándar
• Coeficiente de variación
• Cuartiles, deciles y percentiles
Resultados
Media 6.66 horas
Mediana 6.40 horas

Moda 6-8 horas


Desviación media 1.19 horas
Varianza 1.35 horas

Coeficiente de variación de Pearson 17.87


Q1 = 5.60

Q2 = 6.40
Q3 = 7.50

D1 = 5.24
D5 = 6.40

D9 = 8.53
P25 = 5.60

P50 = 6.40
P75 = 7.50
Conclusión
El análisis de la encuesta realizada a 22 personas sobre sus horas de
sueño muestra que la mayoría de los participantes duerme entre 6 y 8
horas diarias, siendo este el intervalo más frecuente. La media de 6.66
horas, la mediana de 6.40 horas y la moda de 6 a 8 horas indican que el
tiempo de sueño típico de los encuestados se encuentra alrededor de
las 6 a 7 horas por día. Además, las medidas de dispersión obtenidas,
como la desviación media de 0.95 horas, la desviación estándar de 1.19
horas y el coeficiente de variación de 17.87%, muestran que las
respuestas presentan una variabilidad relativamente baja, por lo que
los hábitos de sueño del grupo son bastante homogéneos. Por otra
parte, los cuartiles, deciles y percentiles confirman que la mayor parte
de los encuestados concentra sus horas de descanso entre
aproximadamente 5.6 y 7.5 horas, mientras que solo una pequeña
proporción supera las 8 horas de sueño. En conjunto, los resultados
indican que los participantes mantienen patrones de sueño similares y
que la mayoría duerme una cantidad de horas cercana a la
recomendada para adultos.
Referencias
[Link]

[Link]
datastatistics/mean-and-median/v/statistics-intro-mean-median-and-
mode?utm_source

[Link]
quantitative-data/mean-median-basics/a/mean-median-and-mode-
review?qa_expand_type=question&utm_source

[Link]
statistics/[Link]?utm_source=

OpenAi

Anexos
Gráfico de la encuesta en Google forms

histograma

También podría gustarte