0% encontró este documento útil (0 votos)
6 vistas15 páginas

ESTADISTICA

El documento es una introducción a la estadística, cubriendo conceptos clave como población, muestra, variables y tipos de estadística. Se detallan métodos para organizar datos, calcular medidas de tendencia central, varianza, desviación estándar y cuartiles. Además, se explican los deciles y su utilidad en el análisis de datos.

Cargado por

webdev.michell
Derechos de autor
© All Rights Reserved
Nos tomamos en serio los derechos de los contenidos. Si sospechas que se trata de tu contenido, reclámalo aquí.
Formatos disponibles
Descarga como PDF, TXT o lee en línea desde Scribd
0% encontró este documento útil (0 votos)
6 vistas15 páginas

ESTADISTICA

El documento es una introducción a la estadística, cubriendo conceptos clave como población, muestra, variables y tipos de estadística. Se detallan métodos para organizar datos, calcular medidas de tendencia central, varianza, desviación estándar y cuartiles. Además, se explican los deciles y su utilidad en el análisis de datos.

Cargado por

webdev.michell
Derechos de autor
© All Rights Reserved
Nos tomamos en serio los derechos de los contenidos. Si sospechas que se trata de tu contenido, reclámalo aquí.
Formatos disponibles
Descarga como PDF, TXT o lee en línea desde Scribd

REPÚBLICA BOLIVARIANA DE VENEZUELA

MINISTERIO DEL PODER POPULAR PARA LA EDUCACIÓN


UNIVERSIDAD POLITÉCNICA TERRITORIAL DE PUERTO CABELLO
PROGRAMA NACIONAL DE FORMACIÓN INFORMÁTICA

INTRODUCCIÓN A LA ESTADÍSTICA.

Profesor: Autor(es):
Jesús Valero Samuel Avilez V-31.994.108
Diomigue Lugo V-28.347.384

Puerto Cabello, 13 de Agosto de 2025


ÍNDICE

I.​ Introducción a la Estadística​ ​ ​ ​ ​ Pag:3-4


II.​ Organización de Datos ​ ​ ​ ​ ​ ​ Pag:5-6
III.​ Deciles​ ​ ​ ​ ​ ​ ​ ​ Pag: 7-8
IV.​ Varianza estándar​ ​ ​ ​ ​ ​ ​ Pag: 9
V.​ Desviación estándar​ ​ ​ ​ ​ Pag: 10-11
VI.​ Media y Varianza​ ​ ​ ​ ​ ​ ​ Pag: 12-13
VII.​ Cuartiles​ ​ ​ ​ ​ ​ ​ ​ Pag: 14-15
📊 ¿Qué es la Estadística?
La estadística es una rama de las matemáticas que se encarga
de la recolección, organización, análisis, interpretación y
presentación de datos numéricos. Su propósito principal es
ayudarnos a describir y comprender fenómenos complejos, lo
que permite tomar decisiones más informadas.

📈 Conceptos Clave
●​ Población: El conjunto completo de elementos
(individuos, objetos, eventos) que son de interés en un
estudio.
●​ Muestra: Un subconjunto representativo de la población
que se selecciona para ser analizado.
●​ Variable: Una característica o atributo que puede medirse
o clasificarse.
●​ Datos: Los valores observados o medidos de una
variable.

🔬 Tipos de Estadística
●​ Estadística Descriptiva: Se centra en resumir y describir
las características principales de un conjunto de datos.
Por ejemplo, calcula promedios o frecuencias para
entender la información.
●​ Estadística Inferencial: Se utiliza para hacer
generalizaciones o predicciones sobre una población
completa basándose únicamente en los datos de una
muestra.

📉 Tipos de Variables
Las variables se clasifican en dos grandes grupos:
●​ Variables Cualitativas: Describen cualidades o
características no numéricas.
○​ Ejemplo: Color de ojos, estado civil.
●​ Variables Cuantitativas: Describen cantidades numéricas.
○​ Ejemplo: Estatura, número de hijos.
○​ Variables Discretas: Toman valores enteros
específicos (ejemplo: número de estudiantes en una
clase).
○​ Variables Continuas: Pueden tomar cualquier valor
dentro de un rango (ejemplo: temperatura, peso).
📈 Organización de Datos
La organización de datos en estadística es el proceso de
estructurar y preparar la información para que sea más fácil de
analizar y comprender. Esto se logra a través de una serie de pasos
que transforman los datos brutos en algo útil.

Pasos para Organizar Datos


1.​ Recopilación de Datos: Se obtienen los datos necesarios
para el estudio, ya sea mediante encuestas, experimentos u
otras fuentes.
2.​ Revisión y Limpieza: Se corrigen errores, se eliminan valores
atípicos y se manejan los datos faltantes para asegurar la
calidad de la información.
3.​ Clasificación: Los datos se agrupan según categorías o
criterios específicos, como el tipo de variable (cualitativa o
cuantitativa).
4.​ Agrupación: Para datos cuantitativos, se pueden crear
distribuciones de frecuencias agrupando los valores en
intervalos o clases.
5.​ Presentación: Se utilizan tablas y gráficos (como
histogramas o diagramas de barras) para visualizar la
distribución y los patrones de los datos.

📊 Medidas de Tendencia Central


Las medidas de tendencia central (media, mediana y moda) son
valores que buscan describir el "centro" de un conjunto de datos,
ayudando a resumir la información.
●​ Media (Promedio): Es el valor que se obtiene al sumar todos
los datos y dividirlos por la cantidad total de datos.
○​ Ejemplo: Para el conjunto {2, 4, 6, 8}, la media es
(2+4+6+8)/4=5.
●​ Mediana: Es el valor que se encuentra justo en el centro
cuando los datos están ordenados de menor a mayor. Si hay
un número par de datos, es el promedio de los dos valores
centrales.
○​ Ejemplo: Para el conjunto {2, 4, 6, 8}, la mediana es
(4+6)/2=5.
●​ Moda: Es el valor que aparece con mayor frecuencia en un
conjunto de datos. Un conjunto puede tener una, varias o
ninguna moda.
○​ Ejemplo: En el conjunto {2, 2, 4, 6, 8}, la moda es 2.
📈 ¿Qué son los Deciles?
Los deciles son medidas de posición que dividen un conjunto de
datos ordenados en diez partes iguales, donde cada parte
representa el 10% del total. Hay nueve deciles en total (D1​ a D9​), y
se utilizan para entender mejor la distribución de los datos.
●​ El primer decil (D1​) marca el valor por debajo del cual se
encuentra el 10% de los datos.
●​ El quinto decil (D5​) representa el valor por debajo del cual
está el 50% de los datos, y coincide con la mediana.
●​ El noveno decil (D9​) es el valor por debajo del cual se ubica
el 90% de los datos.

Los deciles son particularmente útiles en estudios económicos para


analizar, por ejemplo, la distribución de ingresos o salarios,
permitiendo identificar rápidamente los extremos de la población.

Cálculo de Deciles
La forma de calcular los deciles varía si los datos están o no
agrupados.
Para datos no agrupados:

1.​ Ordenar los datos: Se deben ordenar de menor a mayor.


2.​ Calcular la posición: Usa la fórmula:​
𝑘⋅(𝑛+1)
𝑃𝑜𝑠𝑖𝑐𝑖ó𝑛 = 10 ​​
Donde k es el decil que buscas (1 al 9) y n es el número total
de datos.
3.​ Encontrar el valor:
○​ Si la posición es un número entero, el decil es el valor en
esa posición.
○​ Si la posición es un decimal, se interpola entre los dos
valores más cercanos.
Para datos agrupados:

El cálculo es más complejo y requiere el uso de una tabla de


frecuencias. Se utiliza una fórmula que considera el límite inferior de
la clase, la frecuencia acumulada y la amplitud de la clase.

𝑘⋅𝑛
10
−𝐹𝑖−1
𝐷𝑘​ = 𝐿𝑖​ + ( 𝑓𝑖
)​ ⋅𝑎
En resumen, los deciles ofrecen una visión más detallada de la
distribución de los datos, complementando a las medidas de
tendencia central como la media o la mediana.
📈 Varianza: ¿Qué es y cómo se calcula?
La varianza es una medida estadística que cuantifica la dispersión de un
conjunto de datos en relación con su media. En términos sencillos, nos dice qué
tan esparcidos o agrupados están los valores individuales alrededor del
promedio.

Pasos para el Cálculo


1.​ Calcular la media (μ o xˉ): Sumar todos los valores del conjunto de
datos y dividirlos por el número total de datos.
2.​ Calcular las desviaciones: Restar la media a cada valor individual (
𝑥𝑖​ − μ).
3.​ Elevar las desviaciones al cuadrado: Elevar al cuadrado cada una de
las diferencias obtenidas para eliminar los valores negativos.
4.​ Sumar los cuadrados de las desviaciones: Sumar todos los resultados
del paso anterior.
5.​ Dividir:
○​ Si es una población, dividir la suma entre el número total
de datos (N).
○​ Si es una muestra, dividir la suma entre el número total
de datos menos uno (n−1).

Fórmulas

●​ Para una población:​ ●​ Para una muestra:​


2 Σ(𝑥𝑖−μ)² Σ(𝑥𝑖−𝑥ˉ)²
σ = 𝑁
​ 𝑠² = 𝑛−1

○​ σ2: Varianza. ○​ s2: Varianza muestral.
○​ xi​: Cada valor ○​ xi​: Cada valor
individual. individual.
○​ μ: Media de la ○​ xˉ: Media de la
población. muestra.
○​ N: Número total de ○​ n: Número total de
datos. datos en la muestra.
📏 ¿Qué es la Desviación?
En estadística, la desviación es la diferencia o distancia entre un valor
individual de un conjunto de datos y un punto de referencia central,
generalmente la media. Mide qué tan lejos se encuentra un punto de datos
específico del centro de la distribución.

El tipo de desviación más importante y comúnmente utilizado es la desviación


estándar.

Desviación Estándar (σ o s)

La desviación estándar es una medida única que resume el nivel de


dispersión o variabilidad de todo el conjunto de datos.
●​ Una desviación estándar baja indica que los datos están agrupados y
muy cerca de la media. Esto significa que los datos son homogéneos y la
media es muy representativa.
●​ Una desviación estándar alta indica que los datos están más
dispersos, con una mayor variabilidad y valores que se alejan más de la
media.

¿Para qué sirve?

La desviación estándar es crucial para entender la consistencia de los datos.


Por ejemplo, dos grupos de estudiantes pueden tener el mismo promedio de
calificación, pero si uno tiene una desviación estándar mucho más alta, sus
calificaciones fueron más variadas (altas y bajas), mientras que en el otro grupo
las calificaciones fueron más uniformes y cercanas al promedio.

Fórmula y Proceso de Cálculo

La fórmula de la desviación estándar para una población es:

𝑁 2
∑ ​(𝑥𝑖​−μ)
σ = 𝑖=1
𝑁

El cálculo implica estos pasos:

1.​ Calcular la diferencia de cada valor (xi​) con respecto a la media (μ).
2.​ Elevar al cuadrado cada una de esas diferencias.
3.​ Sumar todos los resultados.
4.​ Dividir el total entre el número de datos (N). El resultado de este paso es
la varianza.
5.​ Sacar la raíz cuadrada del resultado final para que la medida vuelva a
las unidades originales de los datos.

En resumen, mientras que la desviación es la diferencia de un solo punto de


datos, la desviación estándar es una medida que nos indica, en promedio,
qué tan lejos están los datos de la media.
📊 Media y Varianza: Medidas Clave en Estadística
La media y la varianza son dos medidas fundamentales para comprender un
conjunto de datos. Mientras que la media nos da el valor promedio, la varianza
nos indica qué tan dispersos están los datos alrededor de ese promedio.

¿Cómo se calculan?
●​ Cálculo de la Media:​
Es el promedio de un conjunto de datos. Se calcula sumando todos los
valores y dividiendo el resultado por la cantidad total de datos.
●​ Cálculo de la Varianza:
1.​ Calcula la diferencia entre cada valor individual y la media.
2.​ Eleva al cuadrado cada una de estas diferencias para que todos
los resultados sean positivos.
3.​ Suma todos los cuadrados obtenidos.
4.​ Divide la suma por el número total de valores (o por el número de
valores menos uno, si se trata de una muestra).

Ejemplo Práctico
Tomemos el siguiente conjunto de datos: {2,4,6,8,10}.
1.​ Media: (2+4+6+8+10)/5=6.
2.​ Diferencias con respecto a la media:
○​ 2−6=−4
○​ 4−6=−2
○​ 6−6=0
○​ 8−6=2
○​ 10−6=4
3.​ Cuadrados de las diferencias:
○​ (−4)2=16
○​ (−2)2=4
○​ (0)2=0
○​ (2)2=4
○​ (4)2=16
4.​ Suma de los cuadrados: 16+4+0+4+16=40.
5.​ Varianza: 40/5=8.
En este ejemplo, la media es 6 y la varianza es 8. Una varianza de 8 indica
que los datos están relativamente dispersos alrededor de la media.
📊 ¿Qué son los Cuartiles?
En estadística, los cuartiles son valores que dividen un conjunto de datos
ordenados en cuatro partes iguales. Cada cuartil marca un punto que separa
un porcentaje específico de los datos:
●​ Primer cuartil (Q1​): El valor por debajo del cual se encuentra el 25% de
los datos.
●​ Segundo cuartil (Q2​): El valor por debajo del cual se encuentra el 50%
de los datos. Es lo mismo que la mediana.
●​ Tercer cuartil (Q3​): El valor por debajo del cual se encuentra el 75% de
los datos.

¿Para qué sirven?


Los cuartiles son herramientas clave en el análisis de la distribución y
dispersión de los datos.
●​ Análisis de la dispersión: Ayudan a entender cómo se distribuyen los
datos alrededor de la mediana.
●​ Identificación de valores atípicos: Son útiles para detectar valores
extremos que se alejan mucho del resto de los datos.
●​ Resumen de datos: Proporcionan un resumen conciso de la distribución
de un conjunto de datos.
●​ Comparación de conjuntos: Permiten comparar la dispersión y
distribución de diferentes grupos de datos.

Cálculo de los Cuartiles


El cálculo de los cuartiles es un proceso sencillo que se basa en la mediana:
1.​ Ordenar los datos: Organiza el conjunto de datos de menor a mayor.
2.​ Calcular Q2​(la mediana): Encuentra el valor central del conjunto.
3.​ Calcular Q1​: Encuentra la mediana de la mitad inferior de los datos (los
valores que están por debajo de Q2​).
4.​ Calcular Q3​: Encuentra la mediana de la mitad superior de los datos
(los valores que están por encima de Q2​).

Ejemplo
Para el conjunto de datos ordenado: 2, 4, 6, 8, 10, 12, 14, 16, 18, 20
●​ Q2​(Mediana): Como hay 10 datos (un número par), la mediana es el
promedio de los dos valores centrales: (10+12)/2=11.
●​ Q1​: La mitad inferior es 2, 4, 6, 8, 10. La mediana de este subconjunto
es el promedio de 6 y 8, que es (6+8)/2=7.
●​ Q3​: La mitad superior es 12, 14, 16, 18, 20. La mediana de este
subconjunto es el promedio de 16 y 18, que es (16+18)/2=17.

Por lo tanto, en este ejemplo, Q1​=7, Q2​=11 y Q3​=17.

También podría gustarte