ESTADISTICA
UNIDAD 1
PARTICIPANTES
SILVIA CAMILA MARTINEZ MARTINEZ
TECNOLOGIA EN GESTION EMPRESARIAL-VIRTUAL
DOCENTE
ALEXANDER HOYOS
UNIDADES TECNOLÓGICAS DE SANTANDER “UTS”
ESTADISTICA
ENERO
2025
• ¿Qué es la estadística?
La estadística es la rama de las matemáticas que se encarga de la recolección,
organización, análisis, interpretación y presentación de datos. Su objetivo es
describir, explicar y predecir fenómenos basados en la información obtenida.
Se divide en dos grandes áreas:
1. Estadística descriptiva: Resume y organiza datos mediante gráficos, tablas
y medidas numéricas (como la media, mediana y desviación estándar).
2. Estadística inferencial: Utiliza los datos de una muestra para hacer
estimaciones, pruebas de hipótesis y predicciones sobre una población más
grande.
La estadística se aplica en diversas áreas como economía, medicina, ingeniería,
ciencias sociales y muchas más.
• ¿Qué estudia la estadística?
La estadística estudia la recopilación, organización, análisis, interpretación
y presentación de datos para describir fenómenos y tomar decisiones
informadas. Su propósito es identificar patrones, tendencias y relaciones
dentro de los datos para hacer inferencias sobre una población a partir de
una muestra.
• ¿Qué es una población, y una muestra en estadística?
En estadística, los conceptos de población y muestra son fundamentales para el
análisis de datos.
Población
Es el conjunto total de elementos, individuos u objetos que tienen una
característica en común y sobre los cuales se quiere obtener información. Puede
ser finita o infinita.
Ejemplo: Todos los estudiantes de una universidad, todos los habitantes de un
país.
Muestra
Es un subconjunto representativo de la población, seleccionado para realizar
estudios estadísticos. Se usa cuando estudiar toda la población es costoso o
impracticable.
• ¿Qué es una variable estadística?
Una variable estadística es una característica o propiedad de los individuos de una
población que puede tomar diferentes valores. Se utiliza para recopilar y analizar
datos en estudios estadísticos.
Tipos de variables estadísticas
1. Según la naturaleza de los datos:
o Variables cualitativas (o categóricas): Expresan cualidades o
categorías sin valores numéricos.
Ejemplo: Color de ojos, género, tipo de automóvil.
▪ Nominales: No tienen un orden específico (ejemplo:
nacionalidad).
▪ Ordinales: Tienen un orden o jerarquía (ejemplo: nivel
educativo).
o Variables cuantitativas: Expresan cantidades numéricas y pueden
medirse.
Ejemplo: Edad, peso, número de hijos.
▪ Discretas: Toman valores enteros y específicos (ejemplo:
número de estudiantes en un aula).
▪ Continuas: Pueden tomar cualquier valor dentro de un rango
(ejemplo: altura, temperatura).
Las variables estadísticas permiten organizar, analizar e interpretar los datos para
obtener conclusiones significativas.
• ¿Cuáles son los tipos de variables estadísticas? Dar 5 ejemplos de
cada una.
Tipos de variables estadísticas y ejemplos
1. Variables cualitativas (categóricas)
Son aquellas que representan atributos o cualidades sin valores numéricos. Se
dividen en:
a) Nominales (No tienen un orden específico)
• Color de ojos (azul, verde, marrón)
• Estado civil (soltero, casado, viudo)
• Tipo de sangre (A, B, AB, O)
• Marca de teléfono (Samsung, Apple, Xiaomi)
• Género (masculino, femenino, no binario)
b) Ordinales (Tienen un orden o jerarquía)
• Nivel educativo (primaria, secundaria, universidad)
• Grado militar (soldado, sargento, general)
• Nivel de satisfacción (bajo, medio, alto)
• Puesto en una competencia (1°, 2°, 3°)
• Nivel socioeconómico (bajo, medio, alto)
2. Variables cuantitativas (numéricas)
Representan cantidades numéricas y se pueden medir. Se dividen en:
a) Discretas (Valores enteros y específicos)
• Número de hijos en una familia (0, 1, 2, 3...)
• Cantidad de autos en un estacionamiento (10, 15, 20...)
• Número de estudiantes en un aula (25, 30, 35...)
• Cantidad de llamadas recibidas en un día (5, 7, 12...)
• Veces que alguien viaja al cine al mes (1, 2, 3...)
b) Continuas (Pueden tomar cualquier valor dentro de un rango)
• Estatura de una persona (1.65 m, 1.72 m, 1.80 m...)
• Peso de un bebé al nacer (3.2 kg, 3.5 kg, 4.1 kg...)
• Temperatura de un cuerpo (36.5 °C, 37.2 °C, 38.1 °C...)
• Tiempo en correr 100 metros (10.5 s, 11.3 s, 12.0 s...)
• Presión arterial de una persona (120.5 mmHg, 122.3 mmHg...)
Estos tipos de variables ayudan a organizar y analizar los datos de manera
eficiente en estudios estadísticos.
• ¿Cómo se caracterizará, una variable en estadística?
En estadística, una variable se caracteriza según diferentes criterios que permiten
clasificarla y analizarla adecuadamente.
1. Según el tipo de datos que representa:
• Cualitativa (categórica): No numérica, representa características o atributos.
• Cuantitativa (numérica): Expresada en números y permite operaciones
matemáticas.
2. Según la naturaleza de la medición:
• Nominal: No tiene orden específico (ejemplo: colores, tipos de sangre).
• Ordinal: Tiene jerarquía o niveles (ejemplo: nivel educativo, clasificación en
un concurso).
• Discreta: Toma valores enteros y contables (ejemplo: número de hijos,
cantidad de autos).
• Continua: Puede tomar cualquier valor dentro de un rango (ejemplo: altura,
temperatura).
3. Según su rol en el estudio:
• Variable dependiente: Es la que se estudia y depende de otras variables.
• Variable independiente: Es la que se manipula para observar su efecto en
la dependiente.
4. Según la variabilidad de sus datos:
• Determinística: Su valor es predecible y no cambia.
• Aleatoria: Su valor es incierto y varía (ejemplo: temperatura del día,
resultados de una encuesta).
• ¿Cuáles son los tipos de gráficos más utilizados, para representar un
conjunto de datos?
En estadística, existen varios tipos de gráficos que se utilizan para representar
datos de manera visual. Los más utilizados son:
1. Gráfico de barras
• Se usa para representar datos categóricos o discretos.
• Las barras pueden ser horizontales o verticales.
• La altura de las barras indica la frecuencia de cada categoría.
Ejemplo: Cantidad de estudiantes por carrera universitaria.
2. Histograma
• Se usa para representar datos cuantitativos continuos.
• Similar al gráfico de barras, pero las barras están pegadas.
• Permite observar la distribución de los datos.
Ejemplo: Distribución de alturas de un grupo de personas.
3. Polígono de frecuencias
• Representa la distribución de datos con puntos unidos por líneas.
• Se usa para comparar varias distribuciones.
Ejemplo: Variación de temperaturas a lo largo del año.
4. Gráfico circular o de pastel
• Representa datos categóricos en forma de porciones de un círculo.
• Muestra proporciones o porcentajes del total.
Ejemplo: Distribución del presupuesto en diferentes áreas de una
empresa.
5. Diagrama de dispersión
• Se usa para analizar la relación entre dos variables numéricas.
• Cada punto representa una observación.
Ejemplo: Relación entre el tiempo de estudio y la calificación obtenida.
6. Gráfico de líneas
• Representa datos continuos con puntos conectados por líneas.
• Se usa para analizar tendencias en el tiempo.
Ejemplo: Evolución del precio del dólar en un año.
Estos gráficos ayudan a visualizar la información de manera clara y facilitan la
interpretación de los datos.
• ¿Cuáles son y para qué servirán, las medidas de posición?
Medidas de posición en estadística
Las medidas de posición son herramientas estadísticas que permiten ubicar un
dato dentro de un conjunto de valores ordenados. Sirven para analizar la
distribución de los datos y comparar valores dentro de una muestra o población.
Principales medidas de posición
1. Mediana (Me)
o Es el valor que divide el conjunto de datos ordenados en dos partes
iguales.
o Si hay un número impar de datos, es el valor central; si es par, es el
promedio de los dos valores centrales.
o Sirve para: Representar el valor "típico" de los datos, especialmente
cuando hay valores extremos que afectan la media.
2. Cuartiles (Q1, Q2, Q3)
o Dividen los datos ordenados en cuatro partes iguales.
▪ Q1 (primer cuartil): 25% de los datos están por debajo.
▪ Q2 (segundo cuartil): Es la mediana (50% de los datos están
por debajo).
▪ Q3 (tercer cuartil): 75% de los datos están por debajo.
o Sirven para: Analizar la dispersión y distribución de los datos.
3. Deciles (D1 - D9)
o Dividen los datos en diez partes iguales.
o D5 equivale a la mediana.
o Sirven para: Estudios más detallados de la distribución de los datos.
4. Percentiles (P1 - P99)
o Dividen los datos en 100 partes iguales.
o P50 es la mediana.
o Sirven para: Comparar posiciones dentro de un grupo, como en
pruebas de rendimiento académico o estudios de crecimiento infantil.
o
5. ¿Cuáles son y para qué servirán, las medidas de dispersión?
¿Para qué sirven las medidas de posición?
• Identifican valores centrales o representativos.
• Permiten analizar la distribución de los datos.
• Ayudan a tomar decisiones basadas en datos comparativos.
• Se usan en estudios económicos, educativos, médicos, entre otros.
Medidas de dispersión en estadística
Las medidas de dispersión son herramientas estadísticas que indican qué tan
dispersos o agrupados están los datos en torno a un valor central (como la media).
Sirven para medir la variabilidad de un conjunto de datos y permiten comparar
distribuciones.
Principales medidas de dispersión
1. Rango (R)
o Se calcula como la diferencia entre el valor máximo y el mínimo:
R=Xmaˊx−XmıˊnR = X_{\text{máx}} - X_{\text{mín}}R=Xmaˊx−Xmıˊn
o Sirve para: Dar una idea rápida de la amplitud de los datos. No
considera la distribución interna.
2. Varianza (σ2\sigma^2σ2 o s2s^2s2)
o Es el promedio de las diferencias cuadradas entre cada dato y la
media. σ2=∑(Xi−Xˉ)2N(para poblacioˊn)\sigma^2 = \frac{\sum (X_i -
\bar{X})^2}{N} \quad \text{(para población)}σ2=N∑(Xi−Xˉ)2
(para poblacioˊn) s2=∑(Xi−Xˉ)2n−1(para muestra)s^2 = \frac{\sum
(X_i - \bar{X})^2}{n - 1} \quad \text{(para muestra)}s2=n−1∑(Xi−Xˉ)2
(para muestra)
o Sirve para: Medir qué tan dispersos están los datos respecto a la
media.
3. Desviación estándar (σ\sigmaσ o sss)
o Es la raíz cuadrada de la varianza: σ=σ2(para poblacioˊn)\sigma =
\sqrt{\sigma^2} \quad \text{(para población)}σ=σ2(para poblacioˊn)
s=s2(para muestra)s = \sqrt{s^2} \quad \text{(para muestra)}s=s2
(para muestra)
o Sirve para: Expresar la dispersión en las mismas unidades que los
datos, facilitando la interpretación.
4. Coeficiente de variación (CV)
o Es la relación entre la desviación estándar y la media, expresada en
porcentaje: CV=(σXˉ)×100CV = \left( \frac{\sigma}{\bar{X}} \right)
\times 100CV=(Xˉσ)×100
o Sirve para: Comparar la dispersión entre conjuntos de datos con
diferentes unidades o escalas.
5. Rango intercuartílico (IQR)
o Es la diferencia entre el tercer cuartil (Q3Q3Q3) y el primer cuartil
(Q1Q1Q1): IQR=Q3−Q1IQR = Q3 - Q1IQR=Q3−Q1
o Sirve para: Analizar la dispersión en la parte central de los datos,
ignorando valores extremos.
¿Para qué sirven las medidas de dispersión?
• Evaluar la consistencia de los datos: menor dispersión indica mayor
estabilidad.
• Comparar variabilidad entre diferentes conjuntos de datos.
• Identificar datos atípicos o valores extremos.
• Mejorar la toma de decisiones basada en datos cuantitativos.
• ¿Qué es una correlación lineal, y para qué servirá?
Correlación lineal en estadística
La correlación lineal es una medida estadística que indica la relación o
dependencia entre dos variables numéricas. Se usa para determinar si un
aumento o disminución en una variable está asociado con un cambio en la otra.
Tipos de correlación lineal
1. Correlación positiva (+)
o Cuando una variable aumenta, la otra también aumenta.
o Ejemplo: A mayor estudio, mayor calificación.
2. Correlación negativa (-)
o Cuando una variable aumenta, la otra disminuye.
o Ejemplo: A mayor velocidad, menor tiempo de llegada.
3. Correlación nula (0)
o No hay relación entre las variables.
o Ejemplo: Número de zapatos vendidos y temperatura del agua en el
mar.
Coeficiente de correlación de Pearson (rrr)
El grado de correlación se mide con el coeficiente de correlación de Pearson (rrr),
que varía entre -1 y 1:
• r=1r = 1r=1 → Correlación perfectamente positiva.
• r=−1r = -1r=−1 → Correlación perfectamente negativa.
• r=0r = 0r=0 → No hay correlación.
Se calcula con la fórmula:
r=∑(Xi−Xˉ)(Yi−Yˉ)∑(Xi−Xˉ)2∑(Yi−Yˉ)2r = \frac{\sum (X_i - \bar{X}) (Y_i -
\bar{Y})}{\sqrt{\sum (X_i - \bar{X})^2 \sum (Y_i - \bar{Y})^2}}r=∑(Xi−Xˉ)2∑(Yi−Yˉ)2
∑(Xi−Xˉ)(Yi−Yˉ)
¿Para qué sirve la correlación lineal?
• Analizar relaciones entre variables (ejemplo: ingresos y nivel educativo).
• Predecir tendencias en datos (ejemplo: demanda de un producto según su
precio).
• Tomar decisiones informadas en negocios, economía, salud, etc.
• ¿Qué son y para qué servirá, la regresión lineal?
Regresión lineal en estadística
La regresión lineal es un método estadístico que permite modelar la relación entre
dos variables mediante una ecuación de una línea recta. Se usa para predecir
valores y analizar tendencias basadas en datos históricos.
Ecuación de la regresión lineal
La regresión lineal simple se expresa con la ecuación:
Y=a+bX+εY = a + bX + \varepsilonY=a+bX+ε
Donde:
• YYY = Variable dependiente (lo que queremos predecir).
• XXX = Variable independiente (lo que usamos para predecir).
• aaa = Intersección o constante (valor de YYY cuando X=0X = 0X=0).
• bbb = Pendiente de la recta (indica cuánto cambia YYY por cada unidad de
XXX).
• ε\varepsilonε = Error (diferencias entre valores reales y predichos).
Tipos de regresión lineal
1. Regresión lineal simple
o Relaciona una variable dependiente con una variable independiente.
o Ejemplo: Predecir el salario (YYY) según años de experiencia (XXX).
2. Regresión lineal múltiple
o Relaciona una variable dependiente con dos o más variables
independientes.
o Ejemplo: Predecir ventas (YYY) en función del precio (X1X_1X1) y la
publicidad (X2X_2X2).
¿Para qué sirve la regresión lineal?
• Hacer predicciones (ejemplo: estimar el precio de una casa según su
tamaño).
• Identificar tendencias y relaciones entre variables.
• Optimizar procesos y toma de decisiones en negocios, salud, economía,
etc.
• Analizar el impacto de una variable en otra, midiendo su influencia.
Limitaciones
• Solo es útil si la relación entre las variables es lineal.
• No explica causalidad, solo asociación.
• Puede verse afectada por valores atípicos (outliers).