PROYECTO DE AULA
DANIEL DAVID BARBOSA SABOGAL
IVAN CAMILO CARDONA RIOS
SEGUNDO SEMESTRE ADMINISTRACION PÚBLICA
CORPORACION UNIFICADA NACIONAL DE EDUCACION SUPERIOR
JUAN MANUEL SANCHEZ NAVARRO
ESTADISTICA DESCRIPTIVA PARA CIENCIAS ADMINISTRATIVAS
FICHA: 52476
COLOMBIA, SEPTIEMBRE – 2024
1
TABLA DE CONTENIDO
1. Introducción
2. Objetivo General
3. Objetivos Específicos
4. Investigación y Descripción de Conceptos
4.1. ¿Qué es una variable aleatoria?
4.2. ¿Cuál es la diferencia entre una variable aleatoria continua y una variable aleatoria
discreta?
4.3. ¿Cuál es la diferencia entre un parámetro y un estadístico?
5. Análisis con Base de Datos Excel
5.1. Tabla de distribución de frecuencias absolutas y acumuladas de la variable
symboling
5.2. Gráfico de barras de la variable body-style
5.3. Gráfico de barras de la variable num-of-cylinders
5.4. Gráfico de torta de la variable fuel-type
5.5. Gráfico de torta de la variable make
5.6. Histograma de la variable price
6. Mapa Conceptual
7. Reseña Biográfica de Godofredo Achenwall
8. Investigación y Descripción de Medidas de Posición
8.1. ¿Qué es un Cuartil en estadística?
8.2. ¿Qué es un Quintil en estadística?
2
8.3. ¿Qué es un Decil en estadística?
8.4. ¿Qué es un Percentil en estadística?
8.5. ¿Qué es un dato atípico?
9. Cálculo de Medidas de Tendencia Central y de Dispersión
9.1. Media aritmética, mediana y moda de la variable length
9.2. Media aritmética, mediana y moda de la variable width
9.3. Media aritmética, mediana y moda de la variable height
9.4. Media aritmética, mediana y moda de la variable Uso del carro a la semana
10. Investigación y Descripción de Distribuciones y Coeficientes Estadísticos
10.1. ¿Qué es la campana de Gauss?
10.2. ¿Qué es la distribución normal estándar?
10.3. ¿Qué es el coeficiente de asimetría de Fisher y su utilidad?
10.4. ¿Qué es la curtosis?
10.5. ¿Qué es el coeficiente de asimetría de Pearson?
11. Cálculo de Medidas de Dispersión
11.1. Rango, desviación estándar muestral, varianza muestral y coeficiente de variación
de la variable length
11.2. Rango, desviación estándar muestral, varianza muestral y coeficiente de variación
de la variable width
11.3. Rango, desviación estándar muestral, varianza muestral y coeficiente de variación
de la variable height
11.4. Rango, desviación estándar muestral, varianza muestral y coeficiente de variación
de la variable Uso del carro a la semana
3
12. Infografía Estadística: La ley de los grandes números y el teorema del límite central
13. Bibliografías
4
1. Introducción.
La presente actividad tiene como objetivo facilitar la comprensión de conceptos básicos en
estadística, así como la aplicación de estos conocimientos mediante el análisis de datos. La
disposición de la actividad está diseñada para guiar al lector a través de un proceso de
aprendizaje.
En primer lugar, se inicia con la definición y diferencia de las variables aleatorias, resaltando las
características que distinguen a las variables continuas de las discretas y se clarifican conceptos
esenciales como el de parámetro y estadístico.
En la segunda parte de la actividad, se investiga sobre medidas de posición como cuartiles,
quintiles, deciles y percentiles, así como la identificación de datos atípicos, fortaleciendo el
entendimiento de la distribución de datos y su interpretación, permitiendo al lector la forma de
obtener el cálculo de la media, mediana, moda, rango, desviación estándar, varianza y coeficiente
de variación.
Finalmente, la actividad culmina con la investigación de conceptos avanzados en estadística,
como la campana de Gauss, la distribución normal estándar, los coeficientes de asimetría de
Fisher y Pearson, y la curtosis, así como la creación de una infografía sobre la ley de los grandes
números y el teorema del límite central. Estos elementos teóricos son esenciales para la
comprensión de la distribución de datos y la probabilidad en el análisis estadístico.
2. Objetivo general:
Desarrollar un entendimiento profundo y aplicado de los conceptos fundamentales en estadística,
incluyendo la definición y clasificación de variables aleatorias, la diferencia entre parámetros y
estadísticos, y el manejo de datos a través de la elaboración de tablas de distribución de
5
frecuencias, gráficos y cálculos estadísticos para fortalecer las competencias analíticas en el
análisis e interpretación de datos.
3. Objetivos específicos:
Investigar y describir los conceptos clave en estadística: Definir qué es una variable aleatoria,
identificar la diferencia entre variables aleatorias continuas y discretas, y distinguir entre un
parámetro y un estadístico.
Aplicar técnicas de análisis de datos: Utilizar la base de datos proporcionada para calcular la
tabla de distribución de frecuencias absolutas y acumuladas de diferentes variables, así como
elaborar gráficos de barras, gráficos de torta y un histograma para representar diferentes
variables.
Simplificar y organizar el conocimiento adquirido: Elaborar un mapa conceptual que resuma los
conceptos vistos en clase, facilitando la consolidación y visualización del aprendizaje.
Comprender y describir medidas de posición: Investigar y describir los conceptos de cuartil,
quintil, decil, percentil y datos atípicos, y calcular las medidas de tendencia central (media,
mediana y moda) de varias variables.
Averiguar sobre distribuciones estadísticas: Investigar y describir la campana de Gauss, la
distribución normal estándar, y los coeficientes de asimetría de Fisher, así como la curtosis, y
calcular medidas de dispersión para diferentes variables.
Desarrollo de una infografía que explique de manera clara y concisa la ley de los grandes
números y el teorema del límite central, resaltando su valor en el contexto estadístico.
6
4. Investigación y Descripción de Conceptos Estadísticos
4.1 ¿Qué es una variable aleatoria?
Es una función matemática que asigna un valor, usualmente numérico, a los resultados de
un experimento aleatorio, por ejemplo, los posibles resultados de tirar un dado dos veces:
(1, 1), (1, 2), etc. La variable aleatoria en definitiva, permite ofrecer una descripción de
la probabilidad de que se adoptan ciertos valores. No se sabe de manera precisa qué valor
adoptará la variable cuando sea determinada o medida, pero sí se puede conocer cómo se
distribuyen las probabilidades vinculadas a los valores posibles. En dicha distribución
incide el azar.
4.2 Diferencia entre una variable aleatoria continua y una variable aleatoria discreta:
Variable aleatoria continua: es aquella que adquiere un valor real dentro de un intervalo
o rango. Puede tomar valores enteros como fraccionarios y un número infinito dentro de
un mismo valor. Por ejemplo: el agua lluvia se mide en: 1 litro, 1.5 litros o 6.25 litros.
Otro ejemplo de variable aleatoria, puede ser la altura de las personas: 1.10 mts, 1.55 mts
o 1.87 mts. Variable aleatoria constante: son aquellas que solo pueden tomar valores
enteros tanto positivos como negativos: 1, 2, 3,… -1, -2, -3,… Los miembros de una
familia pueden ser: 2, 3, o 4. Con la aclaración anterior, podemos indicar que la
diferencia entre la variable aleatoria continua y la variable aleatoria discreta, es que la
aleatoria continua puede tomar fracciones como valor y la aleatoria discreta, solo puede
tomar enteros.
7
4.3 Diferencia entre un parámetro y un estadístico:
Parámetro: medida utilizada para representar las características de la población,
ejemplo: estatura, estrato, número de nacimientos en una ciudad, salarios, etc. Teniendo
como resultado un valor único Estadísticos: representa los elementos de una muestra y se
dividen en dos, de posición que son la media aritmética, la mediana, moda, cuartiles,
deciles y percentiles; y dispersión, que mide que tan disperso o separado se encuentran
los datos de una distribución; desviación media, varianza, desviación típica o estándar, y
coeficiente de variación cuyo resultado no tiene valor único. Por lo tanto, podemos
indicar que la diferencia entre un parámetro y un estadístico, es que el estadístico se
caracteriza en una muestra y el parámetro en una población.
8
5. Análisis con Base de Datos Excel
5.1. Tabla de distribución de frecuencias absolutas y acumuladas de la variable symboling
Variable Symboling Frecuencia absoluta Frecuencia acumulada
-2 3 3
-1 22 25
0 67 92
1 54 146
2 32 178
3 27 205
Total general 205
9
5.2. Gráfico de barras de la variable body-style
body-style
100
90
80
70
60
50 Total
40
30
20
10
0
convertible hardtop hatchback sedan wagon
5.3. Gráfico de barras de la variable num-of-cylinders
variable num-of-cylinders
160
140
120
100
80 Total
60
40
20
0
eight five four six three twelve two
10
5.4. Gráfico de torta de la variable fuel-type
[Link]
diesel
10%
diesel
gas
gas
90%
11
5.5. Gráfico de torta de la variable make
make
alfa-romero
audi
bmw
chevrolet
dodge
honda
5% 1% 3% isuzu
6% 4% 1%
4% jaguar
16% 6%
mazda
2%
1%
mercedes-benz
6% 8%
mercury
3% 4%
1%2% 0% mitsubishi
3% 6%
5% 9% nissan
peugot
plymouth
porsche
renault
saab
subaru
toyota
volkswagen
volvo
12
5.6. Histograma de la variable price:
6. Mapa Conceptual:
13
7. Reseña Biográfica de Godofredo Achenwall:
Godofredo Achenwall (1719-1772) fue un influyente jurista, economista y estadístico alemán,
cuyo trabajo sentó las bases para el desarrollo de la estadística moderna. Nacido en Elbing,
Prusia Oriental (hoy Elbląg, Polonia), Achenwall vivió en una Europa que se encontraba en
plena transformación, con cambios profundos en las esferas sociales, económicas y políticas. Su
trabajo ayudó a ser pionero en las estadísticas modernas. Las personas vivían de manera
diferente, trabajaban de nuevas maneras y la forma en que administraban sus países también
estaba cambiando
Comenzó a meterse en asuntos sociales y cuestiones de dinero en efectivo. Hizo su mejor
esfuerzo en la escuela de la Universidad de Göttingen, donde era el mejor en derecho y asuntos
de dinero en efectivo Achenwall hizo su gran trabajo en estadística allí su trabajo se destacó
también en la estadística cuántica, que fue su trabajo más representativo.
Achenwall es muy importante en el mundo de las estadísticas, y hace mucho tiempo, las
estadísticas no consistían sólo en hacer números, para él, las estadísticas eran como evidenciar el
movimiento de un país, ver cómo vive la gente, qué ganan y cómo ellos dirigen el programa.
Uno de sus libros clave es Elementa Iuris Naturae, donde mezcla la ley natural y el dinero, y
también habla de sus ideas sobre números y estadísticas. Achenwall fue famoso por hacer de las
estadísticas un tema importante en las clases universitarias, lo que ayudó a que se hicieran
populares y convertirse en algo propio.
La vida y el trabajo de Achenwall fueron moldeados por la idea de usar la lógica y las pruebas
para tomar decisiones inteligentes. Fue muy bueno reuniendo y verificando números en
diferentes situaciones, lo cual fue muy importante para el gobierno y las cosas cotidianas
14
Godfrey Achenwall falleció en 1772, pero sus ideas inteligentes sobre los números y esas cosas
todavía están entre nosotros. Sus ideas hicieron que las estadísticas fueran muy importantes para
entender el mundo actual.
8. Investigación y Descripción de Medidas de Posición
8.1. ¿Qué es un Cuartil en estadística?
Es un tipo medida de posición que divide un conjunto de datos ordenados, en cuatro
segmentos iguales y cada segmento obtiene el 25% de la información del conjunto de
datos. Los cuartiles se identifican con la letra Q y se interpretan de la siguiente manera:
Cuartil Q1: Primer cuartil, también conocido como cuartil inferior y es donde se
encuentra el 25% de la información del conjunto de datos.
Cuartil Q2: Segundo cuartil, es la mediana de los datos y separa la muestra en dos partes
iguales. El 50% de la información de se encuentra por debajo de este valor y el otro 50%,
se encuentra por encima de este cuartil.
Cuartil Q3: Tercer cuartil, también conocido como cuartil superior y en este segmento, se
encuentra el 75% de la información de la bases de datos.
Cuartil Q4: Cuarto cuartil, representa el 100% de la información de la base de datos
Datos clasificados en orden ascendente
25% 25% 25% 25%
Q1 Q2 Q3 Q4
15
8.2. ¿Qué es un Quintil en estadística?
Es una medida de posición que divide un conjunto de datos ordenados o población en
cinco segmentos iguales, cada segmento, equivale a un 20% de la base de datos. Los
quintiles son útiles para comparar y analizar distribuciones de datos, como estudio de
ingresos, rendimiento académico y en otras áreas donde se segmenten datos en partes
iguales.
Los quintiles son:
Quintil 1 (Q1): en este quintil, se encuentra el 20% de información de una base de datos
ordenados
Quintil 2 (Q2): en este quintil, se encuentra el 40% de información de una base de datos
ordenados
Quintil 3 (Q3): en este quintil, se encuentra el 60% de la información de una base de
datos ordenados, como en este quintal se encuentra más del 50% de la información,
también se le considera como la mediana de la base de datos.
Quintil 4 (Q4): en este quintil, se encuentra el 80% de la información de una base de
datos ordenados.
Quintil 5 (Q5): en este quintil, se encuentra el 100% de la información de una base de
datos ordenados.
20% 20% 20% 20% 20%
Q1 Q2 Q3 Q4 Q5
16
8.3. ¿Qué es un Decil en estadística?
Es una medida de posición que divide un conjunto de datos ordenados en diez partes
iguales, y cada segmento equivale al 10% de la información en la base de datos. Los
deciles se representan con la letra D y se interpretan de la siguiente manera:
Decil 1 (D1): en este Decil se encuentra el 10% de la información de una base de datos
ordenada
Decil 2 (D2): en este Decil se encuentra el 20% de la información de una base de datos
ordenada
Decil 3 (D3): en este Decil se encuentra el 30% de la información de una base de datos
ordenada
Decil 4 (D4): en este Decil se encuentra el 40% de la información de una base de datos
ordenada
Decil 5 (D5): en este Decil se encuentra el 50% de la información de una base de datos
ordenada, y es considerado como la mediana.
Decil 6 (D6): en este Decil se encuentra el 60% de la información de una base de datos
ordenada
Decil 7 (D7): en este Decil se encuentra el 70% de la información de una base de datos
ordenada
Decil 8 (D8): en este Decil se encuentra el 80% de la información de una base de datos
ordenada
Decil 9 (D9): en este Decil se encuentra el 90% de la información de una base de datos
ordenada
17
Decil 10 (D10): en este Decil se representa el valor máximo, el cual es el 100% de la
información de una base de datos ordenada.
10% 10% 10% 10% 10% 10% 10% 10% 10% 10%
D1 D2 D3 D4 D5 D6 D7 D8 D9 D10
8.4. ¿Qué es un Percentil en estadística?
Es una medida de posición que divide un conjunto de datos ordenado en 100 partes
iguales, cada parte representa el 1% de la información de la base de datos.
Se identifican con la letra P y se representan de la siguiente manera:
Percentil 1 (P1): en este Percentil se encuentra el 1% de la información de una base de
datos ordenada
Percentil 2 (P2): en este Percentil se encuentra el 2% de la información de una base de
datos ordenada…
Percentil 10 (P10): en este Percentil se encuentra el 10% de la información de una base
de datos ordenada…
Percentil 50 (P50): Mediana, en este Percentil se encuentra el 50% de la información de
una base de datos ordenada…
Percentil 100 (P100): en este Percentil se encuentra el 100% de la información de una
base de datos ordenada
18
8.5. ¿Qué es un dato atípico?
Es una observación o dato que numéricamente se encuentra distante al resto de
datos.
9. Cálculo de Medidas de Tendencia Central y de Dispersión
9.1. Media aritmética, mediana y moda de la variable length
Media 174,6747
Mediana 173,500
Moda #N/A
9.2. Media aritmética, mediana y moda de la variable width
Media 66,6659
Mediana 66,2500
Moda #N/A
9.3. Media aritmética, mediana y moda de la variable height
Media 53,8510
Mediana 54,100
Moda #N/A
9.4. Media aritmética, mediana y moda de la variable Uso del carro a la semana
Media 4
Mediana 4
Moda #N/A
19
10. Investigación y Descripción de Distribuciones y Coeficientes Estadísticos
10.1. ¿Qué es la campana de Gauss?
Es una representación gráfica donde se evidencia la distribución de los datos alrededor de
un valor central. Estos valores siempre tienden a la mediana.
10.2. ¿Qué es la distribución normal estándar?
Es una de las distribuciones de probabilidad de variable continua que con más frecuencia
aparece en estadística y en la teoría de probabilidades.
10.3. ¿Qué es el coeficiente de asimetría de Fisher y su utilidad?
Es una medida estadística de asimetría de una distribución estadística, la cual establece hasta
que punto, la distribución es simétrica o asimétrica y hacia qué dirección tiende a agruparse,
sí a la izquierda o derecha de la mediana.
10.4. ¿Qué es la curtosis?
Es una característica de una variable estadística o aleatoria ofreciendo una perspectiva
valiosa sobre la distribución de datos.
10.5. ¿Qué es el coeficiente de asimetría de Pearson?
Es una medida de asimetría estadística que se basa en la diferencia entre media, mediana y
moda para cuantificar la dirección y el nivel de asimetría de una distribución estadística,
normalizando el resultado, dividiendo el resultado entre la desviación original para variables
continuas y una distribución unimodal, en distribuciones asimétricas a la derecha la media
aritmética es superior a la mediana y esta, a su vez, superior a la moda y a la inversa en
distribuciones asimétricas a la izquierda.
20
11. Cálculo de Medidas de Dispersión
11.1. Rango, desviación estándar muestral, varianza muestral y coeficiente de variación
de la variable length
Rango 67
Desviación estándar 13,34643
Varianza muestral 178,12732
Coeficiente Variación 0,07641
11.2. Rango, desviación estándar muestral, varianza muestral y coeficiente de variación
de la variable width
Rango 12
Desviación estándar 2,88991
Varianza muestral 8,35160
Coeficiente de variación 0,04335
11.3. Rango, desviación estándar muestral, varianza muestral y coeficiente de variación
de la variable height
Rango 12
Desviación estándar 2,78329
Varianza 7,74672
Coeficiente de variación 0,05169
11.4. Rango, desviación estándar muestral, varianza muestral y coeficiente de variación
de la variable Uso del carro a la semana
Rango 6
Desviación estándar 2,16025
Varianza 4,66667
Coeficiente de variación 0,54006
21
12. Infografía Estadística
22
13. Bibliografías:
[Link]
[Link]
[Link]
[Link]
[Link]
_y_percentiles.html
[Link]
sirven-en-la-economia/
[Link]
[Link]
[Link]
atipicos
[Link]
[Link]
normal-estandar
[Link]
[Link]
23