Estadística Aplicada al Turismo
Estadística Aplicada al Turismo
ESTADISTICA 3ER
PARCIAL
Estadística para el turismo
El turismo impacta
Definiciones:
Estadística: Conjuntos de teorías y métodos que han sido desarrollados para
la recopilación y representación y eventualmente el uso de los datos sobre
una o varias características del interés propio del investigador; con el
propósito de tomar decisiones, sacar conclusiones emprender acciones;
más importante, interpretar los procesos.
Ejercicio 1 - Un turismólogo, que investiga un nuevo producto dentro de la
industria restaurantera pura rebajar la grasa y cochambre de la cocina,
para ello desea conocer el consumo de aceites y grasas
naturales y artificiales en la preparación de platillos y que son consumidos
por 40 sucursales restauranteras de la misma marca ¿Cómo debe proceder
el turismólogo investigador? Para ello debe encontrar la población, la
muestra y la variable a investigar.
Población: La cadena de restaurantes
Definiciones:
Estadística descriptiva: Se ocupa de recoger, clasificar y resumir la
información, contenida en la muestra. En este curso se organiza, resume
(tabular, graficas o numérica) y describe las características principales de
los datos. El análisis a veces es limitado en sí; por ende, limita a los datos
coleccionados no se realiza inferencia alguna o evita generalizar acerca del
total de la procedencia de las observaciones de la distribución.
Calculo de Probabilidad: Es una parte de la matemática teórica, que
estudia las leyes que rigen los mecanismos aleatorios de
fenómenos de estudio.
Estadística inferencial: Esta parte procura hacer estimaciones de las
características de una población por medio del estudio de una muestra.
Pretende extraer conclusiones para la población entera, a partir del
resultado observado en la muestra.
TIPOS DE VARIABLES:
Según el nivel de medida:
Cualitativas: expresan distintas cualidades, características o modalidad.
Cada modalidad que se presenta se denomina atributo o categoría, y la
medición consiste en una clasificación de dichos atributos.
Cualitativa ordinal: Puede tomar distintos valores ordenados siguiendo una
escala. Es excluyente
Cualitativa nominal: Los valores no pueden ser sometidos, a un criterio de
orden.
Discreta: Representa separaciones o interpretaciones en la escala de
valores que pude tomar.
Discreta: Representa separaciones o interpretaciones en la escala de
valores que pueden tomar
Continua: Puede adquirir cualquier valor dentro de un intervalo
especificado de valores.
INFLUENCIA:
Independientes: Cuyo valor no depende de otra variable se suele presentar
por la “y”. Cusa de fenómenos no estudiados.
Dependientes: Cuyos valores dependen de los que tomen otras variables.
Intervinientes: Propiedades que de una u otra manera afectan el resultado
que se espera y están vinculados con las variables dependientes o
independientes.
Variable moderadora: Representan un tipo especial de variable
independiente, que es secundaria. Y representa o selecciona con la
finalidad de determinar si afecta la relación entre la variable primaria
independientes y las variables dependientes.
Metodología de la investigación: Se utiliza como una característica o
propiedad de la investigación que supone ser la causa del fenómeno que
estudia.
Ejemplo:
En la ultima hora han acudido al servicio de urgencias de Hidalgo, 8
pacientes, cuyos datos de ingreso se encuentran resumidos en la siguiente
tabla:
Muestra: 8 pacientes.
Frecuencia absoluta: Se denota por la letra f minúscula y es el numero de
veces que ocurre el resultado 𝑋𝒾.
Sexo{𝑋1, 𝑋2, 𝑋3, 𝑋4, 𝑋5. 𝑋6, 𝑋7, 𝑋8}
Frecuencia relativa: Se denota por ℎ𝒾 y representa un porción de datos en
𝑓𝑖
cada una de las clases ℎ𝒾 = 𝑛
𝐻𝑖 = ∑ ℎ𝑖
𝑗 =1
Frecuencia
Sexo (x) fi Fi hi Hi
H 2 2 0.25 0.25
M 6 8 0.75 1
∑ 𝑓𝑖 = 8 ∑ ℎ𝑖 = 1
25%
¿Qué porcentaje de pacientes son mujeres? 75%
Grafica de nivel de dolor
4.5
3.5
2.5
1.5
0.5
0
LEVE MODERADO INTENSO
Diagrama de Sectores
12.5%
50%
37.5%
muestra dureza
1 Blanda
2 blanda
3 Dura
4 Muy dura
5 Muy dura
6 Extremadamente
dura
7 Blanda
8 Blanda
9 Dura
10 Muy dura
Dureza (xi) fi Fi hi Hi
Blanda 4 4 0.4 0.4
Dura 2 6 0.2 0.6
Muy Dura 3 9 0.3 0.9
Extremadamente 1 10 0.1 1
dura
∑ 𝑓𝑖 = 10 ∑ 𝑓𝑖 = 1
Visitas (xi) fi Fi hi Hi
0 4 4 0.5 0.5
1 3 7 0.375 0.875
2 1 8 0.125 1
n=8 ∑ 𝑓𝑖 = 1
Porcentajes 1 y 2 nos da las veces de visita: Mas de 1 visita
Considerada una muestra de 200 familias en la que se contó el número de
hijos. Suponiendo que se han observado 50 familias sin hijos, 80 familias con
un hijo, 40 familias con dos hijos, 20 familias con 5 hijos y 10 familias con cuatro
hijos. Construir la distribución de frecuencias correspondiente.
Hijos (x) fi Fi hi Hi
0 50 50 0.25 0.25
1 80 130 0.4 0.65
2 40 170 0.2 0.85
3 20 190 0.1 0.95
4 10 200 0.05 1
∑ 𝑓𝑖 = 200 ∑ 𝑓𝑖 = 1
Muestras Pequeñas
Para considerar el número de intervalos se debe tomar en el entero más
próximo a la raíz de 𝑛(√𝑛)
-Recorrido(rango): 87-47=40
Intervalos Marca de fi Fi hi Hi
de Clase clase
(47-61) 54 4 4 0.5 0.5
(61-75) 68 2 6 0.25 0.75
(75-89) 82 2 8 0.25 1
8 1
-El 50% de los pacientes pesan entre 47 y 61 kilogramos.
Color de fi Fi hi Hi
reacción (x)
Naranja 15 15 0.3 0.3
Amarillo 25 40 0.5 0.8
Verde 10 50 0.2 1
∑ = 50 ∑=1
Grafica#. Diagrama de barras y Poligono de Frecuencia de
niveles de acetona en la orina
30
25
20
15
10
0
Naranja Amarillo Verde
20
50
30%
Datos ordenados y no ordenados
Distribución de Frecuencia: es una disposición tabular los datos estadísticos
ordenados ascendente o descendentemente de acuerdo a la frecuencia
de cada dato de la variable a investigar.
5 refrescos muy famosos son Coke classic, coke diet, drpepper, Pepsi y Sprite
suponiendo que los datos de la siguiente tabla muestran los refrescos, que
fueron comprados en un amuestra de 50 ventas de refresco.
Construir la distribución de Frecuencia de refresco.
¿Cuál es el porcentaje de refrescos que mas se vende?
Xi fi Fi Frecuencia Acumulada
relativa
Coke classic 19 19 0.38 0.38
Diet coke 8 27 0.16 0.54
Dr. Pepper 5 32 0.1 0.64
Pepsi 13 45 0.26 0.9
Sprite 5 50 0.1 1
50 1
20
18
16
14
12
10
0
Coke classic Diet coke Dr. Pepper Pepsi Sprite
Grafica #. Pastel dividida en porcentaje de mayor a menor
venta de refrescos
DATOS AGRUPADOS:
Clase: Divisiones o categorías donde se agrupan conjunto de datos
ordenados con características en común. Las fronteras de la clase se
denominan límite inferior y límite superior y se denotan Li+1 y Lo
respectivamente.
Procedimiento:
1.-Determinar el máximo y el mínimo entre los valores recolectados en la
muestra y calcular el "recorrido de la variable o rango" 𝑅 = 𝑋𝑚𝑎𝑥 − 𝑋𝑚𝑖𝑛
2.- Calcula el número de clases a utilizar. Existen criterios para determinar el
número de clases.
Sturges
# de datos # de intervalos
10-100 De 4-8
100-1000 De 8-11
1000-10000 De 11-14
EJEMPLO:
Se ha construido un nuevo hotel en la ciudad de Pachuca, y está a punto
de abrir sus puertas. Pero antes de que el gerente general decida el precio
de sus habitaciones, este último se dio la tarea de investigar los precios por
habitación de 40 hoteles de la misma categoría de la ciudad. Los datos que
recabó (en miles de pesos) fueron los siguientes.
Xi fi Fi hi Hi
(3.3-3.8) 3 3 0.075 0.075
(3.8-4.3) 8 11 0.2 0.275
(4.3-4.8) 14 25 0.35 0.625
(4.8-5.3) 6 31 0.15 0.775
(5.3-5.8) 4 35 0.1 0.875
(5.8-6.3) 5 40 0,125 1
40 1
𝑅 = 6.1 − 3.3 = 2.8 𝐾 = 1 + 3.322 log(40) = 6.32 = 6 𝑖𝑛𝑡𝑒𝑟𝑣𝑎𝑙𝑜𝑠
𝐼𝑐= 2.8=0.46=0.5=𝑎𝑛𝑐ℎ𝑜 𝑑𝑒 𝑖𝑛𝑡𝑒𝑟𝑣𝑎𝑙𝑜𝑠
6
Los datos presentados en el siguiente arreglo, representan los ingresos
diarios, (Miles de pesos) obreros de la empresa pamsa de México.
A) construir una distribución de frecuencias agrupadas, utilizando la fórmula
de sturges.
xi fi Fi hi Hi 𝑥̇ Grados
(16-18) 3 0.15 0.15 17 54
(18-20) 5 8 0.25 0.4 19 90
(20-22) 7 15 0.35 0.75 21 126
(22-24) 4 19 0.2 0.95 23 72
(24-26) 1 20 0.05 1 25 18
20 1
0
16-18 18-20 20-22 22-24 24-26
5%
15%
20%
25%
35%
Media aritmetica:
Media aritmetica:
Es una medida de posición que suele usarse más comúnmente para saber
el promedio, o bien la posición media de un grupo de datos.
También se le conoce como el valor medio de todos los valores que toma
la variable, estadística de una serie de datos, algunos dicen que es el valor
más representativo de la serie de valores; otros dicen que el punto de
equilibrio o el centro de gravedad de la serie de datos.
Ejercicio
Hay 12 compañas fabricantes de automóviles en E.U.A enseguida se enlista
el numero de potente concedidas por el gobierno de E.U.A a cada
campaña en un año reciente
Una población
Compañías No.
Patentes 2,340
General 511 = 195
12
Motors
Nissan 385
Daimein 275
Toyota 257
Honda 249
Ford 234
Mazda 210
Prizder 97
Porsche 50
Mitsubishi 36
Volvo 23
BMW 13
-2 +3
-1
1 2 3 4 5 6 7 8 9
𝑋̿
La media se ve afectada en exceso por valores grandes o pequeños poco
comunes. Y este es su punto débil. Ya que recordando que el valor de cada
elemento en una muestra, o población, se utiliza cuando se calcula la media
si uno o dos de estos valores son extremadamente grandes o pequeños
comparados con la mayoría de los datos, la media podría no
ser un promedio.
Desviaciones
𝐸(𝑋 − 𝑋̅) =0
∑𝑛1=1 𝑓𝑖 ∗ 𝑥 32820
= = 91.17𝑘𝑔
𝑛 360
Interpretación: El peso promedio del grupo de 360 trabajadores es de 91.17
kg
Los kilómetros recorridos por 20 estudiantes al ir al ICEA desde sus casa están
dados enseguida
∑𝑛1=1 𝑓𝑖 ∗ 𝑥
𝑋̅ = = 102.6 = 5.13𝑘𝑚
𝑛
Kilómetros Kilómetros Numero de Total, de
recorridos promedio estudiantes fi kilómetros
recorridos
0 y menos de 2 1 2 2
2 y menos de 4 3 5 15
4 y menos de 6 5 4 20
6 y menos de 8 7 8 56
8 y menos de 10 9 1 9
102
= 5.1𝑘𝑚 Los km promedio de este grupo de 20 estudiantes es de 5.1km
20
La siguiente distribución de frecuencias se construyó con los precios de 20
vehículos de la empres Whitner Autoplex
Precio de Frecuencia fi 𝑋̇ 𝑓𝑖 ∗ 𝑥̇ Frecuencia Grados
venta (miles Relativa hi
de dólares)
15-18 8 16.5 132 0.1 36
18-21 23 19.5 448,5 o.2875 103.5
21-24 17 22.5 382.5 0.2125 76.5
24-27 18 25.5 459 0.225 81
27-30 8 28.5 228 0.1 36
30-33 4 31.5 126 0.05 18
33-36 2 34.5 69 0.025 9
80 1845 1
1845
= 23.0625
80
Determinar el precio de venta medio aritmético de los vehículos
$23.0625
¿Cuál es el porcentaje de vehículos de 24,000 a 30,000?
32.5%
Construir el histograma y el diagrama de sectores de precio de 80 nuevos
vehiulos vendidos el mes pasado en el lote de Whitner Autoplex
20
15
10
18% 36%
36%
103.50%
81%
76.50%
8 23 17 18 8 4 2
MEDIA PONDERADA
Esta medida de tendencia central permite calcular un promedio que
toman en cuenta la importancia de cada valor con respecto al total.
Esto constituye un caso especial de la media aritmética y se presenta
cuando hay varias observaciones con el mismo valor.
Para explicar esto, se presenta el siguiente caso:
Suponiendo que el Wendy's restaurant vende refrescos medianos, grandes
y gigantes a $0.90, $1.25 y $1.50 de las 10 últimas bebidas vendidas 3 eran
medianas, 4 grandes y 3 gigantes. Para determinar el precio promedio de
las últimas 10 bebidas vendidas se calculó de 2 formas.
0.90 + 0.90 + 0.90 + 1.25 + 1.25 + 1.25 + 1.25 + 1.50 + 1.50 + 1.50
𝑋̅ =
10
12.2
𝑋̅𝑊 = 3(0.90) + 4(1.25) + 3(1.50) = = 1.22
10
Considerar los datos donde se utilizan niveles de trabajo para la
producción de dos de sus productos finales la compañía desea saber el
promedio de costo de trabajo por hora para cada uno de los productos.
Usando esta tasa promedio se podría calcular el costo del trabajo invertido
en una unidad del producto 1 como $7 (1+2+5)=$56, y el de una unidad
del producto 2 como $7 (1+3+3)=$70. Puestos promedios son incorrectos.
Para que los cálculo sean correctos las respuestas deben tomar en cuenta
diferentes manos para el producto el costo total del trabajo por unidad es
($5x1) +(7x2)+(9x5)=$64
64
Como se invierten en horas de trabajo es promedio de = $8.00
8
7%
1 + 𝑡𝑎𝑠𝑎 𝑑𝑒 = 1 + 0.07 = 1.07
100
Factor de crecimiento
Cantidad por la que se multiplican los ahorros para obtener el saldo al final
del mismo, el factor de crecimiento considerado como la media aritmética
simple sería (1.07+1.08+1.10+1.12+1.18)15=1.11 que corresponde a una tasa
de interés promedio anual del 11%.
Sin embargo si el banco deja un interés a una tasa del 11% anual, un
depósito de $100 crecerá en 5 años a:
$100x1.11x1.11x1.11x1.11x1.11= $168.57
La tabla se muestra que solo $168.57 así, el factor del crecimiento
promedio correcto debe ser ligeramente menor a 1.11.
Para encontrar el factor de crecimiento correcto se pueden multiplicar los
factores de crecimiento de los 5 años y luego obtener la raíz quinta del
producto, número que al multiplicarse cuatro veces por sí mismo da como
resultado el producto inicial. El resultado es el factor de crecimiento como
media geométrica; Qué es el promedio adecuado que se debe utilizar. La
fórmula para encontrar la media geométrica de una serie de números es:
𝑛
𝑀. 𝐺 = √𝑃𝑟𝑜𝑑𝑢𝑐𝑡𝑜 𝑑𝑒 𝑡𝑜𝑑𝑜𝑠 𝑙𝑜𝑠 𝑣𝑎𝑙𝑜𝑟𝑒𝑠 𝑥
Hay que observar que la tasa de interés promedio es 10.95% obtenida con
la media geométrica está muy cerca de la tasa promedio incorrecta.
𝑛 𝑝𝑒𝑟𝑖𝑜𝑑𝑜
𝑀. 𝐺 = √𝑣𝑎𝑙𝑜𝑟 𝑓𝑖𝑛𝑎𝑙 𝑑𝑒𝑙 𝑖𝑛𝑖𝑐𝑖𝑎𝑙 𝑑𝑒𝑙 𝑝𝑒𝑟𝑖𝑜𝑑𝑜
𝑣𝑎𝑙𝑜𝑟
𝑛 534847
𝑀. 𝐺 = √ − 1 ∗ 100 = 𝑀. 𝐺. = 4.97
258295
Ejercicio 1:
Según la distribución de frecuencias que se muestra a continuación, esta
corresponde al peso en kilogramos de un grupo de 52 trabajadores de la
empresa x, se pide calcular la moda.
Peso Trabajadores
30-39 2 𝐿𝑀𝑜 = 80
40-49 2 ∆1 = 16 − 12 = 4
50-59 7 ∆2 = 16 − 2 = 14
W= 10
60-69 11
4
70-79 12 80 + ( ) ∗ 10 = 82.22𝑘𝑔
4+14
80-89 16
90-99 2
Baton Rouge
48 49 50 51 52
Tucson
40 45 47 50 53 55 60
MEDIDAS DE DISPERSIÓN
Rango: La medida más simple de dispersión es el rango, es la diferencia
entre el valor mas alto y el mas pequeño, observados a la distribución
(muestra)
𝑅𝑎𝑛𝑔𝑜 = 𝑅 = 𝑋𝑚𝑎𝑥 − 𝑋𝑚𝑖𝑛
Haciendo referencia a la gráfica, determinar el rango de número de
monitores de computadora producidos por hora en las plantas de Baton
Rouge y Tucson e interpretar los dos rangos.
Rango Interfractil:
Es una distribución de frecuencias, una fracción a porporción de los datos,
cae en un fractil o debajo de este. La mediana por ejemplo es el fractil 0.5,
por que la mitad del conjunto es el menor o igual que este valor. Hay que
hacer alusión que los fractiles son parecidos a los porcentajes, en una
distribución cualquiera 25% de los datos están en fractil 0.25, o debajo de
este.
Ejemplo:
Suponer que se desea encontrar el rango interfractil entre el primero y
segundo tercios de los donatiles recibidos por la función X hacia el hospital
general de Pachuca.
1
= 0.333333333 ∗ 1000 = 33.33
3
Primer tercio Segundo Tercio Tercer Tercio
863 1138 1698 Q3
903 1204 Q2 1745
957 cuartil 1354 1802
1041 1/3 Fractil 1624 2/3 Fractil 1883
Q3 75%
Cada 3 datos tendremos un cuartil
1698-957= $741,000
2 3 | 5 7 |10 13 |18 20
Q1 Q2
3+5 8 7 + 10 17 13 + 18 31
𝑄1 = = =4 𝑄2 = = = 8.5 = = 15.5
2 2 2 2 2 2
3𝑛 3 ∗ 20
𝑄1 = = = 15
4 4
𝑛
2
−𝑐
𝑄2 = ∗𝑖+𝐿
𝑓
𝑛
𝑄1 = −𝑐−𝑖+𝐿
4
3𝑛𝑓
𝑄3 = −1−𝐿
4
A.D Desviación Media para datos no agrupados
Datos Agrupados
1.- Encontrar la media aritmética
2-. Encontar el valor absoluto de la desviación 𝑥 = |𝑥 − 𝑥̅ |
3.- Se multiplica la desviación de cada clase por la frecuencia de cada
dato f(x)
4.- Encontrar la suma de los valores absolutos ∑(𝑓𝑖 𝑥) Ef=n
Intervalo de # de Km promedio Desviaciones F(x)
clase (km estudiantes (f) (punto medio con respecto a
recorridos) marca de la media
clase) < |𝑥 = (𝑥 − 𝑥 )| >
0-2 2 1 4.1 8.2
2-4 5 3 2.1 10.5
4-6 4 5 0.1 0.4
6-8 8 7 1.9 15.2
8-10 1 9 3.4 3.4
20=n 12.1 38.2
𝑥=2+15+20+56+9 38.2
𝐴. 𝐷. = = 1.41 Km
20 20
𝑥̅=102=
5.1 km
20
Ejercicio:
Encontrar la desviación media de los resultados de la prueba de pureza de
los compuestos de una fábrica.
𝑥̅ = 0.166
Valor Desviación 𝐷. 𝑀 =
∑(𝑋)
=
0.692
= 461
𝑛 15
absoluta
0.04 0.126 𝐷. 𝑀 = 0.461%
0.06 0.106
0.12 0.46
0.14 0.26
0.14 0.26
0.15 0.16
0.17 0.004
0.17 0.004
0.18 0.014
0.19 0.024
0.21 0.044
0.21 0.044
0.22 0.54
0.23 0.079
0.25 0.084
.692
Desviación Estándar
La desviación estándar de la población, es la raíz cuadrada de la varianza
de la población
La varianza es el promedio delos cuadrados de las distancias de las
observaciones de la media, la desviación estándar es la raíz cuadrada del
promedio de los cuadrados del promedio de los cuadrados de las
distancias entre las observaciones y la media.
∑(𝑥 − 𝑛)2 ∑ 𝑥2
𝜎 = √𝜎 2 = √ =√ − 𝑀2
𝑛 𝑛
Poblacional
𝜎 2 = 𝑣𝑎𝑟𝑖𝑎𝑛𝑧𝑎 = 𝜎 = √𝜎 2
X= observación
M= Media
N= Número total
𝜎 = 𝑑𝑒𝑠𝑣𝑖𝑎𝑐𝑖𝑜𝑛 𝑒𝑠𝑡𝑎𝑛𝑑𝑎𝑟
𝜎 2 = 𝑣𝑎𝑟𝑖𝑎𝑐𝑖𝑜𝑛𝑒𝑠 𝑑𝑒 𝑙𝑎 𝑝𝑜𝑏𝑙𝑎𝑐𝑖𝑜𝑛
Muestral
∑(𝑥 − 𝑥̅ )2
∫= √
𝑛 −1
Rectas de Regresión
Cuando se tiene una distribución bidimensional y esta se representa en el
diagrama de dispersión correspondiente, sobre ella se puede dibujar la
recta de regresión. Y que en la estadística se le conoce como “la recta
que mejor se ajusta” a la nube de puntos o diagrama de dispersión.
Xi Accidentes 5 7 2 1 9
yi Vehículos 15 18 10 8 20
A) Calcular el coeficiente de correlación lineal
B) Si ayer se produjeron 6 accidentes ¿Cuántos vehículos podemos suponer
que circulan por la super vía a más de 120 km/h?
fi xi yi 𝑥𝑖 2 𝑦𝑖 2 xi*yi
1 5 15 25 225 75
1 7 18 49 324 126
1 2 10 4 100 20
1 1 8 1 64 8
1 9 20 81 400 180
5 24 71 160 1113 409
Medias aritméticas Varianza y desviaciones típicas
24 ∑(𝑥𝑖 ) 160
𝑥̅ = = 4.8 𝜎 2𝑥 = = (𝑥̅ )2 = = −(4.8)2
5 𝑛 5
71
𝑦̅ = = 14.2 𝜎 2 𝑥 = 8.96 √8.96 = 2.993
5
1113
𝜎 2𝑦 = − (142) 2 = √20.96 = 4.578
5
𝜎𝑥𝑦 13.64
Covarianza a)𝜎𝑥𝜎𝑦 = = 0.995
2.933
∑ 𝑓𝑖∗𝑥𝑖∗𝑦𝑖∗𝑥̅∗𝑦̅ 𝜎𝑥𝑦
𝜎𝑥𝑦 = b)𝑦 − 𝑦̅ + 𝜎𝑥𝜎𝑦 (𝑥 − 𝑥̅ )
𝑛
409 13.64
𝜎𝑥𝑦 = − (4.8)(14.2) 𝑦 = 14.2 + (𝑥 − 4.8)
5 8.96
y= 1.52(1)+6.9=8.42
y= 1.52(20)+6.9=37.3
Valores Y
25
y = 1.5223x + 6.8929
20 R² = 0.9907
15
Vehiculos
Valores Y
10
Lineal (Valores Y)
0
0 2 4 6 8 10
Accidentes
Ejercicio
En el ICEA se realizó una investigación que tienen los resultados entre las
materias de Geografía con Estadística. Los resultados se muestran en la
tabla
Xi Geografía 3 4 5 6 6 7 7 8 10
Yi Estadística 2 5 5 6 9 6 7 9 10
fi Num. 4 6 12 4 5 4 2 1 2
Estudiantes
a) Obtener la ecuación de la recta de regresión de mejor ajuste de las
calificaciones de estadística respecto a las calificaciones de
geografía
b) ¿Cuál es la nota esperada en estadística para un alumno que tuvo
4.5 en geografía?
Valores Y
12
y = 0.9866x + 0.2725
10 R² = 0.9019
8
Estadística
6
Valores Y
4 Lineal (Valores Y)
0
0 2 4 6 8 10 12
Geografía
Propiedades de los números
3+5=8 ó 5+3=8
Multiplicación: cuando dos números se multiplican entre sí, el producto
es el mismo independientemente del orden en que los números se
multipliquen.
3x5=15 ó 5x3=15
Asociativa: cuando tres o más se suman, la suma es la misma
independientemente de la forma en que los números agrupan.
6+(4+3)=13 ó (6+4)+3=13
Multiplicación: Propiedades de los números, cuando tres o más números
se multiplican, el producto es el mismo, independientemente de la forma
en que los números se agrupan.
6x(4x3)=72 ó (6x4)X3=72
Distributiva: Es una de las reglas de la multiplicación, indica que al
multiplicar un número x por dos o más términos que están sumándose o
restándose, se puede efectuar primero la suma o la resta, o multiplicar el
número x por cada uno de los términos que están sumando o restando,
para luego hacer la sumatoria o resta así en ambos casos se obtiene el
mismo resultado.
(a+b)x=(ax)+(bx)
(a-b)x=(ax)-(bx)
Ejercicio
Copier Sales of America vende copiadoras a empresas de todos los
tamaños en Estados Unidos y Canadá. Hace poco ascendieron a la
señora Marcy Bancer al puesto de gerente nacional de ventas. A la
siguiente junta de ventas asistirán los representantes de ventas de todo el
país. Ella desea destacar la importancia de hacer una última llamada de
ventas adicional cada día, y decide reunir información sobre la relación
entre el número de llamadas de ventas y el número de copiadoras
vendidas. Por ello, selecciona una muestra aleatoria de 10
representantes y determina el número de llamadas que hicieron el mes
pasado y el número de copiadoras que vendieron. La información
muestral se reporta en la tabla 13-1 ¿Qué observaciones cabe hacer
respecto de la relación entre el número de llamadas de ventas y el
número de copiadoras vendidas? Elabore un diagrama de dispersión
para representar la información.
70 y = 1.1842x + 18.947
R² = 0.5761
60
Copiadoras vendidas
50
40
Valores Y
30 Lineal (Valores Y)
20
10
0
0 10 20 30 40 50
Numero de llamadas de ventas
22,100
𝜎𝑦 2 = − (45)2 = √185 = 13.60
10
𝑦 = 1.18𝑥 + 19
𝑥 = 0.48(83) + 0.13 = 40.46 d) 78 copiadoras
e) 40 llamadas
Tiene que haber un promedio de 40 llamadas para tener una
buena venta.
Ejercicio
El señor James McWhinney, presidente de Daniel-James
Financial Services, considera que hay una relación entre el
número de contactos con sus clientes y la cantidad de ventas
en dólares. Para documentar esta afirmación, el señor
McWhinney reunió la siguiente información muestral. La
columna X indica el número de contactos con sus clientes el
mes anterior, y la columna Y muestra el valor de las ventas
(miles de $) el mismo mes por cada cliente muestreado.
Fi Xi Yi 𝑥2 𝑦2 Xi*yi
1 14 24 196 576 336
1 12 14 144 196 168
1 20 28 400 184 580
1 16 30 256 900 480
1 46 80 2,116 6,400 3,680
1 23 30 529 900 690
1 48 90 2.304 8,100 4,320
1 50 85 2,500 7,225 4,250
1 55 120 3,025 4,400 6,600
1 50 110 2,500 12,100 5,500
10 334 611 13,470 51,581 26,584
Covarianza Correlación
26,584 617.66
𝜎𝑥𝑦 = − (33.4)(61.1) = 617.66 𝑟= = 0.976
10 (16.77)(37.79)
677.66
𝑦 = 61.1 + (𝑥 − 33.4) = 𝑦 = −12.046 + 2.199𝑥
281.44
120
y = 2.3415x - 19.235
R² = 0.9502
100
80
ventas
60 Valores Y
Lineal (Valores Y)
40
20
0
0 10 20 30 40 50 60
# de contactos
Ejercicio
Medir la fuerza de la relación lineal entre el número de
comerciales y el volumen de venta.
Calcular el coeficiente de correlación y el coeficiente de
determinación. Interpretar ambos
Dibuja el diagrama de dispersión y cuando se haya encontrado
la ecuación de la recta de mejor ajuste dibujar la línea.
Covarianza Correlación
1629 9.9
𝜎𝑥𝑦 = − (3)(5) = 9.91 𝑟= = 0.930
10 (1.414)(7.523)
9.9
𝑦 = 51 + (𝑥 − 3) = 𝑦 = 7𝑥 + 30
(1.414)(7.523)
𝑦 = 7(5) + 30 = 65
ventas por comerciales
70
y = 4.95x + 36.15
60 R² = 0.8658
50
40
ventas
30 Valores Y
Lineal (Valores Y)
20
10
0
0 1 2 3 4 5 6
comerciales
APUNTES DE ESTADISTICA 3ER
PARCIAL
Estadística para el turismo
Conjuntos Infinitos
𝐶 = {𝑥𝐸𝑁| 𝑥 𝑒𝑠 𝑚𝑢𝑙𝑡𝑖𝑝𝑙𝑜 𝑑𝑒 3}
𝐶 = {3,6,9,10,15,18 … }
𝑛(𝐶 ) = ∞
𝐴 = {𝑎, 𝑒, 𝑖, 𝑜, 𝑢} n(A)=5
𝐷{𝑥𝐸𝑁|2𝑥 − 1 = 0} 𝐷 = ∅ 𝐶𝑂𝑁𝐽𝑈𝑁𝑇𝑂 𝑉𝐴𝐶𝐼𝑂 𝑂 𝑁𝑈𝐿𝑂 𝑛(𝐷 ) = 0
2𝑥 = 1 − 0 2𝑥 = 1 𝑥 = 1⁄2 = 0.5
Verificar si a es su A es subconjunto de S
= {0,1,2,3,4,5,6,7,8,9}
𝐴 = {2,4,6,8}
𝑛(𝑅 ) = 4 → 𝑛 23 = 8
𝑆 = {𝑎, 𝑏, 𝑐 }
𝑅 = {𝑎, 𝑏, 𝑐, 𝑑 }
Diagrama de Venn
Forma gráfica de representar conjuntos
𝐴 = {1,2,3,4}
1 2
3 4
𝐵 = {𝑋|𝐸𝑁| 𝑋 𝑒𝑠 𝑚𝑢𝑙𝑡𝑖𝑝𝑙𝑜 𝑑𝑒 3 𝑚𝑒𝑛𝑜𝑟 𝑞𝑢𝑒 1}
𝐵 = {3,6,9,12,15}
N B
15 3 6 9
12
2 5 3 4
2 8 12
4 10 6
14
17
18 19
U A B 14
16 2 6 4
12 10 8 17
18 19
U M 11
13 10
l n
5 9
16 2 6
21 12
23
Unión de Conjuntos
U A B
3 6 2
5 8 12
Intersección
Sean A y B conjuntos no vacíos, entonces la intersección de A y B se define
como
𝐴 ∪ 𝐵 = {𝑋|𝑋 ∈ 𝐴 𝑌 𝑥 ∈ 𝐵}
Sean los conjuntos 𝑢 = {1,2,3,4,5,6,7,8}, 𝑎{1,2,5,6}, 𝑏 =
{1,4,5,6,7}, 𝑝𝑟𝑒𝑐𝑖𝑠𝑎𝑟 𝑦 𝑟𝑒𝑝𝑟𝑒𝑠𝑒𝑛𝑦𝑎𝑟 𝑒𝑛 𝑢𝑛 𝑑𝑖𝑎𝑔𝑟𝑎𝑚𝑎 𝑑𝑒 𝑉𝑒𝑛𝑛 𝐴 ∪ 𝐵
U A B
6 7
3 2 1 4
5
Conjunto Complemento
𝐴⊃𝑂𝐴⊂
𝐴⊂ = {𝑥|𝑥 ∈∪ 𝑦 ∅𝐴}
U A
1 A 6
4 2 3 10
8 5 7 9
Si lanzo una encuesta a 82 alumnos sobre el tipo de música que mas les
agrada. Los resultados fueron los siguientes a 32 de ellos les gusta el pop, a
33 les agrada el rock, a 36 el reggae, a 9 les agrada el rock y el reggae, a 4
les gustan los 3 estilos y únicamente a 7 otros tipos de música.
1. ¿Cuántos estudiantes solo prefieren el rock?
21.95%
2. ¿A cuantos alumnos solo les agrada el reggae?
24.39%
3. ¿Cuántos estudiantes prefieren únicamente pop y reggae?
8.53%
4. ¿Cuántos alumnos prefieren únicamente rock y reggae?
6.09%
U pop rock
15 6 18
4
7 5
20
7
reggae
95 A en física e historia
80 A en calculo, física e historia
Indicar cuantos de estos 350 alumnos aprobaron
1. Solo una materia
30%
2. Exactamente dos materias
24.85%
3. Al menos una materia
U calculo física
85.71%
4. Cuando menos 2 materias
48 40 25
74.14%
60
32 15
60
50
historia
A los niños de una organización se les apoya para que hagan deporte.
Una encuesta revelo que los deportes que mas les agradan son natación,
futbol, beisbol y otros
30 natación y futbol
18 natación y beisbol
20 futbol y beisbol
U natación futbol
7 18 28
12
6 8
1
20
beisbol
Teoría de la Probabilidad
Evento: En la teoría de la probabilidad de un evento es una o mas de los
posibles resultados de hacer algo. Al lanzar una moneda al aire, si cae cruz-
águila es un evento, y si cae cara-sol es otra diferente. De manera análoga,
si se saca una carta de mazo de naipes el tomar el As de espadas es un
evento, Un ejemplo de evento que quizá este, mas cercano a su quehacer
diario es ser elegido de entre 100 estudiantes, para que responda la
pregunta.
Experimento: En la teoría de la probabilidad que origina q de dichos eventos
se conoce como experimento, utilizando un lenguaje formal se podría hacer
la siguiente pregunta. En un experimento de lanzar una manera ¿Cuál es la
probabilidad del evento cara? Y desde luego, si la moneda no está cargada
y tiene la misma probabilidad de caer en cualquiera de sus dos lados (sin
posibilidad de que caiga parada) Podríamos responder
1
𝑃 (𝑐𝑎𝑟𝑎) = 0.5 = 50% 𝑆 = {𝑐𝑎𝑟𝑎, 𝑐𝑟𝑢𝑧}
2
Al conjunto de todos los resultados posibles de un experimento se le llama
espacio muestral del experimento. En el de lanzar una moneda, ¿Cuál es el
espacio muestral?
En el espacio de sacar una carta, el espacio muestral de una carta
Ganar Perder
1 1 49
Regla de adhesión para eventos mutuamente excluyentes
A menudo, sin embargo se esta interesado en la probabilidad en que una
cosa u otra suceda, si estos dos eventos so mutuamente excluyentes
puede expresar esta probabilidad haciendo uso de la regla de adhesión
para eventos mutuamente excluyentes:
P(A o B)= La probabilidad que suceda A o B y se calcula de la siguiente
manera:
P(A o B)= P(A)+P(B)
5 estudiante por igual capaces esperan la fecha en la que se les hará una
entrevista para trabajar en el verano. La compañía solicitante ha
anunciado que contratara a solo 1 de los 5, mediante una elección
aleatoria. El grupo esta formado por los siguientes 5 estudiantes:
A Bill B
Jonh Sally
Walter Helen
Regla de adhesión: Para eventos que no son mutuamente excluyentes
Probabilidad de que dos eventos no son mutuamente excluyentes es posible
que ambos se presenten al mismo tiempo en tales casos, se deben modificar
la regla de adhesión
Por ejemplo: ¿Cuál es la probabilidad de sacar un As o un corazón de un
mazo de cartas? Obviamente los eventos As y Corazón puedes presentarse
juntos pues podemos sacar o un As o un As de corazón.
En consecuencia, As y corazón no son eventos mutuamente excluyentes. Se
deben ajustar la ecuación de la adhesión para evitar la probabilidad de
obtener ambos eventos juntos.
Los empleados de cierta compaña han escogido 5 de ellos para que los
representen en el consejo de personal sobre productividad, los perfiles de
los 5 elegidos son los siguientes:
Edad
Este grupo decide elegir un vocero la elección se
1 hombre 30
efectúa sacando de un sombrero uno de los nombres
2 hombre 32
impresos, La pregunta es ¿Cuál es la probabilidad de
3 mujer 45
que sea mujer o cuya edad sea por arriba de 35
4 mujer 20
5 hombre 40 años?
2 2 1 3
P(mujer o mayor de 35)+ P (mujer de 35)-P(mujer y mayor de 35)= + − =
5 5 5 5
Calculo de los posibles arreglos de objetos
Los procedimientos de calculo para encontrar el numero de arreglos
posibles en un conjunto o conjuntos, son esenciales en el estudio de la
probabilidad. Al contar los arreglos, es utilizar todos los posibles arreglos en
la forma de un árbol llamado diagrama de árbol.
Principio de multiplicación
Como se Muestra en el diagrama, cualquiera de los 7 abrigos puede ser
apareado con cualquiera de los 2 sombreros. Por tanto el numero total de
posibles formas de aparear un abrigo con un sombrero se puede calcular
de la siguiente forma
4(formas de seleccionar un abrigo) *2(formas de escoger un sombrero)
Probabilidades bajo condiciones de independencia estadística
P(B)=5/8
= 5/8*5/8=25/64
Eventos dependientes
Si a y b están relacionados de tal modo que la ocurrencia de b depende
de la concurrencia de a, entonces A y B son llamados eventos
dependientes de la probabilidad, evento b dependiendo de la
concurrencia del evento a es llamda posibilidad condicional y se escribe