Examen Final: Análisis de Datos en Mercado
Examen Final: Análisis de Datos en Mercado
Contenido
Contrastes paramétricos (tema 2).................................................................2
Contrastes no paramétricos tema 2...............................................................8
Anova (Tema 3)............................................................................................ 14
Cluster (tema 4)........................................................................................... 20
No jerárquico............................................................................................. 20
Jerárquico.................................................................................................. 25
Factorial (tema 5)......................................................................................... 29
1
2
Valor de prueba = 40
95% Intervalo de confianza
para la diferencia
Diferencia de
t gl Sig. (bilateral) medias Inferior Superior
Horas semanales 6,400 942 ,000 3,164 2,19 4,13
Valor de prueba = 3
95% Intervalo de confianza
para la diferencia
Diferencia de
t gl Sig. (bilateral) medias Inferior Superior
Satisfacción con el
35,692 404 ,000 2,227 2,10 2,35
trabajo actual
2
3
Estadísticos de grupo
Error típ. de la
Antigüedad N Media Desviación típ. media
Satisfacción con el >= 7 209 5,33 1,308 ,090
trabajo actual <7 195 5,12 1,195 ,086
3
4
Situación laboral
Sí No Total
Grado de Nada feliz Recuento 3 13 16
Felicidad % de Grado de Felicidad
Actual 18,8% 81,3% 100,0%
Actual
4
5
% de Grado de Felicidad
23,0% 77,0% 100,0%
Actual
% de Situación laboral 9,4% 16,1% 13,8%
% de Grado de Felicidad
35,4% 64,6% 100,0%
Actual
% de Situación laboral 79,5% 74,6% 76,3%
% de Grado de Felicidad
33,9% 66,1% 100,0%
Actual
% de Situación laboral 100,0% 100,0% 100,0%
Pruebas de chi-cuadrado
Sig. asintótica
Valor gl (bilateral)
Chi-cuadrado de Pearson 13,633(a) 3 ,003
N de casos válidos
1193
a 0 casillas (,0%) tienen una frecuencia esperada inferior a 5. La frecuencia mínima esperada es 5,43.
5
6
Correlaciones
Actitud ante el Actitud ante el Actitud ante el Actitud ante el Actitud ante el
trabajo (1) trabajo (2) trabajo (3) trabajo (4) trabajo (5)
Actitud ante el trabajo (1) Correlación de Pearson 1 -,026 ,149(**) ,037 ,001
Sig. (bilateral) ,380 ,000 ,199 ,981
N 1194 1185 1 1187 1176 1156
Correlación de Pearson -,026 ,121(**) ,293(**) ,229(**)
Actitud ante el trabajo (2)
Sig. (bilateral) ,380 ,000 ,000 ,000
Actitud ante el trabajo (4) Correlación de Pearson ,037 ,293(**) ,122(**) 1 ,243(**)
Sig. (bilateral) ,199 ,000 ,000 ,000
6
7
Actitud ante el trabajo (5) Correlación de Pearson ,001 ,229(**) ,283(**) ,243(**) 1
Sig. (bilateral) ,981 ,000 ,000 ,000
7
8
8
9
9
10
Estadísticos de contraste
Satisfacción:
Preocupacion aspecto con el Estado de
es: aspecto que que se siente más ánimo más
más le preocupa satisfecho frecuente
Chi-
369,095 480,715 2126,704
cuadrado(a,b,c)
gl 3 3 6
Sig. asintót. ,000 ,000 ,000
a 0 casillas (,0%) tienen frecuencias esperadas menores que 5. La
frecuencia de casilla esperada mínima es 289,5.
b 0 casillas (,0%) tienen frecuencias esperadas menores que 5. La
frecuencia de casilla esperada mínima es 286,3.
c 0 casillas (,0%) tienen frecuencias esperadas menores que 5. La
frecuencia de casilla esperada mínima es 168,7.
10
11
Total 1158
Prueba binomial
Proporción Prop. de Sig. asintót.
Categoría N observada prueba (unilateral)
Situación laboral Grupo 1 Sí 406 ,338 ,333 ,358(a)
Grupo 2 No 794 ,662
a Basado en Total 1200 1,000
la
aproximación
Z.
11
12
N Media 125 125 125 125 125 123 125 115 110 118 122 79 125
Parámetros normalesa,b Desviación típica 4004459 4,59 2569,82 117,08 4670,88 1674,54 5,18 8,897 12,249 12,589 150,59 15,425 1,9760
1937791 1,017 691,505 37,570 716,041 333,603 1,388 1,5026 2,3082 2,8884 16,738 3,3119 ,15366
Absoluta
Diferencias más extremas Positiva ,189 ,448 ,119 ,169 ,170 ,111 ,305 ,100 ,066 ,134 ,129 ,102 ,538
Negativa ,189 ,448 ,119 ,169 ,170 ,087 ,305 ,100 ,066 ,134 ,129 ,068 ,438
-,087 -,280 -,117 -,088 -,114 -,111 -,183 -,064 -,048 -,063 -,068 -,102 -,538
Z de Kolmogorov-Smirnov
2,108 5,007 1,327 1,884 1,896 1,228 3,407 1,071 ,692 1,459 1,423 ,905 6,016
Sig. asintót. (bilateral)
,000 ,000 ,059 ,002 ,002 ,098 ,000 ,202 ,724 ,028 ,035 ,385 ,000
a. La distribución de contraste es la Normal.
N Mínimo 125 125 125 125 125 123 125 115 110 118 122 79 125
Parámetros uniformesa,b Máximo 1367000 4 1298 64 3600 930 2 6,6 8,4 8,1 120 9,4 1,00
10419200 8 5216 225 6500 2320 9 13,7 18,5 22,1 196 22,0 2,00
Absoluta
Diferencias más extremas Positiva ,475 ,728 ,403 ,393 ,246 ,182 ,323 ,329 ,285 ,378 ,220 ,129 ,976
Negativa ,475 ,728 ,403 ,393 ,246 ,099 ,323 ,329 ,285 ,378 ,220 ,129 ,024
-,008 -,024 -,042 -,017 -,066 -,182 -,238 -,026 -,020 -,013 -,058 -,061 -,976
Z de Kolmogorov-Smirnov
5,314 8,139 4,503 4,392 2,754 2,020 3,616 3,524 2,993 4,110 2,430 1,144 10,912 ,000
Sig. asintót. (bilateral)
,000 ,000 ,000 ,000 ,000 ,001 ,000 ,000 ,000 ,000 ,000 ,146
a. La distribución de contraste es la Uniforme.
12
13
Anova (Tema 3)
SOLUCIÓN LABORATORIO Nº 3: TÉCNICOS
Se desea conocer si la zona de trabajo (norte, levante, centro, sur) de los 64 técnicos de
una empresa tiene influencia en el número de visitas que éstos realizan al año. Estime
mediante SPSS el modelo ANOVA correspondiente y conteste las siguientes preguntas:
La hipótesis nula de Levene es que las varianzas del número de visitas de los
técnicos de las cuatro zonas de trabajo son iguales:
13
14
14
15
SCE 79.945,021
2
SCE 79.945,021
R= = = 0,198
SCT 403.310,484
La zona de trabajo del técnico explica un 19,8% del número de visitas que
realiza.
15
16
LABORATORIO Nº 5: AUTOMÓVILES
16
17
Factores inter-sujetos
N
1,00 3
2,00 3
Modelo de automóvil
3,00 3
4,00 3
1,00 4
Conductor 2,00 4
3,00 4
Como sólo tenemos 1 observación por celda no podemos calcular el estadístico del
contraste de Levene:
. 11 0 .
Contrasta la hipótesis nula de que la varianza error de
la variable dependiente es igual a lo largo de todos los
grupos.
17
18
El p-valor asociado al estadístico del factor de bloqueo (conductor) es de 0,025 < 0,05,
por lo que a un nivel de significación del 5% se rechaza la hipótesis nula y, por tanto,
existen diferencias significativas en los consumos medios de los 3 conductores.
3. En caso de rechazar alguna de las anteriores hipótesis realice los contrastes posteriores
oportunos.
Tras el rechazo de la hipótesis nula tendríamos que hacer los contrastes post-hoc sobre
el factor conductores
Los resultados del contraste aparecen en la siguiente tabla:
Comparaciones múltiples
Variable dependiente: Consumo de combustible por cada 100 km Scheffe
18
19
3,00
1,00 -1,6250* ,44488 ,030 -3,0518 -,1982
2,00
3,00 -,3750 ,44488 ,715 -1,8018 1,0518
1,00 -1,2500 ,44488 ,081 -2,6768 ,1768
3,00
2,00 ,3750 ,44488 ,715 -1,0518 1,8018
Basadas en las medias observadas.
El término de error es la media cuadrática(Error) = ,396. *. La
diferencia de medias es significativa al nivel ,05.
Como podemos observar solo existen diferencias significativas entre el consumo medio
de combustible del conductor 1 y el conductor 2, en el sentido de que el conductor 1
consume en media más gasolina que el conductor 2.
A continuación se muestra la tabla de subconjuntos homogéneos:
Consumo de combustible por cada 100 km
Scheffe
Conductor N Subconjunto
1 2
2,00 4 5,6250
Cluster (tema 4)
19
20
No jerárquico
Resultados:
20
21
21
22
SE PIDE:
1. ¿Cuántas iteraciones hacen falta para que el algoritmo
converja?
2. ¿Qué grupo identifica a aquella gente que no siente
confianza en ninguno de los medios de comunicación
actuales? ¿qué proporción de la población pertenece a
dicho grupo?
3. ¿Qué grupo identifica a aquella gente que, en general,
siente confianza en todos los medios de comunicación
actuales? ¿qué proporción de la población pertenece a
dicho grupo?
4. ¿Cómo interpretaría el tercer grupo formado?
22
23
23
24
1 2 3
La televisión 6 2 5
La radio 7 2 6
La prensa escrita (los periódicos editados en papel, o bien
2
en papel y en Internet a la vez)
5
La prensa únicamente digital (publicada únicamente en 7
2
Internet y que no tiene edición en papel)
7 2
5
Los Blogs 6 3
Conglomerado 2 134,000
3 365,000
Válidos 954,000
Perdidos 1523,000
24
25
Jerárquico
25
26
Resultados:
SOLUCIÓN LAB CLUSTER: CEREALES DESAYUNO
Historial de conglomeración
Etapa Conglomerado que se combina Coeficientes Próxima etapa
Etapa en la que el conglomerado
aparece por primera vez
1
1 2 3 5,000 0 0 2
2 2 8 46,500 1 0 3
3 2 5 56,000 2 0 6
4 4 7 149,000 0 0 8
5 9 10 204,000 0 0 6
6 2 9 215,000 3 5 7
7 2 6 273,000 6 0 9
26
27
8 1 4 303,500 0 4 9
9 1 2 780,762 8 7 0
27
28
28
29
ANOVA
F Sig.
Conglomerado Error
gl gl
Media Media
cuadrática cuadrática
Etiquetado
Peso 73,536 2 15,918 7 4,620 ,053
568,771 2 11,622 7 48,937 ,000
Las pruebas F sólo se deben utilizar con una finalidad descriptiva puesto que los conglomerados han
sido elegidos para maximizar las diferencias entre los casos en diferentes conglomerados. Los niveles
críticos no son corregidos, por lo que no pueden interpretarse como pruebas de la hipótesis de que los
centros de los conglomerados son iguales.
29
30
Factorial (tema 5)
LABORATORIO Nº 13: PAMPERS
30
31
V.
31
32
Solución:
1. El primer paso es el examen visual de las
correlaciones, identificando aquellas que sean
estadísticamente significativas Hay 36
coeficientes de correlación distintos, todos ellos
son significativos (100%).
Todas las variables están correlacionadas, con el
resto de variables y el determinante de pie de
tabla es 0 que es el menor valor que puede
tomar.
Estadísticos descriptivos
Desviación
Media típica N del análisis
Piezas por caja 4,79 1,049 300
Precio 4,74 1,007 300
Valor 4,82 1,178 300
Unisex 4,13 1,505 300
Estilo 4,02 1,330 300
Absorbencia 3,91 1,172 300
Escapes 3,87 1,153 300
Comodidad 3,83 1,197 300
Cierre 3,34 1,165 300
Matriz de correlacionesa
Piezas
por caja
Precio Valor Unisex Estilo Absorbencia Escapes Comodidad Cierre
Correlación Piezas por 1,000 ,86 ,864 ,692 ,508 ,459 ,447 ,412 ,395 ,321
caja 4 1,000 ,73 ,730 ,492 ,464 ,422 ,387 ,360 ,321
Precio ,692 0 1,000 ,38 ,381 ,346 ,395 ,357 ,322 ,248
Valor ,508 ,492 1 1,000 ,89 ,894 ,486 ,486 ,396 ,324
Unisex ,459 ,464 ,346 4 1,000 ,46 ,465 ,460 ,404 ,317
Estilo ,447 ,422 ,395 ,486 5 1,000 ,942 ,731 ,540
Absorbencia ,412 ,387 ,357 ,486 ,460 ,942 1,000 ,75 ,753 ,576
Escapes ,395 ,360 ,322 ,396 ,404 ,731 3 1,000 ,654
Comodidad ,321 ,321 ,248 ,324 ,317 ,540 ,576 ,654 1,000
Cierre
Sig. (Unilateral) Piezas por ,000 ,000 ,000 ,000 ,000 ,000 ,000 ,000
caja ,000 ,000 ,000 ,000 ,000 ,000 ,000
Precio ,000 ,000 ,000 ,000 ,000 ,000 ,000 ,000
Valor ,000 ,000 ,000 ,000 ,000 ,000 ,000 ,000
Unisex ,000 ,000 ,000 ,000 ,000 ,000 ,000 ,000
Estilo ,000 ,000 ,000 ,000 ,000 ,000 ,000 ,000
Absorbencia ,000 ,000 ,000 ,000 ,000 ,000 ,000 ,000
Escapes ,000 ,000 ,000 ,000 ,000 ,000 ,000 ,000
Comodidad ,000 ,000 ,000 ,000 ,000 ,000 ,000 ,000
Cierre ,000
a. Determinante = ,000
32
33
Sig. ,000
33
34
Comodidad -,089 ,053 ,046 ,089 -,100 -,089 -,207 ,902a -,405
Cierre ,022 -,090 -,021 ,015 ,067 -,131 -,405 ,885
a
Matrices anti-imagen
a. Medida de adecuación muestral
34
35
35
36
b. Comunalidades reproducidas
Componente
1 2 3
Piezas por caja ,224 ,865 ,251
Precio ,193 ,891 ,243
Valor ,183 ,862 ,105
Unisex ,244 ,266 ,902
Estilo ,237 ,220 ,916
Absorbencia ,850 ,232 ,256
Escapes ,879 ,182 ,257
Comodidad ,863 ,177 ,157
Cierre ,768 ,145 ,079
Método de extracción: Análisis de componentes principales.
Método de rotación:
Normalización Varimax
con Kaiser. a La
rotación ha convergido
en 4 iteraciones.
36
37
Componente
1 2 3
Piezas por caja -,069 ,399 -,056
Precio -,086 ,420 -,062
Valor -,058 ,437 -,160
Unisex -,110 -,097 ,586
Estilo -,109 -,125 ,609
Absorbencia ,310 -,049 -,031
Escapes ,330 -,081 -,025
Comodidad ,344 -,058 -,098
Cierre ,320 -,044 -,131
Método de extracción: Análisis de
componentes principales.
Método de rotación: Normalización
Varimax con Kaiser. Puntuaciones
de componentes.
EXAMEN
HOLA ME RECIBIS
Holaaaa siy sofi me leeis?
Holaaa
Hola
Que poneis
Si alguien lo tiene y cree que esta bien uqe ponga capturA
37
38
Y este ?
38