SPPS
Elementos Básicos
Mg. Jorge Vargas LLumpo
INICIO
La primera pantalla que nos
muestra siempre es la ventana
que tiene dos pestañas:
Archivos recientes: nuestros
últimos trabajos
Archivos de muestra: ejemplos
que están disponibles al
momento de instalar el
software
Además de ventanas a la
derecha de información del
programa: Estadística
Avanzada, Tiempo en días de la
prueba gratuita, y soporte,
foros y guías de aprendizaje
INICIO
Al cerrar la ventana inicial nos muestra 2
ventanas de trabajo
La primera para ingresar las variables y
luego registrar los datos
La segunda muestra los resultados luego
del procesamiento de los datos, esta
ultima por ahora la podemos cerrar, se
abrirá cuando iniciemos el
procesamiento de la data
VENTANAS DE TRABAJO
La primera recibe el nombre de Editor de
Datos donde se ingresan los datos con los
que se trabajará. (Muy similar a Microsoft
Excel).
• En las columnas (“Var”) se introduce las
variables que componen la base de
datos. Cada pregunta de un cuestionario
realizado corresponde a una variable.
• En las filas (numeradas) son introducidas
las respuestas entregadas por los
encuestados. Así, si se entrevistó a 100
personas, hacia abajo deberá haber 100
registros.
Al final de ven dos pestañas: “Vista de
datos” y “Vista de variables”. En la primera
se muestra los datos ingresados; y en la
segunda se configuran las variables.
VENTANAS DE TRABAJO
La segunda ventana es el “Visor de
Resultados”, aqui el software
despliega los resultados que se
obtienen de los distintos análisis
realizados.
En la sección izquierda, el software
mostrará los títulos de los distintos
análisis y los desplegara como una
diagrama de árbol.
En la sección derecha se muestran
los resultados obtenidos, los
cuales pueden ser copiados y
pegados a software como
Microsoft Word o Excel para
realizar informes u otras acciones
que el investigador considere
necesarias.
SPPS
Elementos Básicos
VISOR DE RESULTADOS
¿Cómo trasladar una encuesta a SPSS?
Hagamos un ejemplo con la presente En Desacuerdo
pregunta. Totalmente en Desacuerdo
Tenemos aquí una encuesta que solicita
información del Nivel de Satisfacción
del Personal administrativo de una
empresa la cual ha sido evaluada según
la Escala de Likert en 5 niveles como se
muestra en la tabla superior
VISOR DE RESULTADOS
Una vez efectuada la
encuesta podemos hacer
uso de Microsoft Excel
como apoyo inicial para el
registro de la data
obtenida en las encuestas.
Como podemos observar,
las filas que constituían
las preguntas en el
cuestionario, han sido
colocados como
cabeceras de columna, y
sobre ésta la numeración
correspondiente
Y respecto a la data de las encuestas, se evaluaron a 20 encuestados, las respuestas fueron registrados en las filas
Bien partiendo de este ejemplo iniciaremos con este ejemplo.
VISOR DE RESULTADOS
Lo primero que se debe
hacer antes de ingresar datos
a una base de datos, es
prepararla.
Primero iniciaremos con la
pestaña “Vista de variables”,
lo que mostrará una ventana
como la que se observa a
continuación.
Como se puede observar, en
la parte superior se muestra
una serie de “características”
de las variables.
Sin embargo, no todas se deben utilizar siempre, por lo que solamente se explicará el funcionamiento de las
características que resulten más relevantes para el uso común de SPSS.
VISOR DE RESULTADOS
Nombre: En esta sección se
debe asignar un nombre para
la variable. Dicho nombre debe
poseer un máximo de 8 letras
y se debe evitar el uso de
tildes, símbolos y caracteres
como la letra “ñ”.
Tipo: Se ofrece la posibilidad de asignar una característica
a la variable, de manera que ésta sea más fácil de trabajar
y de forma que el software la interprete de manera
correcta.
Al hacer click sobre una celda en la columna “Tipo” nos
muestra la ventana de “Tipos” de variable”
Por defecto si solo colocamos en Nombre de la variable e
ignoramos el campo tipo, el programa asume que es
Numérico de Ancho 8 y de 2 posiciones decimales (valor
que se puede modificar a gusto del investigador)
VISOR DE RESULTADOS
Etiqueta: Para que en el visor
de resultados muestre
correctamente los nombres de
las variables (y sin el límite de
las 8 letras) se puede
establecer una etiqueta para
ellas , de manera de en este
sector se podrá escribir lo que el investigador considere necesario. Aquí
puede transcribirse las preguntas si se desea.
Valores: Para cierto tipo de variables, la etiqueta debe ser definida para
más de un valor, como por ejemplo cuando estamos hablando del sexo de
una persona (que puede ser masculino o femenino), por lo cual hay que
decir a SPSS como debe identificar eso. Para ello se utiliza esta sección,
haga click en una de las celdas de esta columna y se despliega una
ventana como la siguiente:
Por ejemplo podemos colocar la Escala de Likert que valida la encuesta
Medida: Para que SPSS realice
correctamente los análisis solicitados, es
necesario establecer correctamente las
unidades de medida de cada una de las
variables. Para ello ofrece tres opciones:
Escala, Ordinal y Nominal. A continuación
se explicará brevemente cada una de estas
unidades de medidas utilizadas por el
software.
Las características anteriormente definidas son
las comúnmente utilizadas por los usuarios, no
obstante el investigador puede utilizar el resto
de características de manera de personalizar
aún más su base de datos. Una vez que estas
características se encuentren correctamente
definidas, el investigador se encuentra con la
capacidad de comenzar a ingresar los datos a
la base de datos.
Ejemplo:
Sigamos con el ejemplo de los datos
asignados, completemos la configuración
de las preguntas para preparar nuestra
base de datos
Ejemplo:
Podemos copiar la primera fila ingresada por tener las mismas características
Ejemplo:
Luego procedemos a cambiar los Nombres de las Variables (P1 a P9) y después cambiamos cada Etiqueta
colocando en ella la pregunta correspondiente, para esto podemos hacer Doble Click sobre la celda Etiqueta o
dar F2 para modificar el contenido
Ejemplo:
En la vista de datos queda preparada la base de datos para llenarse de manera manual o copiando los datos de
un archivo Excel.
Para visualizar los valores que ingresamos por las respuestas de cada variable podemos usar el icono [1A]
indicado en a imagen.
Ejemplo:
Cuando usamos el icono
[1A] podemos evidenciar
que cada celda tiene un
menú emergente para
seleccionar la respuesta.
CUESTIONARIO APLICADO POR LA EMPRESA A SUS CLIENTES.
Ejercicio Práctico:
La Empresa XYZ requiere obtener información acerca de la
percepción de sus clientes sobre un nuevo servicio
ofrecido desde hace unos meses. Para ello se aplicará un
cuestionario a 30 de sus mejores clientes para conocer la
opinión de éstos. Su misión como investigador será
elaborar el libro de códigos y preparar la base de datos
para que la realización de los análisis sea efectuada de
manera correcta y sin errores.
Libro de Códigos:
El libro de códigos es una ficha Libro de Códigos:
donde se especifican los valores
numéricos con que se codificará N Nombre de Etiqueta de la Valores Medida
cada una de las variables del ° la Variable Variable
cuestionario, de manera que el 1 Sexo Sexo 1 : Masculino Nominal
ingreso de los valores a la base de 2 : Femenino
datos se realice uniformemente, 2 Edad Edad 1 : 18 a 29 Nominal
evitando así errores derivados de 2 : 30 a 49
la digitación de los cuestionarios. 3 : 50 o más años
3 Ren_Liq Renta Liquida Escala
4 Niv_Est Años de Estudio Escala
5 Exp_Serv El Servicio ofrece 1 : Muy de Acuerdo Ordinal
. una nueva 2 : De acuerdo
1 experiencia en la 3 : Indiferente
compra 4 : En Desacuerdo
5 : Muy en Desacuerdo
5 Pre_Serv El precio del 1 : Muy de Acuerdo Ordinal
. servicio es acorde 2 : De acuerdo
2 a la calidad de 3 : Indiferente
este 4 : En Desacuerdo
5 : Muy en Desacuerdo
Edición de las Variables:
Una vez listo el libro de códigos, pasamos a
preparar la base de datos para el ingreso de
la información. Para ello nos basamos en las
características halladas en el libro de
códigos.
Variable: Sexo:
Colocamos el nombre de la variable, tipo
numérico de CERO decimales, En la Etiqueta
colocamos la descripción de la variable, y en
Valores haciendo doble click en la celda
ingresamos sus dos únicos valores: 1 y 2 cada
uno con su respectiva etiqueta como se muestra en la imagen. Luego colocamos alineación a la izquierda y en el casillero
de Medida colocamos Nominal; debiendo quedar como en la imagen sgte.:
Variable: Edad:
Colocamos el nombre de la variable, tipo numérico de CERO decimales, En la Etiqueta colocamos la descripción de la
variable, y en Valores haciendo doble click en la celda ingresamos sus valores: 1, 2 y 3 cada uno con su respectiva
etiqueta según nuestro libro de códigos. Luego colocamos alineación a la izquierda y en el casillero de Medida colocamos
Nominal; debiendo quedar como en la imagen sgte.:
Variable: Ren_Liq:
Colocamos el nombre de la variable, tipo numérico con dos decimales considerando que el dato puede contener parte
fraccionaria, En la Etiqueta colocamos la descripción de la variable, y en la celda Valores no registramos nada puesto que
no es un dato que este sujeto a un rango de valores según nuestro libro de códigos. Luego colocamos alineación a la
derecha para que se visualicen adecuadamente los valores monetarios y en el casillero de Medida colocamos Escala;
debiendo quedar como en la imagen sgte.:
Variable: Ren_Liq:
Colocamos el nombre de la variable, tipo numérico con dos decimales considerando que el dato puede contener parte
fraccionaria, En la Etiqueta colocamos la descripción de la variable, y en la celda Valores no registramos nada puesto que
no es un dato que este sujeto a un rango de valores según nuestro libro de códigos. Luego colocamos alineación a la
derecha para que se visualicen adecuadamente los valores monetarios y en el casillero de Medida colocamos Escala;
debiendo quedar como en la imagen sgte.:
Variable: Niv_Est:
Colocamos el nombre de la variable, tipo numérico con CERO decimales considerando que los años de estudio son
valores enteros. En la Etiqueta colocamos la descripción de la variable, y en la celda Valores no registramos nada puesto
que no es un dato que este sujeto a un rango de valores según nuestro libro de códigos. Luego colocamos alineación al
centro para que se visualicen adecuadamente los valores y en el casillero de Medida colocamos Escala; debiendo quedar
como en la imagen sgte.:
Variable: Exp_Serv:
Colocamos el nombre de la variable, tipo numérico con CERO pues la elección serán enteros. En la Etiqueta colocamos la
descripción de la variable, y en la celda Valores registramos el rango de valores propuestos. Luego colocamos alineación a
la derecha y en el casillero de Medida colocamos Ordinal; debiendo quedar como en la imagen sgte.:
Variable: Pre_Serv:
Como es similar a la anterior y para ahorranos el trabajo de ingresar la misma escala de valores hacemos una copia de la
fila y le cambiamos solo el nombre de la variable y la etiqueta, lo demás puede quedar igual.
Vista Datos:
Luego es posible ingresar la data
teniendo como filtro la opción [1A]
que activa los menús emergentes en
cada celda si tuviese valores
Caso contrario, si no esta activo esta
opción se pueden ingresar los valores
según sus opciones numéricas
SPPS
Elementos Básicos
En ocasiones, es importante entregar resultados
categorizados, es decir, agrupados por alguna categoría o
variable que sirva para separar los resultados y dar visiones
separadas de estos, como por ejemplo cuando se entregan
resultados separados para mujeres y hombres.
Para realizar estas labores SPSS posee una herramienta de
análisis que se llama “Tablas Cruzadas”, que muestra
información categorizada según los datos definidos
previamente en la Base de Datos.
Para este tipo de análisis se necesita al menos de dos
variables, estas variables deben poseer unidades de medida
“Ordinal” o “Nominal”, no de “Escala” porque no tendría
sentido.
Variables Categóricas
Ejemplo Práctico:
Se utilizará la base de datos del ejemplo de la encuesta para
categorizar la edad de los encuestados de acuerdo al sexo de
estos. Es decir, se buscará definir cuantas personas de cada
grupo de edad corresponden a sexo masculino y cuantas al
sexo femenino.
1. Seleccionar en el menú “Analizar” , luego 2. Luego escoger las variables que va a utilizar. En este caso se
seleccionar “Estadísticos descriptivos”, y escoger utilizarán las variables: “Sexo” y “Edad”.
la opción “Tablas Cruzadas” Se debe ubicar una de las variables en la casilla “Filas” y la otra en
la casilla “Columnas”. Esta ubicación dependerá de la forma en
que al investigador resulte más cómodo
que se despliegue el análisis en la tabla cruzada, por lo que los
resultados no variarán si se ubica en otra dirección. Para mejorar
los resultados se recomienda hacer clic en el botón: “Casillas”
3. Dentro de las opciones para mostrar en las
casillas, se recomienda utilizar porcentajes, ya
que la tabla cruzada por si sola, muestra
únicamente las frecuencias de los datos, lo que
en ocasiones puede resultar insuficiente.
Para mostrar los porcentajes de las frecuencias
en la tabla solamente se debe marcar las
casillas respectivas.
En este caso se seleccionó la opción “Columna”
pues se desea que los porcentajes sean
mostrados para cada una de las columnas.
Finalmente se debe hacer clic en “Continuar” y
posteriormente en “Aceptar ” para visualizar los
resultados.
Interpretación:
Como se puede observar en la tabla, se
ejecutaron 30 encuestas (N=30)
En el rango de 18 a 29 años, el 56,3 %
corresponde a mujeres, mientras que el 43,8 %
corresponde a hombres.
En el rango de 30 a 49 años sucede lo
contrario: El 88,9 % de los encuestados son
varones y el 11,1 % son mujeres
En el rango de los encuestados mayores de 50
años, el 20,0 % corresponde a personas del
sexo masculino, mientras que el 80,0%
corresponde al sexo femenino.
SPPS
Elementos Básicos
Pruebas de Hipótesis:
En términos generales, las pruebas de hipótesis se utilizan cuando se quiere determinar, a través de una muestra, que
la totalidad de la población posee una característica determinada, además de aquellas ocasiones en que esto no es así.
La prueba de hipótesis consta de dos afirmaciones:
• Una hipótesis del investigador (que se identifica como H1), y
• Una hipótesis nula (identificada como H0).
Cada una de estas afirmaciones puede escribir en términos normales, pero también se debe identificar como notación
matemática. Por ejemplo, si deseamos determinar que el promedio de las edad de las mujeres es menor que el de los
hombres, se deberá expresar de la siguiente manera:
H0: El promedio de edad de las mujeres es igual al de los hombres.
H1: El promedio de edad de las mujeres es menor al de los hombres.
O en notación matemática:
Valor p:
Una vez establecidas las hipótesis, es necesario conocer el método por el cual el investigador escogerá entre una
hipótesis y la otra. Para ello se utiliza un estadístico llamado “valor p”. Este estadístico indica la probabilidad que
existe de rechazar la hipótesis del investigador, cuando esta es verdadera. Por convención, se asume que si esta
probabilidad es más de un 5% (0,05) debemos rechazar la hipótesis del investigador (H1) en favor de la hipótesis
nula (H0). Entonces:
Ejemplo:
La empresa “Doble Equis” está enfrentando una seria disputa entre su personal.
Por una parte los profesionales pelean porque de acuerdo a su percepción, el
salario recibido por las mujeres es menor que el salario recibido por los hombres.
Además todos reclaman que el salario promedio de la empresa es inferior al
salario de mercado, que ronda los 4.000 para empresas similares.
Finalmente, todos concuerdan que en los últimos años el salario no ha
aumentado, en promedio, de manera considerable, por lo que piden que se
reajuste a todos los trabajadores su nivel de renta.
La empresa decide tomar cartas en el asunto y genera una base de datos sgte. en
la que incluye información como: Sexo, Salario inicial, Salario actual y años de
escolaridad para cada uno de sus 35 trabajadores.
Se le pide analizar la base de datos y determinar la veracidad de cada una de las
situaciones anteriormente descritas.
Preparación de Base de datos:
Hemos obviado el libro de códigos para apresurar el ejemplo, pero se recomienda hacerlo.
Bueno la base de datos queda diseñada de la manera siguiente
Preparación de Base de datos:
Luego se ha procedido a copiar la data del Excel trabajado a las
celdas de la Base de Datos en SPSS, son 35 personas las
encuestadas
Prueba de medias para muestras independientes:
La primera situación es determinar si efectivamente existe
discriminación en el salario entre las mujeres y los hombres.
Para ello se debe realizar una PRUEBA DE MEDIAS PARA
MUESTRAS INDEPENDIENTES. A continuación se explica como
realizarlo con SPSS, pero primero se debe establecer la prueba
de hipótesis:
H0: En promedio, el salario de las mujeres es igual al salario de
los hombres.
H1: En promedio, el salario de las mujeres es menor al salario de
los hombres.
Ahora es necesario determinar la veracidad de la hipótesis H1.
1. Seleccione del menú “Analizar”, luego
seleccione “Comparar medias” y
finalmente escoja “Prueba T para
muestras independientes”.
Esto abrirá una ventana de diálogo donde
se deberán definir los parámetros para la
realización de la prueba de contraste de
medias.
2. En el cuadro de diálogo, escoger la variable que se 3. Al hacer clic en el botón “Definir Grupos”, se abrirá una
desea medir, en este caso “Salario Final” (salario pequeña ventana. En ella se debe ingresar los valores
actual) y debe ser llevada hasta donde dice “Variables correspondientes a las etiquetas de sexo. De acuerdo a
de prueba”, mientras que la variable por la que se la información de la base de datos: 1=Masculino y
desee agrupar el estadístico (en este caso, el sexo del 2=Femenino. A continuación hay que escribir los
trabajador) debe ir donde dice “Variable de números en las casillas que se denominan “Grupo 1” y
agrupación”. “Grupo 2”, tal cual se observa en la figura.
Posteriormente se deben definir los grupos. Para ello hay Finalmente se debe hacer clic en el botón “Continuar” y
que hacer click en el botón “Definir grupos” para finalizar, en el botón “Aceptar”.
Resultados:
Interpretación:
Los resultados indican que el salario promedio de los
hombres es de 3,115.87 mientras que el salario de las
mujeres es de 3,313.60
Como primera aproximación se observa una diferencia de
salario a favor de las mujeres de 197.73 soles en
promedio. Sin embargo esto necesita ser contrastado por
pruebas más específicas.
Interpretación:
SPSS utiliza el criterio del valor p para determinar la validez de los resultados de la prueba de hipótesis. Sin embargo, en este software, el
valor p, viene escrito como “Sig (bilateral)”. Por ende, para medir el valor p, solamente se debe ver donde dice “Sig (bilateral)”.
Utilizando el criterio del valor p, se puede afirmar que, estadísticamente, no hay diferencias entre el salario de las mujeres en relación al de
los hombres (valor p = 0,578), por lo que esa acusación resulta falsa (Se debe aceptar H0).
Otra prueba:
Si alteramos los datos precipitadamente en la cual solo aproximadamente el 10% de la
población femenina gana igual que los varones y el resto recibe un sueldo menor como se
constata en la data, al realizar nuevamente la prueba de “Prueba T para muestras
independientes” los resultados son diferentes
Interpretación:
Los resultados indican que el salario promedio de los hombres es de 4,334.40
mientras que el salario de las mujeres es de 2,139.60
Como primera aproximación se observa una diferencia de salario a favor de los
varones de 2194.80 soles en promedio. Sin embargo esto necesita ser contrastado
por pruebas más específicas.
Interpretación:
Utilizando el criterio del valor p, se puede afirmar que, estadísticamente, SI hay diferencias entre el salario de las mujeres en relación al de
los hombres (valor p = 0,0), por lo que esa acusación resulta cierta(Se debe aceptar H1).
Bueno continuando con la data anterior a la alterada, determinaremos ahora el SALARIO en el MERCADO
Prueba de medias para una muestra:
La segunda situación que debe resolver el investigador es si efectivamente la empresa ofrece un salario promedio
inferior al del mercado, que ronda los $520.000. Lo primero que se debe realizar es establecer la prueba de hipótesis
correspondiente:
H0: El salario promedio pagado por la empresa es igual al salario de mercado (4,000.00).
H1: El salario promedio pagado por la empresa es menor que el salario de mercado (4,000.00).
Para determinar cual hipótesis es la
correcta, el procedimiento a seguir es el
siguiente:
1. Para realizar este análisis se debe ir al
menú “Analizar” posteriormente
seleccionar donde dice “Comparar
medias” y finalmente escoger
“Prueba T para una muestra”.
2. Una vez abierta la ventana, se debe escoger la
variable que se desea contrastar, en este caso “Salario
Final” (salario actual) )y se debe llevar hacia el cuadro.
Donde dice “Valor de prueba” se debe ingresar el valor
contra el que se quiere contrastar (en este caso el
salario de mercado de 4,000.00
Interpretación:
La primera parte de los resultados indican que el
salario promedio pagado por la empresa es de
3,228.86 soles, lo que está indicando que en
términos brutos, el salario efectivamente es más
bajo que el de mercado.
Interpretación:
Utilizando el criterio del valor p, y dado que el valor entregado por el software es de “0,000” se puede asumir
que el investigador tiene razón al afirmar que la empresa paga un salario más bajo que el promedio de
mercado.
Recordemos que cuando el valor p es menor que 0,05 se puede aceptar como verdadera la hipótesis del
investigador (H1).
Prueba de medias para muestras relacionadas:
La última situación presentada por los trabajadores de la empresa indica que en promedio sus sueldos no han subido
significativamente conforme ha pasado el tiempo. Para resolver lo anterior, el investigador debe realizar una prueba que
se denomina: “Prueba T para muestras relacionadas”.
Las hipótesis detrás de esta prueba son las siguientes:
H0: El salario promedio actual de la empresa es igual al salario inicial.
H1: El salario promedio actual de la empresa es mayor al salario inicial.
Para determinar cual hipótesis es la
correcta, el procedimiento a seguir es el
siguiente:
1. Primero hay que ir al menú “Analizar”,
posteriormente ir al submenú “Comparar
medias” y ahí escoger “Prueba T para
muestras relacionadas...” tal como
muestra
la figura.
2. En la ventana que se abre, se debe escoger las variables que se desea contrastar y agregarlas al sector de “Variables
emparejadas”. Para el desarrollo de este ejemplo, las variables son “Salario Inicial” y “Salario Final”.
Una vez seleccionadas y ubicadas en la sección “variables emparejadas”, se debe hacer click en el botón “Aceptar”.
Interpretación:
Los estadísticos descriptivos indican que
inicialmente el salario inicial promedio de
los trabajadores era de 1,878.31 soles,
mientras que el salario promedio actual de
los trabajadores es de 3,228,86 soles.
Interpretación:
De acuerdo al análisis del valor p, se puede determinar que en promedio, el salario actual de la empresa si es
estadísticamente mayor que el salario que se pagaba inicialmente, debido a que como el valor p < 0,05, se debe
aceptar la hipótesis del investigador (H1), que dice que el salario actual es mayor que el salario inicial.