CAPITULO 3
VARIABLES INDEPENDIENTES O PREDICTORAS
Y VARIABLES DEPENDIENTE
Al estudiar la relación entre dos variables, frecuentemente pensamos en una variable como
la causa y en la otra variable como el efecto.
Por ejemplo, podríamos considerar a la intimidad como causa de la idealización.
En este pequeño mundo formado por sólo dos variables, en el que una es la causa de la
otra, una es independiente y la otra es dependiente de la primera.
En nuestro ejemplo, la intimidad (causa) sería la variable independiente y la idealización
(efecto) la variable dependiente
VARIABLE
INDEPENDIENTE VARIABLE DEPENDIENTE
La variable considerada causa se y la considerada efecto se denomina
denomina variable independiente. variable dependiente.
La variable independiente, se denomina La variable dependiente se denomina así
de ese modo porque su valor no depende porque su valor depende del valor de la
de la variable dependiente. variable independiente.
Por lo tanto, al analizar dos variables relacionadas, algunos investigadores prefieren llamar
a aquella a partir de la cual realizan la predicción, variable predictora.
Sin embargo, la otra variable generalmente continúa denominándose variable dependiente,
(El término adecuado para la variable predicha es variable de criterio, pero este término
rara vez se utiliza en psicología, excepto en algunos textos sobre estadística). Según lo
acostumbrado, en nuestro libro generalmente nos referiremos a una de las dos variables
correlacionadas como la variable predictora, y a la otra como la variable dependiente.
CÓMO GRAFICAR CORRELACIONES: DIAGRAMA DE
DISPERSIÓN
La creación de un diagrama de dispersión puede dividirse en tres pasos:
1. Dibujar los ejes y determinar qué variable se representa en cada uno de ellos. La variable
independiente o predictora se ubica en el eje horizontal, la variable dependiente en el vertical.
2. Determinar la serie de valores que se van a utilizar para cada variable y marcarla en los ejes. Los
números deben ir ascendiendo en cada eje, a partir del punto en el que los dos ejes se cortan.
Comúnmente, comenzamos con el valor 0 ó con el menor valor que pueda tener la medida, y
ascendemos gradualmente hasta llegar al mayor valor posible de esa medida. Cuando no exista un
valor mínimo o máximo posible, que sea evidente o razonable, comenzamos o terminamos la serie
con el valor mínimo o máximo presentado comúnmente por las personas que conforman el grupo de
interés para el estudio.
3. Marcar un punto por el par de observaciones de cada persona. Ubicar el lugar en el eje horizontal que
corresponde al valor observado de la persona en la variable predictora, Luego moverse hacía arriba
hasta llegar a la altura en el eje vertical que corresponde al valor observado de la misma persona con
respecto a esa variable, y marcar un punto bien claro. Si en un mismo lugar coinciden dos casos, se
puede escribir el número 2 en ese lugar o marcar un segundo punto lo más cerca posible del primero,
si es posible tocándolo, pero dejando en claro que en realidad hay 2 puntos en el mismo lugar.
Ejemplo
Supongamos que una empresa está pensando aumentar la cantidad de personal bajo el
mando de cada uno de sus gerentes de piso. Sin embargo, la empresa está preocupada por
el estrés que esto podría provocar a sus gerentes.
La empresa supone que cuantas más personas supervise un gerente, mayor será el estrés
sufrido por él. Para analizar la situación, un psicólogo laboral sugiere estudiar a cinco
gerentes seleccionados al azar de entre todos los gerentes de piso de la empresa.
(En la práctica, debería utilizarse un grupo mucho mayor, pero aquí utilizaremos sólo cinco
casos para simplificar el ejemplo). Se entrega a cada uno de los cinco gerentes un
cuestionario de medición de estrés en el cual los posibles registros van de 0 (estrés nulo) a
10 (estrés extremo). Los resultados podrían ser como los que indica la tabla 3-1.
Ejemplo
Supongamos que una empresa está pensando aumentar la cantidad de personal bajo el
mando de cada uno de sus gerentes de piso. Sin embargo, la empresa está preocupada por
el estrés que esto podría provocar a sus gerentes.
La empresa supone que cuantas más personas supervise un gerente, mayor será el estrés
sufrido por él. Para analizar la situación, un psicólogo laboral sugiere estudiar a cinco
gerentes seleccionados al azar de entre todos los gerentes de piso de la empresa
EMPLEADOS SUPERVISADOS NIVEL DE ESTRÉS SEGÚN
CUESTIONARIO
6 7
8 8
3 1
10 8
8 6
Correlaciones negativas
A veces, la relación entre las variables no es
positiva. Por el contrario, los valores altos
coinciden con los bajos y los bajos con los
altos. A esto se denomina correlación
negativa.
Por ejemplo, en un estudio de las relaciones
amorosas entre estudiantes los
investigadores descubrieron que cuanto más
lejos de su pareja vive una persona (en
función de los minutos de viaje), menos
cantidad de actividades comparte con su
pareja.
Correlaciones curvilíneas
En algunos casos, la relación entre dos variables no
sigue una línea recta positiva o negativa, sino un
patrón más complejo denominado correlación
curvilínea.
Por ejemplo, se sabe que hasta determinado nivel, una
mayor ansiedad fisiológica hace que uno se
desempeñe mejor en cualquier tarea (como por
ejemplo, una prueba de matemática).
A partir de ese nivel, una mayor ansiedad fisiológica
hace que el rendimiento empeore. Es decir, desde estar
casi dormido hasta un nivel moderado de ansiedad, la
efectividad aumenta. Al superar ese nivel moderado, el
aumento de la ansiedad puede “acelerar” demasiado a
un individuo, impidiéndole tener un buen rendimiento.
Es imposible dibujar una línea recta para describirlo.
Correlación nula
También es posible que no exista ningún tipo de
relación entre dos variables.
Por ejemplo, si hiciéramos un análisis entre la
creatividad y el numero de calzado. Los puntos
se dispersan en todas las direcciones, y no existe
línea recta ni de ningún otro tipo que pueda
considerarse indicio razonable de una tendencia.
Esto simplemente es una correlación nula. En
investigaciones reales, algunas veces existe una
relación entre dos variables, pero al no ser muy
fuerte, es difícil notarla en un diagrama de
dispersión.
Esto suele suceder especialmente en análisis en
los que se estudia a una gran cantidad de
personas y la relación entre las dos variables es
muy leve o subliminal.
CÁLCULO DE UN ÍNDICE DEL GRADO DE
CORRELACIÓN LINEAL: COEFICIENTE DE
CORRELACIÓN DE PEARSON
Grado de correlación
El grado de correlación indica en qué medida existe un patrón claro de alguna relación en particular entre
dos variables.
Por ejemplo, vimos que existe una correlación lineal positiva cuando los valores altos coinciden con los
valores altos, los medios con los medios y los bajos con los bajos.
Por lo tanto, el grado de una correlación de este tipo determina cuántos valores altos coinciden con otros
también altos, y así sucesivamente. Del mismo modo, el grado de correlación lineal negativa indica
cuántos valores altos de una variable coinciden con valores bajos de la otra, y así sucesivamente.
En cuanto a los diagramas de dispersión, un alto grado de correlación lineal significa que todos los puntos
se encuentran muy cerca de una línea recta (la recta que se inclina hacia arriba o hacia abajo según la
correlación lineal sea positiva o negativa).
Una correlación lineal perfecta es aquella en la que todos los puntos están ubicados exactamente sobre la
línea recta.
Determinación del grado de correlación lineal
Lo primero que necesitamos para determinar el grado de correlación lineal es alguna forma
de medir qué es un valor alto o bajo, y en qué medida es alto o bajo un determinado valor
alto o bajo.
Otro método, descripto en el capítulo 4, consiste en determinar la distancia entre cada
punto y la línea.
El método aquí propuesto implica comparar valores de diferentes variables en forma
coherente. Como vimos en el capítulo 2, la mejor forma de resolver el problema de
comparar variables es a través de las puntuaciones Z.
Una puntuación Z es la-cantidad de desvíos estándar a los que se encuentra una
observación de la media.
una puntuación Z es la-cantidad de desvíos estándar a los que se encuentra una observación de la media.
No importa la escala con la cual se haya realizado la medición; si uno convierte las puntuaciones
originales en puntuaciones Z, el efecto es el mismo.
Una puntuación original alta (es decir, que se encuentra por encima de la media de los otros valores de la
variable) siempre tendrá una puntuación Z positiva, y una puntuación original baja (por debajo de la
media) siempre tendrá una puntuación Z negativa.
Más aún, cualquiera sea la medida usada en particular, las puntuaciones Z brindan un indicio estándar de
cuán alta o baja es cada puntuación.
Por ejemplo, una puntuación Z de 1 está siempre exactamente 1 desvío estándar por sobre la media, una
puntuación Z de 2 está siempre dos desvíos estándar por sobre la media.
Las puntuaciones Z de una variable son directamente comparables con las puntuaciones Z de otra variable.
Existe otra razón por la cual se utilizan puntuaciones Z para calcular el grado de correlación, y está
relacionada con lo que sucede si se multiplica un valor de una variable por un valor de la otra variable,
cálculo que se denomina producto cruzado.
Cuando se utilizan puntuaciones Z, el cálculo se denomina producto cruzado de puntuaciones Z. Si se
multiplica una puntuación Z alta por una puntuación Z alta, siempre se obtiene un producto cruzado
positivo debido a que, más allá de qué escala se utilice, los valores que se encuentran por sobre la media
(valores altos) se transforman en puntuaciones Z positivas, y un número positivo multiplicado por un
número positivo siempre produce un número positivo.
Por otro lado, consideremos lo que sucedería con una correlación lineal negativa, en la que los
valores altos coinciden con los bajos y los bajos con los altos.
En cuanto a las puntuaciones Z, esto significaría multiplicar positivos con negativos y negativos con
positivos, y obtendríamos todos productos cruzados negativos que, sumados, darían como resultado
un gran número negativo.
Finalmente, supongamos que no existe una correlación lineal. En esa situación, en algunos casos los
valores altos de una variable coincidirían con valores altos de la otra variable (y algunos valores
bajos coincidirían con valores bajos), dando como resultado productos cruzados positivos.
En otros casos, los valores altos de una variable coincidirían con valores bajos de la otra (y algunos
valores bajos coincidirían con valores altos), dando productos cruzados negativos.
Al sumar los productos cruzados de todas las personas incluidas en el estudio, los productos cruzados
positivos y negativos se cancelarían unos a otros, dando un total cercano a 0.
En cada una de las situaciones arriba mencionadas convertimos todos los valores en puntuaciones Z,
multiplicamos las dos puntuaciones Z de cada persona y sumamos los productos cruzados. El
resultado es un gran número positivo, si existe una correlación lineal positiva; un gran número
negativo, si existe una correlación lineal negativa, y un número cercano a 0, si no existe correlación
lineal
Sin embargo, todavía no hemos resuelto el problema de determinar el grado de una correlación
positiva o negativa.
Aparentemente, cuanto mayor sea el número, mayor será la correlación.
¿Pero a partir de qué nivel se considera que un número grande es tal, y qué números grandes no lo
son tanto?
No podemos definirlo simplemente por la suma de los productos cruzados, que aumenta sólo por el
hecho de incluir más participantes en el estudio. (Es decir, un estudio con 100 participantes
presentaría una suma mayor de productos cruzados que el mismo estudio con sólo 25 participantes).
La solución a este problema es dividir la suma de productos cruzados de puntuaciones Z por la
cantidad de casos. Es decir, calculamos el promedio de los productos cruzados de puntuaciones Z,
que nunca podrá ser mayor a +1, y que en el caso de ser igual a +1, indicaría una correlación
perfecta lineal positiva. Por otro lado, el valor mínimo de este promedio es -1, e indicaría una
correlación perfecta lineal negativa.
En el caso de que no exista correlación lineal, el promedio de los productos cruzados de
puntuaciones Z será 0. Generalmente, las correlaciones no son perfectas. En el caso de una
correlación lineal positiva que no es perfecta, el promedio de los productos cruzados de
puntuaciones Z estará entre 0 y +1.
Para decirlo de otro modo, si la tendencia general de las puntuaciones es ascendente y hacia la
derecha, pero no coinciden exactamente con la línea recta, este número estará entre 0 y +1. La
misma regla se aplica para las correlaciones negativas: el número estará entre 0 y - 1.
El coeficiente de correlación
El promedio de los productos cruzados de puntuaciones Z es, entonces, un excelente modo
de calcular el grado de correlación lineal. Se lo denomina coeficiente de correlación.
También se lo llama coeficiente de correlación de Pearson.
El coeficiente de correlación se representa con la letra r, que es la forma abreviada de
regresión.
Formula del coeficiente de correlación
r es el coeficiente de correlación, Zx es la puntuación Z
de cada persona en la variable X.
Zy es la puntuación Z de cada persona en la variable Y.
ZxZy es igual al producto Zx por Zy (el producto
cruzado de puntuaciones Z) de cada persona.
y Ʃ ZxZy es la suma de los productos cruzados de todas
las personas incluidas en el estudio. N es la cantidad de
personas que participan en el estudio. Uniendo todos
los datos, Ʃ ZxZy dividida por N, es el promedio de los
productos cruzados de puntuaciones Z.
Pasos que se deben seguir para calcular el coeficiente de correlación
1. Los cuatro pasos que se deben seguir para calcular el coeficiente de correlación son los
siguientes:
2. Convertir todas las observaciones en puntuaciones Z. Para esto es necesario calcular la
media y el desvío estándar de cada variable y luego la puntuación Z correspondiente a cada
valor observado.}
3. Calcular el producto cruzado de las puntuaciones Z de cada persona. Es decir, por cada
persona, multiplicar la puntuación Z en una variable por la puntuación Z en la otra
variable.
4. Sumar todos los productos cruzados de puntuaciones Z.
5. Dividir el resultado por la cantidad de personas que participan en el estudio
Productos
Cantidad de empleados supervisados Nivel de estrés Y
cruzados
X X-M (X – M)/2 ZX Y Y-M (Y – M)/2 ZY [Link]
6 -1 1 -0.42 7 1 1 0.38 -0.16
8 1 1 o.42 8 2 4 0.77 0.32
3 -4 16 -1.69 1 -5 25 -1.92 3.24
10 3 9 1.27 8 2 4 0.77 0.98
8 1 1 0.42 6 0 0 0.00 0.00
Ʃ35 Ʃ28 Ʃ30 Ʃ34 Ʃ4.38
Mx ═ Ʃ X/N 35/5 ═ 7 Mx ═ Ʃ X/N Ʃ30/5═6
SD2x═ 28/5═ 5.60 SD2x═ Ʃ34/5═ 6.80
SDx═ √5.60═ 2.37 SDx═ √6.80═ 2.61 r═4.38/5
═0.88