Regresión
Dr. José Ignacio Azuela
¿Para qué nos poder servir las regresiones?
Imagine que desea pronosticar la ventas de un producto (variable
dependiente) si realiza una inversión en publicidad (variable
independiente).
El modelo de regresión simple nos ayuda precisamente a eso: analizar
la relación entre dos variables
Regresión Lineal Simple
𝑌𝑖 = 𝑏0 + 𝑏1𝑋1𝑖 + 𝜀𝑖
Donde:
Y es la variable resultado (dependiente)
𝑏1es el coeficiente (parámetro) del primer predictor (variable
independiente; 𝑋1)
𝑋1 es la variable independiente
𝜀𝑖 es el error
𝑏0 es la constante (o el intercepto)
Regresión Lineal Simple
El modelo de regresión lineal se caracteriza por la línea recta que
describe la relación entre variables.
Esta línea recta se compone de dos elementos: 1) la pendiente de la
línea (cuya notación es 𝑏1); y 2) el punto en el que la línea cruza el eje
vertical de la gráfica (conocido como intercepto, 𝑏0). Estos parámetros (
𝑏1 y 𝑏0) son conocidos como coeficientes de regresión.
Regresión Lineal Simple
Regresión Lineal Simple
𝑌𝑖 = 𝑏0 + 𝑏1𝑋1𝑖 + 𝜀𝑖
𝑣𝑒𝑛𝑡𝑎𝑠𝑖 = 𝑏0 + 𝑏1𝑖𝑛𝑣𝑒𝑟𝑠𝑖ó𝑛 𝑒𝑛 𝑝𝑢𝑏𝑙𝑖𝑐𝑖𝑑𝑎𝑑𝑖 + 𝜀𝑖
Supongamos que 𝑏0 es 5 y 𝑏1 es 10, entonces:
𝑣𝑒𝑛𝑡𝑎𝑠𝑖 = 5 + (10 𝑥 𝑖𝑛𝑣𝑒𝑟𝑠𝑖ó𝑛 𝑒𝑛 𝑝𝑢𝑏𝑙𝑖𝑐𝑖𝑑𝑎𝑑𝑖) + 𝜀𝑖
Supongamos que la inversión en publicidad es de $10,000
𝑣𝑒𝑛𝑡𝑎𝑠𝑖 = 5 + (10 𝑥 10,000) + 𝜀𝑖
= 100,005 + 𝜀𝑖
Regresión Lineal Múltiple
𝑌𝑖 = 𝑏0 + 𝑏1𝑋1𝑖 + 𝑏2𝑋2𝑖 + ⋯+ 𝑏𝑛𝑋𝑛𝑖 + 𝜀𝑖
Donde:
Y es la variable resultado (dependiente)
𝑏1es el coeficiente (parámetro) del primer predictor (variable independiente; 𝑋1)
𝑋1 es la variable independiente
𝜀𝑖 es el error
𝑏0 es la constante (o el intercepto)
Estimación del Modelo
Antes vimos que podíamos evaluar el ajuste del
modelo analizando la desviación entre el modelo
y los datos. En otras palabras, a través de la
desviación.
La desviación podemos señalarla como la
distancia vertical entre lo que el modelo predice
y los datos observados (puede ser tanto positiva
como negativa).
En la regresión lineal podemos hacer
exactamente lo mismo, solo que a estas
diferencias las llamamos residuos.
Estimación del Modelo
Como hemos visto, algunas veces los residuos
son positivos y otras veces negativos. Por lo
(+) tanto, para poder evaluar el error en la regresión
tenemos que recurrir a la suma de errores al
cuadrado, que en la regresión nos referimos
como suma de residuos al cuadrado.
(-) La suma de residuos al cuadrado, es un indicador
de qué tan bien la recta se ajusta a los datos: si
la diferencia es grande, la recta no es
representativa de los datos, mientras que si la
diferencia es pequeña, la línea es representativa.
Ratio F
Mide qué tanto el modelo ha mejorado la predicción comparado con sus
niveles de imprecisión. En otras palabras el F es igual al modelo entre el error
del modelo.
Si el modelo es bueno, entonces esperaríamos que la predicción del modelo
sea alta (95% o más).
𝑀𝑆𝑀
𝐹=
𝑀𝑆𝑅
Es la varianza sistemática dividida por la varianza no sistemática. En
resumen, un buen modelo debe tener un F grande (al menos mayor que 1).
𝑅2
El 𝑅2 oscila entre 0 y 1 y mide la proporción de la varianza explicada por el modelo
comparado con qué tanta varianza no es explicada por el modelo.
𝑆𝑆𝑀
𝑅2 =
𝑆𝑆𝑇
En general, 𝑅2 no toma los valores de los extremos (0, 1), sino que se sitúa en
valores intermedios. De tal modo que, mientras más se aproxime al 1, indica que el
regresor es un buen predictor de la variable resultado y viceversa. Éste se
interpreta en términos porcentuales.
Uno de los principales problemas del 𝑅2 este crecerá a medida que se incluyan
variables explicativas al modelo.
Estadístico t
El estadístico t evalúa la 𝐻0 de que el valor de 𝑏 es 0. Por lo tanto, si el
test es significativo, tenemos argumentos a favor de la 𝐻1 que sugiere
que 𝑏 ≠ 0, y que la variable independiente contribuye
significativamente a estimar la variable dependiente.
𝑏𝑜𝑏𝑠𝑒𝑟𝑣𝑎𝑑𝑜
𝑡=
𝑆𝐸𝑏
¿Cómo realizar una Regresión con STATA?
Para hacer una regresión lineal en STATA requiere del siguiente comando:
regress
regress depvar [indepvars], [opciones]
regress sales adverts
Salida de Resultados
Source | SS df MS Number of obs = 200
-------------+---------------------------------- F(1, 198) = 99.59
Model | 433687.978 1 433687.978 Prob > F = 0.0000
Residual | 862264.022 198 4354.8688 R-squared = 0.3346
-------------+---------------------------------- Adj R-squared = 0.3313
Total | 1295952 199 6512.32161 Root MSE = 65.991
------------------------------------------------------------------------------
sales | Coef. Std. Err. t P>|t| [95% Conf. Interval]
-------------+----------------------------------------------------------------
adverts | .0961245 .0096324 9.98 0.000 .0771293 .1151197
_cons | 134.1399 7.536576 17.80 0.000 119.2776 149.0022
------------------------------------------------------------------------------
Ajuste general del Modelo
El valor del 𝑅2 representa la cantidad de varianza explicada
por el modelo y se interpreta en términos porcentuales.
En este caso, el 𝑅2 es de .335, lo que significa que el gasto
en publicidad puede explicar hasta el 33% de la variación
en la venta de discos.
Si tratáramos de explicar por qué unos discos se venden
más que otros, podríamos ver la variación en las ventas de
diferentes discos. En este caso nuestro modelo explica el
33% de la variación, quedando un 66% de variación sin
explicar que sugiere que hay otras variables que influyen en
las ventas.
Ajuste general del Modelo
Esta Tabla nos muestra otro de los ajustes
generales del modelo: el ratio F y su significancia.
Se observa que F es 99.59 y que es significativo al
p< .001. Estos resultados sugieren que hay
menos de 0.1% de probabilidad de que un ratio F
tan grande como este pueda ocurrir si la 𝐻0
fuera cierta. Por lo tanto, se puede concluir que
nuestro modelo es significativo pronosticando las
ventas de discos.
Ajuste general del Modelo
Suma de cuadrados
del Modelo (𝑆𝑆𝑀 )
Suma de cuadrados
Residuales (𝑆𝑆𝑅 )
Suma de cuadrados
Totales (𝑆𝑆𝑇 )
𝑆𝑆𝑀
𝑅2 =
𝑆𝑆𝑇
Ajuste general del Modelo
400
300
200
100
0
0 500 1000 1500 2000 2500
adverts
Fitted values sales
twoway (lfit sales adverts) (scatter sales adverts)
Parámetros del Modelo (1)
Hasta aquí, sabemos que el modelo, en general, es significativamente bueno al
predecir la variable resultado. Sin embargo, el ANOVA no nos dice nada sobre las
contribuciones individuales de las variables del modelo (evidentemente, al ser esta
una regresión simple, esperaríamos que la variable también sea una buena
explicativa).
Parámetros del Modelo (2)
Sabemos que 𝑏0 es el intercepto, la constante. Pero
no sabemos lo que significa, la tabla indica que 𝑏0=
134.140 ¿cómo puede ser interpretado esto?
Significa que cuando no se invierte dinero en
publicidad (X= 0), el modelo pronostica que se
venderían 134 mil discos.
Parámetros del Modelo (3)
Si la variable
independiente
tiene un impacto
significativo,
entonces la b
debería de ser
diferente a 0 (y
𝑏1 representa la pendiente de la recta de regresión y esta puede ser relativamente
interpretada como el cambio en la variable dependiente asociado al cambio en mayor al error
una unidad en la variable independiente. estándar)
Por tanto, si la inversión en publicidad (variable independiente) se aumentada
en una unidad ($1), nuestro modelo pronostica un incremento en ventas de
.096.
Parámetros del Modelo (4)
𝑏 𝑜𝑏𝑠𝑒𝑟𝑣𝑎𝑑𝑜
𝑡=
𝑆𝐸𝑏
El estadístico t también nos ofrece información respecto a la b y si esta es diferente de cero.
La tabla también nos indica el nivel de significatividad, recordemos que si se observa un p<
.05 entonces tenemos un efecto genuino de la variable independiente. En este caso la
variable es significativa al .000. Con lo cual se puede decir que; la probabilidad de que estos
valores de t (o mayores) ocurran cuando el valor de b es cero, es menor que .001. Por lo tanto,
b es significativamente diferente de cero, lo que significa que la inversión en publicidad hace
una contribución significativa en la predicción de la venta de discos.
Usando el Modelo
𝑌𝑖 = 𝑏0 + 𝑏1𝑋1𝑖 + 𝜀𝑖
𝑣𝑒𝑛𝑡𝑎𝑠𝑖 = 𝑏0 + 𝑏1𝑖𝑛𝑣𝑒𝑟𝑠𝑖ó𝑛 𝑒𝑛 𝑝𝑢𝑏𝑙𝑖𝑐𝑖𝑑𝑎𝑑𝑖 + 𝜀𝑖
𝑣𝑒𝑛𝑡𝑎𝑠𝑖 = 134.14 + (.096 𝑥 𝑖𝑛𝑣𝑒𝑟𝑠𝑖ó𝑛 𝑒𝑛 𝑝𝑢𝑏𝑙𝑖𝑐𝑖𝑑𝑎𝑑𝑖) + 𝜀𝑖
𝑣𝑒𝑛𝑡𝑎𝑠𝑖 = 134.14 + (.096 𝑥 100) + 𝜀𝑖
= 143.74 + 𝜀𝑖
Regresión Múltiple
Como vimos anteriormente, la regresión múltiple nos permite incluir
más de una variable independiente en el modelo.
𝑌𝑖 = 𝛽0 + 𝛽1 𝑋1𝑖 + 𝛽2 𝑋2𝑖 + 𝜀𝑖
Ratio F
En el caso de la regresión múltiple, el estadítisco-F sigue evaluando si la
cantidad de la varianza explicada es estadísticamente diferente de cero.
Aunque en este caso, F evalúa si lo coeficeintes de regresión de todas la
variables independientes en el modelo son iguala cero.
𝐻0 : 𝛽1 = 𝛽2 = 0, (ninguna de las v. independientes es útil para predecir la v. dependiente)
Frente a:
𝐻1 : 𝑎𝑙 𝑚𝑒𝑛𝑜𝑠 𝑢𝑛𝑜 𝑑𝑒 𝑙𝑜𝑠 𝑑𝑜𝑠 𝑐𝑜𝑒𝑓𝑖𝑐𝑖𝑒𝑛𝑡𝑒𝑠 ≠ 0
2
𝑅 Ajustado
R-cuadrado ajustado es una versión corregida de R-cuadrado.
Cuando se incrementan variables independientes al modelo de regresión, con
independencia de su relevancia explicando a la variable dependientes, R-cuadrado siempre
incrementará.
Este crecimiento “artificial” de R-cuadrado puede conducir a mal interpretaciones del poder
explicativo del modelo de regresión. R-cuadrado ajustado, remedia este problema
imponiéndole una penalización al incremento de variables independientes al modelo.
En resumen, R-cuadrado ajustado disminuirá si las variables independientes incluidas no
contribuyen significativamente al poder explicativo del modelo de regresión. Por tanto, no
debería haber grandes diferencias entre R-cuadrado y R-cuadrado ajustado.
Multicolinealidad
Cuando incluimos más de una variable independiente en nuestro modelo,
corremos el riesgo de caer en la Multicolinealidad.
La Multicolinealidad se produce cuando existe una fuerte correlación entre
dos o más variables independientes (es decir, cuando se están explicando
entre ellas, no son independientes entre si).
Por su parte, la Colinealidad Perfecta ocurre cuando al menos una
explicativa es una combinación lineal perfecta de otras variables predictoras
(con coeficiente de correlación 1).
Multicolinealidad
Si ocurriera la colinealidad perfecta entre explicativas, se tornaría imposible
obtener una estimación única de los coeficientes de regresión pues habrá
una combinación infinita de coeficientes.
La buena noticia es que la colinealidad perfecta es muy poco probable. La
mala noticia es que la colinealidad es prácticamente inevitable.
Bajos niveles de colinealidad suponen poca amenaza para el modelo, pero a
medida que la colinealidad incrementa, incrementa la presencia de los
siguientes problemas: betas poco confiables, límites en el tamaño de R y,
problemas en la evaluación de la importancia de las explicativas.
Multicolinealidad
Y Y
𝑎 𝑏 𝑎 𝑏
𝑐
𝑐
𝑋1 𝑋2 𝑋1 𝑋2
En ambas figuras tenemos dos predictores X1 y X2 que tratan de predecir a la variable dependiente. En la figura de la
izquierda podemos ver dos áreas a y c que representan la proporción de Y que es explicada por X1; y las áreas b y c que
representan la proporción de Y que es explicada por X2. Dado que comparten varianza (correlacionan), el área c no puede
ser atribuida ni a X1 ni X2; sin embargo, aún quedan efectos únicos de cada variable: X1=a, X2=b.
Multicolinealidad
Y Y
𝑎 𝑏 𝑎 𝑏
𝑐
𝑐
𝑋1 𝑋2 𝑋1 𝑋2
En la figura de la derecha se observa qué ocurre cuando dos predictores están muy correlacionados. En conjunto X1 y X2
explican mucho de la varianza de Y pero su efecto único es muy pequeño. Esta imagen trata de ilustrar lo que ocurre en
regresión múltiple cuando dos o más predictores están correlacionados; mientras más se superpongan unos con otros, más
difícil será identificar sus efectos independientes. En tal caso se tendrá multicolinealidad y dos o más predictores serán
redundantes
¿Cómo detectar la Multicolinealidad?
Una forma de identificar la multicolinealidad es mediante la matriz de correlación de las variables explicativas.
Se observa qué tanta correlación existen entre éstas, si la correlación se sitúa en torno al .80 y .90, entonces se
presume colinealidad.
STATA calcula un test para evaluar la colinealidad: Factor de Inflación de la Varianza (que indica si una explicativa
tiene una fuerte relación lineal con otra explicativa). Este es un test postestimacion; por tanto, se usa después de
la regresión:
estat vif
Si el FIV toma valor superior a 10 para cualquiera de las variables, entonces hay un problema de multicolineliadad
y es necesario hacer cambios al modelo (debe tomar valores menores a 10).
¿Cómo realizar una Regresión Múltiple en STATA?
Para hacer una regresión lineal múltiple en STATA requiere del siguiente
comando:
regress
regress depvar [indepvars], [opciones]
regress sales adverts airplay attract
¿Cómo realizar una Regresión Múltiple en STATA?
Sin embargo, antes de estimar la regresión, sería bueno analizar posible
colinealidad mediante una matriz de correlación.
pwcorr sales adverts airplay attract, obs sig
Correlaciones
| sales adverts airplay attract Esta tabla nos ofrece las
-------------+------------------------------------ correlaciones entre cada par de
sales | 1.0000 variables.
|
| 200
| Esta tabla es muy útil para darnos
adverts | 0.5785 1.0000
| 0.0000
una idea de la posible
| 200 200 multicolinealidad entre las variables
| explicativas.
airplay | 0.5989 0.1019 1.0000
| 0.0000 0.1511
| 200 200 200 Esperamos que no hay
| multicolinealidad en los datos por lo
attract | 0.3261 0.0808 0.1820 1.0000
| 0.0000 0.2557 0.0099
que no deberíamos encontrar alta
| 200 200 200 200 correlación entre las independientes.
Correlaciones
Aquí el resultado que llama la
| sales adverts airplay attract
-------------+------------------------------------
atención es la relación entre
sales | 1.0000 “atractivo” y “tiempo aire” cuyo nivel
| de significatividad indica una
| 200
| correlación entre las variables (p
adverts | 0.5785 1.0000 <.05). No obstante, y a pesar de ser
| 0.0000 significativa, el coeficiente de
| 200 200
| correlación es extremadamente bajo
airplay | 0.5989 0.1019 1.0000 (r = .182).
| 0.0000 0.1511
| 200 200 200
| También observamos que es esta
attract | 0.3261 0.0808 0.1820 1.0000 variable (tiempo aire) la que
| 0.0000 0.2557 0.0099 correlaciona en mayor magnitud con
| 200 200 200 200
la variable dependiente (r = .599; p
<.001).
Salida de Resultados
Source | SS df MS Number of obs = 200
-------------+---------------------------------- F(3, 196) = 129.50
Model | 861377.22 3 287125.74 Prob > F = 0.0000
Residual | 434574.78 196 2217.21827 R-squared = 0.6647
-------------+---------------------------------- Adj R-squared = 0.6595
Total | 1295952 199 6512.32161 Root MSE = 47.087
------------------------------------------------------------------------------
sales | Coef. Std. Err. t P>|t| [95% Conf. Interval]
-------------+----------------------------------------------------------------
adverts | .0848848 .006923 12.26 0.000 .0712316 .098538
airplay | 3.367424 .2777709 12.12 0.000 2.81962 3.915227
attract | 11.08634 2.43785 4.55 0.000 6.278554 15.89412
_cons | -26.61294 17.35 -1.53 0.127 -60.8296 7.603717
------------------------------------------------------------------------------
Resumen del Modelo (1)
En esta tabla podemos observar el valor de R-
cuadrado= .6647.
Esta valor indica que el modelo explica hasta el
66.47% de la varianza en Y; con lo cual supera lo
requerido a modelos de regresión múltiple (más
del 50%).
Si analizamos el valor de R-cuadrado ajustado,
observamos que este bajo a 65.95%. Aunque al
cambio no es muy grande, está indicando una
penalización por la inclusión de una variable
que poco contribuye a explicar Y.
Resumen del Modelo (2)
Number of obs = 200
¿Cómo identificar la variable que contribuye poco?
F(1, 198) = 99.59
Prob > F = 0.0000
R-squared
Adj R-squared
=
=
0.3346
0.3313
Una alternativa es haciendo tres regresiones:
Root MSE = 65.991
1) regress sales adverts
Number of obs = 200
F(2, 197) = 167.20 2) regress sales adverts airplay
Prob > F = 0.0000
R-squared = 0.6293 3) regress sales adverts airplay attract
Adj R-squared = 0.6255
Root MSE = 49.383
Y analizar el cambio en R2 en cada inclusión de variable
independiente. Los resultados de las tres regresiones muestran los
siguientes R-cuadrado:
1) R-squared = 0.3346
2) R-squared = 0.6293
3) R-squared = 0.6647
Resumen del Modelo (3)
Otra alternativa es mediante una regresión jerárquica. La regresión jerárquica estima un modelo por
cada variable independiente que se incluya al modelo (en nuestro ejemplo estimará 3 modelos).
Mediante esta regresión se obtienen los mismo resultados que si hiciéramos las regresiones por
separado.
Una ventaja de la regresión jerárquica es que ofrece un cuadro resumen de los R-cuadrado y el Cambio
en R-cuadrado
nestreg: regress sales adverts airplay attract
Resumen del Modelo (4)
Resumen del Modelo (5)
Otra alternativa es mediante las correlaciones semi-parciales 𝑅 2 . Estas miden la proporción de la
varianza que es explicada exclusivamente por la variable independiente de interés controlando por el
resto de variables independientes. Es decir, la proporción de la varianza que es exclusivamente
atribuida a una variable.
STATA ofrece las correlaciones parciales y semi-parciales para cada variable controlando por el resto de
ellas, a través del siguiente comando:
pcorr
pcorr depvar [indepvars]
pcorr sales adverts airplay attract
Resumen del Modelo (6)
Nos interesa la columna de las correlaciones semi-parciales 𝑅2 que muestra qué tanto contribuye en exclusiva cada variable.
publicidad (adverts) contribuye con un 25.7% de la varianza en ventas (p< .05)
reproducciones en la radio (airplay) contribuye con un 25.1% de la varianza en ventas (p< .05)
atractivo (attract) contribuye con un 3.5% de la varianza en ventas (p< .05)
. pcorr sales adverts airplay attract(obs=200)
Partial and semipartial correlations of sales with
Partial Semipartial Partial Semipartial Significance
Variable | Corr. Corr. Corr.^2 Corr.^2 Value
------------+-----------------------------------------------------------------
adverts | 0.6588 0.5072 0.4341 0.2572 0.0000
airplay | 0.6546 0.5014 0.4285 0.2514 0.0000
attract | 0.3089 0.1881 0.0954 0.0354 0.0000
Resumen del Modelo (7)
Habrá notado diferencias en las contribuciones de cada una de las variables entre los
distintos métodos: tres regresiones y correlaciones semi-parciales. Por ejemplo, en
uno el valor de 𝑅2 en la variable publicidad es del 33.5% mientras que en el otro
método es 25.7% ¿a qué se debe esto?
Esto se debe a que algunos de los predictores están explicando la misma parte de la
varianza en la variable dependiente; y si se comparte con otros predictores entonces
no es una varianza exclusiva de una variable. Las correlaciones semi-parciales 𝑅2
estiman solo el efecto exclusivo de cada variable.
Resumen del Modelo (8)
. regress sales adverts airplay
Source | SS df MS Number of obs = 200
-------------+---------------------------------- F(2, 197) = 167.20
Model | 815523.903 2 407761.952 Prob > F = 0.0000
Residual | 480428.097 197 2438.7213 R-squared = 0.6293
-------------+---------------------------------- Adj R-squared = 0.6255
Total | 1295952 199 6512.32161 Root MSE = 49.383
𝑅2 es una medida de qué tanta variabilidad (varianza) en la variable dependiente se debe a las
variables explicativas (al modelo). Lo que significa que la publicidad es responsable del 33.5% (o
lo que es lo mismo .335) de la variación en la venta de discos. Sin embargo, cuando otras
variables explicativas son incluidas, éste incrementa al 62.9%, lo que significa que “tiempo aire”
explica otro 29.4% de la variación en la venta de discos.
Resumen del Modelo (9)
. regress sales adverts airplay
Source | SS df MS Number of obs = 200
-------------+---------------------------------- F(2, 197) = 167.20
Model | 815523.903 2 407761.952 Prob > F = 0.0000
Residual | 480428.097 197 2438.7213 R-squared = 0.6293
-------------+---------------------------------- Adj R-squared = 0.6255
Total | 1295952 199 6512.32161 Root MSE = 49.383
F representa el ratio de mejora en la predicción del modelo respecto a la inexactitud que
persiste en el modelo.
En otras palabras, este es igual a la varianza sistemática explicada por el modelo dividida
por la varianza no sistemática, y debería ser mayor que 1.
Parámetros del Modelo (1)
------------------------------------------------------------------------------
sales | Coef. Std. Err. t P>|t| [95% Conf. Interval]
-------------+----------------------------------------------------------------
adverts | .086887 .0072459 11.99 0.000 .0725975 .1011765
airplay | 3.588788 .2868075 12.51 0.000 3.023181 4.154395
_cons | 41.12384 9.330954 4.41 0.000 22.72247 59.52522
------------------------------------------------------------------------------
Hasta ahora hemos analizado que el modelo mejore el pronóstico de la variable dependiente. Ahora nos interesa
analizar los efectos de los parámetros del modelo. Es decir, la contribución o los efectos específicos de cada una de
las explicativas.
𝑣𝑒𝑛𝑡𝑎𝑠𝑖 = 41.123 + .086 𝑥 𝑖𝑛𝑣𝑒𝑟𝑠𝑖ó𝑛 𝑒𝑛 𝑝𝑢𝑏𝑙𝑖𝑐𝑖𝑑𝑎𝑑𝑖 + 3.58 𝑥 𝑡𝑖𝑒𝑚𝑝𝑜 𝑎𝑖𝑟𝑒 + 𝜀𝑖
Parámetros del Modelo (2)
------------------------------------------------------------------------------
sales | Coef. Std. Err. t P>|t| [95% Conf. Interval]
-------------+----------------------------------------------------------------
adverts | .086887 .0072459 11.99 0.000 .0725975 .1011765
airplay | 3.588788 .2868075 12.51 0.000 3.023181 4.154395
_cons | 41.12384 9.330954 4.41 0.000 22.72247 59.52522
------------------------------------------------------------------------------
Los valores b nos ofrecen la relación entre la venta de discos y cada una de la variables explicativas. Concretamente
nos dicen grado en el que cada predictor afecta la variable resultado, manteniendo el resto de explicativas
constantes. Si el valor es positivo, podemos decir que la relación entre la variable explicativa y la dependiente es
positiva.
Así pues, los resultados nos indican que: mientras la inversión en publicidad crece, las ventas crecen; a medida que
aumenta el tiempo aire, aumentan las ventas.
Parámetros del Modelo (3)
Publicidad (b = .0868): este valor indica que el incremento en la publicidad en una unidad incrementa las
ventas de discos en .0868 unidades. Ambas variables han sido medidas en miles, por lo tanto, un
incremento de $1000 en gasto en publicidad trae consigo un incremento en ventas de 86 discos. Este
efecto es cierto, siempre y cuando los efectos de tiempo aire permanezca constantes.
Tiempo Aire (b = 3.588): este valor indica que el incremento en una unidad en el número de
reproducciones en la radio antes del lanzamiento del disco, está asociado con incremento en ventas de
3.588 unidades. Por tanto, cada reproducción en la radio (en la semana antes del lanzamiento) esta
asociado con una venta de 3588 discos. Este efecto es cierto, siempre y cuando los efectos de publicidad
permanezca constante.
Parámetros del Modelo (4)
------------------------------------------------------------------------------
sales | Coef. Std. Err. t P>|t| [95% Conf. Interval]
-------------+----------------------------------------------------------------
adverts | .086887 .0072459 11.99 0.000 .0725975 .1011765
airplay | 3.588788 .2868075 12.51 0.000 3.023181 4.154395
_cons | 41.12384 9.330954 4.41 0.000 22.72247 59.52522
------------------------------------------------------------------------------
El estadístico t responde a la pregunta de si b es significativamente diferente de 0 (recuerde que si b = 0, entonces
la variable explicativa no tiene un efecto sobre la dependiente).
En resumen el estadístico t mide si el predictor hace una contribución significativa al modelo. De tal modo que,
mientras mayor sea el valor de t y menor y p<.05, mayor será la contribución del predictor.
t= 11.99 (p<.001)
t= 12.51(p<.001)
¿Podemos comparar la magnitud del efecto entre las distintas
variables?
------------------------------------------------------------------------------
sales | Coef. Std. Err. t P>|t| [95% Conf. Interval]
-------------+----------------------------------------------------------------
adverts | .086887 .0072459 11.99 0.000 .0725975 .1011765
airplay | 3.588788 .2868075 12.51 0.000 3.023181 4.154395
_cons | 41.12384 9.330954 4.41 0.000 22.72247 59.52522
------------------------------------------------------------------------------
Recuerde que los coeficientes dependen de las unidades de medida, no son medidas estandarizadas; por
tanto no es conveniente comparar los coeficientes.
regress sales adverts airplay, beta
------------------------------------------------------------------------------
sales | Coef. Std. Err. t P>|t| Beta
-------------+----------------------------------------------------------------
adverts | .086887 .0072459 11.99 0.000 .5228958
airplay | 3.588788 .2868075 12.51 0.000 .5456445
_cons | 41.12384 9.330954 4.41 0.000 .
------------------------------------------------------------------------------
Parámetros del Modelo (4)
------------------------------------------------------------------------------
sales | Coef. Std. Err. t P>|t| Beta
-------------+----------------------------------------------------------------
adverts | .086887 .0072459 11.99 0.000 .5228958
airplay | 3.588788 .2868075 12.51 0.000 .5456445
_cons | 41.12384 9.330954 4.41 0.000 .
------------------------------------------------------------------------------
Los b estandarizados (coeficientes tipificados) nos dicen el número de desviaciones estándar que la variable
dependiente cambiará como resultado del cambio en una desviación estándar de la variable explicativa.
Estas son más fácil de interpretar ya que éstas no dependen de las unidades de medida de las variables explicativas
(horas, miles de pesos, o escalas de valoración) pues están en términos de desviaciones estándar
Analizar caso de publicidad y tiempo aire cuya importancia es virtualmente idéntica.
Parámetros del Modelo (5)
Variable | Obs Mean Std. Dev. Min Max
-------------+---------------------------------------------------------
adverts | 200 614.4126 485.6553 9.1 2271.86
sales | 200 193.2 80.69896 10 360 Para analizar los efectos de las b
airplay |
attract |
200
200
27.5
6.77
12.26958
1.39529
0
1
63
10
estandarizadas ocupamos la desviación
estándar de cada una de las
------------------------------------------------------------------------------ independientes.
sales | Coef. Std. Err. t P>|t| Beta
-------------+----------------------------------------------------------------
adverts | .086887 .0072459 11.99 0.000 .5228958
airplay | 3.588788 .2868075 12.51 0.000 .5456445
_cons | 41.12384 9.330954 4.41 0.000 .
------------------------------------------------------------------------------
Publicidad (b = .522): este valor indica que el incremento en la publicidad en una desviación estándar
($485,655), incrementa las ventas de discos en .522 desviaciones estándar. 80,699 la SD de la venta lo que
constituye 42,124 (.522 x 80,699). Por tanto, cada $485,655 invertidos en publicidad se venden 42,124
discos extra. Manteniendo el resto de explicativas constantes
(.522 x 80,699)= 42,124
(.545 x 80,699)= 43,980
Evaluando la Multicolinealidad
Variable | VIF 1/VIF
-------------+----------------------
adverts | 1.01 0.989620
airplay | 1.01 0.989620
-------------+----------------------
Mean VIF | 1.01
Ahora nos interesa evaluar la colinealidad entre las explicativas, para ello tenemos el Factor de Inflación de la Varianza (FIV) y 1/VIF.
Los valores del FIV son aceptables si estos están por debajo de 10. Si atendemos a los resultados, podemos concluir que no hay
colinealidad en los datos.
El valor 1/VIF se interpreta de la siguiente forma: si hiciéramos una regresión entre adverts y airplay obtendríamos un R-cuadrado
de .01038. Esto significa que la varianza entre estas dos variables es de 1.038. Por tanto, 1-.01038= .989620, lo que significa que un
98.96% de la varianza no es compartida entre estados dos variables; en resumen no hay colinealidad.
¿Cómo reportar los resultados de una
Regresión Múltiple?
La presentación de los resultados dependerá de la revista a la que desea enviar su trabajo, y del manual
de estilo que ésta siga.
En cualquier caso, independientemente del manual de estilo que esté siguiendo, en general, la
presentación de los resultados debería ofrecer, como mínimo, la siguiente información:
• Los coeficientes b
• El nivel de significancia
• Estadísticos generales del modelo ( 𝑅 2 )
• b estandarizadas
• Errores estándar