Universidad de Concepción
Escuela de Administración y Negocios
Ingenierı́a Comercial
Econometrı́a I (136231), Semestre 2019 - 2,
Profesores: Mónica Jaime, Mauricio Oyarzo
Ayudante: Cristóbal Vásquez (cristvasquez@[Link])
Ayudantı́a no 10
Variables Dummy
1. Sea la siguiente ecuación estimada obtenida de un análisis de datos
[ = 3,840, 83 − 0, 163totwrk − 11, 71educ − 8, 70 age + 0, 128age2 + 87, 75male
sleep (1)
(235,11) (0,018) (5,86) (11,21) (0,134) (34,33)
n = 706, R2 = 0, 123, R̄2 = 0, 117.
La variable sleep es la cantidad total de minutos, por semana, dormidos durante la noche,
totwrk es la cantidad de minutos que se trabajó por semana, educ y age están dadas en años
y male es una binaria para género.
a) Permaneciendo todo lo demás constante, ¿hay alguna evidencia de que los hombres
duermas más que las mujeres? ¿Qué tan fuerte es esa evidencia?
b) ¿Hay un costo de oportunidad estadı́sticamente significativo entre trabajar y dormir?
¿Cuál es el costo de oportunidad estimado?
c) ¿Qué otra regresión necesita realizar para probar la hipótesis nula de que, manteniendo
todo lo demás constante, la edad no afecta el dormir?
Solución: Para el apartado (a), el coeficiente de male es 87,75 minutos. De este modo, un
hombre duerme una hora y media más en comparación con una mujer, por semana. Además,
tmale = 87, 75/34, 33 = 2, 56. Como tmale > tα/2,0,05 , la variable es significativa al 5 %.
Para el apartado (b), el t estadı́stico para totwrk es −0, 163/0, 018 = −9, 06, de modo que
es altamente significativo (al 1 %). El coeficiente implica que una hora más de trabajo (60
minutos), está asociada con 0, 163(60) = 9, 8 minutos menos de sueño (sleep).
Para el apartado (c) se debe obtener el Rr2 , el R − cuadrado de la regresión restringida, por
lo que se debe estimar el modelo sin age ni age2 . Cuando ambas variables se encuentran en
el modelo, age no tiene efecto solo si los parámetros de ambos términos son cero.
2. R. J. Miller, en su estudio sobre las horas de trabajo realizadas por la FDIC (Federal Deposit
Insurance Corporation) realizado en 91 bancos, estimó la siguiente función:
d = 2, 41+0, 3674lnX1 −0, 0628lnX2 +0, 0803lnX3 −0, 1755D1 +0, 2799D2 +0, 5634D3 +0, 2572D4 .
lnY
(0,0477) (0,2217) (0,0287) (0,2905) 0,1044 (0,1657) (0,0787)
(2)
2
con R = 0, 766, donde Y = horas laborales de un auditor FDIC, X1 = activos totales del
banco, X2 = total de número de oficinas en el banco, D1 = 1 si el puntaje de administración
1
Universidad de Concepción
Escuela de Administración y Negocios
Ingenierı́a Comercial
es ”bueno”, D2 = 1 si el puntaje de administración es ”justo”, D3 = 1 si el puntaje de
administración es ”satisfactorio”, D4 = 1 si la auditorı́a fue realizada en conjunto con el
Estado. Luego,
a) Interprete estos resultados.
b) Dado que Y se encuentra en forma logarı́tmica, ¿existe un problema en interpretar las
variables dummy de este modelo?
c) ¿Cómo interpretarı́a los coeficientes de las variables dummy?
Solución:
(a) Sin considerar por el momento las variables dummy, cada pendiente estimada representa
una elasticidad. De este modo, si X2 aumenta en promedio 1 %, las horas laborales del auditor
aumentan en 0,22 %. La otra variable continua se interpreta de manera similiar. A priori, se
espera que los coeficientes de los logaritmos de X sean positivos.
(b) No existe un problema. En este caso, como la variable explicada está en forma de logaritmo
natural, se deben interpretar los coeficientes de la variable dummy de la siguiente manera:
aplicar la función exponencial a cada coeficiente estimado (eβ̂ ) y restarle 1, luego se multiplica
la diferencia por 100, generando un porcentaje que se interpreta como la variación porcentual
en la variable explicada, cuando la variable dummy pasa del estado 0 al 1.
(c) Si se considera el coeficiente de D4 , el cual corresponde a −0, 2572, se calcula la forma
exponencial del coeficiente obteniendo un resultado de 0, 7732. Luego, (0, 77 − 1)100 % =
−22, 68 %. Por lo tanto, cuando una auditorı́a se lleva a cabo en conjunto con el Estado, las
horas de auditorı́a disminuyen, en promedio, un 23 % aproximadamente. La interpretación
es análoga para los otros coeficientes.
3. Considere el siguiente modelo
Yi = α1 + α2 Di + βXi + ui (3)
donde Y = salario anual de un profesor de universidad, X = años de experiencia de un
profesor y D = dummy para género. Considere las siguientes tres maneras para definir la
variable dicotómica:
a) D = 1 para hombre, 0 para mujer.
b) D = 1 para mujer, 0 para hombre.
c) D = 1 para mujer, -1 para hombre.
Interprete el modelo anterior para cada variable dummy asignada. ¿Es alguno de estos méto-
dos preferible sobre los otros? Justifique.
Solución:
(a) Profesor: E(Yi ) = (α1 + α2 ) + βXi . Profesora: E(Yi ) = α1 + βXi . Si se mantiene X
constante, el salario para el profesor es diferente por α2 .
2
Universidad de Concepción
Escuela de Administración y Negocios
Ingenierı́a Comercial
(b) Profesor: E(Yi ) = α1 + βXi . Profesora: E(Yi ) = α1 + βXi . Si se mantiene X constante,
el salario para el profesor también es diferente por α2 .
(c) Profesor: E(Yi ) = (α1 − α2 ) + βXi . Profesora: E(Yi ) = (α1 + α2 ) + βXi . Si se mantiene
X constante, el salario para el profesor es diferente por 2α2 .
Dado que la escala de la variable dummy es arbitraria, no existe una ventaja particular entre
un método y otro.
4. Suponga que mediante una encuesta recolecta usted datos sobre salarios, educación, experien-
cia y género. Solicita también información sobre uso de la marihuana. La pregunta original
es ”¿Cuántas veces fumó marihuana el mes pasado?”
a) Elabore una ecuación que permita estimar el efecto de fumar marihuana sobre el salario,
controlando los demás factores. La ecuación debe permitir hacer afirmaciones como ”se
estima que fumar marihuana cinco veces más al mes hace que el salario varı́e x %”.
b) Formule una ecuación que permita probar si el uso de drogas tiene efectos diferentes
sobre los salarios de hombres y mujeres. ¿Cómo puede probarse que los efectos del uso
de drogas no son diferentes entre hombres y mujeres?
c) Suponga que considera que es mejor el uso de marihuana clasificando a las personas en
cuatro categorı́as: no usuario, usuario suave (1 a 5 veces por mes), usuario moderado
(6 a 10 veces por mes) y usuario fuerte (más de 10 veces por mes). Ahora diseñe un
modelo que permita estimar el efecto del uso de la marihuana sobre el [Link]́s,
indique qué sucederı́a si se incluyen cuatro variables dummy en este caso.
d ) Utilizando el modelo del inciso anterior, explique detalladamente cómo probar la hipóte-
sis nula de que fumar marihuana no tiene ningún efecto sobre el salario.
Solución:
(a) Para cumplir con la afirmación en porcentaje, se debe elaborar un modelo log-lin. De este
modo,
log(salario) = β0 + β1 cons + β2 educ + β3 exper + β4 exper2 + β5 f emale + u. (4)
Luego, 100β1 corresponde al cambio porcentual aproximado en el salario cuando el uso de
marihuana aumenta una vez por mes.
(b) En este caso, se debe añadir un término interacción entre female y cons:
log(salario) = β0 + β1 cons + β2 educ + β3 exper + β4 exper2 + β5 f emale + β6 f emale ∗ cons + u.
(5)
La hipótesis nula que indica que el efecto de la marihuana no difiere por género corresponde
a: H0 : β6 = 0.
(c) Consideremos el grupo base como nonuser. Luego, se crean dummy’s para las otras
variables: lghtuser, moduser y hvyuser. Asumiendo que no existe un efecto interacción con
el género, el modelo corresponderı́a a:
log(salario) = β0 +δ1 lghtuser+δ2 moduser+δ3 hvyuser+β2 educ+β3 exper+β4 exper2 +β5 f emale+u.
(6)
3
Universidad de Concepción
Escuela de Administración y Negocios
Ingenierı́a Comercial
(d) En este caso, la hipótesis nula corresponde a H0 : δ1 = 0, δ2 = 0, δ3 = 0, para un total
de q=3 restricciones. Si el tamaño de la muestra corresponde a n, los grados de libertad
del modelo no restringido corresponden a n − 8 (g.l. del denominador en la distribución F).
Entonces, se podrı́a obtener el valor del estadı́stico a través de la distribución Fq,n−8 .